Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

spark Spark 1.6.1 설치후 HA구성

총관리자 2016.05.24 11:00 조회 수 : 455

1. 다운로드/설치/설정

https://www.gooper.com/ss/bigdata/3115

2. zookeeper를 이용한 HA로 실행(방법1, 별도의 파일에 HA정보를 설정하는 방법)

가. ./conf/ha.conf파일을 생성하고 다음의 내용을 추가한다.(master로 사용되는 서버에 모두 있어야함)

spark.deploy.recoveryMode=ZOOKEEPER
spark.deploy.zookeeper.url=gsda1:2181,gsda2:2181,gsda3:2181
spark.deploy.zookeeper.dir=/spark

나. master실행(master로 사용되는 각 서버에서 실행, 2개서버) :

./sbin/start-master.sh -h gsda1 -p 7077 --webui-port 8123 --properties-file ./conf/ha.conf

./sbin/start-master.sh -h gsda2 -p 7077 --webui-port 8123 --properties-file ./conf/ha.conf

다. slave실행(slave로 사용되는 각 서버에서 실행)

./sbin/start-slave.sh spark://gsda1:7077,gsda2:7077

라. spark-shell실행

./bin/spark-shell --master spark://gsda1:7077,gsda2:7077

* zookeeper의 zlCli.sh를 실행해서 "ls /"을 명령을 주면 znode중에 "spark"를 확인할 수 있다.

3. zookeeper를 이용한 HA로 실행(방법2, spark-env.sh에 HA정보를 설정하는 방법)

가. ./conf/spark-env.sh에 다음의 내용을 추가함

export SPARK_MASTER_WEBUI_PORT=8123

export SPARK_LOG_DIR=/logs/spark

export SPARK_SSH_OPTS=" -p 22 "

export STANDALONE_SPARK_MASTER_HOST=gsda1,gsda2

export SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=ZOOKEEPER -Dspark.deploy.zookeeper.url=gsda1:2181,gsda2:2181,gsda3:2181"

나. ./sbin/start-all.sh을 실행한다.(master와 slave들이 실행된다)

다. 2번째 master서버에서 다음을 실행한다.(standby모드로 기동함)

./sbin/start-master.sh을 실행하면 conf정보를 참조하여 기동한다.

* 확인방법 : http://gsda1:8123/ 하면 status가 alive, http://gsda2:8123/ 하면 status가 standby로 표시된다.

4. HA 작동여부 확인방법

가. master2서버에서 http://gsda2:8123로 status가 standby상태인지 확인한다

나. master1서버에서 ./sbin/stop-master.sh로 master를 중지한다.

다. master2서버에서 http://gsda2:8123를 실행하여 Workers목록이 모두 표시되고 status가 standby->Alive로 변경되는지 확인한다.

5. spark master가 다운되었을때 다시 기동하도록 하는 방법

- spark-env.sh에 다음과 같은 라인을 추가한다.

export SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=FILESYSTEM -Dspark.deploy.recoveryDirectory=/spark/recovery"

* recoveryMode를 FILESYSTEM으로 하면 recoveryDirectory에 recovery정보를 저장하고 있다가 master가 다운되면 master만 다시 기동해주는 형태로 복구를 수행한다.

이 게시물을

번호	제목	글쓴이	날짜	조회 수
21	spark 2.0.0의 api를 이용하는 예제 프로그램	총관리자	2017.03.15	199
20	Scala에서 countByWindow를 이용하기(예제)	총관리자	2018.03.08	235
19	Windows7 64bit 환경에서 Apache Spark 2.2.0 설치하기	총관리자	2017.07.26	260
18	Caused by: java.lang.ClassNotFoundException: org.apache.spark.Logging 발생시 조치사항	총관리자	2017.04.19	284
17	Spark에서 KafkaUtils.createStream()를 이용하여 이용하여 kafka topic에 접근하여 객채로 저장된 값을 가져오고 처리하는 예제 소스	총관리자	2017.04.26	292
16	spark-submit으로 spark application실행하는 다양한 방법	총관리자	2016.05.25	303
15	Apache Spark와 Drools를 이용한 CEP구현 테스트	총관리자	2016.07.15	342
14	spark-sql실행시 The specified datastore driver ("com.mysql.jdbc.Driver") was not found in the CLASSPATH오류 발생시 조치사항	총관리자	2016.06.09	451
»	Spark 1.6.1 설치후 HA구성	총관리자	2016.05.24	455
12	java.lang.OutOfMemoryError: unable to create new native thread오류 발생지 조치사항	총관리자	2016.10.17	466
11	spark-submit 실행시 "java.lang.OutOfMemoryError: Java heap space"발생시 조치사항	총관리자	2018.02.01	517
10	spark client프로그램 기동시 "Error initializing SparkContext"오류 발생할때 조치사항	총관리자	2016.05.27	539
9	spark-shell실행시 "A read-only user or a user in a read-only database is not permitted to disable read-only mode on a connection."오류가 발생하는 경우 해결방법	총관리자	2016.05.20	551
8	spark-env.sh에서 사용할 수있는 항목.	총관리자	2016.05.24	567
7	kafka로 부터 메세지를 stream으로 받아 처리하는 spark샘플소스(spark의 producer와 consumer를 sbt로 컴파일 하고 서버에서 spark-submit하는 방법)	총관리자	2016.07.13	630
6	"Initial job has not accepted any resources; check your cluster UI to ensure that workers are registered and have sufficient resources"오류 발생시 조치사항	총관리자	2016.05.25	1028
5	spark stream처리할때 두개의 client프로그램이 동일한 checkpoint로 접근할때 발생하는 오류 내용	총관리자	2018.01.16	1115
4	Spark 2.1.1 clustering(5대) 설치(YARN기반)	총관리자	2016.04.22	1882
3	VisualVM 1.3.9을 이용한 spark-submit JVM 모니터링을 위한 설정및 spark-submit실행 옵션	총관리자	2016.10.28	1891
2	spark-sql실행시 Caused by: java.lang.NumberFormatException: For input string: "0s" 오류발생시 조치사항	총관리자	2016.06.09	2802

쓰기 태그

첫 페이지 1 2 3 끝 페이지

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

spark Spark 1.6.1 설치후 HA구성

1. 다운로드/설치/설정

댓글 0

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다. 필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

spark Spark 1.6.1 설치후 HA구성

1. 다운로드/설치/설정

댓글 0

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc. We are open to the required minutes. Please send inquiries to gooper@gooper.com.

LOGIN

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.