메뉴 건너뛰기

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.


Environment Variable

spark-env.sh에서 사용할 수있는 항목.


SPARK_WORKER_MEMORY은 중요하기 때문에 여기에서 보충.SPARK_WORKER_MEMORY의 범위 내에서 spark.executor.memory을 별도 정의하게되는데, executor가 차지하는 비중 다른 관리를 위해 수백 MB 정도 남겨두면 좋을 듯. 하지만 거기의 균형은 물론 환경에 의한 다.

SPARK_MASTER_OPTS

SPARK_MASTER_OPTS가 지원하는 속성.


SPARK_WORKER_OPTS

SPARK_WORKER_OPTS가 지원하는 속성.


High Availability

ZooKeeper를 물지시켜 HA 구성 할 수 있습니다. 본문에 따르면, 퍼스트 리더가 다운에서 걸리는 총 복구 프로세스는 약 1-2 분 정도 걸리는 것. 이 지연은 새로운 애플리케이션의 스케줄링에만 영향을 이미 실행중인 응용 프로그램은 마스터 장애 조치 영향을주지 않는다. 

호스트 이름을 쉼표로 구분 OK.

1
export STANDALONE_SPARK_MASTER_HOST = master1, master2


Spark properties for YARN

번호 제목 글쓴이 날짜 조회 수
21 How-to: Tune Your Apache Spark Jobs (Part 2) file 총관리자 2016.10.31 77
20 참고할만한 spark예제를 설명하는 사이트 총관리자 2016.11.11 98
19 spark notebook 0.7.0설치및 설정 총관리자 2016.11.14 160
18 spark 2.0.0를 windows에서 실행시 로컬 파일을 읽을때 발생하는 오류 해결 방법 총관리자 2017.01.12 106
17 spark에서 hive table을 읽어 출력하는 예제 소스 총관리자 2017.03.09 35
16 spark에서 hive table을 읽어 출력하는 예제 소스 총관리자 2017.03.09 37
15 spark2.0.0에서 hive 2.0.1 table을 읽어 출력하는 예제 소스(HiveContext, SparkSession, SQLContext) 총관리자 2017.03.09 163
14 It is indirectly referenced from required .class files 오류 발생시 조치방법 총관리자 2017.03.09 93
13 spark 2.0.0의 api를 이용하는 예제 프로그램 총관리자 2017.03.15 199
12 JavaStreamingContext를 이용하여 스트림으로 들어오는 문자열 카운트 소스 총관리자 2017.03.30 129
11 streaming작업시 입력된 값에 대한 사본을 만들게 되는데 이것이 실패했을때 발생하는 경고메세지 총관리자 2017.04.03 126
10 Caused by: java.lang.ClassNotFoundException: org.apache.spark.Logging 발생시 조치사항 총관리자 2017.04.19 284
9 Spark에서 Serializable관련 오류및 조치사항 총관리자 2017.04.21 4901
8 Spark에서 KafkaUtils.createStream()를 이용하여 이용하여 kafka topic에 접근하여 객채로 저장된 값을 가져오고 처리하는 예제 소스 총관리자 2017.04.26 292
7 Windows7 64bit 환경에서 Apache Spark 2.2.0 설치하기 총관리자 2017.07.26 260
6 spark stream처리할때 두개의 client프로그램이 동일한 checkpoint로 접근할때 발생하는 오류 내용 총관리자 2018.01.16 1115
5 Could not compute split, block input-0-1517397051800 not found형태의 오류가 발생시 조치방법 총관리자 2018.02.01 197
4 spark-submit 실행시 "java.lang.OutOfMemoryError: Java heap space"발생시 조치사항 총관리자 2018.02.01 517
3 scala application 샘플소스(SparkSession이용) 총관리자 2018.03.07 135
2 Scala를 이용한 Streaming예제 총관리자 2018.03.08 69

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

위로