Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

Jupyter Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel)

총관리자 2018.04.17 18:28 조회 수 : 146

0. Spark, Scala, Pip, Python, Hadoop, Jupyter등은 이미 설치되어 있다고 가정한다.

1. 환경변수 설정

sudo vi /etc/profile

export $SPARK_HOME=$HOME/spark

2. 수정된 환경변수값 반영

sudo source /etc/profile

3. toree설치

sudo pip install toree

sudo jupyter toree install --spark_home=$SPARK_HOME --interpreters=Scala,PySpark,SparkR,SQL

4. browser에서 확인

https://gsda4:8888/

5. jupyter kernal목록 확인(jupyter kernelspec list)

/usr/local/lib/python2.7/dist-packages/jupyter_client/session.py:48: VisibleDeprecationWarning: zmq.eventloop.minitornado is deprecated in pyzmq 14.0 and will be removed.

Install tornado itself to use zmq with the tornado IOLoop.

from zmq.eventloop.ioloop import IOLoop

[ListKernelSpecs] WARNING | Native kernel (python2) is not available

Available kernels:

apache_toree_pyspark /usr/local/share/jupyter/kernels/apache_toree_pyspark

apache_toree_scala /usr/local/share/jupyter/kernels/apache_toree_scala

apache_toree_sparkr /usr/local/share/jupyter/kernels/apache_toree_sparkr

apache_toree_sql /usr/local/share/jupyter/kernels/apache_toree_sql

python3 /usr/local/share/jupyter/kernels/python3

이 게시물을

번호	제목	글쓴이	날짜	조회 수
90	Toree 0.1.0-incubating이 Scala 2.10.4까지만 지원하게 되어서 발생하는 NoSuchMethod오류 문제 해결방법(scala 2.11.x을 지원하지만 오류가 발생할 수 있음)	총관리자	2018.04.20	110
89	kudu 테이블 metadata강제 삭제시 발생하는 오류 메세지	총관리자	2022.01.12	110
88	[Kudu]Schema별 혹은 테이블별 사용량(Replica포함) 구하는 방법	gooper	2022.07.14	121
87	streaming작업시 입력된 값에 대한 사본을 만들게 되는데 이것이 실패했을때 발생하는 경고메세지	총관리자	2017.04.03	126
86	start-all.sh로 spark데몬 기동시 "JAVA_HOME is not set"오류 발생시 조치사항	총관리자	2016.08.01	126
85	JavaStreamingContext를 이용하여 스트림으로 들어오는 문자열 카운트 소스	총관리자	2017.03.30	129
84	./spark-sql 실행시 "java.lang.NumberFormatException: For input string: "1s"오류발생시 조치사항	총관리자	2016.06.09	132
83	scala application 샘플소스(SparkSession이용)	총관리자	2018.03.07	135
82	Spark Streaming으로 유실 없는 스트림 처리 인프라 구축하기	총관리자	2016.03.11	137
»	Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel)	총관리자	2018.04.17	146
80	CDH 5.4.4 버전에서 hive on tez (0.7.0)설치하기	총관리자	2016.01.14	158
79	spark notebook 0.7.0설치및 설정	총관리자	2016.11.14	160
78	spark2.0.0에서 hive 2.0.1 table을 읽어 출력하는 예제 소스(HiveContext, SparkSession, SQLContext)	총관리자	2017.03.09	163
77	spark-sql실행시 ERROR log: Got exception: java.lang.NumberFormatException For input string: "2000ms" 오류발생시 조치사항	총관리자	2016.06.09	167
76	Soft memory limit exceeded (at 100.05% of capacity) 오류 조치	총관리자	2022.01.17	181
75	beeline으로 접근시 "User: gooper is not allowed to impersonate anonymous (state=08S01,code=0)"가 발생하면서 "No current connection"이 발생하는 경우 조치	총관리자	2018.04.15	194
74	RHEL 7.4에 zeppelin 0.7.4 설치	총관리자	2018.07.31	196
73	Could not compute split, block input-0-1517397051800 not found형태의 오류가 발생시 조치방법	총관리자	2018.02.01	196
72	우분투 16.04LTS에 Zeppelin 0.7.3설치	총관리자	2018.04.18	198
71	spark 2.0.0의 api를 이용하는 예제 프로그램	총관리자	2017.03.15	199

쓰기 태그

첫 페이지 1 2 3 4 5 6 7 끝 페이지

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

Jupyter Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel)

댓글 0

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다. 필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

Jupyter Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel)

댓글 0

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc. We are open to the required minutes. Please send inquiries to gooper@gooper.com.

LOGIN

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.