메뉴 건너뛰기

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.


0. Spark, Scala, Pip, Python, Hadoop, Jupyter등은 이미 설치되어 있다고 가정한다.


1. 환경변수 설정

sudo vi /etc/profile

export $SPARK_HOME=$HOME/spark


2. 수정된 환경변수값 반영

sudo source /etc/profile


3. toree설치

sudo pip install toree

sudo jupyter toree install --spark_home=$SPARK_HOME --interpreters=Scala,PySpark,SparkR,SQL


4. browser에서 확인

https://gsda4:8888/


5. jupyter kernal목록 확인(jupyter kernelspec list)

/usr/local/lib/python2.7/dist-packages/jupyter_client/session.py:48: VisibleDeprecationWarning: zmq.eventloop.minitornado is deprecated in pyzmq 14.0 and will be removed.

    Install tornado itself to use zmq with the tornado IOLoop.


  from zmq.eventloop.ioloop import IOLoop

[ListKernelSpecs] WARNING | Native kernel (python2) is not available

[ListKernelSpecs] WARNING | Native kernel (python2) is not available

Available kernels:

  apache_toree_pyspark    /usr/local/share/jupyter/kernels/apache_toree_pyspark

  apache_toree_scala      /usr/local/share/jupyter/kernels/apache_toree_scala

  apache_toree_sparkr     /usr/local/share/jupyter/kernels/apache_toree_sparkr

  apache_toree_sql        /usr/local/share/jupyter/kernels/apache_toree_sql

  python3                 /usr/local/share/jupyter/kernels/python3


번호 제목 글쓴이 날짜 조회 수
528 Cloudera Manager재설치하는 동안 "Host is in bad health"오류가 발생하는 경우 확인/조치 사항 총관리자 2018.05.24 69
527 "You are running Cloudera Manager in non-production mode.." warning메세지가 나타나지 않게 조치하는 방법 총관리자 2018.05.23 53
526 oozie db변경후 재기동시 "Table 'oozie.VALIDATE_CONN' doesn't exist" 오류 발생시 조치방법 총관리자 2018.05.23 229
525 Embedded PostgreSql설정을 외부의 MariaDB로변경하기 [1] 총관리자 2018.05.22 156
524 CDH 5.14.2 설치중 agent설치에서 실패하는 경우 확인/조치 총관리자 2018.05.22 293
523 Cluster Install -> Provide Login Credentials에서 root가 아닌 다른 사용자를 지정하는 경우 "Exhausted available authentication methods"오류 발생시 조치방법 총관리자 2018.05.22 94
522 Cloudera Hadoop and Spark Developer Certification 준비(참고) 총관리자 2018.05.16 22
521 tar를 이용한 리눅스 백업 총관리자 2018.05.13 31
520 crypto관련 기생충 박멸 스크립트 총관리자 2018.05.11 1319
519 Hue Job Browser의 Queries탭에서 조건을 지정하는 방법 총관리자 2018.05.10 71
518 Impala의 Queries탭에서 여러조건으로 쿼리 찾기 총관리자 2018.05.09 422
517 Cloudera의 API를 이용하여 impala의 실행되었던 쿼리 확인하는 예시 총관리자 2018.05.03 103
516 Toree 0.1.0-incubating이 Scala 2.10.4까지만 지원하게 되어서 발생하는 NoSuchMethod오류 문제 해결방법(scala 2.11.x을 지원하지만 오류가 발생할 수 있음) 총관리자 2018.04.20 103
515 우분투 16.04LTS에 Zeppelin 0.7.3설치 총관리자 2018.04.18 189
514 CentOS 7.x에 Jupyter설치 총관리자 2018.04.18 535
» Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel) 총관리자 2018.04.17 138
512 우분투 16.04LTS에 Jupyter설치 총관리자 2018.04.17 74
511 beeline으로 접근시 "User: gooper is not allowed to impersonate anonymous (state=08S01,code=0)"가 발생하면서 "No current connection"이 발생하는 경우 조치 총관리자 2018.04.15 151
510 Cloudera Manager 5.x설치시 embedded postgresql를 사용하는 경우의 관리정보 총관리자 2018.04.13 37
509 jupyter, zeppelin, rstudio를 이용하여 spark cluster에 job를 실행시키기 위한 정보 총관리자 2018.04.13 2007

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

위로