메뉴 건너뛰기

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.


0. Spark, Scala, Pip, Python, Hadoop, Jupyter등은 이미 설치되어 있다고 가정한다.


1. 환경변수 설정

sudo vi /etc/profile

export $SPARK_HOME=$HOME/spark


2. 수정된 환경변수값 반영

sudo source /etc/profile


3. toree설치

sudo pip install toree

sudo jupyter toree install --spark_home=$SPARK_HOME --interpreters=Scala,PySpark,SparkR,SQL


4. browser에서 확인

https://gsda4:8888/


5. jupyter kernal목록 확인(jupyter kernelspec list)

/usr/local/lib/python2.7/dist-packages/jupyter_client/session.py:48: VisibleDeprecationWarning: zmq.eventloop.minitornado is deprecated in pyzmq 14.0 and will be removed.

    Install tornado itself to use zmq with the tornado IOLoop.


  from zmq.eventloop.ioloop import IOLoop

[ListKernelSpecs] WARNING | Native kernel (python2) is not available

[ListKernelSpecs] WARNING | Native kernel (python2) is not available

Available kernels:

  apache_toree_pyspark    /usr/local/share/jupyter/kernels/apache_toree_pyspark

  apache_toree_scala      /usr/local/share/jupyter/kernels/apache_toree_scala

  apache_toree_sparkr     /usr/local/share/jupyter/kernels/apache_toree_sparkr

  apache_toree_sql        /usr/local/share/jupyter/kernels/apache_toree_sql

  python3                 /usr/local/share/jupyter/kernels/python3


번호 제목 날짜 조회 수
521 Cloudera Hadoop and Spark Developer Certification 준비(참고) 2018.05.16 872
520 tar를 이용한 리눅스 백업 2018.05.13 729
519 crypto관련 기생충 박멸 스크립트 2018.05.11 1444
518 Hue Job Browser의 Queries탭에서 조건을 지정하는 방법 2018.05.10 677
517 Impala의 Queries탭에서 여러조건으로 쿼리 찾기 2018.05.09 1363
516 Cloudera의 API를 이용하여 impala의 실행되었던 쿼리 확인하는 예시 2018.05.03 886
515 Toree 0.1.0-incubating이 Scala 2.10.4까지만 지원하게 되어서 발생하는 NoSuchMethod오류 문제 해결방법(scala 2.11.x을 지원하지만 오류가 발생할 수 있음) 2018.04.20 297
514 우분투 16.04LTS에 Zeppelin 0.7.3설치 2018.04.18 879
513 CentOS 7.x에 Jupyter설치 2018.04.18 1190
» Apache Toree설치(Jupyter에서 Scala, PySpark, SparkR, SQL을 사용할 수 있도록 하는 Kernel) 2018.04.17 788
511 우분투 16.04LTS에 Jupyter설치 2018.04.17 838
510 beeline으로 접근시 "User: gooper is not allowed to impersonate anonymous (state=08S01,code=0)"가 발생하면서 "No current connection"이 발생하는 경우 조치 2018.04.15 875
509 Cloudera Manager 5.x설치시 embedded postgresql를 사용하는 경우의 관리정보 2018.04.13 176
508 jupyter, zeppelin, rstudio를 이용하여 spark cluster에 job를 실행시키기 위한 정보 2018.04.13 2708
507 Cloudera Manager web UI의 언어를 한글에서 영문으로 변경하기 2018.04.03 1110
506 [우분투] suppoie 채굴 프로세스 발생시 자동으로 삭제하는 shell프로그램 2018.04.01 938
505 Impala daemon기동시 "Could not create temporary timezone file"오류 발생시 조치사항 2018.03.29 856
504 각 서버에 설치되는 cloudera서비스 프로그램 목록(CDH 5.14.0의 경우) 2018.03.29 609
503 Cloudera설치중 실패로 여러번 설치하는 과정에 "Running in non-interactive mode, and data appears to exist in Storage Directory /dfs/nn. Not formatting." 오류가 발생시 조치하는 방법 2018.03.29 1016
502 Cloudera설치중에 "Error, CM server guid updated"오류 발생시 조치방법 2018.03.29 338
위로