메뉴 건너뛰기

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.


MariaDB의 study db에 접속하여 product 테이블의 내용을 가져다가 hive의 test db밑에 product라는 hive테이블로 자동생성하는 sqoop 명령문이다.
이때 MariaDB에서 가져온 내용에 저장되는 HDFS 위치는 hive에서 생성한 test db밑에 저장된다.
hive table을 자동으로 생성하는 경우는 --lines-terminated-by를 사용할 수 없는데... sqoop에서는 지정가능하지만 hive에서 '\n'만 지원하기 때문에 오류가 발생한다.
그리고 console등을 이용하여 자동생성하는 경우 hue에서 필요로 하는 정보가 등록되지 않아서 인지 데이타는 볼수 있으나 column명 및 속성은 조회되지 않는다. 
물론 describe를 이용하여 볼수는 있다.
sqoop에서 바로 hive table을 생성하면 컬럼에 newline(\n)이 들어 있어도 문제없이 데이타를 가져올 수 있다.

sqoop import \
--connect=jdbc:mysql://gsda3:포트/study \
--username=사용자id\
--password=패스워드\
--table=product \
--hive-table test.product  \
--create-hive-table  \
--hive-import  \
--hive-home test.db
번호 제목 글쓴이 날짜 조회 수
661 kerberos연동된 CDH 6.3.4에서 default realm값이 잘못된 상태에서 서비스 기동시 오류 gooper 2022.10.14 36
660 spark에서 hive table을 읽어 출력하는 예제 소스 총관리자 2017.03.09 37
659 [KUDU] kudu tablet server여러가지 원인에 의해서 corrupted상태가 된 경우 복구방법 gooper 2023.03.28 37
658 bash는 PS1 변수를 통해 프롬프트의 모양을 바꿀 수 있다. 총관리자 2016.03.30 38
657 eclipse 3.1 단축키 정리파일 총관리자 2017.01.02 38
656 [u-Auctions]목록이 1개만 나오는 문제 총관리자 2017.05.29 38
655 [Hue]Hue의 메타정보를 담고 있는 desktop_document테이블과 desktop_document2의 관계 총관리자 2022.05.09 38
654 [TLS/SSL]Cloudera 6.3.4기준 Oozie Web UI TLS설정 항목및 설정값 총관리자 2022.05.13 38
653 github에 있는 프로젝트와 로컬에서 작업한 프로젝트 합치기 총관리자 2016.11.22 40
652 DeviceType이 o:motion-sensor_33 이거나 o:motion-sensor_32 경우의 sparql문장은 다음과 같다. 총관리자 2017.08.16 40
651 커리 변경 이벤트를 처리하기 위한 구현클래스 총관리자 2016.07.21 41
650 magento2 설치후 초기화면이 깨지는 문제 file 총관리자 2017.01.31 42
649 windows 혹은 mac에서 docker설치하기 위한 파일 총관리자 2017.10.13 42
648 RDF4J의 rdf4j-server.war가 제공하는 RESTFul API를 이용한 CRUD테스트(트랜잭션처리) 총관리자 2017.08.30 43
647 [oracle]10자리 timestamp값을 날짜로 변환하는 방법 총관리자 2022.04.14 43
646 python실행시 ValueError: zero length field name in format오류 해결방법 총관리자 2016.05.27 44
645 Spark Streaming 코드레벨단에서의 성능개선 총관리자 2016.10.31 44
644 원격의 origin/master를 기준으로 dev branch를 만들어 작업후 원격의 origin/dev에 push하는 방법 file 총관리자 2016.11.22 44
643 new Gson().toJson(new ObjectId())을 사용하면 값이 다르게 나오는 경우가 있음 총관리자 2016.12.23 44
642 특정 단계의 commit상태로 만들기(이렇게 하면 중간에 반영된 모든 commit를 history가 삭제된다) 총관리자 2016.11.17 45

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

위로