메뉴 건너뛰기

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.


oozie의 workflow를 이용하여 sqoop작업 수행시 ooize:launcher가 먼저 수행되고 oozie:launcer가 oozie:action을 호출하면서 새로운 applicationId을 생성하여 sqoop action을 처리한다.

이때, oozie:launcher의 application_id를 application_1234567890123_1234라고 하면 sqoop oozie:action의 application_id는 oozie:launcher의 application_id + 1인 application_1234567890123_1235가 되는 경우가 대부분이다.

또한, oozie:launcher의 log 파일을 보면 >>> Invoking Sqoop command line now >>> 밑에 org.apache.sqoop.tool.CodeGenTool - Beginning code generation이후에

Executing SQL statement: select t.* from DB명.table명 where (1=0)(export인 경우 SELECT t.* from DB명.table명 AS t WHERE 1=0)이라는 문장이 보이면 sqoop source DB에 정상적으로 접근되었다는 것이며 이런 문장이 없으면 sqoop source DB에 권한 이슈 혹은 네트웍 접속 이슈등으로 정상적으로 접속하지 못했다는 의미이며 sqoop job이 별도의 application을 수행하지 않고 바로 종료된다. (별도의 application 을 수행중에 fail되는 경우라도 YARN->Applications에서 검색되지는 않고, YARN->WebUI->ResourceManager WebUI혹은 YARN->WebUI->HistoryServer WebUI에서 검색해야 확인 가능함)

Running job: job_1234567890123_1235 문구의 로그가 보이며 이것이 oozie:launcher가 수행시킨 sqoop action(application_1234567890123_1235)의 job id가 되므로 이것을 기준으로 application log를 찾아 확인할 수 있다. 

이렇게 sqoop action의 applicatin_id를 찾는 이유는 Hue의 Job에서 오류발생시 보여지는 application_id에는 자세한 오류 메세지가 표시되지 않는 경우가 있다. 그래서 별도의 sqoop action job id를 찾아서 해당 로그를 확인하기 위함이다. 



* 정상적으로 sqoop action이 진행된다면 oozie:launcher로그 파일(application_id=application application_1234567890123_1234)에서 다음의 내용을 확인할 수 있다.

>>> Invoking Sqoop command line now >>>

....

org.apache.sqoop.tool.CodeGenTool - Beginning code generation

....

org.apache.sqoop.manager.SqlManager - Executing SQL statement: select * from DB명.table명 where (1=0)

...

org.apache.hadoop.mapreduce.JobSubmitter - Submitting tokens for job: job_1234567890123_1235

...

org.apache.hadoop.yarn.client.api.impl.YarnClientImpl - Submitted application application_1234567890123_1235

...

org.apache.hadoop.mapreduce.Job - Running job: job_1234567890123_1235

...

org.apache.hadoop.mapreduce.Job - map 0% reduce 0%

org.apache.hadoop.mapreduce.Job - map 100% reduce 0%

org.apache.hadoop.mapreduce.Job - Job job_1234567890123_124 completed successfully



번호 제목 글쓴이 날짜 조회 수
721 .git폴더를 삭제하고 다시 git에 추가하고 서버에 반영하는 방법 총관리자 2017.06.19 4079
720 Hadoop Cluster 설치 (Hadoop+Zookeeper+Hbase) file 구퍼 2013.03.07 3995
719 Last transaction was partial에 따른 Unable to load database on disk오류 발생시 조치사항 총관리자 2018.08.03 3978
718 원보드pc인 bananapi를 이용하여 hadoop 클러스터 구성하기(준비물) file 총관리자 2014.05.29 3840
717 Caused by: java.sql.SQLNonTransientConnectionException: Could not read resultset: unexpected end of stream, read 0 bytes from 4 오류시 확인/조치할 내용 총관리자 2016.10.31 3793
716 hadoop 2.6.0 기동(에코시스템 포함)및 wordcount 어플리케이션을 이용한 테스트 총관리자 2015.05.05 3770
715 HBASE Client API : 기본 기능 정리 file 구퍼 2013.04.01 3554
714 HBase 설치하기 – Fully-distributed 구퍼 2013.03.12 3548
713 hadoop및 ecosystem에서 사용되는 명령문 정리 총관리자 2014.05.28 3456
712 빅데이터 분석을 위한 샘플 빅데이터 파일 다운로드 사이트 총관리자 2014.04.28 3285
711 banana pi(lubuntu)에서 한글 설정및 한글깨짐 문제 해결 총관리자 2014.07.06 3205
710 의사분산모드에 hadoop설치및 ecosystem 환경 정리 총관리자 2014.05.29 3170
709 Hbase Shell 명령 정리 구퍼 2013.04.01 3170
708 sqoop 1.4.4 설치및 테스트 총관리자 2014.04.21 3134
707 의사분산모드에서 presto설치하기 총관리자 2014.03.31 3050
706 "java.net.NoRouteToHostException: 호스트로 갈 루트가 없음" 오류시 확인및 조치할 사항 총관리자 2016.04.01 3028
705 Hive 사용법 및 쿼리 샘플코드 구퍼 2013.03.07 2991
704 ping 안될때.. networking restart 날려주면 잘됨.. 총관리자 2014.05.09 2977
703 JobHistory 서버 기동시 HDFS상에 특정 폴더를 생성할 수 없어서 기동하지 못하는 경우 조치 총관리자 2018.05.29 2898
702 hue.axes_accessattempt테이블의 username컬럼에 NULL 혹은 space가 들어갈수도 있음. 총관리자 2021.11.03 2838

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

위로