메뉴 건너뛰기

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.


oozie의 workflow를 이용하여 sqoop작업 수행시 ooize:launcher가 먼저 수행되고 oozie:launcer가 oozie:action을 호출하면서 새로운 applicationId을 생성하여 sqoop action을 처리한다.

이때, oozie:launcher의 application_id를 application_1234567890123_1234라고 하면 sqoop oozie:action의 application_id는 oozie:launcher의 application_id + 1인 application_1234567890123_1235가 되는 경우가 대부분이다.

또한, oozie:launcher의 log 파일을 보면 >>> Invoking Sqoop command line now >>> 밑에 org.apache.sqoop.tool.CodeGenTool - Beginning code generation이후에

Executing SQL statement: select t.* from DB명.table명 where (1=0)(export인 경우 SELECT t.* from DB명.table명 AS t WHERE 1=0)이라는 문장이 보이면 sqoop source DB에 정상적으로 접근되었다는 것이며 이런 문장이 없으면 sqoop source DB에 권한 이슈 혹은 네트웍 접속 이슈등으로 정상적으로 접속하지 못했다는 의미이며 sqoop job이 별도의 application을 수행하지 않고 바로 종료된다. (별도의 application 을 수행중에 fail되는 경우라도 YARN->Applications에서 검색되지는 않고, YARN->WebUI->ResourceManager WebUI혹은 YARN->WebUI->HistoryServer WebUI에서 검색해야 확인 가능함)

Running job: job_1234567890123_1235 문구의 로그가 보이며 이것이 oozie:launcher가 수행시킨 sqoop action(application_1234567890123_1235)의 job id가 되므로 이것을 기준으로 application log를 찾아 확인할 수 있다. 

이렇게 sqoop action의 applicatin_id를 찾는 이유는 Hue의 Job에서 오류발생시 보여지는 application_id에는 자세한 오류 메세지가 표시되지 않는 경우가 있다. 그래서 별도의 sqoop action job id를 찾아서 해당 로그를 확인하기 위함이다. 



* 정상적으로 sqoop action이 진행된다면 oozie:launcher로그 파일(application_id=application application_1234567890123_1234)에서 다음의 내용을 확인할 수 있다.

>>> Invoking Sqoop command line now >>>

....

org.apache.sqoop.tool.CodeGenTool - Beginning code generation

....

org.apache.sqoop.manager.SqlManager - Executing SQL statement: select * from DB명.table명 where (1=0)

...

org.apache.hadoop.mapreduce.JobSubmitter - Submitting tokens for job: job_1234567890123_1235

...

org.apache.hadoop.yarn.client.api.impl.YarnClientImpl - Submitted application application_1234567890123_1235

...

org.apache.hadoop.mapreduce.Job - Running job: job_1234567890123_1235

...

org.apache.hadoop.mapreduce.Job - map 0% reduce 0%

org.apache.hadoop.mapreduce.Job - map 100% reduce 0%

org.apache.hadoop.mapreduce.Job - Job job_1234567890123_124 completed successfully



번호 제목 날짜 조회 수
750 엑셀에서 K ,M, G ,T 단위를 숫자로 변환 하는 수식 2025.04.09 170
749 [Shellscript]Impala view의 실제 참조 테이블 추출용 shellscript파일 2025.03.22 165
748 Failed to resolve 'acme-v02.api.letsencrypt.org' ([Errno -3] Temporary failure in name resolution)" 2024.11.27 810
747 Apache Kudu에서 동일한 이름의 테이블을 반복적으로 DROP → CREATE → INSERT하는 로직을 2분 간격으로 10회 수행할 때 발생할 수 있는 주요 이슈 2025.01.26 1172
746 운영계 하둡클러스터에 노드 4대를 EdgeNode로 추가하는 방법/절차 2025.01.12 1142
745 Oracle 10g 혹은 12c 를 19c로 Upgrade시 Cloudera Cluster작업에 필요한 작업 2025.01.12 1254
744 beeline을 이용한 impala JDBC 테스트 방법(Kerberos 설정된 상태임) 2024.11.29 833
743 외부에서 ImpalaJDBC42.jar를 통해서 Impala에 접속시 sessions정보 2024.11.26 690
742 [Kerberos]Kerberos authentication cache를 FILE로 지정해도 KCM으로 저장되는 경우 조치방법 2024.11.03 1488
741 How to Install Magento 2.4.7 on Ubuntu 24.04 2024.09.04 3302
740 [CDP7.1.7]Hive Replication수행시 Target Cluster에서 Specified catalog.database.table does not exist 오류 2024.05.08 3223
739 [Impala] alter table구문수행시 "WARNINGS: Impala does not have READ_WRITE access to path 'hdfs://nameservice1/DATA/Temp/DB/source/table01_ccd'" 발생시 조치 2024.04.26 1634
738 [CDP7.1.7] oozie sqoop action으로 import혹은 export수행시 발생한 오류에 대한 자세한 로그 확인 하는 방법 2024.04.19 1847
737 [CDP7.1.7]Hive Replication수행중 Specified catalog.database.table does not exist : hive.db명.table명 오류 발생시 조치방법 2024.04.05 3209
736 [Active Directory] AD Kerberos보안 설정 변경 방법 (Maximum lifetime for user ticket, Maximum lifetime for user ticket renewal) 2024.03.12 3142
735 [CDP7.1.7]BDR작업후 오류로 Diagnostic Data를 수집하는 동안 "No content to map due to end-of-input at [Source: (String)""; line: 1, column: 0]" 오류 발생시 조치 2024.02.20 3657
734 [CDP7.1.7, Replication]Encryption Zone내 HDFS파일을 비Encryption Zone으로 HDFS Replication시 User hdfs가 아닌 hadoop으로 수행하는 방법 2024.01.15 1489
733 [CDP7.1.7]Oozie job에서 ERROR: Kudu error(s) reported, first error: Timed out: Failed to write batch of 774 ops to tablet 8003f9a064bf4be5890a178439b2ba91가 발생하면서 쿼리가 실패하는 경우 2024.01.05 3481
732 [CDP7.1.7][Replication]Table does not match version in getMetastore(). Table view original text mismatch 2024.01.02 3160
731 [CDP7.1.7, Hive Replication]Hive Replication진행중 "The following columns have types incompatible with the existing columns in their respective positions " 오류 2023.12.27 3147
위로