메뉴 건너뛰기

Bigdata, Semantic IoT, Hadoop, NoSQL

Bigdata, Hadoop ecosystem, Semantic IoT등의 프로젝트를 진행중에 습득한 내용을 정리하는 곳입니다.
필요한 분을 위해서 공개하고 있습니다. 문의사항은 gooper@gooper.com로 메일을 보내주세요.


hive테이블의 물리적인 위치인 HDFS에 여러개의 데이터 파일이 존재할때 한개의 파일로 만들어서 다시 동일한 테이블에 입력하는 hive쿼리는 다음과 같다.

(1번, 2번 모두 가능함)


1. 

set mapreduce.job.running.map.limit=1;

set mapreduce.job.running.reduce.limit=1;

insert overwrite table temp.tb_test select * from temp.tb_test;


2. 

insert overwrite table temp.tb_test select * from temp.tb_test;


를 실행하면 hive에서 실행하면 목적지 테이블에 데이터를 입력할 때 select된 데이터에 한해서 자동으로 merge해서 입력한다.


1번 쿼리를 impala에서 실행하면 set구문이 인식이 안되어 오류가 발생하며 set구문없이  2번 쿼리를 실행하면 파일 개수에는 변함이 잆이 동일한 개수의 파일로  데이터가 overwrite된다.


번호 제목 글쓴이 날짜 조회 수
601 impala external 테이블 생성시 컬럼과 라인 구분자를 지정하여 테이블 생성하는 예시 총관리자 2020.02.20 64
600 [Kerberos]Kerberos상태의 클러스터에 JDBC로 접근할때 케이스별 오류내용 총관리자 2020.02.14 378
599 cloudera서비스 중지및 기동순서 총관리자 2020.02.14 122
598 impala테이블 쿼리시 max_row_size 관련 오류가 발생할때 조치사항 총관리자 2020.02.12 108
597 hue.axes_accessattempt테이블 데이터 샘플 총관리자 2020.02.10 97
596 hue.desktop_document2의 type의 종류 총관리자 2020.02.10 597
595 hue db에서 사용자가 가지는 정보 확인 총관리자 2020.02.10 1580
594 Cloudera의 CMS각 컴포넌트의 역할 총관리자 2020.02.10 54
593 Namenode Metadata백업하는 방법 총관리자 2020.02.10 204
592 cloudera의 hue에서 사용자가 사용한 쿼리 목록 총관리자 2020.02.07 100
591 hive metadata(hive, impala, kudu 정보가 있음) 테이블에서 db, table, owner, location를 조회하는 쿼리 총관리자 2020.02.07 214
590 쿠버네티스(k8s) 설치 및 클러스터 구성하기 총관리자 2019.10.19 263
589 [kubernetes]우분투 Kubernetes 설치 방법 file 총관리자 2019.07.24 1180
588 LAGOM 1.4 AND KUBERNETES ORCHESTRATION 총관리자 2019.07.19 61
587 oozie WF에서 참고할만한 내용 총관리자 2019.07.18 116
586 [shellscript] 함수에 배열을 인자로 주어서 처리하는 방법 총관리자 2019.07.16 120
585 [shellscript]엑셀파일에서 여러줄에 존재하는 단어를 한줄의 문자열로 합치는 방법(comma로 구분) 총관리자 2019.07.15 790
584 원격에 있는 git를 받은후 기존repository삭제후 새로운 리포지토리에 연결하여 소스 등록 총관리자 2019.07.13 83
583 기준일자 이전의 hdfs 데이타를 지우는 shellscript 샘플 총관리자 2019.06.14 339
582 embedded-cassandra의 data 저장위치 총관리자 2019.06.09 250

A personal place to organize information learned during the development of such Hadoop, Hive, Hbase, Semantic IoT, etc.
We are open to the required minutes. Please send inquiries to gooper@gooper.com.

위로