메뉴 건너뛰기

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.


hive테이블의 물리적인 위치인 HDFS에 여러개의 데이터 파일이 존재할때 한개의 파일로 만들어서 다시 동일한 테이블에 입력하는 hive쿼리는 다음과 같다.

(1번, 2번 모두 가능함)


1. 

set mapreduce.job.running.map.limit=1;

set mapreduce.job.running.reduce.limit=1;

insert overwrite table temp.tb_test select * from temp.tb_test;


2. 

insert overwrite table temp.tb_test select * from temp.tb_test;


를 실행하면 hive에서 실행하면 목적지 테이블에 데이터를 입력할 때 select된 데이터에 한해서 자동으로 merge해서 입력한다.


1번 쿼리를 impala에서 실행하면 set구문이 인식이 안되어 오류가 발생하며 set구문없이  2번 쿼리를 실행하면 파일 개수에는 변함이 잆이 동일한 개수의 파일로  데이터가 overwrite된다.


번호 제목 날짜 조회 수
103 hive metastore db중 TBLS, TABLE_PARAMS테이블 설명 2021.10.22 625
102 kudu hms check 사용법(예시) 2021.10.22 459
101 Hue Load Balancer를 L4로 L/B하는 경우는 L4쪽 도멘인으로 발행된 인증서를 TLS/SSL항목에 설정해주어야 한다. 2021.10.08 518
100 TLS/SSl설정시 방법및 참고 사항 2021.10.08 640
99 you are accessing a non-optimized hue please switch to one of the available addresses 2021.10.06 168
98 AnalysisException: Incomplatible return type 'DECIMAL(38,0)' and 'DECIMAL(38,5)' of exprs가 발생시 조치 2021.07.26 204
97 impala session type별 표시되는 정보로 구분하는 방법 2021.05.25 468
96 Hive JDBC Connection과 유형별 에러및 필요한 jar파일 2021.05.24 962
95 impald에서 idle_query_timeout 와 idle_session_timeout 구분 2021.05.20 1884
94 impala external 테이블 생성시 컬럼과 라인 구분자를 지정하여 테이블 생성하는 예시 2020.02.20 346
93 hive metadata(hive, impala, kudu 정보가 있음) 테이블에서 db, table, owner, location를 조회하는 쿼리 2020.02.07 642
» hive테이블의 물리적인 위치인 HDFS에 여러개의 데이터 파일이 존재할때 한개의 파일로 merge하여 동일한 테이블에 입력하는 방법 2019.05.23 912
91 json으로 존재하는 데이터 parsing하기 2019.03.25 1264
90 [sentry]role부여후 테이블명이 변경되어 오류가 발생할때 조치방법 2018.10.16 505
89 hive metastore ERD file 2018.09.20 882
88 oracle to hive data type정리표 2018.08.22 944
87 RHEL 7.4에 zeppelin 0.7.4 설치 2018.07.31 495
86 conda를 이용한 jupyterhub(v0.9)및 jupyter설치 (v4.4.0) 2018.07.30 725
85 upsert구현방법(년-월-일 파티션을 기준으로) 및 테스트 script file 2018.07.03 1646
84 Toree 0.1.0-incubating이 Scala 2.10.4까지만 지원하게 되어서 발생하는 NoSuchMethod오류 문제 해결방법(scala 2.11.x을 지원하지만 오류가 발생할 수 있음) 2018.04.20 232
위로