메뉴 건너뛰기

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.


hive테이블의 물리적인 위치인 HDFS에 여러개의 데이터 파일이 존재할때 한개의 파일로 만들어서 다시 동일한 테이블에 입력하는 hive쿼리는 다음과 같다.

(1번, 2번 모두 가능함)


1. 

set mapreduce.job.running.map.limit=1;

set mapreduce.job.running.reduce.limit=1;

insert overwrite table temp.tb_test select * from temp.tb_test;


2. 

insert overwrite table temp.tb_test select * from temp.tb_test;


를 실행하면 hive에서 실행하면 목적지 테이블에 데이터를 입력할 때 select된 데이터에 한해서 자동으로 merge해서 입력한다.


1번 쿼리를 impala에서 실행하면 set구문이 인식이 안되어 오류가 발생하며 set구문없이  2번 쿼리를 실행하면 파일 개수에는 변함이 잆이 동일한 개수의 파일로  데이터가 overwrite된다.


번호 제목 날짜 조회 수
105 hue.axes_accessattempt테이블의 username컬럼에 NULL 혹은 space가 들어갈수도 있음. 2021.11.03 89404
104 Query Status: Sender xxx.xxx.xxx.xxx timed out waiting for receiver fragment instance: 1234:cdsf, dest node: 10 의 오류 원인및 대응방안 2021.11.03 2380
103 hive metastore db중 TBLS, TABLE_PARAMS테이블 설명 2021.10.22 2383
102 kudu hms check 사용법(예시) 2021.10.22 2483
101 Hue Load Balancer를 L4로 L/B하는 경우는 L4쪽 도멘인으로 발행된 인증서를 TLS/SSL항목에 설정해주어야 한다. 2021.10.08 2356
100 TLS/SSl설정시 방법및 참고 사항 2021.10.08 2866
99 you are accessing a non-optimized hue please switch to one of the available addresses 2021.10.06 2616
98 AnalysisException: Incomplatible return type 'DECIMAL(38,0)' and 'DECIMAL(38,5)' of exprs가 발생시 조치 2021.07.26 2506
97 impala session type별 표시되는 정보로 구분하는 방법 2021.05.25 2171
96 Hive JDBC Connection과 유형별 에러및 필요한 jar파일 2021.05.24 2223
95 impald에서 idle_query_timeout 와 idle_session_timeout 구분 2021.05.20 3183
94 impala external 테이블 생성시 컬럼과 라인 구분자를 지정하여 테이블 생성하는 예시 2020.02.20 2058
93 hive metadata(hive, impala, kudu 정보가 있음) 테이블에서 db, table, owner, location를 조회하는 쿼리 2020.02.07 2485
» hive테이블의 물리적인 위치인 HDFS에 여러개의 데이터 파일이 존재할때 한개의 파일로 merge하여 동일한 테이블에 입력하는 방법 2019.05.23 2568
91 json으로 존재하는 데이터 parsing하기 2019.03.25 3208
90 [sentry]role부여후 테이블명이 변경되어 오류가 발생할때 조치방법 2018.10.16 2263
89 hive metastore ERD file 2018.09.20 1989
88 oracle to hive data type정리표 2018.08.22 5995
87 RHEL 7.4에 zeppelin 0.7.4 설치 2018.07.31 2755
86 conda를 이용한 jupyterhub(v0.9)및 jupyter설치 (v4.4.0) 2018.07.30 2451
위로