Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

기타 로그 파일에 대해 Elasticsearch 사용하기

총관리자 2014.09.25 23:09 조회 수 : 1279

http://www.bicdata.com/bbs/board.php?bo_table=news_article&wr_id=89

로그 파일에 대해 Elasticsearch 사용하기

--------------------------------------------------------------------------------------------

로그를 저장하기 위해 Elasticsearch를 사용하고자 한다면, 이 문서를 통해서 Elasticsearch를 구성하는 방식에 대한 도움을 얻을 수 있다.

다수의 장비에서 로그를 수집하여 Elasticsearch에 저장하고자 한다면, 아래에서 하나를 선택해볼 수 있다.

Graylog2
Graylog2를 중앙 서버에 설치하면, Graylog2가 알아서 Elasticsearch에 로그를 저장해준다. 그러면 깔끔한 인터페이스를 사용해서 저장된 로그를 검색할 수 있다.
Logstash
꽤 다양한 기능을 제공한다. 저장할 수 있는 로그의 종류(input)가 다양하며, 로그를 변환할 수 있는 방식(filter)도 많고, 변환된 로그를 저장할 수 있는 대상(output) 또한 다양하다. 무엇보다도 Elasticsearch에 직접 저장할 수 있는데, 이때 RabbitMQ의 Elasticsearch river를 사용할 수 있다.
Apache Flume
플럼(Flume)을 사용하면 로그를 데이터소스(data source)로부터 수집한 후, 데코레이터(decoratro)를 사용하여 변환한 다음, 다양한 싱크(sink)를 이용해서 로그를 저장할 수 있다. 그중에서도 elasticflume sink를 살펴보라.
rsyslog에 대한 omelasticsearch output 모듈
어플리케이션 서버에서 rsyslog를 사용하여 로그를 Elasticsearch에 직접 저장하거나, 또는 중앙 서버에서 rsyslog를 사용하여 로그를 저장할 수도 있다. 또한 2가지 방식을 모두 활용할 수도 있다. 설정 방식에 대해서는 rsyslog 위키를 살펴보라.
직접 구현
예를 들어 로그를 Elasticsearch에 저장하도록 커스텀 스크립트를 직접 만들어볼 수도 있다.

위의 방법 중 어느 방식을 사용하느냐에 따라 최적화 방식 또한 달라진다. 하지만 어느 방식을 사용하느냐에 관계 없이, 아래의 가이드는 도움이 될 것이다.

메모리와 열린 파일 갯수

인덱스의 갯수

인덱스 삭제 및 최적화

샤드와 복제본

매핑. _source과 _all

리프레쉬 주기

쓰리프트

비동기 복제

쿼리보다는 필터 사용하기

벌크 인덱싱하기

이 게시물을

이 글의 추천인 목록 목록

번호	제목	날짜	조회 수
101	hadoop에서 yarn jar ..를 이용하여 appliction을 실행하여 정상적으로 수행되었으나 yarn UI의 어플리케이션 목록에 나타나지 않는 문제	2017.05.02	185
100	https://github.com/Merck/Halyard프로젝트 컴파일및 배포/테스트	2017.01.24	185
99	hbase startrow와 endrow를 지정하여 검색하기 샘플	2016.12.07	185
98	참고할만한 spark예제를 설명하는 사이트	2016.11.11	185
97	java스레드 덤프 분석하기	2016.11.03	185
96	lombok설치방법	2020.06.20	183
95	spark에서 hive table을 읽어 출력하는 예제 소스	2017.03.09	179
94	Authorization within Hadoop Projects	2022.06.13	178
93	lagom-windows용 build.sbt파일 내용	2017.10.12	178
92	Windows에서 sbt개발환경 구축 방법(링크)	2016.06.02	178
91	[Hadoop Encryption] Encryption Zone 생성/설정시 User:hadoop not allowed to do 'DECRYPT_EEK' ON 'testkey' 오류 발생 조치 사항	2023.06.28	176
90	[TLS/SSL]Kudu Master 설정하기	2022.05.13	176
89	oracle 접속 방식에 따른 --connect 지정 방법	2022.02.11	176
88	halyard 1.3의 rdf4j-server.war와 rdf4j-workbench.war를 tomcat deploy후 조회시 java.lang.NoClassDefFoundError: org/apache/hadoop/hbase/Cell발생시 조치사항	2017.07.05	176
87	테이블의 row수를 빠르게 카운트 하는 방법	2017.01.26	175
86	jena의 data폴더를 hadoop nfs를 이용하여 HDFS상의 폴더에 마운트 시키고 fuseki를 통하여 inert를 시도했을때 transaction 오류 발생	2016.12.02	174
85	서버 5대에 solr 5.5.0 설치하고 index data를 HDFS에 저장/search하도록 설치/설정하는 방법	2016.04.08	173
84	[CDP7.1.7]Encryption Zone내부/외부 간 데이터 이동(mv,cp)및 CTAS, INSERT SQL시 오류(can't be moved into an encryption zone, can't be moved from an encryption zone)	2023.11.14	171
83	[CDP7.1.7]EncryptionZone에 table생성및 권한 테스트	2023.09.26	171
82	How to Install Magento 2.4.7 on Ubuntu 24.04	2024.09.04	169

쓰기 태그

첫 페이지 28 29 30 31 32 33 34 35 36 37 끝 페이지

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

기타 로그 파일에 대해 Elasticsearch 사용하기

댓글 0

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

기타 로그 파일에 대해 Elasticsearch 사용하기

댓글 0

LOGIN