Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

spark Apache Spark와 Drools를 이용한 CEP구현 테스트

총관리자 2016.07.15 10:20 조회 수 : 2670

* sprue는 Apache Spark와 Drools를 이용한 CEP구현한 예제 소스이다.

(참고 : https://github.com/mganta/sprue)

<<준비/설정>>

1. hbase에 테이블 생성

create 'patientData', {NAME => 'cf1', VERSIONS => 3, REPLICATION_SCOPE => 1, COMPRESSION => 'SNAPPY'}

==> hbase 버전에 따라서 아래의 오류가 발생할 수 있는데 그때는 COMPRESSION => 'SNAPPY'부분을 빼고 실행한다.

* 다음의 사이트에서 로직을 테스트 할 수 있다.

: http://www.mdcalc.com/sirs-sepsis-and-septic-shock-criteria/

2. drools가 사용하는 의사결정테이블 파일은 src/main/resources/sepsis.xls를 사용한다.

3. driver program은 3개의 인자를 받는다.

a. zookeeper info

b. rules xls file

c. open tsdb url

- opentsdb이 설치되지 않았으면 SepsisStream.scala파일의 94(97 ?)라인을 주석처리한다.

- HBase가 설정되지 않았다면 69 & 80(73 & 84 ?) 라인을 주석처리한다.

- local mode로 실행할 경우는 SepsisStream.scala파일의 40 & 41의 주석을 바꾼다.

4. 이 프로그램은 queueRDD를 이용하여 sample data를 생성한다.

<<컴파일/실행하기>>

1. mvn clean package

//2. Create the hbase table. Sample script in src/main/resource/create_hbase_table.rb

//3. Install opentsdb (http://opentsdb.net/docs/build/html/installation.html)

4. Start spark streaming using

spark-submit --driver-java-options

'-Dspark.executor.extraClassPath=/opt/cloudera/parcels/CDH/lib/hbase/lib/htrace-core-3.1.0-incubating.jar'

--master yarn-client

--files sepsis.xls

--class com.cloudera.sprue.SepsisStream

/path_to/sprue-0.0.1-SNAPSHOT-jar-with-dependencies.jar

sepsis.xls zookeeper.host.domain:2181

http://opentsdb.host.domain:4242/api/put

* spark.executor.extraClassPath옵션은 spark에서 실행되는 hbase의 설치위치의 lib에 있는 htrace-core-3.1.0-incubating.jar를 지정한다.

* files옵션은 spark executor들이 사용하는 xls파일을 업로드 한다.

-------------------오류내용------------------------

ERROR: org.apache.hadoop.hbase.DoNotRetryIOException: Compression algorithm 'snappy' previously failed test. Set hbase.table.sanity.checks to false at conf or table descriptor if you want to bypass sanity checks

at org.apache.hadoop.hbase.master.HMaster.warnOrThrowExceptionForFailure(HMaster.java:1603)

at org.apache.hadoop.hbase.master.HMaster.sanityCheckTableDescriptor(HMaster.java:1542)

at org.apache.hadoop.hbase.master.HMaster.createTable(HMaster.java:1452)

at org.apache.hadoop.hbase.master.MasterRpcServices.createTable(MasterRpcServices.java:429)

at org.apache.hadoop.hbase.protobuf.generated.MasterProtos$MasterService$2.callBlockingMethod(MasterProtos.java:52195)

at org.apache.hadoop.hbase.ipc.RpcServer.call(RpcServer.java:2117)

at org.apache.hadoop.hbase.ipc.CallRunner.run(CallRunner.java:104)

at org.apache.hadoop.hbase.ipc.RpcExecutor.consumerLoop(RpcExecutor.java:133)

at org.apache.hadoop.hbase.ipc.RpcExecutor$1.run(RpcExecutor.java:108)

at java.lang.Thread.run(Thread.java:745)

Caused by: org.apache.hadoop.hbase.DoNotRetryIOException: Compression algorithm 'snappy' previously failed test.

at org.apache.hadoop.hbase.util.CompressionTest.testCompression(CompressionTest.java:91)

at org.apache.hadoop.hbase.master.HMaster.checkCompression(HMaster.java:1686)

at org.apache.hadoop.hbase.master.HMaster.checkCompression(HMaster.java:1679)

at org.apache.hadoop.hbase.master.HMaster.sanityCheckTableDescriptor(HMaster.java:1540)

... 8 more

이 게시물을

이 글의 추천인 목록 목록

번호	제목	날짜	조회 수
147	AIX 7.1에 Hadoop설치(정리중#2)	2016.09.20	1156
146	AIX 7.1에 Hadoop설치(정리중)	2016.09.12	2352
145	No broker partitions consumed by consumer thread오류 발생시 확인/조치할 사항	2016.09.02	2359
144	kafka 0.9.0.1버젼의 producer와 kafka버젼이 0.10.0.1인 consumer가 서로 대화하는 모습	2016.08.18	1649
143	down된 broker로 메세지를 전송하려는 경우의 오류 내용및 조치사항	2016.08.12	1278
142	kafkaWordCount.scala의 producer와 consumer 클래스를 이용하여 kafka를 이용한 word count 테스트 하기	2016.08.02	1969
141	bin/start-hbase.sh실행시 org.apache.hadoop.hbase.util.FileSystemVersionException: HBase file layout needs to be upgraded오류가 발생하면 조치사항	2016.08.01	1586
140	start-all.sh로 spark데몬 기동시 "JAVA_HOME is not set"오류 발생시 조치사항	2016.08.01	2453
139	hadoop클러스터를 구성하던 서버중 HA를 담당하는 서버의 hostname등이 변경되어 문제가 발생했을때 조치사항	2016.07.29	1506
138	Journal Storage Directory /data/hadoop/journal/data/mycluster not formatted 오류시 조치사항	2016.07.29	2707
»	Apache Spark와 Drools를 이용한 CEP구현 테스트	2016.07.15	2670
136	org.apache.hadoop.hbase.ClockOutOfSyncException: org.apache.hadoop.hbase.ClockOutOfSyncException 오류시 조치사항	2016.07.14	1245
135	kafka로 부터 메세지를 stream으로 받아 처리하는 spark샘플소스(spark의 producer와 consumer를 sbt로 컴파일 하고 서버에서 spark-submit하는 방법)	2016.07.13	1922
134	avro 사용하기(avsc 스키마 파일 컴파일 방법, consumer, producer샘플소스)	2016.07.08	2749
133	spark-sql실행시 ERROR log: Got exception: java.lang.NumberFormatException For input string: "2000ms" 오류발생시 조치사항	2016.06.09	1492
132	spark-sql실행시 Caused by: java.lang.NumberFormatException: For input string: "0s" 오류발생시 조치사항	2016.06.09	5826
131	spark-sql실행시 The specified datastore driver ("com.mysql.jdbc.Driver") was not found in the CLASSPATH오류 발생시 조치사항	2016.06.09	4363
130	./spark-sql 실행시 "java.lang.NumberFormatException: For input string: "1s"오류발생시 조치사항	2016.06.09	1689
129	beeline실행시 User: root is not allowed to impersonate오류 발생시 조치사항	2016.06.03	3222
128	Caused by: java.net.URISyntaxException: Relative path in absolute URI: ${system:java.io.tmpdir%7D/$%7Bsystem:user.name%7D오류발생시 조치사항	2016.06.03	2113

쓰기 태그

첫 페이지 11 12 13 14 15 16 17 18 19 20 끝 페이지

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

spark Apache Spark와 Drools를 이용한 CEP구현 테스트

댓글 0

Cloudera, BigData, Semantic IoT, Hadoop, NoSQL

Cloudera CDH/CDP 및 Hadoop EcoSystem, Semantic IoT등의 개발/운영 기술을 정리합니다. gooper@gooper.com로 문의 주세요.

spark Apache Spark와 Drools를 이용한 CEP구현 테스트

댓글 0

LOGIN