# Stream data from Elastic search and store in Hadoop

**URL:** https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591
**Category:** Elasticsearch
**Tags:** es-hadoop
**Created:** [August 18, 2017, 1:29pm UTC](https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591 "2017-08-18T13:29:05Z")
**Posts on this page:** 4
**Page:** 1

<div class="post-metadata">

### Author: ![rrai](https://avatars.discourse-cdn.com/v4/letter/r/ecccb3/32.png) [@rrai](https://discuss.elastic.co/u/rrai)
#### Post date: [August 18, 2017, 1:29pm UTC](https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591/1 "2017-08-18T13:29:06Z")

</div>

I am reading data from elastic search through external table in hive. I want load data into HDFS from ES continuously instead of doing an external query in ES, and then fetch data into hive from HDFS. Ultimately, I want to fetch data from hive to tableau .

Please suggest a way to strore data from ES to HDFS.

---

<div class="post-metadata">

### Author: ![rrai](https://avatars.discourse-cdn.com/v4/letter/r/ecccb3/32.png) [@rrai](https://discuss.elastic.co/u/rrai)
#### Post date: [August 21, 2017, 9:45am UTC](https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591/2 "2017-08-21T09:45:07Z")

</div>

Hi ,  
Please share some information on this so that I can start working with ES-Hadoop

---

<div class="post-metadata">

### Author: ![james.baiera](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/james.baiera/32/10209_2.png) [@james.baiera](https://discuss.elastic.co/u/james.baiera)
#### Post date: [August 22, 2017, 8:08pm UTC](https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591/3 "2017-08-22T20:08:36Z")

</div>

@rrai I'm afraid that ES-Hadoop does not support continuously streaming data from Elasticsearch yet. Once all data is consumed from Elasticsearch, the job will conclude. You could instead try doing a regularly scheduled export process that only targets the most recently changed data. You can do this by specifying an ES query to run your job with using the `es.query` setting: [https://www.elastic.co/guide/en/elasticsearch/hadoop/current/configuration.html#\_querying](https://www.elastic.co/guide/en/elasticsearch/hadoop/current/configuration.html#_querying)

---

<div class="post-metadata">

### Author: ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)
#### Post date: [September 19, 2017, 8:08pm UTC](https://discuss.elastic.co/t/stream-data-from-elastic-search-and-store-in-hadoop/97591/4 "2017-09-19T20:08:43Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
