# Fs-crawler for data scraping

**URL:** <https://discuss.elastic.co/t/fs-crawler-for-data-scraping/301063>\
**Category:** Elasticsearch\
**Created:** [March 30, 2022, 9:26am UTC](https://discuss.elastic.co/t/fs-crawler-for-data-scraping/301063 "2022-03-30T09:26:20Z")\
**Posts on this page:** 3\
**Page:** 1

<div class="post-metadata">

**Author:** ![Um\_Ar](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/um_ar/32/103696_2.png) [@Um\_Ar](https://discuss.elastic.co/u/Um_Ar)\
**Post date:** [March 30, 2022, 9:26am UTC](https://discuss.elastic.co/t/fs-crawler-for-data-scraping/301063/1 "2022-03-30T09:26:20Z")

</div>

I would like to use fs-crawler for page by page data extraction or extract data based on title hierarchy(title) instead of getting all the data of a document in a single row.

---

<div class="post-metadata">

**Author:** ![dadoonet](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/dadoonet/32/137187_2.png) [@dadoonet](https://discuss.elastic.co/u/dadoonet)\
**Post date:** [March 30, 2022, 4:37pm UTC](https://discuss.elastic.co/t/fs-crawler-for-data-scraping/301063/2 "2022-03-30T16:37:30Z")

</div>

Welcome!

I believe you'd like this:

> <https://github.com/dadoonet/fscrawler/issues/767>
>
> When indexing large documents you may hit limits not only on the indexing part, …but also when doing searches. 
> 
> Splitting documents into one entry per page helps slice up large documents into bite-size chunks and help performance of indexing and searching in the documents.

This has not been implemented yet.

---

<div class="post-metadata">

**Author:** ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)\
**Post date:** [April 27, 2022, 4:38pm UTC](https://discuss.elastic.co/t/fs-crawler-for-data-scraping/301063/3 "2022-04-27T16:38:06Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
