# Extract arabic caracters from images sing teseract\_ocr

**URL:** <https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836>\
**Category:** Elasticsearch\
**Created:** [June 1, 2019, 8:50pm UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836 "2019-06-01T20:50:00Z")\
**Posts on this page:** 7\
**Page:** 1

<div class="post-metadata">

**Author:** ![kumar4](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/kumar4/32/48326_2.png) [@kumar4](https://discuss.elastic.co/u/kumar4)\
**Post date:** [June 1, 2019, 8:50pm UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/1 "2019-06-01T20:50:00Z")

</div>

i am using teseract\_ocr to extract text (fresnsh and english) from images but te texte that are not frens or english cant be displayed in kibana , what shoud i do to diplay them

---

<div class="post-metadata">

**Author:** ![dadoonet](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/dadoonet/32/137187_2.png) [@dadoonet](https://discuss.elastic.co/u/dadoonet)\
**Post date:** [June 2, 2019, 2:19am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/2 "2019-06-02T02:19:27Z")

</div>

How the documents are looking like in elasticsearch ? Run a query from the command line or from Kibana dev console.

It might be related to Tesseract. May be you need to install a language pack? [https://wiki.apache.org/tika/TikaOCR](https://wiki.apache.org/tika/TikaOCR)

---

<div class="post-metadata">

**Author:** ![kumar4](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/kumar4/32/48326_2.png) [@kumar4](https://discuss.elastic.co/u/kumar4)\
**Post date:** [June 2, 2019, 2:51am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/3 "2019-06-02T02:51:25Z")

</div>

> [@dadoonet](#):
>
> How the documents are looking like in elasticsearch ? Run a query from the command line or from Kibana dev console.

i installaed all languages but i doeosnt work cant detect arabic in images

---

<div class="post-metadata">

**Author:** ![dadoonet](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/dadoonet/32/137187_2.png) [@dadoonet](https://discuss.elastic.co/u/dadoonet)\
**Post date:** [June 2, 2019, 3:05am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/4 "2019-06-02T03:05:02Z")

</div>

Ok. What about the other questions I asked?

---

<div class="post-metadata">

**Author:** ![kumar4](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/kumar4/32/48326_2.png) [@kumar4](https://discuss.elastic.co/u/kumar4)\
**Post date:** [June 2, 2019, 3:06am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/5 "2019-06-02T03:06:47Z")

</div>

the information is text extraced from images but in case of aravbic i sse a strange text that deosnt match he real arabic text

---

<div class="post-metadata">

**Author:** ![dadoonet](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/dadoonet/32/137187_2.png) [@dadoonet](https://discuss.elastic.co/u/dadoonet)\
**Post date:** [June 2, 2019, 3:11am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/6 "2019-06-02T03:11:35Z")

</div>

I can't help.

---

<div class="post-metadata">

**Author:** ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)\
**Post date:** [June 30, 2019, 3:23am UTC](https://discuss.elastic.co/t/extract-arabic-caracters-from-images-sing-teseract-ocr/183836/7 "2019-06-30T03:23:40Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
