# Падает кластер при работе с определенными индексами

**URL:** https://discuss.elastic.co/t/topic/153612
**Category:** Вопросы на русском языке
**Created:** [October 23, 2018, 1:31pm UTC](https://discuss.elastic.co/t/topic/153612 "2018-10-23T13:31:22Z")
**Posts on this page:** 9
**Page:** 1

<div class="post-metadata">

### Author: ![111126](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/111126/32/36818_2.png) [@111126](https://discuss.elastic.co/u/111126)
#### Post date: [October 23, 2018, 1:31pm UTC](https://discuss.elastic.co/t/topic/153612/1 "2018-10-23T13:31:22Z")

</div>

Вводная:  
Elastic версии 6.4.2  
4 дата-ноды, две hot и две warm + одна мастер нода  
Общий объем данных 22Тб, индексов 199, шардов 1038, документов 20млрд  
На hot нодах занято около 600Гб, остальное лежит на warm.

Есть ряд индексов crypto-money-metrics-btc-\* (и аналогичный index pattern в кибане) которые хранятся на теплых нодах. Каждый индекс имеет две праймари шарды и одну реплику. Вот параметры индексов:

 ![image](https://us1.discourse-cdn.com/elastic/original/3X/6/0/602a487a38393b257df2cc00d4ccf0f8f0f5db0f.png)

Есть другой ряд индексов weblog-\* (и аналогичный index pattern в кибане) которые хранятся на теплых нодах, за исключением одного самого последнего, он храниться на горячих нодах т.к. в него идет активная индексация. Каждый индекс имеет 8 праймари шард и одну реплику. Вот параметры индексов:

 ![image](https://us1.discourse-cdn.com/elastic/original/3X/5/8/5845e35b09e16bb3ae7891be3e913689d2834400.png)

Теперь описываю в чем проблема:  
Идем в DIscover, открываем индекс патерн crypto-money-metrics-btc-\*, выбираем любой день (не говоря уже о захватывании большего промежутка времени) и дальше возможно несколько вариантов:

1. ждем и кластер падает
2. ждем и получаем ошибку таймаута от кибаны, который у меня раскручен elasticsearch.requestTimeout: 99999  
Пробуем еще раз и на второй-третей попытки кластер падает.

Вот что в это время происходит с одной из теплых нод (на второй картина примерно такая же):

 ![image](https://us1.discourse-cdn.com/elastic/original/3X/4/5/45d63c9b27fa797dc16c13e6b9648cd02bc8db52.png)

Проблема наблюдается именно при работе с crypto-money-metrics-btc-_.  
Выше я не зря описал индексы weblog-_, их так же много как и crypto-money-metrics-btc-\*, они так же имеют большой объем. Но при этом при обращении к ним кластер не падает. Можно без проблем посмотреть любой день, неделю, можно даже захватить целый месяц. Да иногда при захвате большого по времени куска данных происходит ошибка таймаута от кибаны, но сделав еще попытку, данные в итоге отображаются и кластер при этом никогда не падает.

Помогите найти и понять проблему просмотра данных из crypto-money-metrics-btc-\*, как ее решить?

---

<div class="post-metadata">

### Author: ![Vladimir.Dolzhenko](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/vladimir.dolzhenko/32/34352_2.png) [@Vladimir.Dolzhenko](https://discuss.elastic.co/u/Vladimir.Dolzhenko)
#### Post date: [October 23, 2018, 2:31pm UTC](https://discuss.elastic.co/t/topic/153612/2 "2018-10-23T14:31:17Z")

</div>

Размер индекса ещё ни о чём не говорит - куда более интересны какие именно данные там (уровень вложенности и т.п) и самое главное - какие запросы для них запускаются.

Вполне может быть, что срабатывает circuit breaker, когда предчувствует, что может случится OOM. В этом случае надо смотреть на запрос, быть может, что ограничив размер корзины поможет

[https://www.elastic.co/guide/en/elasticsearch/reference/current/search-aggregations-bucket-terms-aggregation.html#search-aggregations-bucket-terms-aggregation-size](https://www.elastic.co/guide/en/elasticsearch/reference/current/search-aggregations-bucket-terms-aggregation.html#search-aggregations-bucket-terms-aggregation-size)

и опять же - так сложно сказать - нужно смотреть и анализировать логи.

---

<div class="post-metadata">

### Author: ![111126](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/111126/32/36818_2.png) [@111126](https://discuss.elastic.co/u/111126)
#### Post date: [October 23, 2018, 3:05pm UTC](https://discuss.elastic.co/t/topic/153612/3 "2018-10-23T15:05:38Z")

</div>

ЧТо касается запроса, то я же выше описал, речь идет про вкладку discovery в кибане, никаких дополнительных фильтров. Манипулирую только вкладкой Time Range в верхнем правом углу.

ВОт логи [https://pastebin.com/4ZtJjL49](https://pastebin.com/4ZtJjL49)

Вот для примера [https://yadi.sk/i/1rkDRNjkH9u8JQ](https://yadi.sk/i/1rkDRNjkH9u8JQ) один из документов одного из индексов crypto-money-metrics-btc-\* Вложений там действительно много, документ не простой.

Что касается документов в индексе weblog-\*, то тут действительно сравнение видимо некорректное потому как документы там простые, а уж вложений нет и подавно.

Помогите мне, как все же оптимизировать crypto-money-metrics-btc-\* или какие параметры кластера протюнинговать чтобы нормально работать в кибане с этими индексами.

---

<div class="post-metadata">

### Author: ![Igor\_Motov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/igor_motov/32/45193_2.png) [@Igor\_Motov](https://discuss.elastic.co/u/Igor_Motov)
#### Post date: [October 23, 2018, 7:07pm UTC](https://discuss.elastic.co/t/topic/153612/4 "2018-10-23T19:07:42Z")

</div>

А меппинг у `crypto-money-metrics-btc-*` какой? А когда нода с OOM падает стек есть?

---

<div class="post-metadata">

### Author: ![111126](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/111126/32/36818_2.png) [@111126](https://discuss.elastic.co/u/111126)
#### Post date: [October 24, 2018, 7:11am UTC](https://discuss.elastic.co/t/topic/153612/5 "2018-10-24T07:11:29Z")

</div>

Мэппинг дефолтный.  
Стека нет. Потому как сколько не жди - нода полностью не умрет. Т.е. процесс эластика будет висеть, пытаться делать вид что он работает, а по факту эту ноду кластер видеть не будет. А в логах ноды будут сообщения от JvmGcMonitorService про overhead gc

---

<div class="post-metadata">

### Author: ![Igor\_Motov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/igor_motov/32/45193_2.png) [@Igor\_Motov](https://discuss.elastic.co/u/Igor_Motov)
#### Post date: [October 24, 2018, 2:31pm UTC](https://discuss.elastic.co/t/topic/153612/6 "2018-10-24T14:31:48Z")

</div>

А что stats показывают перед тем, как нода помирает?

---

<div class="post-metadata">

### Author: ![111126](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/111126/32/36818_2.png) [@111126](https://discuss.elastic.co/u/111126)
#### Post date: [October 24, 2018, 2:36pm UTC](https://discuss.elastic.co/t/topic/153612/7 "2018-10-24T14:36:22Z")

</div>

> [@Igor\_Motov](#):
>
> А что stats показывают перед тем, как нода помирает?

Игорь, Вы об этом [Nodes stats API | Elasticsearch Guide [8.11] | Elastic](https://www.elastic.co/guide/en/elasticsearch/reference/current/cluster-nodes-stats.html) ?

воспроизведу ситуацию и сниму тогда

---

<div class="post-metadata">

### Author: ![Igor\_Motov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/igor_motov/32/45193_2.png) [@Igor\_Motov](https://discuss.elastic.co/u/Igor_Motov)
#### Post date: [October 24, 2018, 2:38pm UTC](https://discuss.elastic.co/t/topic/153612/8 "2018-10-24T14:38:58Z")

</div>

Да про это. Если там ничего не найдем, то следующим шагом будет анализ heapdump-а.

---

<div class="post-metadata">

### Author: ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)
#### Post date: [November 21, 2018, 2:39pm UTC](https://discuss.elastic.co/t/topic/153612/9 "2018-11-21T14:39:01Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
