# Настройка кластера под высокую нагрузку

**URL:** https://discuss.elastic.co/t/topic/199615
**Category:** Вопросы на русском языке
**Created:** [September 16, 2019, 9:01am UTC](https://discuss.elastic.co/t/topic/199615 "2019-09-16T09:01:32Z")
**Posts on this page:** 12
**Page:** 1

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 16, 2019, 9:01am UTC](https://discuss.elastic.co/t/topic/199615/1 "2019-09-16T09:01:32Z")

</div>

Здравствуйте! Последнее время на моем кластере возникает ряд проблем с отвалами нод и индексов. Кластер состоит из 4 нод, все на SSD, под кучу выделено по 32Гб из 64.

По данным мониторинга я понимаю, что это происходит из-за длительной сборки мусора которая происходит по 2-3, а то и 5 минут. Следуя [документации](https://www.elastic.co/guide/en/elasticsearch/reference/6.4/modules-discovery-zen.html) мне нужно увеличить параметр ping\_retries до 10, что бы ноды висящие по 5 минут не отваливались (10 попыток по 30 секунд).

Подскажите, пожалуйста, правильно ли я думаю и каким потенциальным проблемам может привести столь длительное ожидание отклика ноды?

Возможно мне стоит масштабировать свой кластер, не могли бы Вы взглянуть своим профессиональным взглядом на данные моего мониторинга? По этой [ссылке](https://yadi.sk/d/9ct5YyvQ7Jht_w) pdf с состоянием одной ноды и индекса в момент отвала, а так же общую картину за 2 и 7 дней.

---

<div class="post-metadata">

### Author: ![Denis\_Lamanov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/denis_lamanov/32/13111_2.png) [@Denis\_Lamanov](https://discuss.elastic.co/u/Denis_Lamanov)
#### Post date: [September 16, 2019, 9:17am UTC](https://discuss.elastic.co/t/topic/199615/2 "2019-09-16T09:17:49Z")

</div>

Здравствуйте!  
Какая версия Эластика? Можете залить логи с нод?  
По графикам не видно чтобы сборка мусора длилась минутами

---

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 16, 2019, 10:31am UTC](https://discuss.elastic.co/t/topic/199615/3 "2019-09-16T10:31:38Z")

</div>

Данис, у нас стоит версия 6.4.3. Логи загрузил [сюда](https://yadi.sk/d/FDijhDZCuXnKBw).

Я решил, что это из-за сборки мусора потому что перед тем как нода перестает отвечать происходит резкий скачек использования кучи. Так же периодически у меня возникает переполнение очереди на bulk вставку.

---

<div class="post-metadata">

### Author: ![Denis\_Lamanov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/denis_lamanov/32/13111_2.png) [@Denis\_Lamanov](https://discuss.elastic.co/u/Denis_Lamanov)
#### Post date: [September 16, 2019, 11:00am UTC](https://discuss.elastic.co/t/topic/199615/4 "2019-09-16T11:00:16Z")

</div>

У вас 3 issue:

1. `Caused by: org.elasticsearch.common.io.stream.NotSerializableExceptionWrapper: too_many_clauses: maxClauseCount is set to 1024`
2. `Caused by: org.elasticsearch.common.util.concurrent.EsRejectedExecutionException: rejected execution of org.elasticsearch.ingest.PipelineExecutionService$1@98ed61c on EsThreadPoolExecutor[name = WIN-2/write, queue capacity = 200, org.elasticsearch.common.util.concurrent.EsThreadPoolExecutor@2d8cfc9[Running, pool size = 8, active threads = 8, queued tasks = 1469, completed tasks = 145589831]]`
3. `[2019-09-09T01:01:17,136][WARN][o.e.g.DanglingIndicesState] [WIN-0] [[tenders_commerce_index_2015/cezLHePkRv2HwFA5BPhRDA]] can not be imported as a dangling index, as an index with the same name and UUID exist in the index tombstones. This situation is likely caused by copying over the data directory for an index that was previously deleted.`  
Вы вероятно вручную скопировали папки с индексами где уже существовали индексы с такими именами. Эластик не может их импортировать ()

1 и 2 лечится тюнингом. 3 - просто аккуратно удалить папки указанные в логе

Думаю, что причина "выпадения" ноды в п.2

---

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 16, 2019, 11:13am UTC](https://discuss.elastic.co/t/topic/199615/5 "2019-09-16T11:13:32Z")

</div>

Под тюнингом вы понимаете изменять значения по умолчанию или добавлять ноды?

---

<div class="post-metadata">

### Author: ![Denis\_Lamanov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/denis_lamanov/32/13111_2.png) [@Denis\_Lamanov](https://discuss.elastic.co/u/Denis_Lamanov)
#### Post date: [September 16, 2019, 11:15am UTC](https://discuss.elastic.co/t/topic/199615/6 "2019-09-16T11:15:19Z")

</div>

п.2 - поменять дефолтные значения, например:

thread\_pool.write.size: 24  
thread\_pool.write.queue\_size: 5000

п.1 - для начала я бы попытался оптимизировать запрос и уже потом бы поменял значение

---

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 16, 2019, 11:25am UTC](https://discuss.elastic.co/t/topic/199615/7 "2019-09-16T11:25:59Z")

</div>

Мне не особо понятен такой момент, если мы предполагаем, что нода отваливается под нагрузкой от индексации, то увеличение количества потоков вставки и увеличение размера очереди вызовет еще большую нагрузку на память, что будет приводить к более частым отвалам. Или я ошибаюсь?

---

<div class="post-metadata">

### Author: ![Denis\_Lamanov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/denis_lamanov/32/13111_2.png) [@Denis\_Lamanov](https://discuss.elastic.co/u/Denis_Lamanov)
#### Post date: [September 16, 2019, 11:32am UTC](https://discuss.elastic.co/t/topic/199615/8 "2019-09-16T11:32:24Z")

</div>

Память вообще не причём. С Heap size и сборщиком мусора всё нормально.  
Не сама индексация виновата, а переполнение очереди

---

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 16, 2019, 11:50am UTC](https://discuss.elastic.co/t/topic/199615/9 "2019-09-16T11:50:39Z")

</div>

Ясно, спасибо за помощь. Попробую увеличить эти параметры.

---

<div class="post-metadata">

### Author: ![Igor\_Motov](https://sea2.discourse-cdn.com/elastic/user_avatar/discuss.elastic.co/igor_motov/32/45193_2.png) [@Igor\_Motov](https://discuss.elastic.co/u/Igor_Motov)
#### Post date: [September 16, 2019, 9:48pm UTC](https://discuss.elastic.co/t/topic/199615/10 "2019-09-16T21:48:16Z")

</div>

1. Я бы начал с чистки dangling indices. Это не критично, но это засоряет логи и добаваляет не нужную нагрузку на узлы. Процесс можно посмотреть [тут](https://discuss.elastic.co/t/how-to-resolve-dangling-indices-error-on-each-index/130609/11)

2. GC и правда большие, но судя по графикам, память достаточно. У вас эти сервера - железо или виртуалки? У вас там ничего не свапиться?

3. Что с сетью, там никакие "умные" раутеры не стоят? Что-то сетевой трафик очень не стабильный, хотя причина может быть в GC

4. Многие из запросов, котрые появились логах с ошибками весьма не оптимальны. Запросы типа первого запроса с 1378 regexp в первом логе очень тяжелые и будут вызывать большое количество мусора.

---

<div class="post-metadata">

### Author: ![IvanTushin](https://avatars.discourse-cdn.com/v4/letter/i/dbc845/32.png) [@IvanTushin](https://discuss.elastic.co/u/IvanTushin)
#### Post date: [September 17, 2019, 7:26am UTC](https://discuss.elastic.co/t/topic/199615/11 "2019-09-17T07:26:46Z")

</div>

Спасибо! Действительно, вижу что java читает из файла подкачки, скорей всего это корень всех проблем с подвисаниями.

---

<div class="post-metadata">

### Author: ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)
#### Post date: [October 15, 2019, 7:26am UTC](https://discuss.elastic.co/t/topic/199615/12 "2019-10-15T07:26:58Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
