# Machine learning ML gestion de configuration/crash recovery

**URL:** https://discuss.elastic.co/t/machine-learning-ml-gestion-de-configuration-crash-recovery/323400
**Category:** Discussions en français
**Created:** [January 18, 2023, 10:17am UTC](https://discuss.elastic.co/t/machine-learning-ml-gestion-de-configuration-crash-recovery/323400 "2023-01-18T10:17:35Z")
**Posts on this page:** 2
**Page:** 1

<div class="post-metadata">

### Author: ![dao](https://avatars.discourse-cdn.com/v4/letter/d/a6a055/32.png) [@dao](https://discuss.elastic.co/u/dao)
#### Post date: [January 18, 2023, 10:17am UTC](https://discuss.elastic.co/t/machine-learning-ml-gestion-de-configuration-crash-recovery/323400/1 "2023-01-18T10:17:35Z")

</div>

Bonjour,

Je fais tourner des machine learning jobs sur un cluster (anomaly detection. sur elastic cloud).

En terme de développement des jobs, mon workflow est compliqué car je ne vois pas comment gérer facilement les versions.

Aujourd'hui, je suis par exemple en R&D, et je développe un ML. Je fais des changements (influenceurs, bucket size, metrics...) mais pour améliorer le modèle, je suis obligé de faire `job_1`, `job_2`, etc... si je ne veux pas perdre la conf. et a chaque fois arreter le datafeed, puis delete le job qui ne m'intéresse pas, etc...

**Y a t il une best practice pour cela? des retour d'expérience?**

D'autre part, j'ai des ML jobs en prod. Si je veux les mettre à jour avec une nouvelle version, alors c'est assez compliqué. On a un script qui arrete le datafeed, stop le ML, nettoie, crée, relance le feed... mais le script part souvent en timeout car arreter le datafeed, et delete le job est très long parfois. et il faut attendre toute la phase de delete pour créer le nouveau job. EN effet, il est référencé dans des dashboards, et donc il faut qu'il ait le bon `job_id`

**Comment faites vous?**

merci de vos retours

---

<div class="post-metadata">

### Author: ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)
#### Post date: [February 15, 2023, 10:18am UTC](https://discuss.elastic.co/t/machine-learning-ml-gestion-de-configuration-crash-recovery/323400/2 "2023-02-15T10:18:11Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
