Ingénieur Infrastructure & Aiops - Linux - Elastic - IA Agentique H/F - SooIT
- Indépendant
- SooIT
Les missions du poste
Le besoin
Nous recherchons un Ingénieur Infrastructure & AIOps senior pour accompagner un grand groupe international du secteur de l'énergie, des infrastructures et des services technologiques dans l'évolution et l'industrialisation de ses usages IA appliqués aux opérations IT.
Vous rejoindrez une équipe Infrastructure d'environ 30 personnes, responsable d'un parc d'environ 1 600 serveurs, majoritairement on-premise / datacenter, avec un environnement comprenant notamment Linux, Windows, serveurs physiques et VM, virtualisation, stockage, Kubernetes/containerisation, middleware, Azure, monitoring et observabilité.
Des premiers agents IA appliqués aux opérations Infrastructure sont déjà en place, notamment autour de l'écosystème Elastic / Elasticsearch. L'objectif est de reprendre cet existant, le faire évoluer et étendre progressivement les usages AIOps.
Les principaux cas d'usage sont :
analyse et recherche de root cause lors d'incidents ;
détection et analyse de problèmes récurrents ;
analyse de signaux faibles afin d'identifier plus tôt certaines anomalies ou dégradations Infrastructure ;
exploitation et corrélation des logs, métriques, traces, alertes et référentiels ;
conception d'investigations automatisées déclenchées à partir d'événements/alertes ;
développement d'intégrations, tools, APIs et connecteurs MCP ;
industrialisation des solutions sur un parc Infrastructure important et hétérogène ;
gestion des problématiques de corrélation, déduplication, priorisation, concurrence et scalabilité.
Le profil recherché
Profil recherché
Nous recherchons avant tout un profil disposant d'un solide background Infrastructure / Production / SRE / Ops, ayant ensuite développé une expérience concrète autour de l'IA appliquée à l'Infrastructure / AIOps.
Compétences recherchées :
Infrastructure : Linux, idéalement Windows Server, environnements on-premise/datacenter, VM/virtualisation, stockage, Kubernetes/containerisation, exploitation et gestion d'incidents ;
Observabilité : Elastic Stack / Elasticsearch / Elastic Observability, logs, métriques, traces, APM, monitoring, alerting et RCA ;
Automatisation : Python, APIs REST, GitLab CI/CD, Ansible, Infrastructure as Code ;
IA / AIOps : agents IA, LLM, RAG, tool calling, MCP, LangGraph/LangChain ou technologies équivalentes.
Une expérience de CheckMK, Nagios ou solutions équivalentes est appréciée.
Nous recherchons quelqu'un capable de raisonner à l'échelle d'un SI Infrastructure, notamment sur la corrélation et la déduplication d'un grand nombre d'événements avant de déclencher des investigations automatisées.
Il ne s'agit pas d'un poste de Data Scientist, Prompt Engineer ou développeur IA pur. Nous recherchons plutôt un Ingénieur Systèmes / Infrastructure / Production / SRE / Observabilité expérimenté ayant intégré l'IA et l'AIOps à ses pratiques.
Compétences requises
- Python
- API
- Intelligence artificielle
- Kubernetes
- Git
- Ansible
- Monitoring
- Nagios
- API REST