20 hours ago
Valbonne, FranceSenior
Responsibilities
- Maintenir en conditions opérationnelles les systèmes et applications de production en optimisant leur disponibilité, performance et évolutivité.
- Automatiser les tâches répétitives ainsi que les processus de déploiement, de surveillance et d’alerting.
- Concevoir et mettre en œuvre des solutions pour améliorer la fiabilité et réduire le taux de pannes.
- Analyser les incidents et gérer les urgences afin de réduire le Mean Time To Recovery et d’accroître la résilience.
- Optimiser les performances, la capacité et les coûts des applications et de l’infrastructure.
- Collaborer avec les équipes de développement, d’infrastructure et d’opérations pour intégrer les pratiques DevOps et SRE.
- Créer et suivre des métriques de fiabilité et de performance, notamment les SLI, SLO et SLA.
- Assurer une veille technologique et améliorer continuellement les outils et processus SRE.
Requirements
- Expérience en ingénierie système avec Linux/Unix, gestion de serveurs, stockage et réseaux.
- Maîtrise des outils de monitoring et d’alerting tels que Prometheus, Grafana, Datadog et ELK Stack.
- Compétences en scripting avec Python ou Bash, en outils de CI/CD et en infrastructure-as-code.
- Expérience des environnements cloud, des architectures de microservices et des conteneurs.
- Compétences en administration et optimisation de bases de données SQL et NoSQL.
- Capacité à diagnostiquer et résoudre les pannes dans des environnements de production.
- Bonnes compétences de communication pour collaborer avec des équipes pluridisciplinaires et documenter les solutions.
- Une expérience comme ingénieur DevOps, ingénieur système ou développeur logiciel est un atout.
- La connaissance des pratiques DevOps, de l’observabilité, du monitoring, de la gestion des incidents et de la disponibilité est appréciée.
- Capacité à travailler efficacement sous pression lors d’incidents critiques.
Benefits
- CDI permanent à temps plein.
- Poste situé en Provence-Alpes-Côte d’Azur.
- Pas de possibilité de télétravail complet.
Tech Stack
AnsibleAWSAzureBashDatadogDockerGitHub ActionsGitLab CI/CDGoogle Cloud PlatformGrafanaJenkinsKubernetesLinuxPrometheusPythonSQLTerraform
Categories
Site Reliability
About ALTEN
ALTEN provides engineering and IT services, including R&D outsourcing, product development, and digital systems consulting for major industrial and service-sector companies. Founded in 1988 and headquartered in Boulogne-Billancourt, France, it operates in 30+ countries and is publicly traded on Euronext Paris. Revenue model based on consulting engagements, managed services, and turnkey project delivery across sectors such as aeronautics, automotive, telecom, energy, finance, and life sciences.
