Cloud Platform Engineer

STACKEASE
STACKEASE

Software Engineering

Marseille, France

Posted on Aug 28, 2026

Contexte

La transition énergétique vers un réseau électrique décarboné pose des défis considérables. L'intégration croissante des énergies renouvelables exige des solutions de stockage performantes et des mécanismes robustes d'équilibrage du réseau. Les batteries permettent d’intégrer les ENR au réseau, mais leur exploitation et leur optimisation sont complexes. En effet, une batterie peut générer des revenus via différents mécanismes, chacun présentant des spécificités propres mais aucun de ces mécanismes, pris isolément, ne garantit la viabilité économique du système. Afin d'assurer la rentabilité et d'accélérer le déploiement de ces technologies, il est nécessaire d’opérer et d’optimiser la batterie dans un contexte global.

StackEase relève ce défi en ayant développé des algorithmes qui maximisent le revenu net des batteries en fonction des prix de marchés et des contraintes physiques de chaque site. Les produits proposés sont du conseil en générant des prévisions de revenus long terme, et des opérations en optimisant en temps réel les actifs qui nous sont confiés.

Les opérations consistent à définir les ordres correspondant à l’utilisation la plus performante de chaque batterie, puis à les passer sur les marchés de l’électricité. En fonction de l’acceptation des marchés il faut alors piloter la batterie via notre serveur edge installé localement. Nous avons débuté les opérations cette année et nous cherchons à les industrialiser.

À propos de StackEase

StackEase est une spin-off deeptech issue de l'INRIA (Institut National de Recherche en Informatique et en Automatique). Basés à Paris et Marseille, nous réunissons des talents passionnés par l'innovation technologique. Nos valeurs sont l'innovation, l'excellence opérationnelle, la satisfaction client, la méritocratie et un engagement durable.

Missions

Administrer et fiabiliser notre infrastructure AWS

  • Exploiter et optimiser nos clusters ECS sur EC2 : diagnostiquer les problématiques liées aux instances, aux conteneurs et aux ressources disponibles.
  • Gérer et anticiper les besoins de capacité (autoscaling, mémoire, stockage, disponibilité) et analyser les performances de l'infrastructure.
  • Administrer les composants réseau : VPC, subnets, routage, DNS, VPN, security groups.
  • Gérer les services associés : RDS, S3, CloudWatch, IAM, Secrets Manager, etc.
  • Renforcer la sécurité de l'infrastructure et du réseau : segmentation, contrôle des flux, gestion des accès, durcissement des configurations et application du principe de moindre privilège.
  • Participer au dimensionnement de l'infrastructure et à l'optimisation des coûts AWS.

Améliorer l'exploitation, la résilience et l'observabilité

  • Définir et faire évoluer notre stack d'observabilité (métriques, logs, dashboards, alertes) pour détecter, comprendre et diagnostiquer rapidement les dégradations et incidents.
  • Diagnostiquer les incidents en production, mener les analyses de causes racines et mettre en œuvre les actions correctives permettant d'éviter leur récurrence.
  • Définir et améliorer les mécanismes de sauvegarde, restauration et reprise après incident, afin de renforcer la résilience et la continuité de service de la plateforme.
  • Formaliser les procédures d'exploitation, runbooks et outils de diagnostic.

Industrialiser la plateforme et les déploiements

  • Maintenir et améliorer notre Infrastructure as Code (AWS CDK / TypeScript).
  • Maintenir et améliorer nos pipelines GitHub Actions.
  • Développer des scripts et outils d'automatisation, principalement en Bash et Python, pour automatiser les opérations récurrentes et réduire les interventions manuelles.
  • Améliorer les mécanismes de déploiement, rollback et gestion des environnements.
  • Maintenir et faire évoluer notre instance Apache Airflow auto-hébergée sur ECS.

Développer les services et intégrations de la plateforme

  • Développer et maintenir des APIs et services en Python nécessaires au fonctionnement et à l'exploitation de la plateforme.
  • Concevoir des intégrations avec les systèmes d'information de nos clients et partenaires : APIs, échanges de fichiers et autres interfaces automatisées.
  • Développer des jobs et workflows permettant d'orchestrer des traitements internes et externes, notamment des traitements asynchrones sur AWS.
  • Garantir la robustesse de ces intégrations : authentification, gestion des erreurs, retries, timeouts, idempotence, logs, monitoring et tests.
  • Participer à la définition des interfaces et des protocoles d'échange avec nos partenaires.

Profil recherché

Vous disposez d'au moins 5 ans d'expérience sur des problématiques d'infrastructure, systèmes, DevOps ou dans un domaine comparable.

Nous cherchons avant tout une personne disposant d'un solide socle en cloud, systèmes et réseau, mais également à l'aise avec le développement logiciel en Python. Vous serez amené à développer aussi bien des outils d'automatisation que des services et intégrations avec des systèmes externes. Une expérience IoT / edge constitue un plus, mais n'est pas indispensable.

Vous définirez les bonnes pratiques et les évolutions nécessaires, tout en restant directement impliqué dans leur mise en œuvre et dans la résolution des problèmes rencontrés en production.

Compétences importantes

  • Bonne maîtrise de Linux et du diagnostic système.
  • Solides connaissances en réseau : TCP/IP, DNS, routage, VPN, firewall.
  • Expérience significative sur AWS.
  • Bonne maîtrise de Docker et des environnements conteneurisés.
  • Expérience significative de l'exploitation en production d'une plateforme d'orchestration de conteneurs ; une expérience d'AWS ECS sur EC2 est particulièrement appréciée.
  • Bonne maîtrise de l'Infrastructure as Code.
  • Bonne maîtrise de Git et des workflows de développement collaboratif.
  • Bonne maîtrise de Python et capacité à développer des services, APIs et outils maintenables en production, avec de bonnes pratiques de tests et de qualité de code.
  • Expérience du développement d'APIs HTTP/REST et de l'intégration de services externes.
  • Bonne compréhension des problématiques d'intégration entre systèmes : authentification, échanges de données et de fichiers, traitements asynchrones, gestion des erreurs, retries, timeouts et idempotence.
  • Bonne pratique du scripting système, notamment en Bash.
  • Expérience du monitoring, de l'observabilité, du diagnostic et de la gestion d'incidents en production.
  • Bonne compréhension des problématiques de sécurité système, réseau et cloud.

Compétences appréciées

  • Expérience IoT / Edge Computing et gestion de flottes d'équipements Linux.
  • AWS IoT Core.
  • MQTT et architectures de messagerie asynchrone / event-driven.
  • AWS CDK / TypeScript.
  • GitHub Actions.
  • Apache Airflow.
  • PostgreSQL / RDS.
  • Grafana ou autres outils d'observabilité.

Avantages

  • Rémunération compétitive.
  • Opportunité de travailler sur des projets stimulants à fort impact sur le secteur de l'énergie.
  • Environnement de travail collaboratif favorisant l'innovation et l'évolution professionnelle.
  • Télétravail jusqu'à 2 jours par semaine.

Nous attendons votre candidature ainsi que vos motivations pour nous rejoindre à jobs@stackease.ai. Si vous ne pensez pas avoir toutes les compétences requises n’hésitez pas à postuler tout de même, nous étudierons votre candidature.