Éditeur de logiciel vidéo

Kubernetes air-gapped embarqué dans des camions, partout dans le monde

Un éditeur de logiciel vidéo voulait faire tourner sa plateforme dans des camions déployés aux quatre coins du monde, sans aucune connexion Internet. Son équipe n’avait aucune expérience de Kubernetes. Six mois plus tard, la plateforme tournait en autonomie, et le client la fait encore évoluer aujourd’hui.

Le point de départ

Des serveurs configurés à la main, autour d’une ébauche de cluster Docker Swarm. Le résultat ne répondait à aucune des attentes, et l’équipe devait développer elle-même une bonne partie de ce qu’un orchestrateur moderne fournit de base : redémarrage des services, mise à l’échelle, gestion de la configuration.

Nous sommes intervenus en sous-traitance du partenaire logiciel du client.

Le défi

Faire tourner Kubernetes sans Internet, à l’installation comme en exploitation, à une époque où ni les outils ni la documentation ne couvraient ce cas :

  • installer sans accès aux dépôts publics ;
  • héberger une registry d’images locale, jusqu’aux images système qu’on oublie, comme l’image pause de chaque pod ;
  • mettre à jour sans connexion ;
  • le tout pour une équipe qui découvrait l’orchestration de conteneurs.

Le moment critique

Kubespray ne prévoyait presque rien pour l’air-gap, et les erreurs apparaissaient tard, parfois loin dans les tests. Chaque correction en révélait une nouvelle, au point que livrer dans les délais a semblé hors de portée.

Nous avons changé de méthode : construction de la plateforme entièrement automatisée, échec rapide dès le poste du développeur, et une suite de tests très complète qui bloquait les régressions et raccourcissait fortement la boucle de retour.

Ce que nous avons livré

  • Un cluster Kubernetes sur mesure, 100 % hors ligne : Kubespray, containerd, local-path-provisioner pour le stockage, registry Docker embarquée.
  • Une plateforme entièrement déclarative : chaque déploiement est un playbook Ansible versionné dans Git et appliqué automatiquement. Le client peut la reconstruire et la faire évoluer seul.
  • La mise à l’échelle : sans toucher au logiciel propriétaire du client, son application encaisse une charge nettement plus lourde.

Résultat

Une plateforme autonome, déployée dans des camions partout dans le monde. Le client l’a reprise en main et continue d’itérer dessus, plusieurs années après. Il aurait voulu que nous restions.

« Sans vous, on n’y serait jamais arrivés. »

Si c’était à refaire en 2026

L’écosystème a mûri. Nous partirions aujourd’hui sur Talos Linux, un OS immuable pensé pour Kubernetes, Cilium pour le réseau et la sécurité, et CloudNativePG pour les bases de données. L’approche resterait la même : tout déclaratif, tout testé, rien à la main.

Autres cas clients

  • Institution financière

    Landing zone AWS sécurisée

    Contexte
    Des équipes qui partaient dans le cloud en ordre dispersé : des comptes créés au cas par cas, sans organisation centrale ni moindre privilège.
    Intervention
    Landing zone AWS (Organizations, Control Tower, Terraform), SSO intégré au système d’identité de l’entreprise, et guardrails qui appliquent automatiquement les règles internes.
    Résultat
    Une posture de sécurité transformée, et le socle cloud de toute l’organisation, qui continue d’accueillir de nouveaux services.
    Lire le cas complet — Landing zone AWS sécurisée
  • Startup de la santé

    IA souveraine on-premise

    Contexte
    Des volumes de retours clients devenus ingérables, et des données médicales qui ne peuvent en aucun cas quitter l’entreprise.
    Intervention
    LLM open-weight sur du matériel on-premise orchestré sur mesure, RAG sur les bases internes, et serveurs MCP développés pour interroger les logiciels métier.
    Résultat
    En production, plusieurs heures gagnées par dossier, et un MVP livré aux deux tiers du budget estimé.
    Lire le cas complet — IA souveraine on-premise
  • Fournisseur de services IT

    Observabilité open source pour 1 500 services

    Contexte
    Une supervision propriétaire à bout de souffle : impossible de regrouper les signaux ou de modéliser les dépendances, des lenteurs, et une quinzaine d’incidents par jour.
    Intervention
    Plateforme d’observabilité hautement disponible (OpenTelemetry, Mimir, VictoriaMetrics, Loki, Tempo), service discovery, et sondes sur mesure compatibles Prometheus.
    Résultat
    De quinze incidents par jour à un ou deux par mois, et des équipes de garde qui ne sont presque plus réveillées la nuit.
    Lire le cas complet — Observabilité open source pour 1 500 services

Contact

Un projet du même genre ?

Décrivez-nous votre contexte. Nous vous répondons sous deux jours ouvrables, avec un premier avis concret.

Vous préférez le direct ?

contact@okko.be