Supervision de workflows agentiques · Build & Run

Un agent en production dérive. Nous le surveillons pour vous

Les données changent, les modèles changent, les coûts dérapent - et un agent qui répondait juste en janvier répond faux en juin sans que rien n'ait planté. Nous supervisons vos workflows agentiques en continu : coût par requête, taux d'échec, dérive de la qualité des réponses, conformité. Un abonnement mensuel, pas un projet.

Ils nous ont fait confiance
Abonnement mensuel
3 000 €

HT/mois, à partir de. Le palier dépend du nombre de workflows supervisés et du volume.

Engagement
6 mois, puis mensuel · préavis 2 mois
Mise en place
2 à 3 semaines d'instrumentation avant la première facture
Parler de votre run

Nous supervisons aussi des systèmes que nous n'avons pas construits.

Ce que nous surveillons

  • Coût par requête et par workflow, avec alerte sur dépassement de seuil
  • Taux d'échec, taux de reprise, latence de bout en bout
  • Dérive de la qualité des réponses, mesurée sur un jeu de tests versionné
  • Consommation des garde-fous : refus, échappements, appels d'outils inattendus
  • Traçabilité des décisions et journal de conformité AI Act
  • Santé des connecteurs MCP et des sources RAG (fraîcheur, couverture, erreurs)
  • Revue mensuelle d’une heure avec vos équipes
  • Mise à jour des garde-fous et des jeux de tests au fil des évolutions

Ce que vous avez en permanence

  • Un tableau de bord accessible à vos équipes
  • Un rapport mensuel écrit : coûts, incidents, dérive, décisions
  • Des SLO définis avec vous, et mesurés
  • Un architecte identifié, joignable, qui connaît votre système

Ce qui n'est pas inclus

  • Pas de développement de nouvelles fonctionnalités
  • Pas d'infogérance de l'ensemble de votre infrastructure
  • Pas de support utilisateur final de niveau 1
  • Pas d'astreinte 24/7 par défaut - voir la FAQ
Le constat

Ce qui casse après la mise en production

Une mise en production réussie n'est pas une fin : c'est le début de la période où les choses se dégradent lentement, sans alerte. Aucun de ces problèmes ne déclenche une erreur 500 - et c'est exactement pour cela qu'ils passent inaperçus pendant des mois.

Le coût par requête triple après un changement de modèle, personne ne le voit
La qualité des réponses baisse à mesure que les données de référence vieillissent
Un agent obtient des droits élargis lors d'une évolution, et les garde
Les garde-fous sont contournés par des formulations que personne n’avait prévues
Le jeu de tests n'a pas été mis à jour depuis la livraison, il ne détecte plus rien
Personne ne peut reconstituer pourquoi un agent a pris telle décision il y a trois mois
Notre méthodologie

Comment nous livrons

Des architectes de vingt ans de métier, un delivery instrumenté par l'IA : cadrage, revue de code, qualité et sécurité outillés à chaque phase. Chaque étape produit des livrables concrets, et nous restons présents en run.

01 2 à 3 semaines

Instrumentation

Avant de superviser, il faut mesurer. Nous instrumentons vos workflows et définissons avec vous ce qui constitue une anomalie - un seuil que personne n'a fixé ne déclenche jamais rien.

Livrables
  • Traçage de bout en bout des chaînes agentiques
  • Jeu de tests de référence, versionné comme du code
  • Seuils de coût, de latence et de taux d’échec définis avec vos équipes
  • SLO écrits et validés
  • Tableau de bord en place et accessible
02 Semaine 3

Mise sous supervision

Bascule en supervision continue. L'alerting est branché sur vos canaux, pas sur les nôtres : vous voyez ce que nous voyons, au même moment.

Livrables
  • Alerting branché sur vos canaux (Slack, Teams, PagerDuty ou email)
  • Procédure d’escalade écrite, avec les interlocuteurs nommés
  • Première mesure de référence des coûts et de la qualité
  • Runbook des incidents connus
03 Continu

Le rythme mensuel

Chaque mois : un rapport écrit et une heure de revue. Le rapport arrive avant la réunion, pour que l'heure serve à décider et non à découvrir.

Livrables
  • Rapport mensuel : coûts, incidents, dérive mesurée, décisions à prendre
  • Revue d’une heure avec vos équipes
  • Mise à jour des garde-fous et du jeu de tests
  • Arbitrages d’optimisation chiffrés (FinOps IA)
04 Tous les 3 mois

La revue trimestrielle

Un pas de recul sur l'architecture elle-même : ce qui doit évoluer, ce qui coûte trop cher pour ce qu'il rapporte, ce qui devrait être arrêté.

-40%coûts cloud
Livrables
  • Revue d’architecture et de dette accumulée
  • Recommandations d’évolution chiffrées
  • Revue de conformité et mise à jour du dossier AI Act
  • Bilan des SLO sur le trimestre
Valeur business

Ce que vous gagnez concrètement

Résultats attendus

La dérive se voit avant vos utilisateurs

Le coût redevient pilotable

La conformité reste à jour

La dérive se voit avant vos utilisateurs

Un jeu de tests versionné, exécuté en continu, détecte une baisse de qualité des réponses pendant qu'elle est encore corrigeable - pas quand le métier remonte des plaintes.

Le coût redevient pilotable

Coût par requête et par workflow, avec alerte au dépassement. L'écart entre deux implémentations de la même fonction peut atteindre un facteur douze ; encore faut-il le mesurer.

La conformité reste à jour

Le journal de traçabilité et le dossier AI Act sont tenus au fil de l'eau. Un questionnaire fournisseur se répond en une journée, pas en trois semaines de reconstitution.

Un architecte, pas un centre de services

La même personne qui a conçu ou audité votre système le supervise. Pas de ticket qui remonte trois niveaux avant d'atteindre quelqu'un qui comprend l'architecture.

Questions fréquentes

Vos questions, nos réponses

01 Pouvez-vous superviser un système que vous n'avez pas construit ?
Oui, et c'est fréquent. Nous passons alors par un diagnostic préalable - deux semaines pour comprendre l'existant et l'instrumenter correctement. Superviser un système qu'on ne comprend pas revient à regarder des graphiques sans savoir ce qu'ils signifient.
02 Assurez-vous une astreinte 24/7 ?
Pas dans l'abonnement de base, et nous préférons le dire clairement plutôt que de le sous-entendre. La supervision est continue, mais l'intervention humaine se fait en heures ouvrées avec un engagement de prise en charge. Une astreinte étendue se contractualise à part, en fonction de vos SLO réels - beaucoup d'organisations la paient sans en avoir l'usage.
03 Que se passe-t-il concrètement quand un agent dérive ?
L'alerte part sur vos canaux et les nôtres en même temps. Nous qualifions, nous documentons, et nous vous proposons un arbitrage : correctif immédiat, restriction temporaire du périmètre de l'agent, ou retour à la version précédente. La décision reste la vôtre - nous ne modifions pas un système en production sans votre accord.
04 Pourquoi un abonnement plutôt que des interventions ponctuelles ?
Parce que la dérive est continue et l'intervention ponctuelle arrive toujours après. Un forfait à la demande vous ferait payer les incidents ; l'abonnement paie leur absence. Si sur six mois vous n'avez eu ni incident ni dépassement de coût, l'abonnement a fait son travail.
05 Et si nous voulons arrêter ?
Engagement initial de six mois, puis mensuel avec deux mois de préavis. À la sortie, vous gardez tout : instrumentation, jeux de tests, tableaux de bord, runbooks et documentation. Rien n'est hébergé chez nous d'une manière qui vous rendrait captifs.
06 Le prix dépend de quoi exactement ?
Du nombre de workflows supervisés, du volume de requêtes, et du niveau de SLO retenu. 3 000 € par mois correspond à un système en production avec un à deux workflows et un volume modéré. Le palier est fixé après l'instrumentation, jamais avant : chiffrer une supervision sans avoir mesuré serait deviner.

Qui surveille vos agents en ce moment ?

Si la réponse est « personne » ou « on regarde les logs quand ça remonte », parlons-en trente minutes. Nous vous dirons si une supervision se justifie à votre stade.