AP80 · Coût mesuré au mauvais niveau
Famille : Supervision, exploitation et gouvernance
Preuve moyenne
Noms d'origine : cost blind spots
La dépense est suivie par appel ou par agent principal ; sous-agents, reprises et échecs passent sous le radar.
Définition
On suit la dépense par appel ou par agent principal, et non par tâche complète, sous-agents, nouvelles tentatives et sessions en échec compris.
Symptômes observables
- La somme des coûts suivis est inférieure à la facture.
- Les sessions en erreur n’ont pas de coût.
- Les sous-agents n’apparaissent pas dans la ventilation.
Pourquoi c'est nuisible
Les coûts cachés (sous-agents, échecs, reprises) sont justement ceux qui dérivent. On optimise ce qu’on voit.
Chiffres
- La documentation du Claude Agent SDK prévient que le champ `usage` sous-compte dès qu’il y a des sous-agents imbriqués, que les sessions en erreur ont consommé des tokens jusqu’à l’échec, et que `total_cost_usd` est une estimation côté client, pas une donnée de facturation.
- Le système de recherche multi-agent d’Anthropic consomme environ 15 fois plus de tokens qu’une conversation (mesure de l’éditeur).
Remèdes du catalogue
- D6 · Harnais longue durée — Le harnais tient la comptabilité de la tâche entière, sous-agents, reprises et échecs compris.
- F5 · Budgets et coupe-circuits — Le plafond porte sur le coût de la tâche, pas sur celui d’un appel isolé.
Mesures hors catalogue
- Mesurer le coût par tâche réussie, et le rapprocher chaque mois de l’API de facturation.
- Agréger les attributs d’usage OpenTelemetry par `gen_ai.conversation.id`.
Patterns détournés
Anti-patterns voisins
Sources
- Track cost and usage — Claude Agent SDK (documentation)
- How we built our multi-agent research system — Anthropic, 2025-06-13
Contenu relu le 2026-10-05