AP80 · Coût mesuré au mauvais niveau

Famille : Supervision, exploitation et gouvernance

Preuve moyenne

Noms d'origine : cost blind spots

La dépense est suivie par appel ou par agent principal ; sous-agents, reprises et échecs passent sous le radar.

Définition

On suit la dépense par appel ou par agent principal, et non par tâche complète, sous-agents, nouvelles tentatives et sessions en échec compris.

Symptômes observables

  • La somme des coûts suivis est inférieure à la facture.
  • Les sessions en erreur n’ont pas de coût.
  • Les sous-agents n’apparaissent pas dans la ventilation.

Pourquoi c'est nuisible

Les coûts cachés (sous-agents, échecs, reprises) sont justement ceux qui dérivent. On optimise ce qu’on voit.

Chiffres

  • La documentation du Claude Agent SDK prévient que le champ `usage` sous-compte dès qu’il y a des sous-agents imbriqués, que les sessions en erreur ont consommé des tokens jusqu’à l’échec, et que `total_cost_usd` est une estimation côté client, pas une donnée de facturation.
  • Le système de recherche multi-agent d’Anthropic consomme environ 15 fois plus de tokens qu’une conversation (mesure de l’éditeur).

Remèdes du catalogue

Mesures hors catalogue

  • Mesurer le coût par tâche réussie, et le rapprocher chaque mois de l’API de facturation.
  • Agréger les attributs d’usage OpenTelemetry par `gen_ai.conversation.id`.

Patterns détournés

Anti-patterns voisins

Sources

Contenu relu le 2026-10-05

Catalogue des anti-patterns