D6 · Harnais longue durée
Famille : Contexte et mémoire
Un agent prépare l’environnement, puis un autre avance une fonctionnalité à la fois sur plusieurs sessions.
Principe
Un agent initialisateur prépare l’environnement : script de démarrage, liste des fonctionnalités, fichier de progression, premier commit. Un agent de codage avance ensuite fonctionnalité par fonctionnalité, session après session, en laissant des traces structurées pour la suivante. Une variante sépare planificateur, générateur et évaluateur.
Le problème qu'il résout
Une tâche de plusieurs heures dépasse une fenêtre de contexte, et l’agent a tendance à en faire trop d’un coup puis à laisser un travail inachevé.
Quand l'utiliser
- Le travail dure plusieurs heures et s’étale sur plusieurs sessions : développement d’une application, intervention sur une grande base de code.
- Un oracle automatique, comme des tests, dit si chaque fonctionnalité est terminée : l’autonomie longue marche surtout dans ce cas.
Quand l'éviter
- La tâche tient dans une session : une simple boucle agentique (C1) suffit.
- Le harnais date d’un modèle plus faible : chaque composant encode une hypothèse sur ce que le modèle ne sait pas faire seul, à remettre en cause à chaque nouveau modèle.
Synonymes par éditeur
- Harnais pour agents de longue durée (initialisateur + agent de codage) (Anthropic (nov. 2025))
- Planificateur, générateur, évaluateur (Anthropic (mars 2026))
Patterns voisins
Sources
- Harness design for long-running application development — Anthropic (P. Rajasekaran), 2026-03-24
- Effective harnesses for long-running agents — Anthropic (J. Young), 2025-11-26
- Time Horizon 1.1 — METR, 2026-01-29
- Rakuten et Claude Code — Anthropic (étude client)
Contenu relu le 2026-10-02