Claude Code a réduit son prompt. Vos agents IA ont peut-être besoin du même audit
Le chiffre de 80% ne justifie pas la suppression des garde-fous. Il impose surtout une vraie architecture de contexte.
Anthropic a publié le 24 juillet de nouvelles règles de context engineering pour Claude 5. Le chiffre qui a fait réagir est simple: l'équipe Claude Code dit avoir supprimé plus de 80% de son system prompt pour Claude Opus 5 et Claude Fable 5, sans perte mesurable dans ses évaluations internes de code.

C'est un signal fort pour les équipes qui ont passé l'année à empiler des règles dans CLAUDE.md, AGENTS.md, des Skills, de la mémoire et des templates. Une partie de cette protection peut désormais ralentir l'agent au lieu de l'aider.
La conclusion n'est pas de tout supprimer. Il faut plutôt traiter le contexte comme une architecture: ce que l'agent voit au départ, ce qu'il charge à la demande, quels outils il peut appeler, ce que la mémoire conserve, et quelles limites doivent être imposées par le système plutôt que par une phrase.
Le prompt engineering portait surtout sur la formulation. Le context engineering englobe system prompts, règles de dépôt, outils, mémoire, fichiers récupérés, historique et serveurs MCP. Plus de contexte peut aussi créer du bruit, des contradictions et une consommation inutile de tokens.
L'audit commence par les règles évidentes. Supprimez ce que l'agent peut lire lui-même dans le dépôt, les doublons, les vieilles consignes écrites pour des modèles plus faibles, et les interdictions globales qui devraient dépendre du code environnant.
Gardez les contraintes réelles: secrets, production, données clients, paiements, déploiements, migrations destructives. Mais ces contraintes doivent aussi exister dans les permissions, les sandboxes, les dry runs, les logs, la CI et les validations humaines.
La discussion Hacker News, 332 points et 219 commentaires au moment de la vérification, montre bien le conflit: moins de microgestion peut aider, mais "use your judgement" n'est pas une politique de sécurité.
La bonne réponse est de mesurer. Comparez taux de réussite, tokens, latence, appels d'outils, corrections humaines, tests et incidents. Un agent mature n'a pas le plus long prompt. Il a une architecture de contexte que l'équipe peut maintenir.
Comments
Sign in to comment.
No comments yet.