L'ingénierie du contexte est le nouveau runtime

@harleyfoote_
ANGLAISil y a 1 jour · 27 juil. 2026
336K
169
21
9
25

TL;DR

L'article soutient que l'avenir du développement de l'IA réside dans l'ingénierie du contexte plutôt que dans le prompting complexe, en mettant l'accent sur la soustraction et la discipline architecturale pour construire des agents plus fiables.

Le prochain saut de Claude n'est pas une meilleure poésie de prompt. C'est une plomberie de contexte plus propre.

Le prompt n'est plus le produit

La ligne utile de l'analyse de l'ingénierie de contexte de Claude 5 est presque ennuyeuse : lorsque vous envoyez un message à Claude, le prompt ne représente qu'une petite partie de ce que le modèle reçoit. Le reste est assemblé à partir de prompts système, de Skills, de fichiers CLAUDE.md, de la mémoire et d'autres sources.

C'est le point opérationnel. L'interface ressemble toujours à une boîte de chat. La machine réelle est un système d'assemblage de contexte. Si vous construisez avec Claude Code ou vos propres agents, ce que vous livrez vraiment n'est pas une instruction astucieuse. C'est une architecture de contexte d'exécution.

Le génie du prompt fait de belles captures d'écran. La discipline du contexte fait que les systèmes se comportent bien sur de nombreuses requêtes. Moins glamour. Plus utile. Naturellement, moins viral.

Le contexte général est plus difficile que les prompts spécifiques

Un prompt peut être étroit. Un utilisateur demande une chose, vous orientez le modèle vers cette chose, et tout le monde fait comme si la démo était le produit. Le contexte est différent. L'article de CodeBun le formule clairement : le contexte est utilisé de manière générale sur de nombreuses requêtes, il ne peut donc pas être aussi spécifique.

C'est là que la plupart des constructions d'agents deviennent étranges. Les équipes continuent d'ajouter des instructions parce que chaque échec ressemble à une phrase manquante. Une règle de plus. Une politique de plus. Un exemple de plus. Bientôt, le modèle nage dans le tissu cicatriciel d'hier avant de pouvoir répondre à la question d'aujourd'hui.

La compétence difficile n'est pas d'écrire le paragraphe parfait. C'est de décider ce qui mérite d'être présent par défaut. L'ingénierie de contexte est une curation sous incertitude. Vous ne connaissez pas le prochain prompt utilisateur. Vous devez quand même décider ce que le modèle doit emporter avec lui.

Claude 5 a changé les mathématiques de compression

Le point de données le plus pertinent de la recherche : les ingénieurs d'Anthropic auraient supprimé plus de 80 % du prompt système de Claude Code pour les modèles Claude plus récents comme Claude Opus 5 et Claude Fable 5, sans perte mesurable sur leurs évaluations de codage.

Cela ne prouve pas que chaque long prompt est mauvais. Cela ne prouve pas que chaque workflow devrait supprimer 80 % de ses instructions d'ici vendredi. S'il vous plaît, ne transformez pas un résultat d'évaluation en religion. Nous en avons assez comme ça.

Mais cela dit quelque chose d'important : à mesure que les capacités des modèles s'améliorent, l'ancien échafaudage peut devenir un poids mort. Les instructions qui aidaient le modèle d'hier peuvent distraire le modèle d'aujourd'hui. Le modèle s'améliore ; votre contexte doit peut-être devenir plus petit.

La nouvelle compétence opérationnelle est la soustraction

La plupart des gens entendent "ingénierie de contexte" et pensent expansion : plus de fichiers, plus de mémoire, plus de contexte, plus d'outils, plus de règles. La leçon de Claude 5 va dans l'autre sens. Si une grande partie du prompt système de Claude Code pouvait disparaître sans nuire aux évaluations de codage, la question par défaut devrait passer de quoi d'autre devrions-nous ajouter ? à que pouvons-nous supprimer en toute sécurité ?

C'est la version opérationnelle du goût. Gardez le contexte qui améliore constamment les résultats sur de nombreuses requêtes. Coupez le contexte qui existe parce que quelqu'un a vu un échec et a appliqué un correctif de panique au prompt système.

Les meilleurs opérateurs d'IA ressembleront moins à des poètes du prompt et plus à des éditeurs, des bibliothécaires et des ingénieurs d'infrastructure. Ils maintiendront les fichiers CLAUDE.md, les Skills, les instructions système et la mémoire comme une couche de contexte vivante. Ils l'élagueront. Ils la testeront. Ils résisteront à l'amas d'instructions sacré de 4 000 mots que personne ne comprend mais que tout le monde craint de toucher.

Les agents rendent la dette de contexte coûteuse

C'est plus important pour les agents que pour les conversations ponctuelles. La recherche lie explicitement l'ingénierie de contexte à Claude Code et à la construction de vos propres agents. Dans un agent, le contexte n'est pas un seul message. Il fait partie de l'environnement d'exploitation.

Un mauvais contexte se cumule. Une règle système vague peut façonner l'utilisation des outils. Un souvenir obsolète peut orienter les décisions. Un fichier projet surchargé peut enterrer la seule instruction qui comptait. L'utilisateur voit un agent capricieux. Le véritable bug pourrait être la pile de contexte.

C'est pourquoi "prompting" est un mot trop petit. Les agents ont besoin de budgets de contexte, de sources de contexte et d'hygiène de contexte. Ils ont besoin de décisions sur ce qui est global, ce qui est local à la tâche, ce qui appartient à la mémoire, ce qui appartient à un fichier, et ce qui ne devrait pas être chargé du tout.

La gouvernance poussera dans la même direction

Le contexte réglementaire évolue également. La mise à jour des lois sur l'IA de Gunderson pour 2026 décrit un paysage de gouvernance en mutation, y compris les efforts fédéraux pour consolider la supervision de l'IA, de nouveaux cadres au Colorado et en Californie, et l'évolution des exigences internationales dans le cadre de la loi européenne sur l'IA. La Commission européenne décrit la loi sur l'IA comme un cadre juridique traitant des risques de l'IA.

Cela ne signifie pas que chaque fichier de contexte de Claude devient soudainement un artefact réglementaire. Cela signifie que les équipes IA auront plus de raisons de savoir ce que leurs systèmes reçoivent comme instructions, d'où provient ce contexte et comment il change.

En d'autres termes : l'ingénierie de contexte n'est pas seulement une optimisation des performances. C'est un contrôle opérationnel. Les équipes gagnantes ne seront pas celles avec les prompts les plus élaborés. Ce seront celles qui peuvent expliquer, tester et soustraire leur contexte sans casser le produit.

Qui est derrière tout ça

Je suis Harley Foote. Je construis des agents IA qui font du vrai travail — et j'essaie d'être en avance sur les changements qui comptent.

Deux choses auxquelles je crois à fond : heyfriday.app — un agent IA d'achat personnel qui apprend vos goûts ; et hermesshield.ai — la sécurité pour les agents IA, parce que dès qu'un agent peut agir en votre nom, il peut être attaqué.

Si vous construisez des agents, venez dire bonjour.

heyfriday.app · hermesshield.ai · linkedin.com/in/harley-lewis-foote-850177109

Remixer dans YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Pour les créateurs

Transformez votre Markdown en un article 𝕏 impeccable

Quand vous publiez vos propres textes longs, la mise en forme 𝕏 des images, tableaux et blocs de code est pénible. YouMind transforme un brouillon Markdown complet en un article 𝕏 impeccable, prêt à publier.

Essayer Markdown vers 𝕏

D'autres patterns à décoder

Articles viraux récents

Explorer plus d'articles viraux