Claude Tag закрывает 65% PR команды Claude Code, а системный промпт ужали на 80%
Cat Wu и Thariq Shihipar из команды Claude Code в Anthropic на конференции AI Engineer World's Fair в июле 2026 года раскрыли внутреннюю кухню. Claude Tag — их новый ассистент в Slack — уже закрывает 65% инженерных PR команды. А системный промпт Claude Code сократили на 80%: новые модели Fable 5 и Opus 4.8 хуже работают с примерами и запретами «не делай X».
Traité par IA depuis Simon Willison ; édité par Hamidun News
CatWu et Thariq Shihipar, de l'équipe Claude Code chez Anthropic, ont expliqué lors de la conférence AI Engineer World's Fair début juillet 2026 que leur outil interne ClaudeTag ferme déjà 65% des PR d'ingénierie de l'équipe, et que le system prompt de Claude Code a été réduit de 80%.
Ce que sait faire ClaudeTag
ClaudeTag, c'est Claude intégré directement dans les outils d'équipe ; il a été lancé sur Slack début juillet 2026. La principale différence avec Claude Code est qu'il est multi-utilisateur et proactif par défaut : une fois ajouté à un canal Slack, toute l'équipe travaille ensemble sur une seule PR, et le bot lui-même surveille les rapports de bugs et ouvre des correctifs sans invocation manuelle.
Selon Cat Wu, la version interne de ClaudeTag ferme déjà 65% des PR de product engineering de l'équipe Claude Code — plus de la moitié de toutes les PR. Claude Code reste quant à lui le lieu des tâches interactives les plus complexes, tandis que ClaudeTag travaille de manière proactive en arrière-plan.
*ClaudeTag est une intégration collaborative sur Slack, lancée début juillet 2026
*Ferme 65% des PR de product engineering de l'équipe Claude Code
*Multi-utilisateur : toute l'équipe travaille sur une seule PR
*La mémoire d'équipe est stockée dans un fichier markdown par canal
*Fonctionne au-dessus d'automode — le même mécanisme de sécurité que Claude Code
Pourquoi le system prompt a été réduit de 80%
Le system prompt de Claude Code a été réduit de 80% parce que les nouveaux modèles — Fable 5 et Opus 4.8 — fonctionnent moins bien avec un grand nombre d'exemples et d'interdictions strictes. Selon Thariq Shihipar, l'équipe avait « sur-contraint » Claude : supprimer des exemples a produit un gain notable, car le modèle s'est révélé plus créatif que les modèles (templates) qui lui étaient suggérés.
Anthropic maintient désormais un system prompt différent pour chaque modèle : seuls les modèles de pointe (frontier) ont reçu la réduction de 80% des tokens, tandis que les anciens modèles ont conservé le prompt complet. Les listes du type « ne fais pas X, ne fais pas Y » nuisent aussi — une forte impulsion d'interdiction entre en conflit avec des instructions ultérieures de l'utilisateur et perturbe le modèle.
OpenAI donne un conseil similaire : selon ses données, des system prompts plus « allégés », dans un échantillon d'exécutions internes de co-agents, ont fait grimper le score de 10–15% tout en réduisant les tokens de 41–66%.
Automode est-il sûr
Selon l'équipe, automode réduit les principaux risques — prompt injection et fuite de données — davantage qu'un relecteur humain moyen. En interne chez Anthropic, presque tous les employés l'utilisent, et le mode lui-même est testé depuis janvier 2026 ; il est disponible publiquement depuis le 24 mars 2026.
Voici comment ça fonctionne : à chaque action de Claude, un classificateur distinct basé sur Sonnet évalue l'appel d'outil et le contexte de la conversation, y compris des autorisations dynamiques — par exemple, « pousse sur GitHub » ou « ne pousse pas ». L'équipe a fait tourner des milliers d'evals et engagé des red teams externes pour tenter de provoquer des actions nuisibles, et affirme avoir corrigé tous les problèmes trouvés.
« Pratiquement tout le monde chez Anthropic utilise automode.
C'est la meilleure façon de mener de longues sessions de travail dans Claude Code tout en restant en sécurité. » — Cat Wu, équipe Claude Code, Anthropic
C'est précisément automode qui rend ClaudeTag possible : le bot lit les retours des utilisateurs dans les canaux, ce qui ouvre une multitude de vecteurs d'attaque, et sans une défense multicouche de type « gruyère », faire tourner un bot Slack pareil serait dangereux.
Ce que cela signifie
Anthropic retire de plus en plus l'humain de la boucle de relecture et s'appuie sur le jugement des modèles eux-mêmes. La réduction des prompts, les agents proactifs et automode pointent tous dans la même direction : les équipes de développement passent du contrôle manuel de chaque étape à la délégation des tâches routinières, pour se consacrer à des travaux plus ambitieux.
«
Le seul moyen de compenser ce sentiment de perte, c'est de devenir plus ambitieux. » — Thariq Shihipar, équipe Claude Code, Anthropic
Questions fréquentes
Qu'est-ce que ClaudeTag ?
ClaudeTag, c'est Claude intégré dans les outils d'équipe ; il a été lancé sur Slack début juillet 2026. Il est multi-utilisateur et proactif : il surveille les rapports de bugs dans un canal, ouvre lui-même des PR et tague l'ingénieur qui a touché en dernier cette portion de code.
Pourquoi le system prompt de
Claude Code a-t-il été réduit de 80% ?
Parce que les nouveaux modèles Fable 5 et Opus 4.8 fonctionnent moins bien avec un grand nombre d'exemples et d'interdictions strictes du type « ne fais pas X ». Anthropic a supprimé les exemples et restrictions superflus ; pour les anciens modèles, le prompt complet a été conservé.
Automode est-il sûr ?
Selon l'équipe, pour les principaux risques — prompt injection et fuites de données — il est plus sûr qu'un relecteur humain moyen. En interne chez Anthropic, automode est utilisé depuis janvier 2026, et des milliers d'evals ont été menées avec des red teams externes.
Besoin d'une IA qui travaille dans votre entreprise — pas seulement dans votre fil d'actualité?
Je construis de l'IA en production pour les entreprises — CRM sur mesure, outils internes, agents autonomes, automatisation des processus. Vous en êtes propriétaire, adaptée à votre processus, sans coût par utilisateur. Réalisé par Zhemal Khamidun, CPO d'AlpinaGPT (plateforme IA, 6 000+ utilisateurs).
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.