Simon Willison→ original

Claude Tag закрывает 65% PR команды Claude Code, а системный промпт ужали на 80%

Cat Wu и Thariq Shihipar из команды Claude Code в Anthropic на конференции AI Engineer World's Fair в июле 2026 года раскрыли внутреннюю кухню. Claude Tag — их новый ассистент в Slack — уже закрывает 65% инженерных PR команды. А системный промпт Claude Code сократили на 80%: новые модели Fable 5 и Opus 4.8 хуже работают с примерами и запретами «не делай X».

Processado por IA de Simon Willison; editado por Hamidun News
Claude Tag закрывает 65% PR команды Claude Code, а системный промпт ужали на 80%
Fonte: Simon Willison. Colagem: Hamidun News.
◐ Ouvir artigo

CatWu e Thariq Shihipar, da equipe do Claude Code na Anthropic, contaram na conferência AI Engineer World's Fair no início de julho de 2026 que a ferramenta interna deles, o ClaudeTag, já fecha 65% dos PRs de engenharia da equipe, e que o system prompt do Claude Code foi reduzido em 80%.

O que o ClaudeTag faz

O ClaudeTag é o Claude embutido diretamente nas ferramentas de equipe; foi lançado no Slack no início de julho de 2026. A principal diferença em relação ao Claude Code é que ele é multiusuário e proativo por padrão: ao ser adicionado a um canal do Slack, toda a equipe trabalha junto em um único PR, e o próprio bot fica de olho nos relatos de bugs e abre correções sem precisar ser acionado manualmente.

Segundo Cat Wu, a versão interna do ClaudeTag já fecha 65% dos PRs de product engineering da equipe do Claude Code — mais da metade de todos os PRs. O Claude Code, por sua vez, continua sendo o lugar para as tarefas interativas mais complexas, enquanto o ClaudeTag atua de forma proativa em segundo plano.

*ClaudeTag é uma integração colaborativa no Slack, lançada no início de julho de 2026

*Fecha 65% dos PRs de product engineering da equipe do Claude Code

*Multiusuário: toda a equipe trabalha em um único PR

*A memória da equipe é armazenada em um arquivo markdown por canal

*Roda em cima do automode — o mesmo mecanismo de segurança do Claude Code

Por que o system prompt foi reduzido em 80%

O system prompt do Claude Code foi reduzido em 80% porque os novos modelos — Fable 5 e Opus 4.8 — funcionam pior com um grande número de exemplos e proibições rígidas. Segundo Thariq Shihipar, a equipe vinha "super-restringindo" o Claude: remover exemplos trouxe um ganho perceptível, porque o modelo se mostrou mais criativo do que os modelos (templates) que lhe eram sugeridos.

A Anthropic agora mantém um system prompt diferente para cada modelo: apenas os modelos de fronteira (frontier) receberam o corte de 80% nos tokens, enquanto os modelos mais antigos mantiveram o prompt completo. Listas do tipo "não faça X, não faça Y" também prejudicam — um impulso forte de proibição entra em conflito com instruções posteriores do usuário e confunde o modelo.

A OpenAI dá um conselho parecido: segundo seus dados, system prompts mais "enxutos", numa amostra de execuções internas de co-agentes, elevaram a pontuação em 10–15% ao mesmo tempo em que reduziram os tokens em 41–66%.

Quão seguro é o automode

Segundo a equipe, o automode reduz os principais riscos — prompt injection e vazamento de dados — mais do que um revisor humano médio. Dentro da Anthropic, quase todos os funcionários o usam, e o próprio modo vem sendo testado desde janeiro de 2026; publicamente, está disponível desde 24 de março de 2026.

Funciona assim: a cada ação do Claude, um classificador separado baseado no Sonnet avalia a chamada da ferramenta e o contexto da conversa, incluindo permissões dinâmicas — por exemplo, "dê push no GitHub" ou "não dê push". A equipe rodou milhares de evals e contratou red teams externos para tentar provocar ações prejudiciais e, segundo eles, corrigiu todos os problemas encontrados.

«Praticamente todo mundo na Anthropic usa o automode.

É a melhor forma de manter sessões de trabalho longas no Claude Code continuando seguro.» — Cat Wu, equipe do Claude Code, Anthropic

É justamente o automode que torna o ClaudeTag possível: o bot lê o feedback dos usuários nos canais, o que abre uma quantidade enorme de vetores de ataque, e sem uma defesa em camadas múltiplas, tipo "queijo suíço", seria perigoso colocar um bot desses no ar no Slack.

O que isso significa

A Anthropic está cada vez mais tirando o humano do ciclo de revisão e confiando no julgamento dos próprios modelos. A redução dos prompts, os agentes proativos e o automode apontam numa mesma direção: as equipes de desenvolvimento estão passando do controle manual de cada etapa para delegar tarefas rotineiras e se dedicar a trabalhos mais ambiciosos.

«A única forma de compensar essa sensação de perda é se tornando mais ambicioso.» —

Thariq Shihipar, equipe do Claude Code, Anthropic

Perguntas frequentes

O que é o ClaudeTag?

O ClaudeTag é o Claude embutido nas ferramentas de equipe; foi lançado no Slack no início de julho de 2026. Ele é multiusuário e proativo: fica de olho nos relatos de bugs em um canal, abre PRs por conta própria e marca o engenheiro que mexeu por último naquele trecho de código.

Por que o system prompt do Claude Code foi reduzido em 80%?

Porque os novos modelos Fable 5 e Opus 4.8 funcionam pior com um grande número de exemplos e proibições rígidas do tipo "não faça X". A Anthropic removeu os exemplos e restrições desnecessários; para os modelos antigos, o prompt completo foi mantido.

Quão seguro é o automode?

Segundo a equipe, para os principais riscos — prompt injection e vazamentos de dados — ele é mais seguro do que um revisor humano médio. Dentro da Anthropic, o automode é usado desde janeiro de 2026, e milhares de evals já foram rodados com red teams externos.

ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Precisa de IA funcionando dentro da sua empresa — não só no feed de notícias?

Eu construo IA em produção para empresas — CRM sob medida, ferramentas internas, agentes autônomos, automação de processos. Pertence a você, moldada ao seu processo, sem taxa por usuário. Feito por Zhemal Khamidun, CPO da AlpinaGPT (plataforma de IA, 6.000+ usuários).

O que você acha?
Carregando comentários…