Claude Tag закрывает 65% PR команды Claude Code, а системный промпт ужали на 80%
Cat Wu и Thariq Shihipar из команды Claude Code в Anthropic на конференции AI Engineer World's Fair в июле 2026 года раскрыли внутреннюю кухню. Claude Tag — их новый ассистент в Slack — уже закрывает 65% инженерных PR команды. А системный промпт Claude Code сократили на 80%: новые модели Fable 5 и Opus 4.8 хуже работают с примерами и запретами «не делай X».
Processado por IA de Simon Willison; editado por Hamidun News
CatWu e Thariq Shihipar, da equipe do Claude Code na Anthropic, contaram na conferência AI Engineer World's Fair no início de julho de 2026 que a ferramenta interna deles, o ClaudeTag, já fecha 65% dos PRs de engenharia da equipe, e que o system prompt do Claude Code foi reduzido em 80%.
O que o ClaudeTag faz
O ClaudeTag é o Claude embutido diretamente nas ferramentas de equipe; foi lançado no Slack no início de julho de 2026. A principal diferença em relação ao Claude Code é que ele é multiusuário e proativo por padrão: ao ser adicionado a um canal do Slack, toda a equipe trabalha junto em um único PR, e o próprio bot fica de olho nos relatos de bugs e abre correções sem precisar ser acionado manualmente.
Segundo Cat Wu, a versão interna do ClaudeTag já fecha 65% dos PRs de product engineering da equipe do Claude Code — mais da metade de todos os PRs. O Claude Code, por sua vez, continua sendo o lugar para as tarefas interativas mais complexas, enquanto o ClaudeTag atua de forma proativa em segundo plano.
*ClaudeTag é uma integração colaborativa no Slack, lançada no início de julho de 2026
*Fecha 65% dos PRs de product engineering da equipe do Claude Code
*Multiusuário: toda a equipe trabalha em um único PR
*A memória da equipe é armazenada em um arquivo markdown por canal
*Roda em cima do automode — o mesmo mecanismo de segurança do Claude Code
Por que o system prompt foi reduzido em 80%
O system prompt do Claude Code foi reduzido em 80% porque os novos modelos — Fable 5 e Opus 4.8 — funcionam pior com um grande número de exemplos e proibições rígidas. Segundo Thariq Shihipar, a equipe vinha "super-restringindo" o Claude: remover exemplos trouxe um ganho perceptível, porque o modelo se mostrou mais criativo do que os modelos (templates) que lhe eram sugeridos.
A Anthropic agora mantém um system prompt diferente para cada modelo: apenas os modelos de fronteira (frontier) receberam o corte de 80% nos tokens, enquanto os modelos mais antigos mantiveram o prompt completo. Listas do tipo "não faça X, não faça Y" também prejudicam — um impulso forte de proibição entra em conflito com instruções posteriores do usuário e confunde o modelo.
A OpenAI dá um conselho parecido: segundo seus dados, system prompts mais "enxutos", numa amostra de execuções internas de co-agentes, elevaram a pontuação em 10–15% ao mesmo tempo em que reduziram os tokens em 41–66%.
Quão seguro é o automode
Segundo a equipe, o automode reduz os principais riscos — prompt injection e vazamento de dados — mais do que um revisor humano médio. Dentro da Anthropic, quase todos os funcionários o usam, e o próprio modo vem sendo testado desde janeiro de 2026; publicamente, está disponível desde 24 de março de 2026.
Funciona assim: a cada ação do Claude, um classificador separado baseado no Sonnet avalia a chamada da ferramenta e o contexto da conversa, incluindo permissões dinâmicas — por exemplo, "dê push no GitHub" ou "não dê push". A equipe rodou milhares de evals e contratou red teams externos para tentar provocar ações prejudiciais e, segundo eles, corrigiu todos os problemas encontrados.
«Praticamente todo mundo na Anthropic usa o automode.
É a melhor forma de manter sessões de trabalho longas no Claude Code continuando seguro.» — Cat Wu, equipe do Claude Code, Anthropic
É justamente o automode que torna o ClaudeTag possível: o bot lê o feedback dos usuários nos canais, o que abre uma quantidade enorme de vetores de ataque, e sem uma defesa em camadas múltiplas, tipo "queijo suíço", seria perigoso colocar um bot desses no ar no Slack.
O que isso significa
A Anthropic está cada vez mais tirando o humano do ciclo de revisão e confiando no julgamento dos próprios modelos. A redução dos prompts, os agentes proativos e o automode apontam numa mesma direção: as equipes de desenvolvimento estão passando do controle manual de cada etapa para delegar tarefas rotineiras e se dedicar a trabalhos mais ambiciosos.
«A única forma de compensar essa sensação de perda é se tornando mais ambicioso.» —
Thariq Shihipar, equipe do Claude Code, Anthropic
Perguntas frequentes
O que é o ClaudeTag?
O ClaudeTag é o Claude embutido nas ferramentas de equipe; foi lançado no Slack no início de julho de 2026. Ele é multiusuário e proativo: fica de olho nos relatos de bugs em um canal, abre PRs por conta própria e marca o engenheiro que mexeu por último naquele trecho de código.
Por que o system prompt do Claude Code foi reduzido em 80%?
Porque os novos modelos Fable 5 e Opus 4.8 funcionam pior com um grande número de exemplos e proibições rígidas do tipo "não faça X". A Anthropic removeu os exemplos e restrições desnecessários; para os modelos antigos, o prompt completo foi mantido.
Quão seguro é o automode?
Segundo a equipe, para os principais riscos — prompt injection e vazamentos de dados — ele é mais seguro do que um revisor humano médio. Dentro da Anthropic, o automode é usado desde janeiro de 2026, e milhares de evals já foram rodados com red teams externos.
Precisa de IA funcionando dentro da sua empresa — não só no feed de notícias?
Eu construo IA em produção para empresas — CRM sob medida, ferramentas internas, agentes autônomos, automação de processos. Pertence a você, moldada ao seu processo, sem taxa por usuário. Feito por Zhemal Khamidun, CPO da AlpinaGPT (plataforma de IA, 6.000+ usuários).
O essencial da IA — uma vez por semana
Sete histórias que realmente importaram, escolhidas a dedo. Sem ruído nem releases.
Pronto! Verifique seu e-mail para a confirmação.