Claude Tag закрывает 65% PR команды Claude Code, а системный промпт ужали на 80%
Cat Wu и Thariq Shihipar из команды Claude Code в Anthropic на конференции AI Engineer World's Fair в июле 2026 года раскрыли внутреннюю кухню. Claude Tag — их новый ассистент в Slack — уже закрывает 65% инженерных PR команды. А системный промпт Claude Code сократили на 80%: новые модели Fable 5 и Opus 4.8 хуже работают с примерами и запретами «не делай X».
Procesado por IA desde Simon Willison; editado por Hamidun News
CatWu y Thariq Shihipar, del equipo de Claude Code en Anthropic, contaron en la conferencia AI Engineer World's Fair de principios de julio de 2026 que su herramienta interna ClaudeTag ya cierra el 65% de las PR de ingeniería del equipo, y que el system prompt de Claude Code se redujo en un 80%.
Qué puede hacer ClaudeTag
ClaudeTag es Claude integrado directamente en las herramientas de equipo; se lanzó en Slack a principios de julio de 2026. La principal diferencia con Claude Code es que es multijugador y proactivo por defecto: al añadirlo a un canal de Slack, todo el equipo trabaja junto en una misma PR, y el propio bot vigila los reportes de errores y abre correcciones sin necesidad de invocación manual.
Según Cat Wu, la versión interna de ClaudeTag ya cierra el 65% de las PR de product engineering del equipo de Claude Code — más de la mitad de todas las PR. Claude Code, por su parte, sigue siendo el lugar para las tareas interactivas más complejas, mientras que ClaudeTag trabaja de forma proactiva en segundo plano.
*ClaudeTag es una integración colaborativa en Slack, lanzada a principios de julio de 2026
*Cierra el 65% de las PR de product engineering del equipo de Claude Code
*Multijugador: todo el equipo trabaja sobre una misma PR
*La memoria del equipo se guarda en un archivo markdown por cada canal
*Funciona sobre automode — el mismo mecanismo de seguridad que Claude Code
Por qué el system prompt se redujo en un 80%
El system prompt de Claude Code se redujo en un 80% porque los nuevos modelos —Fable 5 y Opus 4.8— funcionan peor con un gran número de ejemplos y prohibiciones estrictas. Según Thariq Shihipar, el equipo había estado "sobre-restringiendo" a Claude: quitar ejemplos produjo una mejora notable, porque el modelo resultó ser más creativo que las plantillas que se le habían sugerido.
Anthropic mantiene ahora un system prompt distinto para cada modelo: solo los modelos de frontera recibieron el recorte del 80% de tokens, mientras que los modelos antiguos conservaron el prompt completo. Las listas de "no hagas X, no hagas Y" también perjudican — un impulso de prohibición fuerte entra en conflicto con instrucciones posteriores del usuario y confunde al modelo.
OpenAI da un consejo similar: según sus datos, los system prompts más "ligeros", en una muestra de ejecuciones internas de co-agentes, elevaron la puntuación en un 10–15% al tiempo que reducían los tokens en un 41–66%.
Qué tan seguro es automode
Según el equipo, automode reduce los principales riesgos —prompt injection y fuga de datos— más que un revisor humano promedio. Dentro de Anthropic lo usa casi todo el personal, y el propio modo se ha estado probando desde enero de 2026; está disponible públicamente desde el 24 de marzo de 2026.
Funciona así: en cada acción de Claude, un clasificador independiente basado en Sonnet evalúa la llamada a la herramienta y el contexto de la conversación, incluyendo permisos dinámicos —por ejemplo, "haz push a GitHub" o "no hagas push". El equipo ejecutó miles de evals y contrató red teams externos para intentar provocar acciones dañinas, y, según dice, corrigió todos los problemas encontrados.
«Prácticamente todo el mundo en Anthropic usa automode.
Es la mejor forma de mantener sesiones de trabajo largas en Claude Code sin dejar de estar seguro.» — Cat Wu, equipo de Claude Code, Anthropic
Es precisamente automode lo que hace posible ClaudeTag: el bot lee el feedback de los usuarios en los canales, lo que abre un montón de vectores de ataque, y sin una defensa multicapa tipo "queso suizo" sería peligroso poner en marcha un bot de Slack así.
Qué significa esto
Anthropic elimina cada vez más al humano del ciclo de revisión y confía en el juicio de los propios modelos. La reducción de los prompts, los agentes proactivos y automode apuntan en una misma dirección: los equipos de desarrollo pasan de controlar manualmente cada paso a delegar lo rutinario y dedicarse a tareas más ambiciosas.
«La única forma de compensar esa sensación de pérdida es volverse más ambicioso.» —
Thariq Shihipar, equipo de Claude Code, Anthropic
Preguntas frecuentes
¿Qué es ClaudeTag?
ClaudeTag es Claude integrado en las herramientas de equipo; se lanzó en Slack a principios de julio de 2026. Es multijugador y proactivo: vigila los reportes de errores en un canal, abre PR por sí mismo y etiqueta al ingeniero que tocó por última vez esa parte del código.
¿Por qué se redujo en un 80% el system prompt de
Claude Code?
Porque los nuevos modelos Fable 5 y Opus 4.8 funcionan peor con un gran número de ejemplos y prohibiciones estrictas de tipo "no hagas X". Anthropic eliminó los ejemplos y restricciones superfluos; para los modelos antiguos se mantuvo el prompt completo.
¿Qué tan seguro es automode?
Según el equipo, para los riesgos principales —prompt injection y fugas de datos— es más seguro que un revisor humano promedio. Dentro de Anthropic, automode se usa desde enero de 2026 y se han ejecutado miles de evals con red teams externos.
¿Necesitas IA funcionando dentro de tu empresa — no solo en tu feed de noticias?
Construyo IA en producción para empresas — CRM a medida, herramientas internas, agentes autónomos, automatización de procesos. Tuya, adaptada a tu proceso, sin coste por usuario. Creado por Zhemal Khamidun, CPO de AlpinaGPT (plataforma de IA, 6.000+ usuarios).
Lo esencial de la IA — una vez por semana
Siete historias que de verdad importaron, elegidas a mano. Sin ruido ni notas de prensa.
¡Listo! Revisa tu correo para la confirmación.