Anthropic elimina el 80% del system prompt de Claude Code: con Claude 5, menos reglas y más criterio
Anthropic ha eliminado más del 80% del system prompt de Claude Code para los modelos de la generación Claude 5 (Opus 5 y Fable 5), sin pérdidas medibles en las evaluaciones de codificación. El post del 24 de julio explica el cambio de enfoque: los modelos más capaces necesitan menos reglas rígidas y manejan mejor el contexto confiando en su propio criterio.
Si construyes agentes o usas Claude Code con archivos CLAUDE.md y Skills cargadas de instrucciones, esto cambia la forma en que trabajas. El patrón anterior era acumular reglas defensivas para evitar los peores casos: “no escribas comentarios”, “no crees documentos de planificación”, “no elimines archivos”. Con Claude 5, muchas de estas instrucciones terminan contradiciéndose y obligan al modelo a negociar antes de decidir. Eliminarlas lo libera en lugar de debilitarlo.
Anthropic ha puesto a disposición el comando /doctor en Claude Code para revisar y redimensionar Skills y archivos CLAUDE.md. Aún no lo hemos probado.
El cambio de paradigma es simple: antes dabas reglas, ahora pides criterio. Las reglas servían cuando el modelo podía causar daños graves por iniciativa propia. Ahora que el modelo es más capaz, el sobreconstreñimiento cuesta más de lo que el riesgo que previene.
Junto al Cookbook de patrones agentivos publicado el mismo día, Anthropic está haciendo públicas las prácticas internas sobre cómo trabajar con Claude en producción: una sobre patrones arquitectónicos, la otra sobre cómo escribir el contexto.
En detalle
Qué significa context engineering.
Cuando escribes un prompt para Claude, lo que envías es solo una parte de lo que el modelo recibe. El resto proviene del system prompt (las instrucciones básicas), de los archivos CLAUDE.md (las reglas del proyecto), de las Skills (competencias específicas), de la memoria y de otras fuentes. Anthropic llama context engineering a todo esto: la práctica de ensamblar el contexto correcto para que el modelo funcione bien en muchas solicitudes diferentes, no solo en una.
La diferencia entre prompt y contexto es que el contexto debe ser general. No sabes qué te pedirá el usuario, así que no puedes ser demasiado específico. Pero si eres demasiado vago, el modelo toma direcciones que no deseas. Encontrar el punto correcto es difícil y cambia cuando cambia el modelo.
Qué cambió con Claude 5.
Anthropic descubrió que había sobreconstreñido Claude Code. Leyendo transcripciones de sesiones internas, encontraba instrucciones conflictivas en el mismo mensaje: el system prompt decía una cosa, las Skills decían otra, y la solicitud del usuario una tercera. Por ejemplo, una instrucción decía “deja documentación donde sea apropiado” mientras que otra imponía “NO añadas comentarios”.
El modelo tenía que negociar entre estas direcciones contrastantes antes de siquiera empezar a trabajar. Con Claude 4, estas reglas servían para evitar comportamientos peores. Con Opus 5 y Fable 5, el modelo tiene suficiente criterio para decidir por sí solo cuándo dejar un comentario y cuándo no hacerlo. La confirmación está en los números: eliminado más del 80% del system prompt, las evaluaciones de codificación no han empeorado de manera medible.
Hay también un factor instrumental. Antes, CLAUDE.md actuaba como memoria, fuente de información y guía. Ahora Claude Code tiene herramientas separadas para cada función: memoria persistente, artifacts y Skills. El contexto no debe hacer todo el trabajo solo, y las instrucciones que duplicaban estas funciones se convirtieron en peso innecesario.
Los límites de lo que sabemos.
El 80% es una cifra declarada por Anthropic sobre sus propias evaluaciones internas. No sabemos qué pruebas utilizaron ni qué tan rigurosas fueron. El consejo aplica a los modelos Claude 5: en modelos menos capaces, eliminar las reglas defensivas podría degradar el desempeño. El paso de “reglas” a “criterio” también requiere que confíes en el modelo sobre decisiones donde antes tenías control explícito. No es un salto que se hace en todas partes de la misma manera: en un sistema que gestiona datos sensibles o realiza operaciones irreversibles, la cautela inicial sigue siendo razonable incluso con un modelo capaz.