Con Claude Fable 5.1, estamos cambiando cómo la API de Mensajes maneja los bloques de pensamiento para proteger contra la destilación. Un bloque de pensamiento es un registro del razonamiento que Claude puede producir mientras trabaja en una respuesta. Las nuevas cuentas de API para Fable 5.1 ya no podrán editar el contexto alrededor de un bloque de pensamiento, como los mensajes, herramientas o indicación del sistema, durante una conversación de múltiples turnos.
Modificar este contexto anterior tiene aplicaciones legítimas, que continuamos apoyando usando los ajustes descritos a continuación. Sin embargo, tales modificaciones también son una técnica común y documentada públicamente para la destilación ilícita a escala industrial, que está prohibida por nuestra Política de Uso y Términos de Servicio.
Aquí está lo que cambia: la API ahora verificará que un bloque de pensamiento se devuelva con la misma indicación del sistema, herramientas y mensajes que lo produjeron, y devolverá un error si no coinciden. Para que las solicitudes modificadas tengan éxito, los desarrolladores pueden optar por tener los bloques de pensamiento eliminados de tales solicitudes; el modelo responderá sin ver el bloque de pensamiento. Para Fable 5.1, el pensamiento preservado se aplica solo a nuevas cuentas de API, aunque esta actualización se aplicará a todas las cuentas en futuras versiones de modelos.
En este artículo, compartimos detalles sobre por qué estamos haciendo esto y los ajustes que puede hacer para minimizar la interrupción.
¿Qué son los bloques de pensamiento?
Claude produce pasos de razonamiento antes de proporcionar su respuesta final. En la API, estos se devuelven al usuario como "bloques de pensamiento". En una conversación de múltiples turnos, los usuarios de API devuelven estos bloques con cada intercambio (junto con la indicación del sistema, herramientas y mensajes anteriores), para que Claude tenga contexto conversacional completo.
¿Qué está cambiando?
Para cuentas afectadas (ver a continuación) en Fable 5.1, la API devolverá un error si la indicación del sistema, herramientas o mensajes anteriores a un bloque de pensamiento anterior han sido modificados.
Para evitar un mensaje de error, puede optar por el modo "no estricto". En este modo, la solicitud se procesará, pero los bloques de pensamiento afectados se eliminarán de lo que el modelo ve. Esto le permite continuar su conversación o tarea sin interrupciones a pesar de que el pensamiento de los turnos anteriores no se muestre al modelo. Cuando esto sucede, la respuesta de la API le indicará qué bloques fueron eliminados.
¿Por qué estamos haciendo este cambio?
Alterar los turnos anteriores de una conversación es una técnica común utilizada en campañas de destilación ilícita, que tienen como objetivo extraer las capacidades de modelos avanzados, especialmente el pensamiento, para entrenar otro modelo, sin autorización. La destilación a menudo se emplea a escala industrial, utilizando miles de cuentas falsas. Encriptamos los bloques de pensamiento de Claude para prevenir esto, pero al editar la conversación antes de un bloque de pensamiento, un usuario podría lograr que Claude desencripte e imprima su razonamiento. Los sistemas entrenados de esta manera pueden heredar capacidades que de otro modo no tendrían, sin heredar las salvaguardas que hemos construido para prevenir una amplia gama de abusos como ciberataques y desarrollo de armas.
Este cambio tiene como objetivo hacer que las campañas de destilación sean más difíciles de ejecutar. Se basa en medidas anti-destilación existentes como clasificadores de destilación mejorados y restricciones sobre la transferencia de sesiones o razonamiento de modelos más avanzados a modelos menos capaces con salvaguardas más débiles.
¿Qué significa esto para las integraciones de API?
Ciertas integraciones, particularmente aquellas que implican reescribir turnos anteriores a mitad de la conversación, como compactación de contexto y recordatorios del sistema inyectados, pueden necesitar ajustes.
Aquí hay recursos para ayudarle a través de esta actualización:
La documentación de pensamiento preservado cubre dónde se aplica y dónde no se aplica el cambio.
La guía de migración de Fable 5.1 tiene una lista de verificación completa para las actualizaciones necesarias.
La guía de indicaciones de Fable 5.1 cubre diferencias de comportamiento y patrones de indicación que le ayudan a aprovechar las capacidades completas de Fable 5.1.
Si la orientación anterior no cubre su caso de uso, por favor comuníquese con nuestro equipo de soporte. Si trabaja con un equipo de cuenta, también puede comunicarse con ellos para obtener soporte con la actualización de integraciones más complejas.
Hay beneficios adicionales para mantener los bloques de pensamiento consistentes: significa que la API puede reutilizar indicaciones en caché más a menudo, lo que reduce costos y tiempo de respuesta.
¿A quién afectará esto?
En Fable 5.1, esta actualización se aplica a nuevas cuentas de API creadas después del 31 de agosto de 2026 12:00:00 AM UTC. Específicamente, afecta a nuevas organizaciones de Claude Platform, cuentas de Amazon Bedrock, proyectos de Google Cloud Vertex AI y proyectos de Microsoft Azure Foundry creados en o después del 31 de agosto de 2026.
Estamos adoptando un enfoque gradual para la aplicación, comenzando con nuevas cuentas, donde vemos la mayor concentración de abuso relacionado con la destilación. Las cuentas existentes no se verán afectadas para Fable 5.1, lo que da a los desarrolladores tiempo para hacer que sus arneses e integraciones sean compatibles con esta actualización. El pensamiento preservado se aplicará a todos los usuarios para modelos futuros.
Los usuarios de Claude Code, Claude Cowork, Claude.ai o Claude a través de un producto de terceros no se ven afectados, ni tampoco el uso de modelos distintos de Fable 5.1.
