Con Claude Fable 5.1, stiamo cambiando il modo in cui il Messages API gestisce i thinking block per proteggere dalla distillazione. Un thinking block è una registrazione del ragionamento che Claude può produrre mentre lavora su una risposta. I nuovi account API per Fable 5.1 non potranno più modificare il contesto intorno a un thinking block, come i messaggi, gli strumenti o il prompt di sistema, durante una conversazione multi-turno.
Modificare questo contesto precedente ha applicazioni legittime, che continuiamo a supportare utilizzando gli aggiustamenti descritti di seguito. Tuttavia, tali modifiche sono anche una tecnica comune e pubblicamente documentata per la distillazione illecita su scala industriale, che è vietata dalla nostra Politica di utilizzo e dai Termini di servizio.
Ecco cosa cambia: l'API verificherà ora che un thinking block sia rimandato indietro con lo stesso prompt di sistema, gli stessi strumenti e gli stessi messaggi che lo hanno prodotto, e restituirà un errore se non corrispondono. Affinché le richieste modificate abbiano successo, gli sviluppatori possono scegliere di avere i thinking block rimossi da tali richieste; il modello risponderà senza vedere il thinking block. Per Fable 5.1, il preserved thinking si applica solo ai nuovi account API, anche se questo aggiornamento si applicherà a tutti gli account nelle future versioni del modello.
In questo articolo, condividiamo i dettagli su perché stiamo facendo questo e gli aggiustamenti che puoi apportare per minimizzare le interruzioni.
Cosa sono i thinking block?
Claude produce passaggi di ragionamento prima di fornire la sua risposta finale. Sull'API, questi vengono restituiti all'utente come "thinking block". In una conversazione multi-turno, gli utenti dell'API rimandano questi block con ogni scambio (insieme al prompt di sistema, agli strumenti e ai messaggi precedenti), in modo che Claude abbia il contesto conversazionale completo.
Cosa sta cambiando?
Per gli account interessati (vedi sotto) su Fable 5.1, l'API restituirà un errore se il prompt di sistema, gli strumenti o i messaggi che precedono un thinking block precedente sono stati modificati.
Per evitare un messaggio di errore, puoi optare per la modalità "non ristretta". In questa modalità, la richiesta andrà a buon fine, ma i thinking block interessati verranno eliminati da ciò che il modello vede. Questo ti consente di continuare la tua conversazione o attività senza interruzioni nonostante il ragionamento dei turni precedenti non sia mostrato al modello. Quando ciò accade, la risposta dell'API ti dirà quali block sono stati eliminati.
Perché stiamo apportando questo cambiamento?
Alterare i turni precedenti di una conversazione è una tecnica comune utilizzata nelle campagne di distillazione illecita, che mirano a estrarre le capacità di modelli avanzati, in particolare il ragionamento, per addestrare un altro modello, senza autorizzazione. La distillazione è spesso impiegata su scala industriale, utilizzando migliaia di account falsi. Crittografiamo i thinking block di Claude per prevenire questo, ma modificando la conversazione prima di un thinking block, un utente potrebbe far sì che Claude decrittografi e stampi il suo ragionamento. I sistemi addestrati in questo modo possono ereditare capacità che altrimenti non avrebbero, senza ereditare i meccanismi di sicurezza che abbiamo costruito per prevenire un'ampia gamma di abusi come attacchi informatici e sviluppo di armi.
Questo cambiamento mira a rendere più difficile l'esecuzione delle campagne di distillazione. Si basa su misure anti-distillazione esistenti come classificatori di distillazione migliorati e restrizioni sul trasferimento di sessioni o ragionamento da modelli più avanzati a modelli meno capaci con meccanismi di sicurezza più deboli.
Cosa significa questo per le integrazioni API?
Alcune integrazioni, in particolare quelle che comportano la riscrittura dei turni precedenti a metà conversazione, come la compattazione del contesto e i promemoria di sistema iniettati, potrebbero richiedere aggiustamenti.
Ecco le risorse per aiutarti a navigare questo aggiornamento:
La documentazione del preserved thinking copre dove il cambiamento si applica e dove non si applica.
La guida alla migrazione di Fable 5.1 contiene una lista di controllo completa per gli aggiornamenti necessari.
La guida ai prompt di Fable 5.1 copre le differenze comportamentali e i modelli di prompt che ti aiutano a sfruttare appieno le capacità di Fable 5.1.
Se le indicazioni di cui sopra non coprono il tuo caso d'uso, contatta il nostro team di supporto. Se lavori con un team di account, puoi anche contattarli per ricevere supporto nell'aggiornamento di integrazioni più complesse.
Ci sono ulteriori vantaggi nel mantenere i thinking block coerenti: significa che l'API può riutilizzare i prompt memorizzati nella cache più spesso, il che riduce i costi e il tempo di risposta.
Chi sarà interessato da questo?
Su Fable 5.1, questo aggiornamento si applica ai nuovi account API creati dopo il 31 agosto 2026 alle 12:00:00 AM UTC. Nello specifico, riguarda le nuove organizzazioni Claude Platform, gli account Amazon Bedrock, i progetti Google Cloud Vertex AI e i progetti Microsoft Azure Foundry creati il 31 agosto 2026 o successivamente.
Stiamo adottando un approccio graduale all'applicazione, iniziando con i nuovi account, dove vediamo la più alta concentrazione di abusi legati alla distillazione. Gli account esistenti non saranno interessati per Fable 5.1, il che dà ai sviluppatori il tempo di rendere i loro harness e le loro integrazioni compatibili con questo aggiornamento. Il preserved thinking si applicherà a tutti gli utenti per i modelli futuri.
Gli utenti di Claude Code, Claude Cowork, Claude.ai o Claude attraverso un prodotto di terze parti non sono interessati, né l'uso di modelli diversi da Fable 5.1.
