Dengan Claude Fable 5.1, kami mengubah cara Messages API menangani blok pemikiran untuk melindungi dari distilasi. Blok pemikiran adalah catatan penalaran yang mungkin dihasilkan Claude saat mengerjakan respons. Akun API baru untuk Fable 5.1 tidak lagi dapat mengedit konteks di sekitar blok pemikiran, seperti pesan, alat, atau prompt sistem, selama percakapan multi-putaran.
Memodifikasi konteks sebelumnya ini memiliki aplikasi yang sah, yang terus kami dukung menggunakan penyesuaian yang dijelaskan di bawah. Namun, modifikasi semacam itu juga merupakan teknik yang umum dan terdokumentasi secara publik untuk distilasi ilegal skala industri, yang dilarang oleh Kebijakan Penggunaan dan Syarat Layanan kami.
Berikut perubahan yang terjadi: API sekarang akan memverifikasi bahwa blok pemikiran dikirim kembali dengan prompt sistem, alat, dan pesan yang sama yang menghasilkannya, dan akan mengembalikan kesalahan jika tidak cocok. Agar permintaan yang dimodifikasi berhasil, pengembang dapat memilih untuk memiliki blok pemikiran dihapus dari permintaan tersebut; model akan merespons tanpa melihat blok pemikiran. Untuk Fable 5.1, pemikiran yang dipertahankan berlaku hanya untuk akun API baru, meskipun pembaruan ini akan berlaku untuk semua akun dalam rilis model di masa depan.
Dalam artikel ini, kami berbagi detail tentang mengapa kami melakukan ini dan penyesuaian yang dapat Anda lakukan untuk meminimalkan gangguan.
Apa itu blok pemikiran?
Claude menghasilkan langkah-langkah penalaran sebelum memberikan jawaban akhirnya. Di API, ini dikembalikan kepada pengguna sebagai "blok pemikiran." Dalam percakapan multi-putaran, pengguna API mengirim blok-blok ini kembali dengan setiap pertukaran (bersama dengan prompt sistem, alat, dan pesan sebelumnya), sehingga Claude memiliki konteks percakapan lengkap.
Apa yang berubah?
Untuk akun yang terdampak (lihat di bawah) di Fable 5.1, API akan mengembalikan kesalahan jika prompt sistem, alat, atau pesan sebelum blok pemikiran sebelumnya telah dimodifikasi.
Untuk menghindari pesan kesalahan, Anda dapat memilih mode "non-ketat". Dalam mode ini, permintaan akan diproses, tetapi blok pemikiran yang terpengaruh akan dihapus dari apa yang dilihat model. Ini memungkinkan Anda untuk melanjutkan percakapan atau tugas tanpa gangguan meskipun pemikiran dari putaran sebelumnya tidak ditampilkan kepada model. Ketika ini terjadi, respons API akan memberi tahu Anda blok mana yang dihapus.
Mengapa kami membuat perubahan ini?
Mengubah putaran sebelumnya dari percakapan adalah teknik umum yang digunakan dalam kampanye distilasi ilegal, yang bertujuan untuk mengekstrak kemampuan model canggih—terutama pemikiran—untuk melatih model lain, tanpa otorisasi. Distilasi sering digunakan pada skala industri, menggunakan ribuan akun palsu. Kami mengenkripsi blok pemikiran Claude untuk mencegah ini, tetapi dengan mengedit percakapan sebelum blok pemikiran, pengguna dapat membuat Claude mendekripsi dan mencetak penalarannya. Sistem yang dilatih dengan cara ini dapat mewarisi kemampuan yang tidak akan mereka miliki sebaliknya, tanpa mewarisi perlindungan yang telah kami bangun untuk mencegah berbagai penyalahgunaan seperti serangan siber dan pengembangan senjata.
Perubahan ini bertujuan untuk membuat kampanye distilasi lebih sulit dijalankan. Ini dibangun di atas langkah-langkah anti-distilasi yang ada seperti pengklasifikasi distilasi yang ditingkatkan dan pembatasan pada transfer sesi atau penalaran dari model yang lebih canggih ke model yang kurang mampu dengan perlindungan yang lebih lemah.
Apa artinya ini untuk integrasi API?
Integrasi tertentu—terutama yang melibatkan penulisan ulang putaran sebelumnya di tengah percakapan, seperti pemadatan konteks dan pengingat sistem yang disuntikkan—mungkin memerlukan penyesuaian.
Berikut adalah sumber daya untuk membantu memandu Anda melalui pembaruan ini:
Dokumentasi pemikiran yang dipertahankan mencakup di mana perubahan berlaku dan tidak berlaku.
Panduan migrasi Fable 5.1 memiliki daftar periksa lengkap untuk pembaruan yang diperlukan.
Panduan prompt Fable 5.1 mencakup perbedaan perilaku dan pola prompting yang membantu Anda memanfaatkan kemampuan penuh Fable 5.1.
Jika panduan di atas tidak mencakup kasus penggunaan Anda, silakan hubungi tim dukungan kami. Jika Anda bekerja dengan tim akun, Anda juga dapat menghubungi mereka untuk mendapatkan dukungan dalam memperbarui integrasi yang lebih kompleks.
Ada manfaat tambahan untuk menjaga blok pemikiran tetap konsisten: ini berarti API dapat menggunakan kembali prompt yang di-cache lebih sering, yang mengurangi biaya dan waktu respons.
Siapa yang akan terdampak?
Di Fable 5.1, pembaruan ini berlaku untuk akun API baru yang dibuat setelah 31 Agustus 2026 12:00:00 AM UTC. Secara khusus, ini mempengaruhi organisasi Claude Platform baru, akun Amazon Bedrock, proyek Google Cloud Vertex AI, dan proyek Microsoft Azure Foundry yang dibuat pada atau setelah 31 Agustus 2026.
Kami mengambil pendekatan bertahap untuk penegakan, dimulai dengan akun baru, di mana kami melihat konsentrasi tertinggi penyalahgunaan terkait distilasi. Akun yang ada tidak akan terpengaruh untuk Fable 5.1, yang memberi pengembang waktu untuk membuat harness dan integrasi mereka kompatibel dengan pembaruan ini. Pemikiran yang dipertahankan akan berlaku untuk semua pengguna untuk model di masa depan.
Pengguna Claude Code, Claude Cowork, Claude.ai, atau Claude melalui produk pihak ketiga tidak terpengaruh, begitu juga penggunaan model selain Fable 5.1.
