Halaman ini membahas kegagalan paling umum saat mengonfigurasi thinking atau melakukan round-trip blok thinking (mengirim kembali blok thinking yang dikembalikan dalam permintaan berikutnya). Bagian pertama memetakan setiap model ke konfigurasi thinking yang didukungnya dan yang ditolaknya; bagian-bagian setelahnya masing-masing dimulai dari gejala yang Anda amati, sehingga Anda dapat mencocokkan pesan error atau respons tak terduga langsung ke penyebab dan perbaikannya. Untuk cara kerja thinking, lihat ikhtisar Thinking.
Sebagian besar error konfigurasi thinking adalah ketidakcocokan antara nilai thinking.type dalam permintaan dan apa yang didukung model. Pada model saat ini, thinking berjalan sebagai thinking: {type: "adaptive"}, dan pada model terbaru, thinking aktif secara default. Beberapa model sebelumnya menggunakan extended thinking (pemikiran diperpanjang), mode manual lama yang dikonfigurasi sebagai thinking: {type: "enabled", budget_tokens: N}.
Extended thinking (pemikiran diperpanjang) (thinking.type: "enabled" dengan budget_tokens) sudah tidak digunakan lagi (deprecated) pada model Claude 4.6 (permintaan yang menggunakannya masih berhasil). Model Claude 4.7 dan yang lebih baru tidak mendukungnya dan menolak permintaan yang menggunakannya, dengan mengembalikan error 400. Pada model Claude 4.5 dan yang lebih lama yang mendukung thinking, pemikiran diperpanjang adalah satu-satunya mode thinking yang tersedia. Claude Mythos Preview mendukung kedua mode. Jika kedua mode tersedia, gunakan adaptive thinking sebagai gantinya.
Tabel ini mencantumkan apa yang didukung setiap model, apa defaultnya, dan nilai thinking.type mana yang ditolaknya dengan error 400; nilai apa pun yang tidak tercantum sebagai ditolak berarti diterima.
| Model | Tipe thinking | Default | Ditolak dengan 400 |
|---|---|---|---|
| Claude Fable 5 | Adaptive saja | Selalu aktif | "enabled", "disabled" |
| Claude Mythos 5 | Adaptive saja | Selalu aktif | "enabled", "disabled" |
| Claude Mythos Preview | Adaptive, extended | Selalu aktif | "disabled" |
| Claude Opus 5 | Adaptive saja | Aktif | "enabled", "disabled"2 |
| Claude Opus 4.8 | Adaptive saja | Nonaktif | "enabled" |
| Claude Opus 4.7 | Adaptive saja | Nonaktif | "enabled" |
| Claude Sonnet 5 | Adaptive saja | Aktif | "enabled" |
| Claude Opus 4.6 | Adaptive, extended (tidak digunakan lagi)1 | Nonaktif | Tidak ada |
| Claude Sonnet 4.6 | Adaptive, extended (tidak digunakan lagi)1 | Nonaktif | Tidak ada |
| Claude Opus 4.5 | Extended saja | Nonaktif | "adaptive" |
| Claude Haiku 4.5 | Extended saja | Nonaktif | "adaptive" |
| Claude Sonnet 4.5 | Extended saja | Nonaktif | "adaptive" |
1 enabled dan budget_tokens masih berfungsi pada model-model ini tetapi sudah tidak digunakan lagi; gunakan adaptive thinking sebagai gantinya.
2 Claude Opus 5 menerima "disabled" pada effort high atau lebih rendah; menggabungkannya dengan effort xhigh atau max mengembalikan error 400. Pembatasan ini berlaku untuk Claude Opus 5 dan model-model setelahnya, dan diberlakukan pada setiap permintaan.
Model yang ditandai Selalu aktif tidak dapat menonaktifkan thinking. Model yang ditandai Aktif secara default menggunakan thinking tetapi menerima thinking: {type: "disabled"}.
Model Claude 4 sebelumnya (Claude Opus 4.1, Claude Sonnet 4, dan Claude Opus 4) hanya mendukung pemikiran diperpanjang; lihat Penghentian model untuk ketersediaannya. Claude Fable 5 dan Claude Mythos 5 tidak tersedia di bawah zero data retention.
"thinking.type.enabled" tidak didukungPermintaan gagal dengan error 400 yang pesannya berbunyi:
"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.Ini terjadi karena model yang Anda minta telah menghapus pemikiran diperpanjang (lihat Konfigurasi yang ditolak setiap model).
Ubah permintaan menjadi thinking: {type: "adaptive"} dan arahkan kedalaman thinking dengan effort alih-alih budget_tokens. Migrasi ke adaptive thinking memandu Anda melalui proses konversi.
"thinking.type.disabled" tidak didukungPermintaan gagal dengan error 400 yang pesannya berbunyi:
"thinking.type.disabled" is not supported for this model. Thinking defaults to adaptive mode when not specified; use "thinking.type.enabled" with "budget_tokens" for extended thinking.Ini terjadi pada model yang thinking-nya selalu aktif: Claude Fable 5, Claude Mythos 5, dan Claude Mythos Preview menolak "disabled". Pada Claude Fable 5 dan Claude Mythos 5, saran teks error untuk menggunakan "thinking.type.enabled" juga tidak berlaku: model-model tersebut juga menolaknya.
Hilangkan parameter thinking; model-model ini melakukan thinking tanpa konfigurasi apa pun. Jika tujuan Anda adalah menghilangkan teks thinking dari respons, gunakan display: "omitted" alih-alih menonaktifkan thinking; lihat Mengontrol tampilan thinking.
Error 400 pada "disabled" juga dapat terjadi pada Claude Opus 5, yang menerima thinking: {type: "disabled"} hanya pada effort high atau lebih rendah: menggabungkannya dengan effort xhigh atau max akan ditolak. Turunkan level effort, atau biarkan thinking tetap aktif.
Permintaan gagal dengan error 400 yang pesannya berbunyi:
adaptive thinking is not supported on this modelIni terjadi karena model hanya mendukung pemikiran diperpanjang (lihat Konfigurasi yang ditolak setiap model).
Gunakan thinking: {type: "enabled", budget_tokens: N} sebagai gantinya; lihat Extended thinking untuk konfigurasinya.
Permintaan yang mengembalikan hasil alat gagal dengan invalid_request_error 400 yang pesannya berisi:
`thinking` or `redacted_thinking` blocks in the latest assistant message cannot be modifiedDalam percakapan multi-turn dan penggunaan alat, Anda mengirim kembali pesan asisten sebelumnya, termasuk blok thinking dan redacted_thinking miliknya, ke API, dan API memverifikasi bahwa blok-blok tersebut tiba tanpa modifikasi. Error ini terjadi ketika pesan asisten yang Anda kirim kembali berbeda dari yang dikembalikan API, paling sering karena kode Anda memfilter blok konten berdasarkan tipe dan membuang blok redacted_thinking, atau membangun ulang pesan asisten alih-alih mengirimkannya kembali apa adanya.
Kirim kembali giliran asisten secara verbatim, termasuk blok thinking. Lihat Mempertahankan blok thinking untuk aturannya, dan contoh round trip yang dikerjakan di Thinking dalam alur kerja alat dan multi-turn untuk kode yang benar di setiap SDK.
Respons berisi blok thinking, tetapi field thinking-nya berupa string kosong dan hanya field signature yang terisi.
Ini terjadi karena display secara default bernilai "omitted" pada model yang lebih baru, yang mengembalikan blok thinking tanpa teksnya.
Atur display: "summarized" dalam konfigurasi thinking Anda untuk menerima teks thinking yang diringkas; lihat Mengontrol tampilan thinking untuk default per model.
Beberapa respons tidak berisi blok thinking sama sekali, meskipun thinking telah dikonfigurasi.
Ini normal dalam mode adaptive: Claude melewati thinking pada permintaan yang dinilainya cukup sederhana untuk dijawab langsung.
Jika Anda ingin thinking lebih sering atau lebih dalam, naikkan effort atau arahkan dengan prompting; lihat Mengarahkan seberapa sering Claude berpikir.
Sebuah respons terkadang menulis panggilan alat ke dalam teksnya alih-alih mengeluarkan blok tool_use, atau menyertakan <thinking> atau tag XML internal lainnya dalam teks yang terlihat. Panggilan alat yang bocor tidak pernah dijalankan, dan dalam loop agentik teks yang bocor tetap berada dalam riwayat percakapan, sehingga giliran berikutnya juga terpengaruh.
Ini terjadi pada Claude Opus 5 ketika thinking dinonaktifkan, paling umum pada beban kerja yang banyak menggunakan alat seperti pencarian. Aturan prompt sistem yang menginstruksikan model untuk tidak berpikir atau tidak bernalar meningkatkan kebocoran tag.
Aktifkan kembali thinking (default) dan gunakan level effort yang lebih rendah untuk mengontrol biaya token sebagai gantinya. Jika integrasi Anda harus tetap menonaktifkan thinking, terapkan mitigasi prompting di Menjalankan dengan thinking dinonaktifkan.
stop_reason: "max_tokens"Respons berakhir dengan stop_reason: "max_tokens", sering kali dengan blok teks yang terpotong atau hilang.
Ini terjadi karena token thinking dihitung terhadap max_tokens, sehingga proses thinking yang panjang dapat menghabiskan anggaran sebelum respons teks selesai.
Naikkan max_tokens untuk menyisakan ruang bagi thinking dan teks, atau turunkan effort agar Claude menghabiskan lebih sedikit untuk thinking; lihat Kontrol biaya dan Thinking dan jendela konteks.
cache_read_input_tokens turun menjadi nol pada permintaan yang sebelumnya mengenai cache.
Ini terjadi karena konfigurasi thinking dan level effort (atau defaultnya) adalah bagian dari prefiks prompt yang di-cache, sehingga mengubah salah satunya memulai prefiks baru: mengganti mode thinking, mengubah nilai effort, dan mengubah budget_tokens semuanya membatalkan breakpoint cache pesan, dan dapat juga membatalkan breakpoint alat dan prompt sistem, tergantung di mana model merender konfigurasi tersebut.
Jaga agar konfigurasi thinking dan level effort tetap konstan di seluruh permintaan yang berbagi percakapan; mengatur parameter secara eksplisit ke defaultnya setara dengan menghilangkannya dan tidak membatalkan cache. Lihat Thinking dan caching prompt.
Anda mengubah effort tetapi frekuensi atau kedalaman thinking tetap sama.
Ini terjadi karena effort adalah tuas thinking utama hanya dalam mode adaptive. Pada model yang hanya mendukung pemikiran diperpanjang, kedalaman thinking diatur oleh budget_tokens sebagai gantinya.
Sesuaikan budget_tokens pada model-model tersebut, atau periksa mode mana yang dijalankan model Anda; lihat Thinking dan effort. Pada Claude Opus 4.5, satu-satunya model khusus pemikiran diperpanjang yang mendukung effort, effort dikombinasikan dengan budget; lihat Aturan budget dan penyetelan.
Ikhtisar: apa itu thinking, cara mengonfigurasinya, dan bagaimana interaksinya dengan alat, caching, dan streaming.
Referensi error lengkap, termasuk error 400 konfigurasi thinking dengan pesan server persisnya.
Konversi permintaan budget_tokens ke adaptive thinking dengan effort.
Was this page helpful?