Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Pemikiran adaptif
Pemikiran adaptif adalah cara yang disarankan untuk digunakan Pemikiran yang diperluas dengan Claude Opus 4.6. Alih-alih menetapkan anggaran token pemikiran secara manual, pemikiran adaptif memungkinkan Claude secara dinamis memutuskan kapan dan berapa banyak yang harus dipikirkan berdasarkan kompleksitas setiap permintaan. Pemikiran adaptif secara andal mendorong kinerja yang lebih baik daripada pemikiran yang diperluas dengan pemikiran yang tetapbudget_tokens, dan kami merekomendasikan beralih ke pemikiran adaptif untuk mendapatkan respons paling cerdas dari 4.6. Claude Opus Tidak diperlukan header beta.
Model yang didukung adalah sebagai berikut:
| Model | ID Model |
|---|---|
Mitos Claude 5 |
|
Dongeng Claude 5 |
|
Claude Opus4.7 |
|
Pratinjau Claude Mythos |
|
Claude Opus4.6 |
|
Claude Soneta 4.6 |
|
catatan
Claude Mythos 5, Claude Fable 5, Claude Opus 4.7, dan Claude Mythos Preview hanya mendukung pemikiran adaptif. Pemikiran diperpanjang manual (thinking.type: "enabled"denganbudget_tokens) dan pemikiran yang dinonaktifkan (thinking.type: "disabled") tidak didukung pada model ini dan akan mengembalikan kesalahan 400. Gunakan thinking.type: "adaptive" dengan output_config.effort untuk mengontrol perilaku berpikir.
thinking.type: "enabled"dan budget_tokens tidak digunakan lagi pada Claude Opus 4.6 dan Claude Sonnet 4.6 dan akan dihapus dalam rilis model future. Gunakan thinking.type: "adaptive" dengan parameter upaya sebagai gantinya.
Model lama (Claude Sonnet 4.5, Claude Opus 4,5, dll.) Tidak mendukung pemikiran adaptif dan membutuhkan thinking.type: "enabled" denganbudget_tokens.
Cara kerja pemikiran adaptif
Dalam mode adaptif, Claude mengevaluasi kompleksitas setiap permintaan dan memutuskan apakah dan berapa banyak yang harus dipikirkan. Pada tingkat upaya default (high), hampir selalu Claude akan berpikir. Pada tingkat usaha yang lebih rendah, Claude mungkin melewatkan pemikiran untuk masalah yang lebih sederhana.
Pemikiran adaptif juga secara otomatis memungkinkanPemikiran yang disisipkan (beta). Ini berarti Claude dapat berpikir di antara panggilan alat, membuatnya sangat efektif untuk alur kerja agen.
Setel thinking.type ke "adaptive" dalam permintaan API Anda:
Berpikir adaptif dengan parameter usaha
Anda dapat menggabungkan pemikiran adaptif dengan parameter upaya untuk memandu seberapa banyak pemikiran yang Claude dilakukan. Tingkat upaya bertindak sebagai panduan lunak untuk Claude alokasi pemikiran:
| Tingkat upaya | Perilaku berpikir |
|---|---|
max |
Claudeselalu berpikir tanpa kendala pada kedalaman berpikir. Claude Opus4.6 saja — permintaan yang menggunakan max model lain akan mengembalikan kesalahan. |
high (default) |
Claudeselalu berpikir. Memberikan penalaran mendalam tentang tugas-tugas kompleks. |
medium |
Claudemenggunakan pemikiran moderat. Dapat melewatkan pemikiran untuk pertanyaan yang sangat sederhana. |
low |
Claudememinimalkan pemikiran. Melompati berpikir untuk tugas-tugas sederhana di mana kecepatan paling penting. |
penting
effortParameter harus ditempatkan di dalam output_config objek terpisah di badan permintaan Anda — bukan di dalam thinking objek. Menempatkan effort di dalam thinking akan menghasilkan aValidationException.
Contoh berikut menunjukkan cara mengatur level usaha saat menggunakan InvokeModel API:
{ "anthropic_version": "bedrock-2023-05-31", "max_tokens": 16000, "thinking": { "type": "adaptive" }, "output_config": { "effort": "high" }, "messages": [{ "role": "user", "content": "Your prompt here" }] }
Menggunakan pemikiran adaptif dengan Converse API
Saat menggunakan Converse API, teruskan effort parameter thinking dan di dalamnyaadditionalModelRequestFields. Contoh berikut menunjukkan pemikiran adaptif dengan tingkat upaya default:
import boto3, json bedrock_runtime = boto3.client(service_name='bedrock-runtime', region_name='us-east-2') response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "Explain why the sum of two even numbers is always even."}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" } } ) print(json.dumps(response["output"], indent=2, default=str))
Untuk menentukan tingkat usaha, tambahkan effort bidang di dalam output_config objek terpisah diadditionalModelRequestFields:
response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "What is 2 + 2?"}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" }, "output_config": { "effort": "low" } } )
Caching cepat
Permintaan berturut-turut menggunakan adaptive pemikiran mempertahankan breakpoint cache yang cepat. Namun, beralih antara adaptive danenabled/mode disabled berpikir memecah breakpoint cache untuk pesan. Permintaan sistem dan definisi alat tetap di-cache terlepas dari perubahan mode.
Menyetel perilaku berpikir
Jika berpikir Claude lebih atau kurang sering dari yang Anda inginkan, Anda dapat menambahkan panduan ke prompt sistem Anda:
Extended thinking adds latency and should only be used when it will meaningfully improve answer quality — typically for problems that require multi-step reasoning. When in doubt, respond directly.
Awas
ClaudeMengarahkan untuk berpikir lebih jarang dapat mengurangi kualitas pada tugas-tugas yang mendapat manfaat dari penalaran. Ukur dampak pada beban kerja spesifik Anda sebelum menerapkan penyetelan berbasis prompt ke produksi. Pertimbangkan pengujian dengan tingkat usaha yang lebih rendah terlebih dahulu.
Ringkasan teks konektor (beta)
Pada Claude Fable 5, teks yang dipancarkan model di antara panggilan alat (kadang-kadang disebut “teks konektor” - misalnya, “Biarkan saya memeriksa file itu berikutnya...”) diringkas sisi server dan dikembalikan sebagai blok pemikiran daripada blok konten teks biasa. Blok berpikir menggunakan bentuk yang sama seperti blok berpikir lainnya (teks kosong dengan tanda tangan di bawah omitted tampilan default).
Dampak pelanggan:
Bentuk respons: Tool-use tanggapan dari Claude Fable 5 mungkin berisi blok pemikiran tambahan di mana model sebelumnya memancarkan teks biasa di antara blok.
tool_useTidak ada jenis blok konten baru. Jawaban asisten akhir (setelah semua penggunaan alat selesai) tidak terpengaruh dan tetap teks biasa.Multi-turn penanganan: Lewati blok pemikiran ini kembali tidak berubah dalam percakapan multi-putaran — penanganan yang sama dengan pemikiran yang dilindungi (tanda tangan divalidasi pada passback; dilucuti secara diam-diam jika dikirim ke model yang berbeda).
Lingkup: Ringkasan konektor hanya berlaku setelah
tool_resultada dalam percakapan. Narasi sebelum panggilan alat pertama dalam percakapan baru tetap teks biasa. Segmen teks pendek dapat melewati sebagai teks biasa tanpa ringkasan.
Fitur ini diaktifkan sisi server untuk Claude Fable 5. Tidak ada opt-in atau opt-out pelanggan.