Penalaran
Apa itu?
Model reasoning dilatih untuk menghasilkan fase berpikir eksplisit sebelum jawaban akhir — selalu ("thinking" models) atau saat diminta ke mode reasoning.
Kapan memakainya?
- Matematika, logika, analisis multi-langkah, perencanaan hati-hati.
- Tradeoff: token berpikir memakan waktu dan konteks. Untuk chat sederhana, model chat biasa lebih cepat.
Prasyarat
- Model bertag reasoning — filter katalog dengan Reasoning.
- Panjang konteks cukup untuk fase berpikir plus jawaban. Lihat Konteks dan memori.
Contoh kerja minimum
bash
curl http://127.0.0.1:11435/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"<publisher>/<model>","messages":[{"role":"user","content":"Solve: if 3x+7=22, what is x?"}]}'Respons memuat reasoning model diikuti jawabannya. Cara fase berpikir dibatasi bergantung pada chat template model.
Konfigurasi/opsi
- Beberapa model mengaktifkan/mematikan reasoning dengan flag chat template atau system prompt; periksa kartu model.
- Output berpikir bisa muncul sebaris dengan jawaban tergantung dukungan template; parsing ke field terpisah direncanakan. Planned
Keterbatasan
- Perilaku bergantung model: template bervariasi antar keluarga model; beberapa mengeluarkan blok
<think>, lainnya teks polos. - Token berpikir menghabiskan konteks — reasoning sangat panjang bisa terpotong.
- Jangan menyamakan "badge reasoning" dengan kebenaran terjamin; verifikasi output kritis.
Penyelesaian masalah
Berpikir tak pernah selesai, atau jawaban tercampur reasoning: ketidakcocokan template — lihat Masalah model.