BotConnector
Masuk Workspace Buka Aplikasi

Penalaran

Apa itu?

Model reasoning dilatih untuk menghasilkan fase berpikir eksplisit sebelum jawaban akhir — selalu ("thinking" models) atau saat diminta ke mode reasoning.

Kapan memakainya?

  • Matematika, logika, analisis multi-langkah, perencanaan hati-hati.
  • Tradeoff: token berpikir memakan waktu dan konteks. Untuk chat sederhana, model chat biasa lebih cepat.

Prasyarat

  • Model bertag reasoning — filter katalog dengan Reasoning.
  • Panjang konteks cukup untuk fase berpikir plus jawaban. Lihat Konteks dan memori.

Contoh kerja minimum

bash
curl http://127.0.0.1:11435/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"<publisher>/<model>","messages":[{"role":"user","content":"Solve: if 3x+7=22, what is x?"}]}'

Respons memuat reasoning model diikuti jawabannya. Cara fase berpikir dibatasi bergantung pada chat template model.

Konfigurasi/opsi

  • Beberapa model mengaktifkan/mematikan reasoning dengan flag chat template atau system prompt; periksa kartu model.
  • Output berpikir bisa muncul sebaris dengan jawaban tergantung dukungan template; parsing ke field terpisah direncanakan. Planned

Keterbatasan

  • Perilaku bergantung model: template bervariasi antar keluarga model; beberapa mengeluarkan blok <think>, lainnya teks polos.
  • Token berpikir menghabiskan konteks — reasoning sangat panjang bisa terpotong.
  • Jangan menyamakan "badge reasoning" dengan kebenaran terjamin; verifikasi output kritis.

Penyelesaian masalah

Berpikir tak pernah selesai, atau jawaban tercampur reasoning: ketidakcocokan template — lihat Masalah model.

Terkait