Advisor Tool Claude Code: Model Kedua di Momen Penting

Sebuah server tool yang membuat Claude bisa berkonsultasi ke model kedua, biasanya lebih kuat, di momen penting selama sebuah tugas — sebelum berkomitmen pada pendekatan, ketika sebuah error terus berulang, atau sebelum menyatakan tugasnya selesai. Advisor-nya menerima seluruh percakapan termasuk panggilan tool dan hasilnya, lalu mengembalikan panduan yang diterapkan Claude sebelum melanjut.
Tiga cara: perintah advisor menyetelnya di tengah sesi dan menyimpannya sebagai bawaan Anda, sebuah kunci settings model advisor mengonfigurasi bawaan permanen, dan sebuah flag peluncuran menyetelnya untuk satu sesi saja. Ia butuh model utama yang mendukung advisor, dan ia keluar saat peluncuran kalau pasangannya atau daftar model yang diizinkan organisasi Anda menolak pilihannya.
Advisor-nya harus setidaknya sekuat model utamanya. Sonnet sebagai utama menerima Opus, Fable, atau Sonnet 5; Opus 4.7 atau sesudahnya sebagai utama menerima Fable atau Opus lain di generasi itu; Fable sebagai utama hanya menerima Fable. Kalau advisor-nya lebih lemah ia sekadar tidak dilekatkan, dan perintahnya memberi tahu Anda.
Biasanya lebih murah. Tiap panggilan membuat advisor-nya membaca percakapannya dan memakan token dengan tarifnya, tapi Claude memanggilnya di titik keputusan ketimbang tiap giliran, jadi memasangkan model utama yang lebih cepat dengan advisor yang lebih kuat biasanya lebih murah daripada menjalankan model kuatnya sepanjang waktu. Pemakaian advisor muncul di total sesi Anda.
Dua syarat menghasilkan kesunyian ketimbang error. Advisor butuh Anthropic API, jadi ia tak tersedia di Amazon Bedrock, Claude Platform on AWS, Agent Platform milik Google Cloud, dan Microsoft Foundry. Ia juga dinyalakan lewat feature flag, jadi sesi yang mematikan pengambilan feature flag membiarkan advisor-nya mati.

Ringkasan Utama
Advisor tool memasangkan model utama Anda dengan model kedua, biasanya lebih kuat, yang dikonsultasikan Claude di momen penting — sebelum berkomitmen pada sebuah pendekatan, ketika sebuah error terus berulang, sebelum menyatakan tugasnya selesai. Advisor-nya menerima seluruh percakapan termasuk tiap panggilan tool dan hasilnya, lalu mengembalikan panduan yang diterapkan Claude sebelum melanjut. Ia berjalan di sisi server dan butuh Anthropic API.
Saya pernah menyaksikan sesi Sonnet memilih pendekatan yang masuk akal tapi salah untuk sebuah migrasi, menjalankannya dengan cakap selama dua puluh menit, dan baru menemukan masalahnya di titik ketika tesnya tidak mau lulus. Tak ada yang buruk soal eksekusinya. Keputusan di menit kedua itulah yang buruk, dan tidak ada momen di sepanjang jam itu ketika model yang lebih kuat diminta melihatnya.
Celah itulah yang ditutup advisor. Tulisan ini membahas apa ia, tiga cara menyalakannya, aturan pasangan yang menentukan advisor mana yang diterima sebuah model utama, apa yang Anda lihat ketika konsultasi terjadi, berapa biayanya dan kenapa ia biasanya lebih murah daripada menaikkan model utama, perilaku prompt cache-nya yang tidak biasa, serta perbandingannya dengan cara lain mendapat pendapat kedua.
Advisor adalah server tool yang berjalan di infrastruktur Anthropic, tersedia baik untuk akun berlangganan maupun yang ditagih lewat API. Anda memilih model mana yang bertindak sebagai advisor; Claude memutuskan kapan memanggilnya. Pembagian itulah seluruh desainnya — Anda tidak sedang mengonfigurasi peninjau kedua yang berjalan menurut jadwal, Anda memberi modelnya tempat untuk mengeskalasi.
Ia cocok untuk tugas panjang bertahap ketika sebagian besar giliran bersifat rutin tapi mutu rencananya menentukan hasilnya: refactor besar, debugging ketika error yang sama terus kembali, pekerjaan yang ingin Anda periksa secara independen sebelum dinyatakan selesai. Ia menambah sedikit di tugas pendek yang tak ada rencananya, dan di pekerjaan yang tiap gilirannya butuh model terkuat Anda sebaiknya sekadar berganti model.
Sebuah perintah menyetelnya di tengah sesi dan menyimpannya sebagai bawaan Anda, sebuah kunci settings mengonfigurasi bawaan permanen tanpa membuka sesi, dan sebuah flag peluncuran menyetelnya untuk satu sesi saja. Masing-masing menyalakan advisor untuk sesi yang model utamanya mendukungnya, dan sebuah notifikasi memberi tahu bahwa ia menyala begitu sesinya mulai.
/advisor # picker of available advisor models
/advisor opus # set directly; saved as your default
/advisor off # clear it
{ "advisorModel": "opus" } # persistent default in settings
claude --advisor opus # one session only
# Aliases resolve to Claude Code's built-in default for that
# family and advance with releases. A full model ID works too.
# It EXITS at launch if the main model does not support an
# advisor, if the requested model cannot act as one, or if your
# organisation's allowed-models list excludes it. A background
# session starts WITHOUT the advisor instead of exiting.
CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1
# the command becomes unavailable, a configured advisorModel is
# ignored, and --advisor is accepted but does nothingDua syarat menjebak orang. Advisor butuh Anthropic API — ia tidak tersedia di Amazon Bedrock, Claude Platform on AWS, Agent Platform milik Google Cloud, atau Microsoft Foundry, dan lewat gateway ia tergantung apakah permintaannya diteruskan utuh. Dan ia dinyalakan lewat feature flag yang diambil Claude Code, jadi di sesi yang menyetel variabel yang mematikan pengambilan flag, advisor-nya diam-diam tetap mati.
Advisor-nya harus setidaknya sekuat model utamanya, dan pemeriksaannya terjadi sebelum permintaan dikirim. Kalau advisor-nya lebih lemah, ia sekadar tidak dilekatkan dan baik keluaran perintahnya maupun sebuah notifikasi memberi tahu Anda — subagent yang modelnya sendiri memenuhi pasangannya masih boleh memakainya. Kombinasi spesifiknya lebih penting daripada aturannya.
Pasangan yang layak diketahui:
| Pasangan | Kapan memakainya |
|---|---|
| Sonnet utama, Opus advisor | Rekomendasi bawaannya. Sonnet menangani pekerjaan rutin dan mengeskalasi perencanaan, kegagalan yang ambigu, dan pemeriksaan penyelesaian |
| Haiku utama, Opus advisor | Model utama termurah dengan perencanaan yang kuat. Lebih mahal daripada Haiku saja, lebih murah daripada menaikkan model utamanya |
| Opus utama, Opus advisor | Opus kedua meninjau yang pertama. Untuk pekerjaan bertaruhan tinggi ketika pemeriksaan independen lebih penting daripada biaya |
| Fable, di sisi mana pun | Fable tingkat lebih tinggi, jadi Fable sebagai model utama hanya menerima advisor Fable. Di sebagian paket, advisor Fable juga butuh persetujuan usage credits sekali seumur lebih dulu |
Claude yang menentukan waktunya, dan transkripnya menunjukkannya terjadi. Perilaku setelah panduannya kembali adalah bagian yang layak dibaca cermat, karena ia lebih masuk akal daripada aturan sederhana turuti-apa-kata-advisor.
# In the transcript, while the call is in flight:
Advising · opus
# When it returns, one of two things:
# reviewed -> Ctrl+O expands the advisor's full guidance
# declined -> "Advisor declined to advise on this request",
# with the reason behind Ctrl+O if it gave one
# Claude generally follows the guidance, but adapts when its own
# evidence contradicts it: if a recommended step fails when tried,
# or the file contents say otherwise, it surfaces the conflict
# rather than following the advice unconditionally.
# You can ask for a consultation like any other tool:
# "consult the advisor before you continue"
# There is no setting to cap or force calls — say it in the
# instructions instead.Tidak ada setelan untuk membatasi atau memaksa panggilan advisor, yang mengagetkan orang yang mencari tombolnya. Tuasnya adalah instruksi Anda: meminta Claude berkonsultasi ke advisor sebelum melanjut bekerja persis seperti meminta tool lain, dan menyuruhnya berkonsultasi lebih sering atau lebih jarang selama sebuah tugas juga bekerja. Kalau Anda mau konsultasi terjamin di titik tertentu, katakan di prompt-nya.
Tiap panggilan membuat model advisor-nya membaca percakapannya, jadi ia memakan token dengan tarif model itu di atas pemakaian model utama Anda. Dengan penagihan API Anda membayar tarif input dan output advisor-nya; di langganan, pemakaian advisor dihitung ke batas paket Anda, dengan advisor Fable ditagihkan ke usage credits di paket tempat pemakaian Fable memang begitu.
Ekonominya bekerja karena Claude memanggilnya di titik keputusan ketimbang tiap giliran. Memasangkan model utama yang lebih cepat dengan advisor yang lebih kuat biasanya lebih murah daripada menjalankan model kuatnya sepanjang waktu — dan itulah seluruh argumen fiturnya, yang layak diuji di beban kerja Anda sendiri ketimbang diterima begitu saja. Pemakaian advisor muncul di total sesinya.
Menyalakan-mematikan advisor di tengah sesi tidak membatalkan prompt cache model utama Anda. Itu sungguh berbeda dari mengganti model atau effort level, yang keduanya membatalkannya, dan artinya Anda bisa menyalakan advisor di tengah percakapan panjang tanpa membayar pemrosesan ulang riwayatnya. Panduan yang dikembalikan advisor-nya lalu ter-cache sebagai bagian transkrip di giliran berikutnya.
Pembacaan advisor-nya sendiri tidak ter-cache. Tiap panggilan memproses seluruh transkripnya dari awal, tanpa pemakaian ulang antar panggilan — jadi biaya sebuah konsultasi tumbuh seiring percakapannya, sama seperti pembacaan tanpa cache lainnya. Itu argumen lain untuk advisor yang lebih kuat di tugas yang lebih pendek ketimbang di sesi yang sudah berjalan sepanjang sore.
Empat mekanisme menggabungkan kekuatan model, dan bedanya di kapan model kuatnya berjalan, bukan di apa yang bisa dilakukannya:
Cobalah pada bentuk tugas yang memang ia dibangun untuknya: refactor panjang atau sesi debugging ketika rencananya lebih penting daripada pengetikannya. Perhatikan vonisnya ketimbang keluarannya — panduan advisor di balik tombol perluasan memberi tahu apakah eskalasinya sepadan dengan biayanya. Dan kalau ia sama sekali tak tersedia, cek dua syaratnya sebelum yang lain, karena feature flag yang mati dan penyedia cloud sama-sama menghasilkan kesunyian, bukan error.
Sumber & bacaan lanjutan