Skip to content

Chọn model: session, skill, subagent

Model được đặt ở hai chỗ, và đó là thứ quyết định cách đổi nó:

  • Session model — vòng lặp chính, đặt bằng /model, ghim full ID trong ~/.claude/settings.json. Mọi skill chạy ở đây và luôn dùng model này.
  • Subagent model — agent dispatch qua Agent tool: ghim riêng (frontmatter full ID, hoặc tham số model enum), hoặc kế thừa session khi không đặt.

Một skill không tự nâng model được. Muốn một bước bắt buộc chạy Opus: giữ session ở Opus, hoặc đẩy việc đó qua agent có frontmatter ghi full ID.

Việc nào chạy model nào

Model mạnh điều phối, model rẻ làm phần song song — một agent tốn ~4× token so với chat, multi-agent ~15×, và Opus dẫn dắt + Sonnet subagent vượt Opus đơn lẻ (multi-agent).

Nguyên tắc (theo superpowers): dùng model ít mạnh nhất mà vẫn kham được role. Với subagent, tier do người dispatch tự phán đoán theo task — không ghim cứng một model cho mỗi chỗ; ghim full ID là việc của session (settings.json), không phải của dispatch. Haiku hợp chỗ miss thì rẻ (transcription sai → fail test → fix loop bắt); KHÔNG hợp chỗ miss là false-negative âm thầm và đắt (review, chẩn đoán bug, drift cross-repo) — chỗ đó "kham được" phải đọc thận trọng, sàn sonnet.

NơiModelVì sao
Agent code-reviewerclaude-opus-4-8Review nặng phán đoán; ship hạ tier cho diff nhỏ
Agent scout, ui-verifiersonnetDò/tổng-hợp phụ thuộc, thẩm định visual — phán đoán nhẹ, nhiều bước; haiku miss âm thầm
cook bước 0–5 (brainstorm→analyze)Session (Opus)Quyết định thiết kế, chạy ở vòng lặp chính
cook bước 6 implementertheo SDD Model Selection — tier rẻ nhất cho transcription; standard (sonnet) từ prose / integration; bỏ model lên Opus khi phán đoán; người dispatch tự chọn theo taskTranscription không cần raised effort → tier rẻ; haiku KHÔNG ghép xhigh (nó âm thầm hạ)
review T1sonnet <50 LOC / midDiff nhỏ dùng model rẻ; không xuống haiku — review haiku grade tệ hơn
review T2 fan-outsonnet; contracts lên opus khi chạm contract chia sẻSâu hơn ở phần rủi ro
review T3security+contracts opus; bugs/perf/types sonnet; verify opusBlast radius auth/contract cần model mạnh
review adviser · fix · gatesonnetadviser=chất lượng lời khuyên; fix=chẩn đoán (nặng phán đoán); gate=drift cross-repo, miss âm thầm+đắt
Explorepin ≤ sonnet khi dispatch — KHÔNG để kế thừa OpusTìm kiếm rộng: chạy search ở top tier là lãng phí thuần (fix/gate đã pin sẵn)

Đổi model

  • Xuống tier: đặt model: 'sonnet' hoặc 'haiku' (tham số dispatch nhận enum tier, không phải full ID). Lên top tier: bỏ tham số model (kế thừa session) — đừng đặt alias opus, nó trôi sang bản mới nhất.
  • Effort quan trọng hơn tier với code, nhưng chỉ với model chạy được nó: claude-haiku-4-5 không hỗ trợ xhigh (bị âm thầm hạ effort, không báo lỗi). Nên đừng ghép haiku với xhigh — task transcription chạy haiku ở effort mặc định (đủ dùng), còn sonnet + xhigh để dành cho task làm từ prose nơi dial mạnh mới đáng tiền. Cách này thay cho việc floor cứng tier ở sonnet.

Ghi chú

  • Ghim full ID cho session, không dùng alias. opus trỏ bản opus mới nhất và âm thầm override phiên bản đã ghim — với team, đó là cả team đổi hành vi một đêm mà không ai review. Full ID (trong settings.json) khóa hành vi session lại; nâng cấp là bump con số sau khi kiểm chứng qua gate + luồng thật. Còn dispatch subagent thì chọn tier theo phán đoán từng task (superpowers) — không ghim full ID ở đó.
  • Chưa lên Opus 5. Không phải vì nó kém — Anthropic công bố ngang giá 4.8 và dẫn đầu benchmark hard-agentic (opus-5). Nhưng chính hướng dẫn prompt Opus 5 của Anthropic nêu các mặc định gây tranh cãi: dài hơn, tự verify khi không được yêu cầu, mở rộng scope ngoài yêu cầu, delegate nhiều hơn. Ghim giữ cho team quyền đổi có kiểm chứng thay vì để alias tự quyết.
  • "Bỏ harness khi model mạnh" chỉ đúng với prompt thừa. Anthropic tắt mặc định TodoWrite/Task trên model mới vì chúng tự track — đó là bỏ prompt, không phải bỏ kiến trúc. Gate xác định, route model rẻ, tái lập cả team, quan sát được: không phần nào là prompt scaffolding, nên giữ.

Liên quan

  • Gate fail-open — các gate xác định là một nửa harness.
  • Ba lớp — nơi các lựa chọn model sống.
  • Review và gate — tier review chọn model theo kích thước và blast radius.