judges use claude-opus-4-8; everything else stays on sonnet-4-6

Both LLM-as-judge sites — the door governor (Runtime::judge) and the topology
comparison scorer (JudgeScorer) — now use the judge model (default
claude-opus-4-8, override CLAWMATES_JUDGE_MODEL). Execution/reasoning turns keep
using the configured default model (claude-sonnet-4-6).

Co-Authored-By: Claude Opus 4.8 <[email protected]>
This commit is contained in:
Omar Sobh
2026-06-17 03:36:43 -07:00
co-authored by Claude Opus 4.8
parent e0e150084d
commit 325038e806
2 changed files with 19 additions and 5 deletions
+6 -2
View File
@@ -91,10 +91,14 @@ pub async fn compare_topologies(
Json(req): Json<CompareRequest>,
) -> Result<Json<Comparison>, ApiError> {
let provider = state.runtime.provider();
// Execution turns run on the configured default model (sonnet); the judge
// uses the stronger judge model (default claude-opus-4-8).
let model = state.runtime.model().to_string();
let judge_model =
std::env::var("CLAWMATES_JUDGE_MODEL").unwrap_or_else(|_| "claude-opus-4-8".to_string());
let executor =
ProviderExecutor::new(provider.clone(), model.clone(), state.runtime.max_tokens());
let scorer = JudgeScorer::new(provider, model, 16);
ProviderExecutor::new(provider.clone(), model, state.runtime.max_tokens());
let scorer = JudgeScorer::new(provider, judge_model, 16);
let cmp = compare(&req.graphs, &req.task, &executor, &scorer)
.await
.map_err(|_| ApiError::Internal)?;