judges use claude-opus-4-8; everything else stays on sonnet-4-6
Both LLM-as-judge sites — the door governor (Runtime::judge) and the topology comparison scorer (JudgeScorer) — now use the judge model (default claude-opus-4-8, override CLAWMATES_JUDGE_MODEL). Execution/reasoning turns keep using the configured default model (claude-sonnet-4-6). Co-Authored-By: Claude Opus 4.8 <[email protected]>
This commit is contained in:
co-authored by
Claude Opus 4.8
parent
e0e150084d
commit
325038e806
@@ -91,10 +91,14 @@ pub async fn compare_topologies(
|
||||
Json(req): Json<CompareRequest>,
|
||||
) -> Result<Json<Comparison>, ApiError> {
|
||||
let provider = state.runtime.provider();
|
||||
// Execution turns run on the configured default model (sonnet); the judge
|
||||
// uses the stronger judge model (default claude-opus-4-8).
|
||||
let model = state.runtime.model().to_string();
|
||||
let judge_model =
|
||||
std::env::var("CLAWMATES_JUDGE_MODEL").unwrap_or_else(|_| "claude-opus-4-8".to_string());
|
||||
let executor =
|
||||
ProviderExecutor::new(provider.clone(), model.clone(), state.runtime.max_tokens());
|
||||
let scorer = JudgeScorer::new(provider, model, 16);
|
||||
ProviderExecutor::new(provider.clone(), model, state.runtime.max_tokens());
|
||||
let scorer = JudgeScorer::new(provider, judge_model, 16);
|
||||
let cmp = compare(&req.graphs, &req.task, &executor, &scorer)
|
||||
.await
|
||||
.map_err(|_| ApiError::Internal)?;
|
||||
|
||||
Reference in New Issue
Block a user