agentcompass run 的第三个位置参数:
ModelSpec,再由所选 Harness 决定如何使用。
model API 协议列表
不同 provider 的 model ID 各不相同,但 AgentCompass 定义了三个协议 ID;它们也会出现在agentcompass list dump 输出中。
协议支持还取决于所选 Harness。端点实现了 OpenAI Chat,并不意味着它能搭配要求响应或Anthropic Messages 行为的 Harness。
--model-api-protocol 可以直接使用上表中的协议 ID。不传该参数或传入 auto 时,由所选 Harness 决定协议;例如 codex 默认使用 openai-responses,claude_code 使用 anthropic。
也可以传入有序 JSON 数组,例如 '["openai-responses","openai-chat"]'。Harness 会选择第一个自身支持的协议;该数组不表示请求失败后的回退,且不能包含 auto。
配置 ModelSpec
运行参数参考介绍 model 位置参数和--model-* 参数;它们共同构造以下ModelSpec 字段:
配置连接信息
一个agentcompass run 只包含一个 ModelSpec。如需比较多个 model ID,请使用agentcompass launch 为每个 model 声明一个具名请求;这样端点和推理设置的差异是显式的,而不是复制一份隐式对比模板。
统一导出 model 连接信息,避免凭证进入命令历史:
配置 params 字段
--model-params <json> 没有一套 AgentCompass 全局生成结构。可接受字段是以下三个契约的交集:
这些名称默认不具备可移植性。例如 OpenAI Chat 常用
max_tokens,OpenAI 响应使用max_output_tokens 等响应专属 字段,Anthropic Messages 也有自己的必填请求结构。各协议页面说明 AgentCompass 的转发方式。
所选 Harness 页面同样是权威来源。CLI 驱动 Harness 可能把 ModelSpec 转换为自己的配置文件,而不是通过AgentCompass 原生协议客户端直接转发 --model-params。
--model-params 必须是合法 JSON。CLI 值会深度合并到配置文件的 model.params 同名字段上。只传入与有效端点和 Harness 默认值不同的字段。
配置评委与分析 model
部分 Benchmark 和分析器使用额外 model 配置进行评判或定性分析。这些嵌套配置使用相同概念——model ID、基础 URL、API 密钥、协议和参数——但归属于对应组件:- Benchmark 评委 model 通常位于
--benchmark-params,例如judge_model。 - 分析器 model 位于
--analysis-params,例如QualitativeAnalyzer。 - 工具专属摘要 model 可能属于所选 Harness。
--model-params 对象。
排查 model 配置
先把失败缩小到一个任务,检查 Harness 和端点错误,再修改多个 model 参数。
