Skip to main content
配置 model ID、端点、凭证、API 协议和端点专属 推理参数。 AgentCompass 不维护固定的 model 名称注册表。model ID 由你实际评测的端点提供,也是agentcompass run 的第三个位置参数:
runtime 将该 ID 与端点、凭证、API 协议和推理参数一起存入 ModelSpec,再由所选 Harness 决定如何使用。

model API 协议列表

不同 provider 的 model ID 各不相同,但 AgentCompass 定义了三个协议 ID;它们也会出现在agentcompass list dump 输出中。 协议支持还取决于所选 Harness。端点实现了 OpenAI Chat,并不意味着它能搭配要求响应或Anthropic Messages 行为的 Harness。 --model-api-protocol 可以直接使用上表中的协议 ID。不传该参数或传入 auto 时,由所选 Harness 决定协议;例如 codex 默认使用 openai-responsesclaude_code 使用 anthropic 也可以传入有序 JSON 数组,例如 '["openai-responses","openai-chat"]'。Harness 会选择第一个自身支持的协议;该数组不表示请求失败后的回退,且不能包含 auto

配置 ModelSpec

运行参数参考介绍 model 位置参数和 --model-* 参数;它们共同构造以下ModelSpec 字段:

配置连接信息

一个 agentcompass run 只包含一个 ModelSpec。如需比较多个 model ID,请使用agentcompass launch 为每个 model 声明一个具名请求;这样端点和推理设置的差异是显式的,而不是复制一份隐式对比模板。 统一导出 model 连接信息,避免凭证进入命令历史:

配置 params 字段

--model-params <json> 没有一套 AgentCompass 全局生成结构。可接受字段是以下三个契约的交集:
常见 model 参数可按用途分为以下几类: 这些名称默认不具备可移植性。例如 OpenAI Chat 常用 max_tokens,OpenAI 响应使用max_output_tokens 等响应专属 字段,Anthropic Messages 也有自己的必填请求结构。各协议页面说明 AgentCompass 的转发方式。 所选 Harness 页面同样是权威来源。CLI 驱动 Harness 可能把 ModelSpec 转换为自己的配置文件,而不是通过AgentCompass 原生协议客户端直接转发 --model-params --model-params 必须是合法 JSON。CLI 值会深度合并到配置文件的 model.params 同名字段上。只传入与有效端点和 Harness 默认值不同的字段。

配置评委与分析 model

部分 Benchmark 和分析器使用额外 model 配置进行评判或定性分析。这些嵌套配置使用相同概念——model ID、基础 URL、API 密钥、协议和参数——但归属于对应组件:
  • Benchmark 评委 model 通常位于 --benchmark-params,例如 judge_model
  • 分析器 model 位于 --analysis-params,例如 QualitativeAnalyzer
  • 工具专属摘要 model 可能属于所选 Harness。
除非 Benchmark 或 Harness 明确声明对应结构,不要把评委凭证放入主要 --model-params 对象。

排查 model 配置

先把失败缩小到一个任务,检查 Harness 和端点错误,再修改多个 model 参数。