跳到主要内容

模型与提供商目录参考手册

Ante 根据**目录(Catalog)**解析每个提供商与模型:包括本文档中记录的内置预设,以及在启动时合并覆盖的 ~/.ante/catalog.json。目录在每个进程启动时读取一次 —— 修改后请重启 Ante 以生效。

本页面为详尽的参考手册。关于日常选择提供商的流程与可直接复制的配置范例,请参阅模型提供商

内置提供商列表

提供商key通信协议格式 (Wire style)身份认证
AnthropicanthropicAnthropicMessageANTHROPIC_API_KEY
Anthropic Subscriptionanthropic-subscriptionAnthropicMessageOAuth
OpenAIopenaiOpenAiResponseOPENAI_API_KEY
OpenAI Compatibleopenai-compatibleOpenAiCompatibleOPENAI_COMPATIBLE_API_KEY
OpenAI Subscriptionopenai-subscriptionOpenAiResponseOAuth (Codex)
GeminigeminiGeminiGEMINI_API_KEY
Vertex AI Geminivertex-geminiGeminiVERTEX_GEMINI_API_KEY
Open RouteropenrouterOpenAiCompatibleOPENROUTER_API_KEY
Open Router Responsesopenrouter-responsesOpenAiResponseOPENROUTER_API_KEY
Open Router Anthropicopenrouter-anthropicAnthropicMessageOPENROUTER_API_KEY
Grok (xAI)xaiOpenAiResponseXAI_API_KEY
ZaizaiOpenAiCompatibleZAI_API_KEY
DeepSeekdeepseekOpenAiCompatibleDEEPSEEK_API_KEY
Ali Coding Planali-coding-planAnthropicMessageALI_CODING_PLAN_API_KEY
AntixantixAnthropicMessageOAuth
Antix (API key)antix-api-keyAnthropicMessageANTIX_API_KEY
LocallocalOpenAiCompatible

key 列即为传递给 --provider 的参数值。通过 OAuth 认证的提供商(anthropic-subscriptionopenai-subscriptionantix)在 TUI 中通过交互式向导登录;其余提供商从列出的环境变量中读取 API 密钥。

各提供商的模型清单

每个提供商均预设了一组 preferred_models —— 即在模型选择器中展示的模型 ID。当您选择提供商而未显式指定模型时,Ante 默认选用其**权重等级最高(heaviest-weight)**的模型(参见权重等级),而非简单地选择列表第一项。显式指定的提供商具有最高权威性:若传入了 --provider,即使该模型 ID 未列在 preferred_models 中,Ante 也会将该模型 ID 发送给该提供商(参见解析规则)。

Anthropic

anthropicanthropic-subscription 提供相同的模型:

模型 ID说明上下文大小
claude-haiku-4-5极速响应,接近前沿智能水平200K
claude-sonnet-5速度与智能的最佳平衡1M
claude-opus-5复杂智能体编码与企业级任务1M
claude-fable-5-1针对高要求推理的最强能力1M
ante --provider anthropic --model claude-sonnet-5

OpenAI

模型 ID说明上下文大小
gpt-5.6-solGPT-5.6 旗舰模型,擅长复杂推理与系统级编码1.05M
gpt-5.6-terraGPT-5.6 智能水平与 Token 成本的极佳平衡1.05M
gpt-5.6-luna面向高效、大规模高吞吐任务的 GPT-5.6 模型1.05M
gpt-5.5-pro复杂问题上的最高稳定性400K
gpt-5.4-proGPT-5.4 系列中可靠性最高的主力400K
gpt-5.3-codex前沿代码专精模型400K
gpt-5.4-mini更快、更经济的 GPT-5.4 模型400K
gpt-5.4-nanoGPT-5.4 家族最小轻量模型400K
ante --provider openai --model gpt-5.6-sol

openai-subscription 提供商(ChatGPT/Codex OAuth)支持 gpt-5.6-solgpt-5.6-terragpt-5.6-luna(272K 上下文),以及 gpt-5.5gpt-5.4gpt-5.4-mini(400K 上下文)。

OpenAI 传输协议

openaiopenai-subscription 提供商支持两种流式响应传输方式:

传输协议端点地址默认状态
http_sse (HTTP + SSE)https://api.openai.com/v1/responses(或订阅对应端点)
websocket_auto (持久化 WebSocket)wss://.../v1/responses可选启用

WebSocket 模式在每个会话中保持单条长连接,并通过 previous_response_id 仅传递新增输入项以继续下一轮 Turn。在长链路的智能体工具调用循环中,这能显著消除每轮往返的网络建立延迟。协议细节可参考 OpenAI 的 WebSocket 模式指南

通过进程级环境变量启用(默认为 http_sse):

ANTE_OPENAI_TRANSPORT=websocket_auto ante --provider openai --model gpt-5.4-mini

支持的值:http_ssewebsocket_auto。未识别的值会打印警告并回退至 http_sse

注意事项:

  • WebSocket 仅在流式轮次(TUI 会话)中启用。无头 --prompt 模式使用非流式 chat() 并按设计跳过 WS。

  • 任何临时的 WS 故障(连接超时、网络抖动)会在该轮次中自动回退至 HTTP/SSE —— 用户绝不会因为传输协议选型而遭遇硬错误。认证失败(401/403)会将整个会话在其生命周期内永久切换至 HTTP/SSE。

  • 同时适用于 api.openai.com(API Key)与 ChatGPT 订阅后端 chatgpt.com/backend-api/codex

  • 验证当前激活的传输方式:在调试构建中按 Ctrl+L 打开调试面板查看 Info 选项卡中的 OpenAI Transport: 行;或在日志中检索 transport selected

    grep "transport selected" ~/.ante/logs/*/ante.*.log

Gemini

geminivertex-gemini 提供相同的模型:

模型 ID说明上下文大小
gemini-3.8-flashGemini 3.8 Flash,适用于长程编码与自主智能体1.05M
gemini-3.7-flashGemini 3.7 Flash,适用于快速智能体与多模态工作流1.05M
gemini-3.6-flashGemini 3.6 Flash,适用于智能体与多模态工作流1M
gemini-3.1-pro-preview具备深度思考能力的 Gemini 3.1 Pro1M
gemini-3.1-pro-preview-customtools针对自定义工具调用优化的 Gemini 3.1 Pro1M
gemini-3.5-flash-lite最快、成本最低的 Gemini 3.5 模型,适用于高吞吐量任务1M
ante --provider gemini --model gemini-3.1-pro-preview

Grok (xAI)

模型 ID说明上下文大小
grok-4.6Grok 4.6 旗舰推理模型500K
ante --provider xai --model grok-4.6

Zai(智谱)

模型 ID说明上下文大小
glm-5.3最新 GLM-5.3 模型,适用于编程与智能体任务1M
ante --provider zai --model glm-5.3

Open Router

Open Router 拆分为共享同一 API 密钥的三个提供商(按协议方言划分):openrouter(兼容 OpenAI Chat Completions)、openrouter-responses(OpenAI Responses)与 openrouter-anthropic(Anthropic Messages)。

openrouter 预设模型:

模型 ID说明上下文大小
deepseek/deepseek-v4-flash-0731DeepSeek V4 Flash 07311.05M
google/gemini-3.8-flashGemini 3.8 Flash,适用于长程编码与自主智能体1.05M
google/gemini-3.7-flashGemini 3.7 Flash 快速多模态智能体工作流1.05M
x-ai/grok-4.6通过 OpenRouter 调用的 Grok 4.6 旗舰推理模型500K
qwen/qwen3.8-max通义千问 3.8 旗舰多模态推理模型1M
qwen/qwen3.7-plus高性价比且支持视觉的通义千问 3.7 模型1M
qwen/qwen3.7-flash超低成本通义千问 3.7 多模态推理模型1M
meta/muse-spark-1.3Muse Spark 1.3 多模态智能体推理模型1.05M
tencent/hy3腾讯混元 Hy3 智能体推理模型262K
xiaomi/mimo-v2.5-pro小米 MiMo-V2.5-Pro 旗舰智能体模型1.05M
xiaomi/mimo-v2.5小米 MiMo-V2.5 全模态模型1.05M
z-ai/glm-5.3通过 OpenRouter 调用的 GLM 5.3 编程与智能体推理模型1.05M
moonshotai/kimi-k3月之暗面 Kimi K3 旗舰多模态推理模型1.05M
moonshotai/kimi-k2.7-code支持视觉的 Kimi K2.7 Code 代码推理模型262K
minimax/minimax-m3MiniMax M3 多模态模型512K
deepseek/deepseek-v4-pro-0813DeepSeek V4 Pro 0813 正式版1.05M

openrouter-responses 提供 openai/gpt-5.6-solopenai/gpt-5.6-sol-proopenai/gpt-5.6-terraopenai/gpt-5.6-terra-proopenai/gpt-5.6-lunaopenai/gpt-5.6-luna-pro(1.05M 上下文),以及 openai/gpt-5.3-codex(400K 上下文)。带有 -pro 后缀的 ID 会走 OpenRouter 的专业推理路由。

openrouter-anthropic 通过 Anthropic Messages 协议提供 Claude 家族:anthropic/claude-haiku-4.5(200K 上下文),以及 anthropic/claude-sonnet-5anthropic/claude-opus-5anthropic/claude-opus-5-fastanthropic/claude-fable-5.1(1M 上下文)。

每个提供商还可以通过完整 ID 调用 Open Router 模型列表 中的任意模型,只要其符合该提供商的协议格式即可。

ante --provider openrouter --model deepseek/deepseek-v4-pro-0813
ante --provider openrouter-responses --model openai/gpt-5.6-sol
ante --provider openrouter-anthropic --model anthropic/claude-fable-5.1

DeepSeek

模型 ID说明上下文大小
deepseek-v4-flashDeepSeek V4 Flash 快速模型1M
deepseek-v4-proDeepSeek V4 Pro 旗舰深度思考模型1M
ante --provider deepseek --model deepseek-v4-flash

需配置环境变量 DEEPSEEK_API_KEY,可选配置 DEEPSEEK_BASE_URL

Ali Coding Plan(阿里代码计划)

模型 ID说明上下文大小
qwen3.5-plus支持视觉的 Qwen 3.5 Plus1M
qwen3.6-plus最新的 Qwen 3.6 Plus(带视觉)1M
glm-5.1GLM-5.1 模型200K
MiniMax-M2.5MiniMax M2.5 模型205K
qwen3-max-2026-01-23Qwen 3 Max 快照版本1M
qwen3-coder-nextQwen 3 Coder Next 代码模型1M
qwen3-coder-plusQwen 3 Coder Plus 代码模型1M
qwen-plus快速且高能力1M
ante --provider ali-coding-plan --model qwen3.5-plus

需要开通阿里云百炼代码计划订阅并获取 API 密钥(格式如:sk-sp-xxxxx)。内置提供商采用 Anthropic 协议端点。部分模型仅在 OpenAI 兼容端点提供 —— 可通过自定义目录项添加接入:

{
"providers": {
"ali-coding-plan-oai": {
"display_name": "Ali Coding Plan (OpenAI)",
"base_url": "https://coding.dashscope.aliyuncs.com/v1",
"auth": { "bearer": { "env_key": "ALI_CODING_PLAN_API_KEY" } },
"wire_style": "OpenAiCompatible",
"http_headers": {
"User-Agent": "ante-cli/1.0.0",
"X-DashScope-UserAgent": "coding-agent"
}
}
}
}

Antix

antix(OAuth)与 antix-api-key(API Key)通过 Antigma 平台提供相同模型:

模型 ID说明上下文大小
gemini-3.7-flashGemini 3.7 Flash,适用于快速智能体与多模态工作流1M
grok-4.5Grok 4.5,xAI 专为代码与智能体打造的旗舰500K
grok-4.6Grok 4.6 旗舰推理模型500K
kimi-k3Kimi K3 旗舰多模态推理模型1M
qwen3.7-max最新 Qwen 3.7 Max1M
qwen3.7-plus最新 Qwen 3.7 Plus1M
gemini-3.1-pro-preview具备深度思考的 Gemini 3.1 Pro1M
claude-haiku-4-5快速且高能力200K
claude-sonnet-5速度与智能的最佳平衡1M
claude-opus-5复杂智能体编码与企业级任务1M
claude-fable-5-1最强大的 Claude 模型1M
gpt-5.3-codex针对代码深度优化的 Codex 模型
gpt-5.4-mini更快、更经济的 GPT-5.4 模型400K
gpt-5.4-nanoGPT-5.4 家族最小轻量模型400K
deepseek-v4-flash高速 DeepSeek V4 Flash1M
deepseek-v4-pro具备深度思考的 DeepSeek V4 Pro1M
glm-5.3最新 GLM-5.3 模型,适用于编程与智能体任务1M
glm-5.3-flash快速 GLM-5.3 Flash,适用于编程与智能体任务1M
ante --provider antix --model claude-sonnet-5 # OAuth
ante --provider antix-api-key --model claude-sonnet-5 # ANTIX_API_KEY

Local(本地模型)

通过内置的 llama.cpp 引擎在本地运行 GGUF 模型 —— 无需 API 密钥。local 是通配提供商;其可用模型取决于离线服务端当前加载的模型,且仅在有活跃服务注册时才存在于目录中。在未启动服务时选择 local 会弹出提示通知。详见离线模式

ante --provider local

catalog.json 配置规范

启动时,~/.ante/catalog.json 会合并覆盖在内置预设之上。包含两个可选的顶层键:

{
"providers": { /* 添加或覆盖提供商 */ },
"models": { /* 覆盖现有模型的字段属性 */ }
}

providers 中,若 key 匹配内置提供商(如 openai),则逐字段修改该预设;若为新 key 则添加新提供商。Map 的 key 即为传递给 --provider 的名称。内部的 id(或历史 name)字段会被忽略。

备注

~/.ante 目录可通过环境变量 ANTE_HOME 重定向;目录配置文件路径始终为 $ANTE_HOME/catalog.json

提供商字段

字段必填说明
display_name新增提供商:可选在 TUI 中展示的友好名称。省略时默认使用 map key
base_url新增提供商:✅API 基础 URL
wire_style新增提供商:✅Ante 通信采用的 API 方言 —— AnthropicMessageOpenAiCompatibleOpenAiResponseGemini
auth认证方式(参见身份认证)。无需密钥的提供商可省略
http_headers随每次请求发送的额外自定义 HTTP Header 映射表(string→string)
extra_body合并到每个 Chat 和 Streaming 请求体顶层的专属 JSON 字段(参见额外请求字段
supports_web_search该提供商是否提供原生网络搜索功能。为 true 时自动向该提供商的会话添加 WebSearch 工具;为 false(默认)时不提供
preferred_models在选择器中展示并作为默认模型的推荐列表(参见模型字段)。对于内置提供商,匹配的模型 ID 会被合并修改,新 ID 会被追加;省略时保持内置列表不变
stream_idle_timeout_secs提供商请求在超时报错前允许的最长空闲时间(秒)。流式调用涵盖等待首个事件及 SSE/WebSocket 后续事件间隔;缓冲调用则限制收集响应期间的整个请求时长。默认 300 秒。慢速本地模型或代理端点可适当调大
{
"providers": {
"my-provider": {
"display_name": "My Provider",
"base_url": "https://api.example.com/v1",
"wire_style": "OpenAiCompatible",
"auth": { "bearer": { "env_key": "MY_PROVIDER_API_KEY" } },
"http_headers": { "X-Org": "my-team" },
"preferred_models": [
{
"id": "my-model",
"description": "My fine-tuned model",
"max_tokens": 32000,
"context_limit": 200000,
"effort": "medium"
}
]
}
}
}

针对内置提供商,仅需填写希望修改的字段。将可选字段设置为 null 可清除预设值,这在将提供商重新指向不应发送内置认证或请求头的本地代理时非常有用:

{
"providers": {
"openai": {
"base_url": "http://localhost:8080/v1",
"auth": null,
"http_headers": null
}
}
}

额外请求字段

部分网关或代理需要 Ante 原生未建模的特定参数(服务等级、路由提示、厂商专属 Beta 字段)。extra_body 是一个 JSON 对象,会直接合并到发送给该提供商的每个请求体顶层:

{
"providers": {
"my-gateway": {
"base_url": "https://gateway.example.com/v1",
"wire_style": "OpenAiCompatible",
"auth": { "bearer": { "env_key": "MY_GATEWAY_API_KEY" } },
"extra_body": {
"service_tier": "priority",
"routing": { "region": "us-east" }
}
}
}
}

参数值原样透传,因此支持任意 JSON 结构。在内置提供商覆盖层中,extra_body 会逐键合并到预设中 —— 匹配的键被替换,其他键保留。

extra_body 只能追加新字段,绝不能覆盖 Ante 为选定 wire_style 生成的保留关键字:

wire_style保留关键字列表
AnthropicMessagemodel, max_tokens, messages, system, temperature, tools, stream, thinking, stop_sequences, output_config, cache_control
OpenAiCompatiblemodel, messages, reasoning_effort, max_tokens, stream, stream_options, temperature, top_p, top_k, stop, tools, tool_choice, thinking, enable_thinking, thinking_budget, enable_search, search_options
OpenAiResponsemodel, instructions, input, tools, tool_choice, parallel_tool_calls, max_output_tokens, temperature, reasoning, stream, include, store
Geminicontents, systemInstruction, generationConfig, tools, toolConfig

保留关键字在加载目录时会被自动丢弃并在启动提示中命名;提供商的其余配置仍正常加载。若想修改这些参数,请使用模型字段环境变量覆盖

Skipped 1 entry in ~/.ante/catalog.json:
- providers.my-gateway.extra_body: ignoring Ante-owned request field(s): model

身份认证配置

auth 是一个带标签的对象:标签指定凭据传递位置,凭据可以为环境变量(env_key)或 Ante 内置的 OAuth 流程(oauth_preset)。

形式JSON 声明实际网络发送
Bearer Token{ "bearer": { "env_key": "MY_KEY" } }Authorization: Bearer <token>
自定义 Header{ "header": { "name": "x-api-key", "env_key": "MY_KEY" } }<name>: <token>
Query URL 参数{ "query": { "name": "api_key", "env_key": "MY_KEY" } }?<name>=<token>

使用 oauth_preset 接入内置 OAuth 流程(anthropicopenaiantix)而非环境变量:

"auth": { "bearer": { "oauth_preset": "anthropic" } }

提供商在凭据存在时即被视为已认证 —— 环境变量已设置且非空,或磁盘上存在 OAuth Token。没有 auth 块的提供商始终被视为已认证。未认证的提供商在自动检测过程中会被跳过,并在选择器中排在最后。

模型字段

这些字段既可在提供商的 preferred_models 中完整声明模型(此时 id 必填),也可在顶层 models 下部分覆盖已有模型(此时由 map key 提供 id)。除 ID 以外的所有字段均为可选:

字段说明
id模型 ID。在 preferred_models 中必填(兼容历史别名 name);在 models 下由 key 提供
display_name友好展示名称
description在模型选择器中展示的简短说明
temperature采样温度。在 AnthropicMessage 提供商上,开启思考推理时必须为 1 —— 带有 effort 等级时若设置其他值,轮次会直接显式报错
top_pNucleus 采样截断阈值
top_kTop-k 采样截断阈值
max_tokens单轮最大输出 Token 数。在需要显式思考预算的 AnthropicMessage 提供商上,设置思考等级时必须大于 1024 —— API 的最低预算要求
stop_sequences停止生成的标记字符串列表
context_limit上下文窗口上限(Token 数)
effort默认思考深度等级 —— minlowmediumhighxhighmax。不支持推理调节的模型请省略(Ante 不会发送 effort 参数并隐藏滑块)
supported_efforts该模型在当前提供商上接受的思考深度级别,按升序排列(取值同 effort)。它会替换内置档位:滑块只显示这些级别,OpenAI 兼容提供商会发送同名 reasoning_effortmin 在线上拼写为 minimal)。空列表表示模型不接受思考深度设置;省略则保留内置档位
weight_class规模/成本等级 —— Feather(轻量/快速/低成本)、Middle(中等)或 Heavy(最大/能力最强)。驱动默认模型与辅助模型选取(参见权重等级
support_vision是否支持图片输入。省略时 Ante 根据模型 ID 自动推断;对无视觉支持的模型读取图片时返回图片元数据而非像素

顶层 models 可在解析阶段针对模型 ID 原地打补丁,层叠在标准规格之上。内置预设中该部分为空:

{
"models": {
"claude-sonnet-5": { "effort": "high", "max_tokens": 64000 }
}
}

权重等级

每个内置模型均带有 weight_classFeatherMiddleHeavy),Ante 根据此属性自动进行智能选择:

  • 默认模型 — 选择提供商但未指明具体模型时,默认解析为其 Heavy 旗舰模型。
  • 环境感知 UI 调用 — 加载状态语和下一提示词建议等装饰性调用会在提供商拥有 Feather 或 Middle 模型时选用其最轻量模型。WebFetch 会把网页内容直接返回给当前会话模型,不走此路径。

未设置 weight_class 的模型回退到目录声明顺序。在自定义模型上设置 weight_class 可以精确引导这些自动化选择。

模型与提供商的解析仲裁规则

解析模型 ID 时分层覆盖(后生效者覆盖前者):

  1. 规范声明(Canonical spec) — 目录中首个(按目录顺序)在其 preferred_models 中列出该 ID 的提供商。未知 ID 回退为纯基础默认规格。
  2. models 覆盖 — 用户在 models 中对该 ID 的局部配置(若有)。
  3. 环境变量覆盖 — 进程环境变量优先级高于一切。

提供商与模型的匹配: 若仅传入 --model,Ante 会挑选已认证且其 preferred_models 列表包含该 ID 的提供商,其次回退至没有 preferred_models 的已认证提供商,最后回退至默认提供商。

若同时传入 --provider--model,显式指定的提供商只要通过认证即优先胜出。Ante 仍会首先全局解析模型 ID,因此已知 ID 即使由不同提供商提供,也会继承目录元数据和用户覆盖;未知 ID 作为裸模型规格原样透传。

当未传入 --model / --provider 时,Ante 执行自动检测:按目录顺序选用第一个已认证提供商的最高权重模型(参见权重等级),若均未认证则回退到 local

环境变量覆盖

无需编辑文件即可覆盖会话级目录参数:

环境变量覆盖目标字段
MODEL_BASE_URL所有提供商的基础 URL(专属变量如 ANTHROPIC_BASE_URL 优先级更高)
MODEL_TEMPERATUREtemperature
MODEL_TOP_Ptop_p
MODEL_MAX_TOKENSmax_tokens
MODEL_CONTEXT_LIMITcontext_limit

思考深度(Effort)无通用环境变量 —— 请通过命令行参数 --effort 或配置文件中的 effort 字段指定。

多个预设也支持专属的 base-URL 环境变量,且优先级高于 MODEL_BASE_URLANTHROPIC_BASE_URLOPENAI_BASE_URLOPENAI_COMPATIBLE_BASE_URLOPENROUTER_BASE_URLDEEPSEEK_BASE_URL

容错处理

单个无效条目不会破坏整个配置文件。Ante 对 catalog.json 进行宽容解析:任何反序列化失败的提供商或模型条目会被跳过,其余条目仍正常加载。跳过的条目会在启动时报告,例如:

Skipped 1 entry in ~/.ante/catalog.json:
- providers.my-provider: missing field `base_url`

仅当文件**根本不是一个 JSON 对象(isn't a JSON object at all)**时才会被整体拒绝。缺少 catalog.json 完全正常 —— Ante 会直接使用内置预设。