模型与提供商目录参考手册
Ante 根据**目录(Catalog)**解析每个提供商与模型:包括本文档中记录的内置预设,以及在启动时合并覆盖的 ~/.ante/catalog.json。目录在每个进程启动时读取一次 —— 修改后请重启 Ante 以生效。
本页面为详尽的参考手册。关于日常选择提供商的流程与可直接复制的配置范例,请参阅模型提供商。
内置提供商列表
| 提供商 | key | 通信协议格式 (Wire style) | 身份认证 |
|---|---|---|---|
| Anthropic | anthropic | AnthropicMessage | ANTHROPIC_API_KEY |
| Anthropic Subscription | anthropic-subscription | AnthropicMessage | OAuth |
| OpenAI | openai | OpenAiResponse | OPENAI_API_KEY |
| OpenAI Compatible | openai-compatible | OpenAiCompatible | OPENAI_COMPATIBLE_API_KEY |
| OpenAI Subscription | openai-subscription | OpenAiResponse | OAuth (Codex) |
| Gemini | gemini | Gemini | GEMINI_API_KEY |
| Vertex AI Gemini | vertex-gemini | Gemini | VERTEX_GEMINI_API_KEY |
| Open Router | openrouter | OpenAiCompatible | OPENROUTER_API_KEY |
| Open Router Responses | openrouter-responses | OpenAiResponse | OPENROUTER_API_KEY |
| Open Router Anthropic | openrouter-anthropic | AnthropicMessage | OPENROUTER_API_KEY |
| Grok (xAI) | xai | OpenAiResponse | XAI_API_KEY |
| Zai | zai | OpenAiCompatible | ZAI_API_KEY |
| DeepSeek | deepseek | OpenAiCompatible | DEEPSEEK_API_KEY |
| Ali Coding Plan | ali-coding-plan | AnthropicMessage | ALI_CODING_PLAN_API_KEY |
| Antix | antix | AnthropicMessage | OAuth |
| Antix (API key) | antix-api-key | AnthropicMessage | ANTIX_API_KEY |
| Local | local | OpenAiCompatible | 无 |
key 列即为传递给 --provider 的参数值。通过 OAuth 认证的提供商(anthropic-subscription、openai-subscription、antix)在 TUI 中通过交互式向导登录;其余提供商从列出的环境变量中读取 API 密钥。
各提供商的模型清单
每个提供商均预设了一组 preferred_models —— 即在模型选择器中展示的模型 ID。当您选择提供商而未显式指定模型时,Ante 默认选用其**权重等级最高(heaviest-weight)**的模型(参见权重等级),而非简单地选择列表第一项。显式指定的提供商具有最高权威性:若传入了 --provider,即使该模型 ID 未列在 preferred_models 中,Ante 也会将该模型 ID 发送给该提供商(参见解析规则)。
Anthropic
anthropic 与 anthropic-subscription 提供相同的模型:
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
claude-haiku-4-5 | 极速响应,接近前沿智能水平 | 200K |
claude-sonnet-5 | 速度与智能的最佳平衡 | 1M |
claude-opus-5 | 复杂智能体编码与企业级任务 | 1M |
claude-fable-5-1 | 针对高要求推理的最强能力 | 1M |
ante --provider anthropic --model claude-sonnet-5
OpenAI
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
gpt-5.6-sol | GPT-5.6 旗舰模型,擅长复杂推理与系统级编码 | 1.05M |
gpt-5.6-terra | GPT-5.6 智能水平与 Token 成本的极佳平衡 | 1.05M |
gpt-5.6-luna | 面向高效、大规模高吞吐任务的 GPT-5.6 模型 | 1.05M |
gpt-5.5-pro | 复杂问题上的最高稳定性 | 400K |
gpt-5.4-pro | GPT-5.4 系列中可靠性最高的主力 | 400K |
gpt-5.3-codex | 前沿代码专精模型 | 400K |
gpt-5.4-mini | 更快、更经济的 GPT-5.4 模型 | 400K |
gpt-5.4-nano | GPT-5.4 家族最小轻量模型 | 400K |
ante --provider openai --model gpt-5.6-sol
openai-subscription 提供商(ChatGPT/Codex OAuth)支持 gpt-5.6-sol、gpt-5.6-terra 和 gpt-5.6-luna(272K 上下文),以及 gpt-5.5、gpt-5.4 和 gpt-5.4-mini(400K 上下文)。
OpenAI 传输协议
openai 与 openai-subscription 提供商支持两种流式响应传输方式:
| 传输协议 | 端点地址 | 默认状态 |
|---|---|---|
http_sse (HTTP + SSE) | https://api.openai.com/v1/responses(或订阅对应端点) | ✅ |
websocket_auto (持久化 WebSocket) | wss://.../v1/responses | 可选启用 |
WebSocket 模式在每个会话中保持单条长连接,并通过 previous_response_id 仅传递新增输入项以继续下一轮 Turn。在长链路的智能体工具调用循环中,这能显著消除每轮往返的网络建立延迟。协议细节可参考 OpenAI 的 WebSocket 模式指南。
通过进程级环境变量启用(默认为 http_sse):
ANTE_OPENAI_TRANSPORT=websocket_auto ante --provider openai --model gpt-5.4-mini
支持的值:http_sse、websocket_auto。未识别的值会打印警告并回退至 http_sse。
注意事项:
-
WebSocket 仅在流式轮次(TUI 会话)中启用。无头
--prompt模式使用非流式chat()并按设计跳过 WS。 -
任何临时的 WS 故障(连接超时、网络抖动)会在该轮次中自动回退至 HTTP/SSE —— 用户绝不会因为传输协议选型而遭遇硬错误。认证失败(
401/403)会将整个会话在其生命周期内永久切换至 HTTP/SSE。 -
同时适用于
api.openai.com(API Key)与 ChatGPT 订阅后端chatgpt.com/backend-api/codex。 -
验证当前激活的传输方式:在调试构建中按
Ctrl+L打开调试面板查看 Info 选项卡中的OpenAI Transport:行;或在日志中检索transport selected:grep "transport selected" ~/.ante/logs/*/ante.*.log
Gemini
gemini 与 vertex-gemini 提供相同的模型:
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
gemini-3.8-flash | Gemini 3.8 Flash,适用于长程编码与自主智能体 | 1.05M |
gemini-3.7-flash | Gemini 3.7 Flash,适用于快速智能体与多模态工作流 | 1.05M |
gemini-3.6-flash | Gemini 3.6 Flash,适用于智能体与多模态工作流 | 1M |
gemini-3.1-pro-preview | 具备深度思考能力的 Gemini 3.1 Pro | 1M |
gemini-3.1-pro-preview-customtools | 针对自定义工具调用优化的 Gemini 3.1 Pro | 1M |
gemini-3.5-flash-lite | 最快、成本最低的 Gemini 3.5 模型,适用于高吞吐量任务 | 1M |
ante --provider gemini --model gemini-3.1-pro-preview
Grok (xAI)
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
grok-4.6 | Grok 4.6 旗舰推理模型 | 500K |
ante --provider xai --model grok-4.6
Zai(智谱)
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
glm-5.3 | 最新 GLM-5.3 模型,适用于编程与智能体任务 | 1M |
ante --provider zai --model glm-5.3
Open Router
Open Router 拆分为共享同一 API 密钥的三个提供商(按协议方言划分):openrouter(兼容 OpenAI Chat Completions)、openrouter-responses(OpenAI Responses)与 openrouter-anthropic(Anthropic Messages)。
openrouter 预设模型:
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
deepseek/deepseek-v4-flash-0731 | DeepSeek V4 Flash 0731 | 1.05M |
google/gemini-3.8-flash | Gemini 3.8 Flash,适用于长程编码与自主智能体 | 1.05M |
google/gemini-3.7-flash | Gemini 3.7 Flash 快速多模态智能体工作流 | 1.05M |
x-ai/grok-4.6 | 通过 OpenRouter 调用的 Grok 4.6 旗舰推理模型 | 500K |
qwen/qwen3.8-max | 通义千问 3.8 旗舰多模态推理模型 | 1M |
qwen/qwen3.7-plus | 高性价比且支持视觉的通义千问 3.7 模型 | 1M |
qwen/qwen3.7-flash | 超低成本通义千问 3.7 多模态推理模型 | 1M |
meta/muse-spark-1.3 | Muse Spark 1.3 多模态智能体推理模型 | 1.05M |
tencent/hy3 | 腾讯混元 Hy3 智能体推理模型 | 262K |
xiaomi/mimo-v2.5-pro | 小米 MiMo-V2.5-Pro 旗舰智能体模型 | 1.05M |
xiaomi/mimo-v2.5 | 小米 MiMo-V2.5 全模态模型 | 1.05M |
z-ai/glm-5.3 | 通过 OpenRouter 调用的 GLM 5.3 编程与智能体推理模型 | 1.05M |
moonshotai/kimi-k3 | 月之暗面 Kimi K3 旗舰多模态推理模型 | 1.05M |
moonshotai/kimi-k2.7-code | 支持视觉的 Kimi K2.7 Code 代码推理模型 | 262K |
minimax/minimax-m3 | MiniMax M3 多模态模型 | 512K |
deepseek/deepseek-v4-pro-0813 | DeepSeek V4 Pro 0813 正式版 | 1.05M |
openrouter-responses 提供 openai/gpt-5.6-sol、openai/gpt-5.6-sol-pro、openai/gpt-5.6-terra、openai/gpt-5.6-terra-pro、openai/gpt-5.6-luna 和 openai/gpt-5.6-luna-pro(1.05M 上下文),以及 openai/gpt-5.3-codex(400K 上下文)。带有 -pro 后缀的 ID 会走 OpenRouter 的专业推理路由。
openrouter-anthropic 通过 Anthropic Messages 协议提供 Claude 家族:anthropic/claude-haiku-4.5(200K 上下文),以及 anthropic/claude-sonnet-5、anthropic/claude-opus-5、anthropic/claude-opus-5-fast、anthropic/claude-fable-5.1(1M 上下文)。
每个提供商还可以通过完整 ID 调用 Open Router 模型列表 中的任意模型,只要其符合该提供商的协议格式即可。
ante --provider openrouter --model deepseek/deepseek-v4-pro-0813
ante --provider openrouter-responses --model openai/gpt-5.6-sol
ante --provider openrouter-anthropic --model anthropic/claude-fable-5.1
DeepSeek
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
deepseek-v4-flash | DeepSeek V4 Flash 快速模型 | 1M |
deepseek-v4-pro | DeepSeek V4 Pro 旗舰深度思考模型 | 1M |
ante --provider deepseek --model deepseek-v4-flash
需配置环境变量 DEEPSEEK_API_KEY,可选配置 DEEPSEEK_BASE_URL。
Ali Coding Plan(阿里代码计划)
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
qwen3.5-plus | 支持视觉的 Qwen 3.5 Plus | 1M |
qwen3.6-plus | 最新的 Qwen 3.6 Plus(带视觉) | 1M |
glm-5.1 | GLM-5.1 模型 | 200K |
MiniMax-M2.5 | MiniMax M2.5 模型 | 205K |
qwen3-max-2026-01-23 | Qwen 3 Max 快照版本 | 1M |
qwen3-coder-next | Qwen 3 Coder Next 代码模型 | 1M |
qwen3-coder-plus | Qwen 3 Coder Plus 代码模型 | 1M |
qwen-plus | 快速且高能力 | 1M |
ante --provider ali-coding-plan --model qwen3.5-plus
需要开通阿里云百炼代码计划订阅并获取 API 密钥(格式如:sk-sp-xxxxx)。内置提供商采用 Anthropic 协议端点。部分模型仅在 OpenAI 兼容端点提供 —— 可通过自定义目录项添加接入:
{
"providers": {
"ali-coding-plan-oai": {
"display_name": "Ali Coding Plan (OpenAI)",
"base_url": "https://coding.dashscope.aliyuncs.com/v1",
"auth": { "bearer": { "env_key": "ALI_CODING_PLAN_API_KEY" } },
"wire_style": "OpenAiCompatible",
"http_headers": {
"User-Agent": "ante-cli/1.0.0",
"X-DashScope-UserAgent": "coding-agent"
}
}
}
}
Antix
antix(OAuth)与 antix-api-key(API Key)通过 Antigma 平台提供相同模型:
| 模型 ID | 说明 | 上下文大小 |
|---|---|---|
gemini-3.7-flash | Gemini 3.7 Flash,适用于快速智能体与多模态工作流 | 1M |
grok-4.5 | Grok 4.5,xAI 专为代码与智能体打造的旗舰 | 500K |
grok-4.6 | Grok 4.6 旗舰推理模型 | 500K |
kimi-k3 | Kimi K3 旗舰多模态推理模型 | 1M |
qwen3.7-max | 最新 Qwen 3.7 Max | 1M |
qwen3.7-plus | 最新 Qwen 3.7 Plus | 1M |
gemini-3.1-pro-preview | 具备深度思考的 Gemini 3.1 Pro | 1M |
claude-haiku-4-5 | 快速且高能力 | 200K |
claude-sonnet-5 | 速度与智能的最佳平衡 | 1M |
claude-opus-5 | 复杂智能体编码与企业级任务 | 1M |
claude-fable-5-1 | 最强大的 Claude 模型 | 1M |
gpt-5.3-codex | 针对代码深度优化的 Codex 模型 | — |
gpt-5.4-mini | 更快、更经济的 GPT-5.4 模型 | 400K |
gpt-5.4-nano | GPT-5.4 家族最小轻量模型 | 400K |
deepseek-v4-flash | 高速 DeepSeek V4 Flash | 1M |
deepseek-v4-pro | 具备深度思考的 DeepSeek V4 Pro | 1M |
glm-5.3 | 最新 GLM-5.3 模型,适用于编程与智能体任务 | 1M |
glm-5.3-flash | 快速 GLM-5.3 Flash,适用于编程与智能体任务 | 1M |
ante --provider antix --model claude-sonnet-5 # OAuth
ante --provider antix-api-key --model claude-sonnet-5 # ANTIX_API_KEY
Local(本地模型)
通过内置的 llama.cpp 引擎在本地运行 GGUF 模型 —— 无需 API 密钥。local 是通配提供商;其可用模型取决于离线服务端当前加载的模型,且仅在有活跃服务注册时才存在于目录中。在未启动服务时选择 local 会弹出提示通知。详见离线模式。
ante --provider local
catalog.json 配置规范
启动时,~/.ante/catalog.json 会合并覆盖在内置预设之上。包含两个可选的顶层键:
{
"providers": { /* 添加或覆盖提供商 */ },
"models": { /* 覆盖现有模型的字段属性 */ }
}
在 providers 中,若 key 匹配内置提供商(如 openai),则逐字段修改该预设;若为新 key 则添加新提供商。Map 的 key 即为传递给 --provider 的名称。内部的 id(或历史 name)字段会被忽略。
~/.ante 目录可通过环境变量 ANTE_HOME 重定向;目录配置文件路径始终为 $ANTE_HOME/catalog.json。
提供商字段
| 字段 | 必填 | 说明 |
|---|---|---|
display_name | 新增提供商:可选 | 在 TUI 中展示的友好名称。省略时默认使用 map key |
base_url | 新增提供商:✅ | API 基础 URL |
wire_style | 新增提供商:✅ | Ante 通信采用的 API 方言 —— AnthropicMessage、OpenAiCompatible、OpenAiResponse 或 Gemini |
auth | — | 认证方式(参见身份认证)。无需密钥的提供商可省略 |
http_headers | — | 随每次请求发送的额外自定义 HTTP Header 映射表(string→string) |
extra_body | — | 合并到每个 Chat 和 Streaming 请求体顶层的专属 JSON 字段(参见额外请求字段) |
supports_web_search | — | 该提供商是否提供原生网络搜索功能。为 true 时自动向该提供商的会话添加 WebSearch 工具;为 false(默认)时不提供 |
preferred_models | — | 在选择器中展示并作为默认模型的推荐列表(参见模型字段)。对于内置提供商,匹配的模型 ID 会被合并修改,新 ID 会被追加;省略时保持内置列表不变 |
stream_idle_timeout_secs | — | 提供商请求在超时报错前允许的最长空闲时间(秒)。流式调用涵盖等待首个事件及 SSE/WebSocket 后续事件间隔;缓冲调用则限制收集响应期间的整个请求时长。默认 300 秒。慢速本地模型或代理端点可适当调大 |
{
"providers": {
"my-provider": {
"display_name": "My Provider",
"base_url": "https://api.example.com/v1",
"wire_style": "OpenAiCompatible",
"auth": { "bearer": { "env_key": "MY_PROVIDER_API_KEY" } },
"http_headers": { "X-Org": "my-team" },
"preferred_models": [
{
"id": "my-model",
"description": "My fine-tuned model",
"max_tokens": 32000,
"context_limit": 200000,
"effort": "medium"
}
]
}
}
}
针对内置提供商,仅需填写希望修改的字段。将可选字段设置为 null 可清除预设值,这在将提供商重新指向不应发送内置认证或请求头的本地代理时非常有用:
{
"providers": {
"openai": {
"base_url": "http://localhost:8080/v1",
"auth": null,
"http_headers": null
}
}
}
额外请求字段
部分网关或代理需要 Ante 原生未建模的特定参数(服务等级、路由提示、厂商专属 Beta 字段)。extra_body 是一个 JSON 对象,会直接合并到发送给该提供商的每个请求体顶层:
{
"providers": {
"my-gateway": {
"base_url": "https://gateway.example.com/v1",
"wire_style": "OpenAiCompatible",
"auth": { "bearer": { "env_key": "MY_GATEWAY_API_KEY" } },
"extra_body": {
"service_tier": "priority",
"routing": { "region": "us-east" }
}
}
}
}
参数值原样透传,因此支持任意 JSON 结构。在内置提供商覆盖层中,extra_body 会逐键合并到预设中 —— 匹配的键被替换,其他键保留。
extra_body 只能追加新字段,绝不能覆盖 Ante 为选定 wire_style 生成的保留关键字:
wire_style | 保留关键字列表 |
|---|---|
AnthropicMessage | model, max_tokens, messages, system, temperature, tools, stream, thinking, stop_sequences, output_config, cache_control |
OpenAiCompatible | model, messages, reasoning_effort, max_tokens, stream, stream_options, temperature, top_p, top_k, stop, tools, tool_choice, thinking, enable_thinking, thinking_budget, enable_search, search_options |
OpenAiResponse | model, instructions, input, tools, tool_choice, parallel_tool_calls, max_output_tokens, temperature, reasoning, stream, include, store |
Gemini | contents, systemInstruction, generationConfig, tools, toolConfig |
保留关键字在加载目录时会被自动丢弃并在启动提示中命名;提供商的其余配置仍正常加载。若想修改这些参数,请使用模型字段或环境变量覆盖:
Skipped 1 entry in ~/.ante/catalog.json:
- providers.my-gateway.extra_body: ignoring Ante-owned request field(s): model
身份认证配置
auth 是一个带标签的对象:标签指定凭据传递位置,凭据可以为环境变量(env_key)或 Ante 内置的 OAuth 流程(oauth_preset)。
| 形式 | JSON 声明 | 实际网络发送 |
|---|---|---|
| Bearer Token | { "bearer": { "env_key": "MY_KEY" } } | Authorization: Bearer <token> |
| 自定义 Header | { "header": { "name": "x-api-key", "env_key": "MY_KEY" } } | <name>: <token> |
| Query URL 参数 | { "query": { "name": "api_key", "env_key": "MY_KEY" } } | ?<name>=<token> |
使用 oauth_preset 接入内置 OAuth 流程(anthropic、openai 或 antix)而非环境变量:
"auth": { "bearer": { "oauth_preset": "anthropic" } }
提供商在凭据存在时即被视为已认证 —— 环境变量已设置且非空,或磁盘上存在 OAuth Token。没有 auth 块的提供商始终被视为已认证。未认证的提供商在自动检测过程中会被跳过,并在选择器中排在最后。
模型字段
这些字段既可在提供商的 preferred_models 中完整声明模型(此时 id 必填),也可在顶层 models 下部分覆盖已有模型(此时由 map key 提供 id)。除 ID 以外的所有字段均为可选:
| 字段 | 说明 |
|---|---|
id | 模型 ID。在 preferred_models 中必填(兼容历史别名 name);在 models 下由 key 提供 |
display_name | 友好展示名称 |
description | 在模型选择器中展示的简短说明 |
temperature | 采样温度。在 AnthropicMessage 提供商上,开启思考推理时必须为 1 —— 带有 effort 等级时若设置其他值,轮次会直接显式报错 |
top_p | Nucleus 采样截断阈值 |
top_k | Top-k 采样截断阈值 |
max_tokens | 单轮最大输出 Token 数。在需要显式思考预算的 AnthropicMessage 提供商上,设置思考等级时必须大于 1024 —— API 的最低预算要求 |
stop_sequences | 停止生成的标记字符串列表 |
context_limit | 上下文窗口上限(Token 数) |
effort | 默认思考深度等级 —— min、low、medium、high、xhigh 或 max。不支持推理调节的模型请省略(Ante 不会发送 effort 参数并隐藏滑块) |
supported_efforts | 该模型在当前提供商上接受的思考深度级别,按升序排列(取值同 effort)。它会替换内置档位:滑块只显示这些级别,OpenAI 兼容提供商会发送同名 reasoning_effort(min 在线上拼写为 minimal)。空列表表示模型不接受思考深度设置;省略则保留内置档位 |
weight_class | 规模/成本等级 —— Feather(轻量/快速/低成本)、Middle(中等)或 Heavy(最大/能力最强)。驱动默认模型与辅助模型选取(参见权重等级) |
support_vision | 是否支持图片输入。省略时 Ante 根据模型 ID 自动推断;对无视觉支持的模型读取图片时返回图片元数据而非像素 |
顶层 models 可在解析阶段针对模型 ID 原地打补丁,层叠在标准规格之上。内置预设中该部分为空:
{
"models": {
"claude-sonnet-5": { "effort": "high", "max_tokens": 64000 }
}
}
权重等级
每个内置模型均带有 weight_class(Feather、Middle 或 Heavy),Ante 根据此属性自动进行智能选择:
- 默认模型 — 选择提供商但未指明具体模型时,默认解析为其 Heavy 旗舰模型。
- 环境感知 UI 调用 — 加载状态语和下一提示词建议等装饰性调用会在提供商拥有 Feather 或 Middle 模型时选用其最轻量模型。WebFetch 会把网页内容直接返回给当前会话模型,不走此路径。
未设置 weight_class 的模型回退到目录声明顺序。在自定义模型上设置 weight_class 可以精确引导这些自动化选择。
模型与提供商的解析仲裁规则
解析模型 ID 时分层覆盖(后生效者覆盖前者):
- 规范声明(Canonical spec) — 目录中首个(按目录顺序)在其
preferred_models中列出该 ID 的提供商。未知 ID 回退为纯基础默认规格。 models覆盖 — 用户在models中对该 ID 的局部配置(若有)。- 环境变量覆盖 — 进程环境变量优先级高于一切。
提供商与模型的匹配:
若仅传入 --model,Ante 会挑选已认证且其 preferred_models 列表包含该 ID 的提供商,其次回退至没有 preferred_models 的已认证提供商,最后回退至默认提供商。
若同时传入 --provider 与 --model,显式指定的提供商只要通过认证即优先胜出。Ante 仍会首先全局解析模型 ID,因此已知 ID 即使由不同提供商提供,也会继承目录元数据和用户覆盖;未知 ID 作为裸模型规格原样透传。
当未传入 --model / --provider 时,Ante 执行自动检测:按目录顺序选用第一个已认证提供商的最高权重模型(参见权重等级),若均未认证则回退到 local。
环境变量覆盖
无需编辑文件即可覆盖会话级目录参数:
| 环境变量 | 覆盖目标字段 |
|---|---|
MODEL_BASE_URL | 所有提供商的基础 URL(专属变量如 ANTHROPIC_BASE_URL 优先级更高) |
MODEL_TEMPERATURE | temperature |
MODEL_TOP_P | top_p |
MODEL_MAX_TOKENS | max_tokens |
MODEL_CONTEXT_LIMIT | context_limit |
思考深度(Effort)无通用环境变量 —— 请通过命令行参数 --effort 或配置文件中的 effort 字段指定。
多个预设也支持专属的 base-URL 环境变量,且优先级高于 MODEL_BASE_URL:ANTHROPIC_BASE_URL、OPENAI_BASE_URL、OPENAI_COMPATIBLE_BASE_URL、OPENROUTER_BASE_URL、DEEPSEEK_BASE_URL。
容错处理
单个无效条目不会破坏整个配置文件。Ante 对 catalog.json 进行宽容解析:任何反序列化失败的提供商或模型条目会被跳过,其余条目仍正常加载。跳过的条目会在启动时报告,例如:
Skipped 1 entry in ~/.ante/catalog.json:
- providers.my-provider: missing field `base_url`
仅当文件**根本不是一个 JSON 对象(isn't a JSON object at all)**时才会被整体拒绝。缺少 catalog.json 完全正常 —— Ante 会直接使用内置预设。
相关章节
- 模型提供商 — 选择提供商与自定义配置配方
- 存储与目录结构参考手册 —
catalog.json在磁盘上的位置 - 离线模式 — 本地运行 GGUF 模型