Skip to content
FunCoding

Search

Search docs, Skills and MCP

跨产品 Auto 模型路由

区分任务优化、可靠性路由、档位范围和模型费用折扣。

This page has not been translated into English yet. The original Chinese version is shown below.

Auto 是在允许范围内选择模型的机制。它会受到套餐、管理员政策、数据驻留、FedRAMP 和 evaluation model 限制,不会因为手动选择 Auto 就绕过这些条件。

不同入口的路由方式

产品入口官方描述
GitHub 网站 Chat、VS Code、JetBrains、CLI、桌面 app、cloud agent支持 task optimization,结合任务复杂度与实时系统健康、可用性
Eclipse、Xcode、Visual Studio优化模型可靠性和可用性,减少限流、延迟与错误

任务优化在自然缓存边界和会话复杂度明显变化时路由,以避免没有质量收益的额外缓存成本。路由根据任务而非提问语言决定;一次对话不应被理解为始终固定使用同一模型。

档位只在部分客户端提供

目前 Auto tiers 仅列出 VS Code、CLI、桌面 app:

档位路由偏好
Efficiency为任务选择合适且成本较低的模型
Balance兼顾成本、质量和延迟
Intelligence优先回答质量

档位使用相同的候选模型池,改变的是偏好。Intelligence 的简单请求仍可能使用较小模型;没有保证始终选最昂贵模型。JetBrains 的任务优化支持不等于有档位选择,SDK 的实验性路由配置也不能直接当作所有产品菜单的档位。

候选池与实际模型

支持参考页的 Auto 表在 Chat、CLI、app、cloud agent 四列共同列出:GPT-5.6 Luna / Sol / Terra、GPT-6 Astra / Luna / Sol、GPT-6.1 Sol、Claude Haiku 4.5、Claude Opus 4.8 / 5 / 5.5、Claude Sonnet 5 / 5.5、Gemini 3.8 Flash、MAI-Code-1.1-Flash。

这是候选范围,不是每个账号都能使用的清单。若组织账号没有其他可用模型,基础模型的回退规则见base 与 LTS。个人套餐还可能使用评估模型,可按评估模型设置退出。

查看实际使用结果:在 Chat 和 app 中悬停回答,在 CLI 中查看终端展示,在 cloud agent 中查看回答结尾的模型信息。

用量与折扣

费用按实际路由到的模型计算,档位本身不是固定价格。官方当前为付费套餐在 Chat、CLI、app、cloud agent 的 Auto 模型费用提供 10% 折扣,不要扩展到未列明的其他收费项目。

IDE 的切换操作见Auto 与 IDE;VS Code 官方指南特别要求,在已用 Auto 的对话中需要切换模型时先新建会话。