跨产品 Auto 模型路由
区分任务优化、可靠性路由、档位范围和模型费用折扣。
Auto 是在允许范围内选择模型的机制。它会受到套餐、管理员政策、数据驻留、FedRAMP 和 evaluation model 限制,不会因为手动选择 Auto 就绕过这些条件。
不同入口的路由方式
| 产品入口 | 官方描述 |
|---|---|
| GitHub 网站 Chat、VS Code、JetBrains、CLI、桌面 app、cloud agent | 支持 task optimization,结合任务复杂度与实时系统健康、可用性 |
| Eclipse、Xcode、Visual Studio | 优化模型可靠性和可用性,减少限流、延迟与错误 |
任务优化在自然缓存边界和会话复杂度明显变化时路由,以避免没有质量收益的额外缓存成本。路由根据任务而非提问语言决定;一次对话不应被理解为始终固定使用同一模型。
档位只在部分客户端提供
目前 Auto tiers 仅列出 VS Code、CLI、桌面 app:
| 档位 | 路由偏好 |
|---|---|
| Efficiency | 为任务选择合适且成本较低的模型 |
| Balance | 兼顾成本、质量和延迟 |
| Intelligence | 优先回答质量 |
档位使用相同的候选模型池,改变的是偏好。Intelligence 的简单请求仍可能使用较小模型;没有保证始终选最昂贵模型。JetBrains 的任务优化支持不等于有档位选择,SDK 的实验性路由配置也不能直接当作所有产品菜单的档位。
候选池与实际模型
支持参考页的 Auto 表在 Chat、CLI、app、cloud agent 四列共同列出:GPT-5.6 Luna / Sol / Terra、GPT-6 Astra / Luna / Sol、GPT-6.1 Sol、Claude Haiku 4.5、Claude Opus 4.8 / 5 / 5.5、Claude Sonnet 5 / 5.5、Gemini 3.8 Flash、MAI-Code-1.1-Flash。
这是候选范围,不是每个账号都能使用的清单。若组织账号没有其他可用模型,基础模型的回退规则见base 与 LTS。个人套餐还可能使用评估模型,可按评估模型设置退出。
查看实际使用结果:在 Chat 和 app 中悬停回答,在 CLI 中查看终端展示,在 cloud agent 中查看回答结尾的模型信息。
用量与折扣
费用按实际路由到的模型计算,档位本身不是固定价格。官方当前为付费套餐在 Chat、CLI、app、cloud agent 的 Auto 模型费用提供 10% 折扣,不要扩展到未列明的其他收费项目。
IDE 的切换操作见Auto 与 IDE;VS Code 官方指南特别要求,在已用 Auto 的对话中需要切换模型时先新建会话。