按任务选择模型
用任务类型比较延迟、推理、长期执行与视觉输入,并检查可用范围。
选模型时先区分任务需要快速反馈,还是需要跨文件推理和多步验证。官方比较页给出的是任务适配建议,不是对任意项目都成立的固定排名;模型的价格、套餐和客户端访问需要另查。
常见任务
| 任务 | 官方比较页列出的候选 | 使用重点 |
|---|---|---|
| 日常编码、写作、解释 | GPT-5 mini、GPT-5.3-Codex、GPT-5.6 Terra | 函数、差异、文档、错误解释,以及交互式和 agent 工作 |
| 小型或重复任务 | GPT-5.6 Luna、Claude Haiku 4.5 | 工具函数、语法问题、简单原型和快速修改 |
| 深度推理与调试 | GPT-5 mini、GPT-5.5、GPT-5.6 Sol、Claude Sonnet 4.6 | 多文件问题、架构取舍、复杂重构、日志和性能分析 |
| 截图与图示 | GPT-5 mini、Claude Sonnet 4.6 | 在支持图片输入的入口分析界面和视觉上下文 |
Sonnet 4.6 虽仍出现在任务推荐表,但当前访问受年度个人订阅例外限制,见支持范围。模型有视觉能力也不意味着当前输入入口接受图片;需要同时满足两者。
长期执行与复杂代码任务
官方单模型说明将 GPT-6 Astra 用于持续规划、诊断和独立结果确认的长期任务;GPT-6 Sol 面向包含多步验证的开发,GPT-6.1 Sol 面向复杂代码推理。Claude Fable 5 / 5.1 面向长期自主编码和知识工作,Opus 5.5 强调多步任务、错误恢复和协作,Sonnet 5.5 强调更少步骤与工具调用的任务完成。
这些描述可用来选择试用方向,但不要仅凭名称跳过对本项目结果的验证。Fable 还有单独的数据保留条件。
比较页中 GPT-6.1 Sol 和 Sonnet 5.5 的 Coming soon 位于 model card 链接列;支持总表已列为 GA。因此不能把该文字解读为模型尚未提供。
持续变化与特定模型
MAI 模型会持续发布新 checkpoint,行为和性能可能变化。Kimi K3 面向长上下文和多步 agent 工作;官方说明其 GitHub 提供版本可能包含微调变体,但这些变体仅针对个人套餐,不包括 Business / Enterprise。这不代表 Kimi K3 本身不支持组织套餐。
官方也记录了 Kimi K3 预发布测试中的部分高风险提示表现及新增保护措施;企业应结合实际用途评估能力与限制。模型托管位置与原始开发者并不相同,详见托管与数据。
不确定时用 Auto
Auto可以结合可用性和任务复杂度路由。手动比较时,应使用相同任务与验证要求,观察结果质量和用量;选择更高推理档位或更长上下文前,先确认任务确实需要该能力。