响应速度与 Fast 模式
切换 Fast,理解速度与用量倍率的区别,并按账号查看 Ultrafast 可用性。
速度模式改变支持模型的生成速度与用量,不等于任务所需步骤变少。工具运行、测试和等待外部系统仍会影响整体完成时间。
使用 Fast
CLI 用 /fast 切换,/statusline 可将状态显示在底部。持久默认配置为:
service_tier = "fast"
[features]
fast_mode = trueChatGPT 登录的桌面应用、CLI 和 IDE 扩展在账号与模型支持时可使用 Fast。具体模型和入口以当前选择器为准。
用量与速度分别判断
官方当前列出的 Fast 用量倍率:订阅内额度按 Standard 的 2.5 倍消耗;购买 credits 和 Enterprise pay-as-you-go 按 2 倍计费。它们是计量倍率,不是运行速度提升倍数。API Key 使用 API token 价格,不适用 ChatGPT credits 倍率。
Ultrafast
当前 GPT-6 Astra Ultrafast 的“最高 8 倍”指 token 生成速度,不是全部任务时间。可用性限定于官方所列 Pro $500 与符合条件的 Enterprise/Edu,购买 credits 本身不会让所有其他自助套餐获得权限。
Enterprise 默认关闭,管理员可为用户或工作区启用;美国以外 inference residency 要求可能使工作区不符合条件。具体套餐、价格和模型会变化,部署前核对官方 Speed 与 Pricing,而不是仅依据本地可见配置键。
选择方式
用同一任务比较完成质量、实际耗时和用量。需要更快响应时尝试速度模式,任务拆分则属于子智能体的独立选择。不要把 Fast 与更高 reasoning effort 混为一项设置。