跳到正文
FunCoding

搜索

搜索文档、Skill 和 MCP

响应速度与 Fast 模式

切换 Fast,理解速度与用量倍率的区别,并按账号查看 Ultrafast 可用性。

速度模式改变支持模型的生成速度与用量,不等于任务所需步骤变少。工具运行、测试和等待外部系统仍会影响整体完成时间。

使用 Fast

CLI 用 /fast 切换,/statusline 可将状态显示在底部。持久默认配置为:

service_tier = "fast"

[features]
fast_mode = true

ChatGPT 登录的桌面应用、CLI 和 IDE 扩展在账号与模型支持时可使用 Fast。具体模型和入口以当前选择器为准。

用量与速度分别判断

官方当前列出的 Fast 用量倍率:订阅内额度按 Standard 的 2.5 倍消耗;购买 credits 和 Enterprise pay-as-you-go 按 2 倍计费。它们是计量倍率,不是运行速度提升倍数。API Key 使用 API token 价格,不适用 ChatGPT credits 倍率。

Ultrafast

当前 GPT-6 Astra Ultrafast 的“最高 8 倍”指 token 生成速度,不是全部任务时间。可用性限定于官方所列 Pro $500 与符合条件的 Enterprise/Edu,购买 credits 本身不会让所有其他自助套餐获得权限。

Enterprise 默认关闭,管理员可为用户或工作区启用;美国以外 inference residency 要求可能使工作区不符合条件。具体套餐、价格和模型会变化,部署前核对官方 Speed 与 Pricing,而不是仅依据本地可见配置键。

选择方式

用同一任务比较完成质量、实际耗时和用量。需要更快响应时尝试速度模式,任务拆分则属于子智能体的独立选择。不要把 Fast 与更高 reasoning effort 混为一项设置。