Skip to content
FunCoding

Search

Search docs, Skills and MCP

响应速度与 Fast 模式

切换 Fast,理解速度与用量倍率的区别,并按账号查看 Ultrafast 可用性。

This page has not been translated into English yet. The original Chinese version is shown below.

速度模式改变支持模型的生成速度与用量,不等于任务所需步骤变少。工具运行、测试和等待外部系统仍会影响整体完成时间。

使用 Fast

CLI 用 /fast 切换,/statusline 可将状态显示在底部。持久默认配置为:

service_tier = "fast"

[features]
fast_mode = true

ChatGPT 登录的桌面应用、CLI 和 IDE 扩展在账号与模型支持时可使用 Fast。具体模型和入口以当前选择器为准。

用量与速度分别判断

官方当前列出的 Fast 用量倍率:订阅内额度按 Standard 的 2.5 倍消耗;购买 credits 和 Enterprise pay-as-you-go 按 2 倍计费。它们是计量倍率,不是运行速度提升倍数。API Key 使用 API token 价格,不适用 ChatGPT credits 倍率。

Ultrafast

当前 GPT-6 Astra Ultrafast 的“最高 8 倍”指 token 生成速度,不是全部任务时间。可用性限定于官方所列 Pro $500 与符合条件的 Enterprise/Edu,购买 credits 本身不会让所有其他自助套餐获得权限。

Enterprise 默认关闭,管理员可为用户或工作区启用;美国以外 inference residency 要求可能使工作区不符合条件。具体套餐、价格和模型会变化,部署前核对官方 Speed 与 Pricing,而不是仅依据本地可见配置键。

选择方式

用同一任务比较完成质量、实际耗时和用量。需要更快响应时尝试速度模式,任务拆分则属于子智能体的独立选择。不要把 Fast 与更高 reasoning effort 混为一项设置。