Skip to content
FunCoding

Search

Search docs, Skills and MCP

模型价格与费用计算

区分输入、输出、缓存和长上下文档位,并识别代码审查的双重计费。

This page has not been translated into English yet. The original Chinese version is shown below.

Copilot 按模型及实际 token 使用量计算成本,再换算成 AI Credits。当前换算率为 1 AI Credit = 0.01 美元;一次交互可能不足一个 credit,也可能包含多次模型调用。

看清单价列

官方价格表统一以 每一百万 token 的美元价格列出:input、cached input、output;部分模型还有独立的 cache write 列。缓存读写不是同一个价格,也不能假设任何模型的缓存写入都免费。

Anthropic 模型有 cache write 费用;GPT-5.6 Luna / Sol / Terra、GPT-6 Astra / Luna / Sol、GPT-6.1 Sol 也有该项,较早的 OpenAI 模型表中没有 cache write 费用。用量应按报告中的对应分类计算,避免把同一批缓存 token 重复当成普通输入。

例如仅按默认档 GPT-5.4 的 10,000 个普通输入 token 和 2,000 个输出 token 估算,分别为 0.025 美元、0.03 美元,合计 0.055 美元,即 5.5 credits。这个演算不含缓存、Auto 折扣或其他加价,不是每次请求固定价格。

长上下文档位

模型表中的 Threshold (input tokens) 是输入 token 阈值,不是输入与输出相加。例如 GPT-5.4 的默认档为不超过 272K,超过后列在 Long context 档;GPT-5.6 Luna 的分界是 200K,不能统一套用 272K。

长上下文档可能同时改变输入、缓存和输出单价。应使用该模型对应行,不要只增加可容纳 token 数,也不要自行假定只有超出阈值的部分才使用较高单价。具体数字见模型单价。

优惠与可用性

Gemini 3.7 / 3.8 Flash 的当前价格为促销价,官方注明截止 2026-12-31。付费账号在指定产品中用 Auto 有模型费用折扣,见Auto;合规或区域端点可能有额外成本。

价格行存在不等于账号可以选择模型。例如价格表仍列 Claude Sonnet 4,但支持参考有停用记录;Sonnet 4.6 也有年度订阅例外。模型访问应按支持范围判断。

代码审查的两部分费用

Code review 自动选择且不公开具体模型,因此单次审查的每 token 成本可能不同。它同时消耗 AI Credits 和运行 agentic 基础设施的 GitHub Actions minutes。

Actions minutes 归仓库,再归对应企业或成本中心;AI Credits 通常归请求审查的人,自动审查归 PR 作者。Cloud agent、其他 bot 与无席位请求者有专门归属规则,见审查用量。

查看审查 Actions 用量时,可在 Actions metrics 按 copilot-pull-request-reviewer workflow 筛选,或在账单用量报告按 workflow_path 等于 dynamic/agents/copilot-pull-request-reviewer 筛选。不要把审查的 token 估算当作包括 Actions 的总价。

年度旧计费账号

当前仍采用 request-based billing 的既有年度 Pro / Pro+ 订阅使用单独的 legacy model multipliers。模型名相同也不代表按本页 token 单价计算,先确认账号的计费类型。