模型与计费
Cline 的三条模型接入路径(Cline 用量计费、ClinePass、自带密钥)、Anthropic / OpenRouter / OpenAI 兼容配置、30+ 其他提供商概览与本地模型(Ollama、LM Studio、Atomic Chat)。
价格、订阅额度、可用模型和免费模型会随时变化,下文涉及的具体数字和模型名一律以官方为准。
Cline 通过提供商连接 AI 模型,有三条常见路径:Cline(用量计费)、ClinePass 和自带密钥(BYOK)。认证的操作步骤见「快速上手」。接入自定义模型(任何兼容 OpenAI 的端点)就在这一页的「OpenAI 兼容」一节里讲。
Cline(用量计费)
这是 Cline 里最简单的按量计费模型访问方式:不用在多个厂商之间管理各自的 API key,你登录一次、添加 Cline credits,就能直接在 Cline 里从可用模型里选。
- 最快的设置:无需手动复制粘贴 API key;可访问 Cline 支持的 100+ 个模型。
- 一个账号:用 Google、GitHub 或邮箱登录一次。
- 按量付费:添加 Cline credits,跨受支持的模型共用一份余额。
- 免费选项:在选择器里找标有 FREE 的模型。
用法:在 IDE 扩展设置里把 API Provider 设为 Cline 并登录;CLI 里进入 /settings 选 Cline 作为提供商。从 Cline 仪表板(app.cline.bot/dashboard)添加 credits;在选择付费模型时按量使用;在 Cline Settings → View Usage 查看用量,在 Cline Settings → Switch Organization 切换组织。
ClinePass
ClinePass 是低价的月度订阅,官方核实时为每月 9.99 美元,相比标准 API 费率在流行的开放编码模型上提供 2–5 倍的用量;它完全可选,你不需要 ClinePass 也能使用 Cline,并且总是可以并用其他任何提供商。ClinePass 是 Cline 里一个单独的提供商:订阅后,在你配置提供商的任何地方选择 ClinePass(IDE 扩展设置里把 API Provider 设为 ClinePass 并登录;CLI 里进入 /settings 选 ClinePass)。
为什么用它:开放模型已经变得很好,在编码任务上性能接近专有模型,并且因为许多提供商可以有竞争力地提供它们,通常便宜得多;但获得可靠的访问可能很难,提供商的质量和可用性各异,标准的速率限制会限制读文件、运行命令、跨多轮迭代的重度智能体工作流。ClinePass 通过这些来解决:精选一组为编码智能体使用而测试和基准评测过的开放模型;相比标准 API 费率在流行的开放编码模型上提供 2–5 倍的用量,让你不被打断地运行长而复杂的智能体任务;通过 Cline 的基础设施提供稳定的访问。它与 Cline(用量计费)是分开的提供商,你可以独立使用两者。
模型:ClinePass 包含一组测试并基准评测过的模型(官方核实时包括 GLM、Kimi、DeepSeek、MiMo、MiniMax、Qwen 等系列,模型 ID 形如 cline-pass/<model>),因容量限制和模型升级,部分旧模型会被下线,当前列表以官方页面为准。你也可以在自己的脚本、应用或自动化里通过 Cline API 使用 ClinePass 模型(同样兼容 OpenAI 的 Chat Completions 格式):在 app.cline.bot 的 Settings > API Keys 创建 API key,在 model 字段里用完整的 ClinePass 模型 slug,例如:
export CLINE_API_KEY="your_api_key_here"
curl -X POST https://api.cline.bot/api/v1/chat/completions \
-H "Authorization: Bearer $CLINE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "cline-pass/qwen3.7-max",
"messages": [
{"role": "user", "content": "Write a TypeScript function that validates an email address."}
],
"stream": false
}'ClinePass 是固定月费,所以你不按各个模型的 API 价格被收费;官方给出的参考价格是每个模型底层的每百万 token 费率(输入、输出、缓存读写),用来帮助你理解用量如何对照 ClinePass 配额衡量。用量按三个限制衡量:5 小时滚动窗口(你在滚动的 5 小时周期内的用量)、每周(日历周内的用量)和每月(日历月内的用量);在 Cline 仪表板的订阅页查看当前用量。
自带密钥(BYOK)
使用你自己的提供商凭据,云端或本地运行时均可:
| 提供商 | 适合 | 备注 |
|---|---|---|
| OpenRouter | 多种模型、有竞争力的价格 | 见下 |
| Anthropic | 直接访问 Claude | 见下 |
| Claude Code | Claude Max/Pro 订阅 | 见下 |
| OpenAI | GPT 模型 | OpenAI API key 或 OpenAI Codex OAuth |
| Google Gemini | Gemini 模型 | |
| AWS Bedrock | 企业 | API key、IAM 凭据或 CLI profile(SSO)三种设置方式 |
| DeepSeek | 性价比高 |
Anthropic / Claude Code
Anthropic API(基于密钥):去 Anthropic Console 创建账号或登录,进入 API keys 部分,点「Create Key」并给它一个描述性名称(如「Cline」),立即复制 API key(之后看不到了,安全存放)。在 Cline 里:点面板里的设置图标(⚙️),在「API Provider」下拉框选「Anthropic」,把 key 粘贴进「Anthropic API Key」字段,在「Model」下拉框里选想用的 Claude 模型;如果需要为 Anthropic API 使用自定义基础 URL,勾选「Use custom base URL」并输入 URL(多数用户不需要调整)。
Claude Code(基于订阅):如果你已经有 Claude Max/Pro 并想在 Cline 里使用基于订阅的访问:按 Anthropic 文档安装并认证 Claude CLI;在 Cline 设置里选 Claude Code 作为提供商;设置 Claude CLI 路径(如果在 PATH 里通常就是 claude,macOS/Linux/WSL/Git Bash 用 which claude 查找,Windows 命令提示符用 where claude)。注意:用的是你的 Claude 订阅限额而不是 API token 计费;响应可能不会逐 token 流式输出;这种模式下图片上传和提示缓存受限。
扩展思考(Extended Thinking):Anthropic 模型提供「Extended Thinking」功能,为复杂任务提供增强的推理能力:模型在给出最终答案之前输出它一步一步的思考过程,提供透明度并为有挑战的提示实现更彻底的分析。在 Cline 里启用后,模型生成详细说明其内部推理的 thinking 内容块,这些洞见随后被纳入它的最终回复。在选了 Claude 模型之后,勾选模型选择菜单下方的 Enable Extended Thinking 复选框即可使用。要点:对 Claude 3.7+ 模型,API 返回完整思考过程的摘要以平衡洞见和效率并防止滥用,但你按完整的思考 token 付费而不只是摘要;扩展思考响应(包括 thinking 块)可以流式输出;它与工具使用(需要把 thinking 块传回)和提示缓存(有关于缓存失效和上下文的特定行为)相互作用。
提示与注意:Claude 3 模型支持提示缓存,可以显著降低重复提示的成本和延迟;Claude 模型有大的上下文窗口(官方核实时 200,000 token);定价参考 Anthropic 定价页;Anthropic 有基于用量层级的严格速率限制,如果你反复触及,考虑联系 Anthropic 销售,或通过 OpenRouter 或 Requesty 这样的其他提供商访问 Claude。
OpenRouter
OpenRouter 是通过单一 API 访问来自不同提供商的多种语言模型的 AI 平台,能简化设置并让你轻松试验不同模型。去 OpenRouter 网站用 Google 或 GitHub 账号登录,进入 keys 页面(应该已列出一个 API key,没有就新建一个),复制它。在 Cline 里:点设置图标(⚙️),在「API Provider」下拉框选「OpenRouter」,把 key 粘贴进「OpenRouter API Key」字段,在「Model」下拉框里选想用的模型;如果需要自定义基础 URL,勾选「Use custom base URL」(多数用户留空)。OpenRouter 按底层模型的定价计费;它把缓存请求传给支持缓存的底层模型,对大多数模型,只要模型本身支持,缓存应自动激活;例外是通过 OpenRouter 的 Gemini 模型:由于 Google 的缓存机制经 OpenRouter 访问时有时出现响应延迟,需要手动激活:使用 Gemini 模型时必须手动勾选提供商设置里的「Enable Prompt Caching」复选框,这是个临时的变通办法,非 Gemini 模型不需要它。
OpenAI 兼容(自定义模型接入)
Cline 支持一大批提供兼容 OpenAI API 标准的 API 的 AI 模型提供商,让你在使用熟悉的 API 接口的同时,使用 OpenAI 之外的提供商的模型,包括通过 Ollama 和 LM Studio 这类工具运行的本地模型、Perplexity、Together AI、Anyscale 这样的云提供商,以及任何其他提供 OpenAI 兼容 API 端点的提供商。用 OpenAI 兼容提供商的关键是配置这几个主要设置:
- Base URL:提供商特定的 API 端点,不是
https://api.openai.com/v1(那是官方 OpenAI API 的 URL)。 - API Key:你从所选提供商获得的密钥(或勾选 Use Azure Identity Authentication)。
- Model ID:你想使用的模型的具体名称或标识符。
在 Cline 设置面板(点 ⚙️ 图标)里:API Provider 选「OpenAI Compatible」;Base URL 输入提供商给的基础 URL(这是关键的一步);API Key 输入你从提供商获得的密钥;Model 选择或输入模型 ID;Use Azure Identity Authentication 勾选后用你的 Azure 托管身份认证(注意它不会触发认证,而是使用现有的,如「az login」);Model Configuration 部分让你自定义模型的高级参数:最大输出 token、上下文窗口大小、图片支持能力、Computer Use(例如支持工具/函数调用的模型)、输入价格和输出价格(按 token/百万 token)。注意:使用 Together AI、Anyscale 这样的其他 OpenAI 兼容提供商时,可用的模型 ID 会不同,始终参考你具体提供商的文档了解它支持的模型名称和任何独特的配置细节。例如用 v0(Vercel SDK):选 OpenAI Compatible 提供商,Base URL 设为 https://api.v0.dev/v1,粘贴你的 v0 API key,Model ID 设为 v0-1.0-md,点 Verify 确认连接。
排障:「Invalid API Key」——仔细检查 key 输入正确且属于正确的提供商;「Model Not Found」——确保为所选提供商使用有效的模型 ID,并且它在指定的基础 URL 可用;连接错误——验证基础 URL 正确、你的机器能访问提供商的 API、没有防火墙或网络问题;结果出乎意料——尝试不同的模型,或仔细检查所有配置参数。
其他 30+ 个提供商
这些提供商遵循同一个设置模式:打开 Cline 设置(⚙️);从 API Provider 选你的提供商;把 API key/令牌粘贴进相应的凭据字段;从 Model 选模型。官方页面列出的提供商有(核实时):ai&、AIHubMix、AskSage、Avian、Baseten、Cerebras、CoreWeave、Crusoe、Dify.ai、豆包(Doubao)、Fireworks AI、GCP Vertex AI、Groq、Hicap、华为云 MaaS、Hugging Face、Mistral、Moonshot(Kimi)、Nebius AI Studio、Nous Research、Oracle Code Assist、Qwen Code、Requesty、SambaNova、SAP AI Core、Together、Vercel AI Gateway、VS Code Language Model API 和 xAI(Grok)。每个提供商的基础步骤基本相同:在该提供商网站创建账号并生成 API key,然后在 Cline 里选择该提供商并粘贴;少数提供商(如 Avian)改用 OpenAI Compatible 并指定基础 URL(https://api.avian.io/v1)和模型 ID;CoreWeave 手动配置时选 OpenAI Compatible、基础 URL 设为 https://api.inference.wandb.ai/v1、用 W&B API key 和目录里的确切模型 ID;GCP Vertex AI 需要先设置启用了 Vertex AI 的 GCP 项目并配置认证(服务账号或应用默认凭据);Oracle Code Assist 需要 OCI 账号、在租户里启用 OCI Generative AI 服务并配置 OCI 认证(API key、配置文件或实例主体)。
本地模型
在你的机器上用本地推理运行 Cline。快速开始:安装本地运行时(Ollama、LM Studio 或 Atomic Chat);启动本地服务器;在 Cline 设置里选择匹配的提供商;选择本地模型;在 Cline Settings → Features 里启用 Use Compact Prompt。
| 内存 | 典型的本地配置 |
|---|---|
| 16–32GB | 小型/量化模型 |
| 32–64GB | 中型编码模型 |
| 64GB 以上 | 更大的模型和更大的上下文窗口 |
Ollama:从 ollama.com 下载并安装;在 Ollama 模型目录(ollama.com/search)里按热门度、模型大小和最新更新浏览,打开任何模型页面并复制 ollama pull 命令;ollama pull <model-name> 然后 ollama run <model-name>;在 Cline 设置里选提供商 Ollama,Base URL 为 http://localhost:11434,从下拉框选模型。排障:发送提示前确保 Ollama 在运行;连接失败时验证 http://localhost:11434;模型缺失时运行 ollama pull <model-name>。
LM Studio:从 lmstudio.ai 下载、安装并启动应用;在 LM Studio 模型目录里按模型系列、大小和能力过滤,挑选匹配你硬件的模型;打开 Discover 下载模型;打开 Developer 标签页启动服务器(默认 http://localhost:1234);在 Cline 设置里选提供商 LM Studio,保持 Base URL 为 http://localhost:1234,从下拉框选模型。排障:确保 LM Studio 服务器在运行、模型已加载;连接失败时验证 http://localhost:1234。
Atomic Chat:从 atomic.chat 下载(macOS Apple Silicon),或从 AtomicBot-ai/Atomic-Chat 构建;打开 Atomic Chat 并从目录下载或加载本地模型;它默认在 http://127.0.0.1:1337/v1 暴露兼容 OpenAI 的服务器(curl http://127.0.0.1:1337/v1/models 列出已加载的模型);在 Cline 设置里选提供商 Atomic Chat,Base URL 为 http://127.0.0.1:1337/v1(默认),选模型。排障:发送提示前确保 Atomic Chat 在运行;连接失败时验证 http://127.0.0.1:1337/v1/models;模型列表为空时先在 Atomic Chat 里加载模型。
本地推理的推荐 Cline 设置:启用 Use Compact Prompt;保持任务聚焦(上下文越小响应越快);上下文变得太大时开始新任务。