跳到正文
FunCoding

搜索

搜索文档、智能体、博客、Skill 和 MCP

模型与自定义推理

Warp 的模型选择(Auto、各家模型、推理级别、按 profile 默认值),自带 API Key(BYOK)与 OpenAI 兼容的自定义推理端点。

可用模型、积分消耗与订阅方案随时调整,以官方为准。接入自己的模型就在本页。

模型选择

Warp 提供一组精选的大模型来驱动智能体,也可以让 Warp 为每个任务自动选择最合适的模型;有来自 OpenAI、Anthropic、Google 和开源提供商的模型,推理级别可配,也可按 profile 设默认值。Auto 模型包括按「响应优先」等偏好自动选择最高质量、最快可用模型的选项(可能消耗更多积分,细节见官方)。官方表里的 model_id 值可用于 Automation Platform 或 CLI 配置模型。还可以定义自定义路由器(custom routers),用你自己的逻辑为每个任务选择模型。

自带 API Key(BYOK)

Warp 支持让智能体连接你自己的 Anthropic、OpenAI 或 Google API 账号:让你控制模型选择、计费和数据路由,通过你自己的 Key 路由的请求 Warp 不会消耗你的 AI 积分。xAI 的 Grok 模型不是加 Key,而是在 Settings > Agents > Warp Agent 里连接 SuperGrok 订阅(Warp 打开浏览器完成连接)。官方有一张表对比 BYOK、自定义推理端点和 BYOLLM 的含义与适用方案。

自定义推理端点

可以用任何兼容 OpenAI Chat Completions API 的推理端点驱动智能体——模型路由器(OpenRouter、LiteLLM)、有 OpenAI 兼容接口的模型服务商(如 z.ai)或自己的内部网关,同时把智能体体验保留在 Warp 里。重要限制:你的端点必须能通过公网 URL 访问,因为请求经由 Warp 的服务器路由,Warp 必须能通过公网到达它;localhost、私有或内部网络地址、仅内部可达的服务(如只在内网可达的 LiteLLM 代理)都会被拒绝。要使用内部或本地端点,先把它暴露为公网 HTTPS URL。网络要求和工作原理见官方页面。