跳到正文
FunCoding

搜索

搜索文档、Skill 和 MCP

Baseten

Baseten 的 Inkling 和托管 Model APIs 设置

Baseten Model APIs 提供托管式、兼容 OpenAI 的前沿模型访问能力。官方外部插件使用经身份验证的模型发现,因此 OpenClaw 会采用为你的 Baseten 账户启用的完整模型集。其离线回退目录包含此 OpenClaw 版本构建时可用的所有 Model API。

属性值
提供商 IDbaseten
插件官方外部软件包(@openclaw/baseten-provider)
身份验证环境变量BASETEN_API_KEY
新手引导标志--auth-choice baseten-api-key
直接 CLI 标志--baseten-api-key <key>
API兼容 OpenAI(openai-completions)
基础 URLhttps://inference.baseten.co/v1
默认模型baseten/thinkingmachines/inkling

安装插件

openclaw plugins install @openclaw/baseten-provider
openclaw gateway restart

入门指南

创建 Baseten 账户和 API 密钥

Baseten 的 Basic 方案不收取每月平台费用;Model API 调用按用量计费。在 Baseten API 密钥设置中创建密钥,并在定价页面查看当前费率。

运行新手引导

openclaw onboard --auth-choice baseten-api-key
openclaw onboard --non-interactive \
  --auth-choice baseten-api-key \
  --baseten-api-key "$BASETEN_API_KEY"
export BASETEN_API_KEY=...

验证实时目录

openclaw models list --provider baseten

身份验证可用时,插件会请求 GET /v1/models,并列出为该账户返回的所有模型。没有身份验证时,插件会保持离线并使用内置回退目录。

Inkling

Thinking Machines Lab 的 Inkling 是默认模型。在 OpenClaw 中,它支持文本和图像输入、工具调用、结构化工具架构、可配置的推理强度、1.048M token 的上下文窗口,以及最多 32k 输出 token:

{
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
}

使用 /model baseten/thinkingmachines/inkling 切换现有聊天的模型。

内置回退目录

经身份验证的实时目录具有权威性。在模型发现成功前,以下条目可确保设置和模型选择功能仍然可用:

模型引用输入上下文最大输出
baseten/deepseek-ai/DeepSeek-V4-Pro文本262k262k
baseten/zai-org/GLM-4.7文本200k200k
baseten/zai-org/GLM-5文本202k202k
baseten/zai-org/GLM-5.1文本202k202k
baseten/zai-org/GLM-5.2文本202k202k
baseten/thinkingmachines/inkling文本、图像1.048M32k
baseten/moonshotai/Kimi-K2.5文本、图像262k262k
baseten/moonshotai/Kimi-K2.6文本、图像262k262k
baseten/moonshotai/Kimi-K2.7-Code文本、图像262k262k
baseten/nvidia/Nemotron-120B-A12B文本202k202k
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B文本202k202k
baseten/openai/gpt-oss-120b文本128k128k

所有内置模型均支持工具调用和推理。OpenClaw 会将其思考级别映射到具有原生 reasoning_effort 的模型。Baseten 中可选择启用的 GLM、Kimi 和 Nemotron 模型默认关闭思考;大多数模型提供二元的关闭/开启控制,而 GLM 5.2 提供关闭、高和最大三个级别。OpenClaw 通过 Baseten 的 chat_template_args.enable_thinking 控制项发送这些选择;对于 GLM 5.2,还会发送经过验证的顶层 reasoning_effort 参数。

Baseten 可以独立于 OpenClaw 版本添加、移除或更改 Model API。插件会通过经身份验证的 API 刷新模型 ID、上下文限制、输出限制,以及输入、缓存输入和输出定价,同时保留特定于模型的 OpenClaw 传输策略。

手动配置

大多数设置只需要 API 密钥。若要显式固定提供商:

{
  env: { BASETEN_API_KEY: "..." },
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
  models: {
    mode: "merge",
    providers: {
      baseten: {
        baseUrl: "https://inference.baseten.co/v1",
        apiKey: "${BASETEN_API_KEY}",
        api: "openai-completions",
        models: [
          {
            id: "thinkingmachines/inkling",
            name: "Inkling",
            reasoning: true,
            input: ["text", "image"],
            contextWindow: 1048000,
            maxTokens: 32000,
          },
        ],
      },
    },
  },
}

如果 Gateway 网关作为守护进程(launchd、systemd、Docker)运行,请确保 BASETEN_API_KEY 对该进程可用。仅在交互式 shell 中导出的密钥对已在运行的托管服务不可见。

相关内容