Skip to content
FunCoding

Search

Search docs, Skills and MCP

DashScope Batch 提交

为独立单轮批量任务配置模型,预览冻结快照并提交异步请求。

This page has not been translated into English yet. The original Chinese version is shown below.

Batch 把多个独立单轮请求交给 DashScope 异步处理。/batch-api 帮助准备计划,qwen batch 负责提交和收集文件结果;它不是把普通多轮 agent 每一步都换成异步调用。

先配置独立模型

官方示例使用以下目录项。合并到现有设置时保留其他提供商条目,并替换凭据:

{
  "modelProviders": {
    "openai": [
      {
        "id": "qwen3.7-plus",
        "baseUrl": "https://dashscope.aliyuncs.com/compatible-mode/v1",
        "envKey": "DASHSCOPE_API_KEY"
      }
    ]
  },
  "batch": {
    "authType": "openai",
    "model": "qwen3.7-plus"
  }
}

在环境或 settings.env 提供 DASHSCOPE_API_KEY。batch.authType 默认 openai;选择必须匹配唯一的 OpenAI 兼容 chat-completions 项,并具备 baseUrl 和非空 envKey 对应凭据。同 ID 多条时,设置 batch.baseUrl 为准确的已配置 URL。

提供商 generationConfig 控制生成。wireApi 应省略或为 chat-completions;此执行器不支持 responses。显式选择无效会在上传前失败,不回退到主对话凭据。修改后重启交互会话,使自动收集器和子命令使用同一配置。

没有独立 Batch 选择时沿用主模型配置,但仍要求 OpenAI 兼容 API key,不能使用 OAuth 凭据提交。

qwen batch check

该检查验证准备情况,不提交付费请求。

预览冻结快照

/batch-api summarize each Markdown file in docs/source into docs/summaries with matching names

Skill 先检查能力、读取小样本,把计划写入 .qwen/batch/plans/,然后 dry-run:

qwen batch run .qwen/batch/plans/<slug>.json --dry-run

预览会显示条目数、目标目录、模型、生成参数、输出限制、窗口、粗略 token 估计和快照标识。此时没有上传或计费。

按预览给出的实际标识提交:

qwen batch run .qwen/batch/plans/<slug>.json --expect <snapshot>

这一步命令审批用于确认支出。计划、源文件或设置在预览后变化时拒绝提交。运行会冻结采样参数、输出上限与 thinking 模式,后续重试复用它们。

等待与成本判断

run 很快返回任务 ID。Skill 启动后台 collect --wait,等待时只通过 HTTP 轮询,不调用模型;完成后唤醒 agent 一次,报告结果并处理原请求已要求的后续工作。

核验日的 Qwen 官方文档把 Batch 成功请求标为实时标价的 50%,同时指出批内不命中前缀缓存。高比例共享前缀、短输出的任务可能使用实时缓存更省;这不是通用于全部模型和未来价格的折扣保证,实际单价与支持范围以提供商当前报价为准。

队列耗时可以从秒到小时,文档以 24h 完成窗口为示例,不适合依赖即时响应的操作。适合内容相互独立、由各自输入占主要 token 的整理、摘要、提取任务。

预算设置

默认只估 token。需要美元估计时设置 QWEN_BATCH_INPUT_PRICE_PER_1M_USD、QWEN_BATCH_OUTPUT_PRICE_PER_1M_USD;粗略估计不含 thinking tokens,也不含准备计划时的对话成本。

计划 maxCostUsd 按请求上限估最坏情况,需要这两项价格、maxOutputTokens,以及关闭 thinking 或指定 thinking_budget;缺失会拒绝运行。收集、重试与未知提交状态见Batch 结果管理。