跳到正文
FunCoding

搜索

搜索文档、Skill 和 MCP

DashScope Batch 提交

为独立单轮批量任务配置模型,预览冻结快照并提交异步请求。

Batch 把多个独立单轮请求交给 DashScope 异步处理。/batch-api 帮助准备计划,qwen batch 负责提交和收集文件结果;它不是把普通多轮 agent 每一步都换成异步调用。

先配置独立模型

官方示例使用以下目录项。合并到现有设置时保留其他提供商条目,并替换凭据:

{
  "modelProviders": {
    "openai": [
      {
        "id": "qwen3.7-plus",
        "baseUrl": "https://dashscope.aliyuncs.com/compatible-mode/v1",
        "envKey": "DASHSCOPE_API_KEY"
      }
    ]
  },
  "batch": {
    "authType": "openai",
    "model": "qwen3.7-plus"
  }
}

在环境或 settings.env 提供 DASHSCOPE_API_KEY。batch.authType 默认 openai;选择必须匹配唯一的 OpenAI 兼容 chat-completions 项,并具备 baseUrl 和非空 envKey 对应凭据。同 ID 多条时,设置 batch.baseUrl 为准确的已配置 URL。

提供商 generationConfig 控制生成。wireApi 应省略或为 chat-completions;此执行器不支持 responses。显式选择无效会在上传前失败,不回退到主对话凭据。修改后重启交互会话,使自动收集器和子命令使用同一配置。

没有独立 Batch 选择时沿用主模型配置,但仍要求 OpenAI 兼容 API key,不能使用 OAuth 凭据提交。

qwen batch check

该检查验证准备情况,不提交付费请求。

预览冻结快照

/batch-api summarize each Markdown file in docs/source into docs/summaries with matching names

Skill 先检查能力、读取小样本,把计划写入 .qwen/batch/plans/,然后 dry-run:

qwen batch run .qwen/batch/plans/<slug>.json --dry-run

预览会显示条目数、目标目录、模型、生成参数、输出限制、窗口、粗略 token 估计和快照标识。此时没有上传或计费。

按预览给出的实际标识提交:

qwen batch run .qwen/batch/plans/<slug>.json --expect <snapshot>

这一步命令审批用于确认支出。计划、源文件或设置在预览后变化时拒绝提交。运行会冻结采样参数、输出上限与 thinking 模式,后续重试复用它们。

等待与成本判断

run 很快返回任务 ID。Skill 启动后台 collect --wait,等待时只通过 HTTP 轮询,不调用模型;完成后唤醒 agent 一次,报告结果并处理原请求已要求的后续工作。

核验日的 Qwen 官方文档把 Batch 成功请求标为实时标价的 50%,同时指出批内不命中前缀缓存。高比例共享前缀、短输出的任务可能使用实时缓存更省;这不是通用于全部模型和未来价格的折扣保证,实际单价与支持范围以提供商当前报价为准。

队列耗时可以从秒到小时,文档以 24h 完成窗口为示例,不适合依赖即时响应的操作。适合内容相互独立、由各自输入占主要 token 的整理、摘要、提取任务。

预算设置

默认只估 token。需要美元估计时设置 QWEN_BATCH_INPUT_PRICE_PER_1M_USD、QWEN_BATCH_OUTPUT_PRICE_PER_1M_USD;粗略估计不含 thinking tokens,也不含准备计划时的对话成本。

计划 maxCostUsd 按请求上限估最坏情况,需要这两项价格、maxOutputTokens,以及关闭 thinking 或指定 thinking_budget;缺失会拒绝运行。收集、重试与未知提交状态见Batch 结果管理。