DashScope Batch 提交
为独立单轮批量任务配置模型,预览冻结快照并提交异步请求。
Batch 把多个独立单轮请求交给 DashScope 异步处理。/batch-api 帮助准备计划,qwen batch 负责提交和收集文件结果;它不是把普通多轮 agent 每一步都换成异步调用。
先配置独立模型
官方示例使用以下目录项。合并到现有设置时保留其他提供商条目,并替换凭据:
{
"modelProviders": {
"openai": [
{
"id": "qwen3.7-plus",
"baseUrl": "https://dashscope.aliyuncs.com/compatible-mode/v1",
"envKey": "DASHSCOPE_API_KEY"
}
]
},
"batch": {
"authType": "openai",
"model": "qwen3.7-plus"
}
}在环境或 settings.env 提供 DASHSCOPE_API_KEY。batch.authType 默认 openai;选择必须匹配唯一的 OpenAI 兼容 chat-completions 项,并具备 baseUrl 和非空 envKey 对应凭据。同 ID 多条时,设置 batch.baseUrl 为准确的已配置 URL。
提供商 generationConfig 控制生成。wireApi 应省略或为 chat-completions;此执行器不支持 responses。显式选择无效会在上传前失败,不回退到主对话凭据。修改后重启交互会话,使自动收集器和子命令使用同一配置。
没有独立 Batch 选择时沿用主模型配置,但仍要求 OpenAI 兼容 API key,不能使用 OAuth 凭据提交。
qwen batch check该检查验证准备情况,不提交付费请求。
预览冻结快照
/batch-api summarize each Markdown file in docs/source into docs/summaries with matching namesSkill 先检查能力、读取小样本,把计划写入 .qwen/batch/plans/,然后 dry-run:
qwen batch run .qwen/batch/plans/<slug>.json --dry-run预览会显示条目数、目标目录、模型、生成参数、输出限制、窗口、粗略 token 估计和快照标识。此时没有上传或计费。
按预览给出的实际标识提交:
qwen batch run .qwen/batch/plans/<slug>.json --expect <snapshot>这一步命令审批用于确认支出。计划、源文件或设置在预览后变化时拒绝提交。运行会冻结采样参数、输出上限与 thinking 模式,后续重试复用它们。
等待与成本判断
run 很快返回任务 ID。Skill 启动后台 collect --wait,等待时只通过 HTTP 轮询,不调用模型;完成后唤醒 agent 一次,报告结果并处理原请求已要求的后续工作。
核验日的 Qwen 官方文档把 Batch 成功请求标为实时标价的 50%,同时指出批内不命中前缀缓存。高比例共享前缀、短输出的任务可能使用实时缓存更省;这不是通用于全部模型和未来价格的折扣保证,实际单价与支持范围以提供商当前报价为准。
队列耗时可以从秒到小时,文档以 24h 完成窗口为示例,不适合依赖即时响应的操作。适合内容相互独立、由各自输入占主要 token 的整理、摘要、提取任务。
预算设置
默认只估 token。需要美元估计时设置 QWEN_BATCH_INPUT_PRICE_PER_1M_USD、QWEN_BATCH_OUTPUT_PRICE_PER_1M_USD;粗略估计不含 thinking tokens,也不含准备计划时的对话成本。
计划 maxCostUsd 按请求上限估最坏情况,需要这两项价格、maxOutputTokens,以及关闭 thinking 或指定 thinking_budget;缺失会拒绝运行。收集、重试与未知提交状态见Batch 结果管理。