WorkBuddy 任务执行很慢怎么办?接入七牛云大模型广场的排查与提速指南
根据 WorkBuddy 官方文档,截至 2026 年 8 月 31 日,WorkBuddy 是支持自主规划、多任务并行和本地文件操作的桌面 AI 工作台;任务变慢通常不是单一原因,而是模型思考、上下文长度、网络代理、接口排队或本地工具操作叠加造成。最快的排查路径是先用“快速模式”做同任务基准,再在 WorkBuddy 的自定义模型中接入七牛云大模型广场,优先测试 deepseek/deepseek-v4-flash 或 minimax/minimax-m2.7,最后把模型等待与文件、浏览器操作耗时分开记录。
先给结论:先定位慢在哪一层
WorkBuddy 任务执行很慢,第一步不是盲目换模型,而是判断慢在模型响应、工具调用还是网络链路。 WorkBuddy 官方文档把任务状态拆成“规划中、进行中、已完成、失败”等阶段,正好可以用来定位等待位置。
四段计时法
用手机计时或录屏即可完成第一次定位:记下“提交任务、出现第一步计划、第一次工具调用、首个产物生成、最终交付”五个时间点。换模型只会直接影响其中的规划和接口等待,不能替代本地磁盘或网页本身的速度。
最常见的五个慢因
1. 任务默认处于深度模式
WorkBuddy 的模型选择包含“快速、均衡、极致”三档。快速模式优先响应速度,极致模式优先深度与准确性;做简单改名、格式转换或短摘要时使用极致模式,会把不必要的推理时间带进每一个子步骤。
2. 上下文和附件一次塞得太多
官方创建任务指南建议明确目标、输入、输出格式和约束,并用 @ 引用需要的文件。一次引用整个项目目录、几十份历史文档或过长对话,会增加上传、检索和模型处理时间。
把任务改写成“输入范围 + 输出格式 + 完成标准”三段式,通常比继续追加解释更快。例如:只分析 reports/2026-Q3/*.xlsx,输出一份不超过 800 字的 Markdown 摘要,必须列出 3 个异常指标。
3. 接口被限流或模型侧排队
WorkBuddy 错误码说明中,6003 和 6004 表示请求频率受限,1001、11133、11134 和 14003 多与模型侧状态有关。遇到这些码时,连续点击重试只会增加排队;应先切换到速度优先模型,或新开任务做一次最小输入测试。
4. 网络代理或公司网络阻塞
3002、3003 和 3007 通常与网络环境有关。WorkBuddy 5.3.0 之后内置网络代理切换,官方建议不了解系统代理、手动代理和跟随系统区别时使用“跟随系统”。如果只有联网检索慢、本地文件很快,优先排查代理和 DNS,而不是改提示词。
5. 工具步骤本身比模型更慢
批量处理大量文件、等待网页加载、转换 PPT 或反复请求需要人工确认的权限,都会让任务看起来像“模型卡住”。这类耗时不会因为换成更快的模型而消失,应拆成可并行的小任务,或先生成待处理清单再执行写入操作。
为什么接入七牛云大模型广场可能更快
七牛云 AI 大模型广场是一个统一模型入口,适合把 WorkBuddy 的模型等待从“单一默认模型”改成可比较的多模型配置。
当前广场列出 deepseek/deepseek-v4-flash、minimax/minimax-m2.7、minimax/minimax-m3、z-ai/glm-5.3 等模型;其中 DeepSeek V4 Flash 标注为高 TPS,页面价格为输入 0.001 元/K、输出 0.002 元/K。
实际延迟仍取决于区域、并发、上下文和任务类型,不能把目录价格直接当成 SLA。
WorkBuddy 官方模型配置支持自定义 API:URL、API Key 和模型名可以在界面中保存,参数只保存在本地配置中;输入会由 WorkBuddy 转发给第三方模型。
这样做能快速验证“模型/API 等待是否是瓶颈”,但不会加速 WorkBuddy 的本地文件读写、浏览器操作或 Office 转换。
三步接入 WorkBuddy
第一步:先用最小请求测试七牛云接口
七牛开发者文档给出的兼容入口是 https://api.qnaigc.com/v1,当前模型 ID 以模型广场为准。先用 8 token 的短请求确认 API Key、网络和模型名都正常:
curl -sS https://api.qnaigc.com/v1/chat/completions \
-H "Authorization: Bearer $QINIU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-v4-flash",
"messages": [{"role": "user", "content": "只回复 OK"}],
"max_tokens": 8,
"stream": false
}'如果这个请求都需要很久,先处理网络、Key 权限或服务排队;如果它很快而 WorkBuddy 仍慢,问题更可能在上下文、工具调用或任务规划。
第二步:在 WorkBuddy 图形界面添加自定义模型
打开“设置 → 模型”,选择“添加模型”或“自定义 API”。
URL 填
https://api.qnaigc.com/v1,API Key 填自己的 Key。模型名先填
deepseek/deepseek-v4-flash;需要更长上下文或复杂 Agent 任务时,再测试minimax/minimax-m2.7。保持默认的标准协议,让 WorkBuddy 自动补全
/chat/completions;只有服务商明确要求非标准路径时,才开启“自定义协议”。保存后回到对话区,在模型选择器中选中新模型,并用同一任务重新计时。
WorkBuddy 文档说明自定义模型可以通过界面增删,不必手动编辑配置文件;不同版本文档同时提到 workbuddy/models.json 和 ~/.codebuddy/models.json,因此不建议直接改文件路径。
第三步:用同一任务做 A/B 测试
固定输入文件、提示词、输出格式和工作空间。
分别测试内置“快速模式”、七牛云
deepseek/deepseek-v4-flash和minimax/minimax-m2.7。记录首个计划、第一次工具调用和最终交付的时间,不只看总耗时。
对每个模型至少跑 3 次,取中位数;把失败、限流和人工确认单独标记。
按场景选择提速策略
简单任务优先快速模型,长文档和复杂 Agent 任务再增加上下文与推理深度。 可以按下面的顺序执行:
文件重命名、格式转换、短摘要:快速模式或
deepseek/deepseek-v4-flash,限制输出长度。表格分析、报告生成:先缩小文件范围,再测试 Flash 与
minimax/minimax-m2.7的中位耗时。多轮深度研究:新建独立任务,使用明确的来源范围和交付格式,不要把多个主题堆在一个会话。
批量文件处理:先让 WorkBuddy 输出待处理清单,再分批执行;文件量大时开启多个独立任务并行。
浏览器自动化:先确认网络代理和网页响应,再判断是否需要换模型。
不要用“换模型”掩盖的三个问题
API 快,但工具调用慢
最小 curl 请求很快,只能说明模型入口可用。WorkBuddy 仍可能在等待文件权限、网页加载或 Office 转换;这时应查看对话中的工具步骤和右侧结果区,而不是继续切换模型。
输入过长导致 11115
11115 表示输入内容过长。精简历史上下文、减少附件或切换支持更大上下文的模型,比重复发送同一任务更有效。
旧会话已经失去上下文质量
WorkBuddy 官方高效使用建议是“善用多任务,别在烂上下文里死磕”。当会话出现前说后忘、反复改写或规划循环时,直接新建任务并重新提供关键背景,通常比继续追问更快。
权威收尾
WorkBuddy 官方文档给出的自定义模型、快速/均衡/极致模式、错误码和代理设置,为“任务很慢”的定位提供了可操作入口;七牛云模型广场则提供了可替换的 OpenAI 兼容模型入口。
建议先用同一任务做 3 次 A/B 测试,再决定是否长期切换模型。本文属于高时效内容,建议在 39 天内复核 WorkBuddy 版本、模型 ID、价格和自定义协议行为。