字节跳动的 AI 办公助手豆包工作在 9 月 23 日推送本周更新,任务模式新增目标模式和计划模式,同时上线任务队列、Markdown 文件编辑和深色模式,已在电脑端全量推送。
目标模式:写完验收标准,不达标就返工
目标模式面向有明确要求的复杂任务。用户把验收目标写清楚后开启执行,豆包工作在完成任务后会对目标逐项校验,只要有一项不达标就自动返工、继续调整,直到达标为止。
这个设计解决的是 Agent 交付质量的老问题。此前大部分 AI 办公产品是一次性出结果,好坏全靠用户自己判断,不满意就再来一轮对话。把校验环节交给系统自动跑,等于给 Agent 加了一个内部验收闭环。
计划模式:先出方案,确认后再动手
计划模式面向步骤多、消耗大的复杂任务。豆包工作会先产出一份可审阅、可编辑的 Markdown 格式实施计划,用户校准修改、对齐需求并确认后才开始执行。这个模式下还支持对 .md 文件在线编辑、查看和分享,也可以直接下指令让豆包工作改文件。
两种模式都可以在对话栏输入斜杠,或点击左下角加号选择开启。从操作路径看,字节在努力降低这些高级模式的发现成本。
| 能力 | 面向场景 | 关键机制 |
|---|---|---|
| 目标模式 | 有明确验收标准的复杂任务 | 逐项校验,不达标自动返工 |
| 计划模式 | 步骤多、消耗大的复杂任务 | 先出 Markdown 计划,确认后执行 |
| 任务队列 | 长任务执行中追加指令 | 新指令排队,当前任务完成后依次执行 |
| Markdown 编辑 | 文档协作 | 在线编辑、查看、分享,可指令修改 |
| 深色模式 | 外观 | 可跟随系统或单独设置 |
任务队列解决的是打断问题
同步上线的任务队列允许用户在复杂任务执行过程中不打断运行、连续发送多条新指令,新指令排入队列,等当前任务完成后自动依次执行。用过 Agent 的人都知道,等一个长任务跑完再发下一条有多难受,这个改动属于体验层面的硬需求。
AI 办公这个赛道在往哪走
把验收闭环和执行前置对齐引入 AI 办公产品,方向很清楚,Agent 协作从一键执行走向过程可控。站里写过几条相邻的路子可以对照,千问办公 QwenWork 把 Agent 平台深度绑定钉钉,讯飞智文的 Agent 升级走的是文档润色与排版,Codex 在周活 500 万后转向知识工作 Agent。大家都在同一件事上较劲,让 Agent 的产出可被信任、可被干预。
豆包工作本身的底座也在升级,此前 豆包 Pro 全量升级时打通了 500 多个子 Agent 调度,这次的目标与计划模式算是把调度能力包装成了更具体的工作方式。
常见问题
目标模式会自动返工多少次
官方表述是逐项校验,只要有一项不达标就自动返工、继续调整,直到达标。没有公布返工次数上限,实际使用中建议把验收标准写得可量化,避免无限循环。
计划模式产出的计划能改吗
能。计划是 Markdown 格式,可审阅可编辑,用户校准修改并确认后才开始执行,也能下指令让豆包工作直接改文件。
手机端能用吗
这次更新是电脑端全量推送,更新到最新版本即可体验,官方未提及移动端同步上线。
小结
值得肯定的地方是字节没有继续堆功能数量,而是在补交付质量的机制。目标校验和计划确认都是在给 Agent 加刹车,这在办公场景里比多几个按钮有用得多。至于自动返工会不会把 token 消耗推上去,得看实际跑起来的成本,官方这次没提。
相关阅读
延伸阅读
- GPT-5.6Sol 模型失准:OpenAI 披露训练期 27 条隐藏错误摘要,监控压力升高4 天前
- Codex 角色插件上线:62 个应用 + 110 个 Skills,周活 500 万后转向知识工作 Agent2 天前
- 微软 UFO² 桌面 AgentOS 解析:自动化成功率 32.7%,超越 OpenAI Operator 且 MIT 开源2 天前
- 谷歌 Gemini 测试中自主入侵 3 家公司:首次确认 AI 突破测试环境,安全红线告急4 天前
