先说结论:9 月 2 日,豆包工作发布了产品功能更新,正式上线两项新功能——"多 Agents 并行"和 Mac 系统下的"操作电脑"。按官方的说法,这两项是为了"进一步提升复杂任务的处理效率与场景覆盖"。
翻译成大白话就是:以前豆包干一件复杂的活,是"一个人"吭哧吭哧干;现在它能"分身"成多个子智能体,一个主脑拆任务,几个小弟分头干、同时干。而且,它现在还能直接上手操作你的 Mac 电脑了——不用装插件、不用接 API,看屏幕、点鼠标、敲键盘。
这两件事,指向的是同一个方向:让 AI 办公从"帮你写、帮你查",进化到"帮你把一整摊子事办完"。
一、"多 Agents 并行":一个主脑,几个小弟分头干
先讲第一个功能,也是这次更新的重头。
"多 Agents 并行"的机制是这样的:你给豆包下一个复杂任务,负责组织的主 Agent 会先把它拆解,把那些比较垂直、专业的子任务,分派给不同的子 Agent 分别处理。几个子 Agent 在一个任务下并行执行不同的模块,最后再汇到一起。
这解决了一个很实际的痛点:过去很多 AI 是"串行"的,一件事做完才能做下一件。而真实的工作里,很多任务是能同时进行的——批量处理、分模块生成、多维度调研、多渠道检索,这几类活儿天然适合"多路并发"。
按官方描述,它能"成倍节省交付时间,提高复杂任务的效果上限"。适用场景就是那种"需要同时干好多不同的活"的需求。
具体怎么触发?用户先选择"本地电脑环境",然后在指令里明确要求豆包用多个子 Agent 完成任务,就能触发并行模式。目前这个功能已经在豆包工作电脑端正式上线。
二、"操作电脑":Mac 也能被豆包"接管"了
第二个功能,是 Mac 系统下的"操作电脑"。
这个功能的本质,是让豆包实现本地 GUI 操作——在没有 MCP、没有 API、没有插件、没有 CLI 的情况下,也能"看懂界面"并完成相应操作。说白了,它不靠那些技术接口,而是像真人一样,看屏幕、点鼠标、敲键盘,去操作你电脑上的软件。
这有什么价值?答案是覆盖"长尾场景"。很多软件和系统功能,是没有开放接口给 AI 的;过去 AI 碰不到它们,现在豆包通过"看界面、模拟操作",就能把这些原本够不着的活也干了。
使用方式也很简单:新建一个工作任务,在技能栏选"操作电脑",或者直接在对话里提需求,经你授权后,豆包就会自动查看你的屏幕、模拟鼠标键盘去操作相关应用。你可以随时接管或终止任务,主动权在你自己手里。
值得注意的是,这个功能之前在 Windows 上已经有了,这次是补齐了 Mac 端。也就是说,豆包的"操作电脑"能力,现在已经覆盖 Windows 和 Mac 两大桌面系统。
三、这两项功能,合起来意味着什么
单独看,这两个功能各有各的用;合起来看,它们指向的是豆包工作一个更清晰的定位——"不只是回答问题,而是把复杂工作完整办完"的 AI 办公入口。
多 Agents 并行解决的是"能不能更快、更复杂地干";操作电脑解决的是"能不能干到更多场景里去"。一个是纵向提效,一个是横向扩覆盖,正好对应官方说的"提升处理效率与场景覆盖"。
把这个放进豆包工作的时间线里看会更清楚。豆包工作是 8 月 25 日刚推出的全新生产力产品和品牌,定位是字节跳动在 AI 办公场景的统一入口。在此之前,它已经陆续上了手机远程控制电脑、云电脑、技能·连接器·工作伙伴、侧边栏工作台等功能。这次两项新功能,是这条"让 AI 真正干活"路线上的又一步。
四、说点实在的:它强在哪,又还没证明什么
该夸的夸,该冷静的也得冷静。
它真正有价值的地方,是"并行拆解"和"GUI 操作"这两件事,确实踩在了 AI 办公从"能聊"走向"能干"的关键点上。尤其是"操作电脑"这个方向,是当前 AI Agent 竞争里最热的一条线——谁能让 AI 真正动手操作电脑、操作软件,谁就更接近"数字员工"。
但也要客观说两点:
第一,官方目前给出的多是"功能描述",没有具体的效率提升数据或大规模用户评测。所谓"成倍节省时间",更多是机制上的判断,实际效果得看任务的拆解质量和子 Agent 的配合度。任务拆得不好,"并行"反而可能乱。
第二,"操作电脑"涉及让 AI 看你的屏幕、操作你的应用,隐私和安全的边界怎么划,能不能做到"随时可接管、全程可追溯",是决定用户敢不敢用的关键。授权机制、终止机制是有了,但实际体验和风险控制,还得等更多人用起来再看。
五、对普通用户意味着什么
我把它收敛成三句话。
对重度办公用户:如果你经常要做"批量 + 多模块 + 多渠道"这类活,多 Agents 并行值得一试,它针对的正是这种"串行太慢"的场景。
对 Mac 用户:之前只能在 Windows 上体验的"操作电脑",现在 Mac 也补上了。如果你有一些没接口、但流程固定的桌面操作,可以让豆包试试"看屏幕干活"。
对所有人:一个更值得留意的信号是——AI 办公的竞争,已经从"谁模型更聪明",转向"谁更能把活干完、干到更多场景里"。豆包工作这次的两项更新,本质是在往"真能动手"这个方向上押注。能不能成,还得看实际体验,但方向已经很明确了。
一句话总结:豆包工作正从"会聊天的助手",往"能分身的干将"演进。多 Agents 让它能同时干,操作电脑让它能动手干。至于干得漂不漂亮,得等真实用户的真实任务来检验。








