用同一台电脑和8类真实任务比较执行、调研、跨设备、多模态、扩展生态与成本,并结合最新官方文档校正快速迭代带来的变化
桌面Agent和普通聊天机器人最大的区别,不是回答更长,而是能否读取本地文件、操作浏览器和软件、调用外部工具,并把任务交付成可以继续使用的文档、表格、PPT或网页。
本文以豆包专业版、腾讯WorkBuddy和QoderWork为对象,在同一台Mac上使用相近提示词完成8类办公任务。由于三款产品迭代非常快,测试结论反映的是当时版本;文中同时结合当前官方文档复核产品定位,并把价格、模型、额度和渠道能力标注为动态信息。
站内入口:豆包、WorkBuddy、QoderWork。想了解豆包与飞书的最新协作形态,也可以阅读豆包工作实测。



一、先看定位:三款产品不是同一种桌面Agent
豆包专业版更像字节模型和多模态能力的一体化生产力套装,强调文档、PPT、图片、视频、语音和屏幕协作;当前产品线又进一步发展出更聚焦工作流的“豆包工作”。
WorkBuddy强调全场景办公、腾讯生态、专家与连接器,也提供企业版和云端托管能力。它的优势更偏向模型开放度、IM渠道和企业系统接入。
QoderWork把Qoder的Agent能力从代码扩展到知识工作。官方文档当前列出的能力包括本地文件、浏览器与桌面控制、任务监控、Skills、MCP、连接器、Hooks和IM渠道。它更像一个透明度较高的可扩展执行工作台。



二、本地电脑操控:能完成是一回事,路径是否可靠是另一回事
测试任务要求Agent打开浏览器并收集OpenAI博客动态。豆包和QoderWork都能在后台完成加载、滚动、翻页与信息整理,过程中持续同步执行状态。QoderWork还通过任务监控面板展示待办和所调用的Computer Use、浏览器等工具。
WorkBuddy当时的默认路线更曲折:它先尝试安装依赖和写代码,后来才通过RSS完成任务,总耗时更长。但这不代表其当前版本必然如此;官方近几个月持续更新桌面控制和Agent执行能力。
评价电脑操控不能只看最终成功。还应记录首次成功率、是否错误点击、遇到弹窗时能否恢复、是否占用前台、敏感操作有没有确认,以及失败后能否从断点继续。




三、信息搜索与内容交付:调研质量和PPT审美往往分开
第二类任务要求调研一个新兴技术主题并生成汇报材料。三款产品都能完成搜索与整理,但风格明显不同:豆包的PPT视觉完成度较高,图文结构更接近可直接汇报的成品;QoderWork表达清爽、观点收束快,但当时样本中的资料密度偏低;WorkBuddy覆盖角度较全,内容扎实,不过版式和图表表现相对保守。
这说明桌面Agent的“交付质量”至少包含事实准确、信息完整、结论清晰、视觉排版和可编辑性五个维度。只比较生成速度或页数,很容易得到错误结论。
对于高风险调研,还应抽查引用来源、发布日期与原始数据;重要报告不要把Agent生成的结论直接当成事实。




四、跨设备与IM协作:桌面Agent能否从“座机”变成随身入口?
测试把三款Agent连接到手机或IM工具,并要求任务结束后主动通知。QoderWork和WorkBuddy的接入相对顺畅,都能从手机继续控制电脑任务;当时QoderWork还能按要求主动推送完成提醒。
产品此后已有变化。QoderWork最新官方文档显示,IM Channels支持钉钉、飞书、微信等渠道,还可用绑定指令接管正在运行的桌面任务;WorkBuddy官方也提供多端协同,让手机成为桌面Agent的远程控制台。具体渠道、地区和账号限制应以当前版本为准。
跨设备功能意味着新的安全边界:必须确认绑定对象、群聊授权和可执行范围,并为文件发送、付款、删除和外部发布保留二次确认。




五、多模态:豆包更强,但要区分“生成能力”和“办公闭环”
在图片、海报和短视频任务中,豆包依靠Seedream、Seedance等自有模型表现更完整,能够在同一产品里完成内容、视觉和视频生成。WorkBuddy也能调用多模态能力,但模型、时长和积分规则会随版本变化;当时QoderWork在文生视频方面相对有限。
多模态领先不等于所有办公任务都领先。营销内容更看重视觉和视频;研究、法务、财务和运营任务则可能更看重数据、连接器、审计与可追溯性。选择产品时应先确定自己产出最多的是“媒体素材”还是“结构化工作成果”。



六、Skill、MCP与连接器:决定产品能否长期扩展
三款产品都在建立扩展生态,但路径不同。QoderWork把Skills市场、MCP、连接器与Hooks放进统一扩展体系,并在任务监控里展示调用过程;WorkBuddy强调专家、专家团、Skills和企业连接器;豆包则更依赖自有能力与内置Skill,同时对本机已有Skill的识别较方便。
不要只比较Skill数量。更值得检查的是:Skill能否查看来源和权限、安装前是否可审查、能否限制目录和网络访问、失败时是否有日志,以及团队能否统一管理版本。
任何第三方Skill或MCP都可能读取文件和调用外部服务,涉及公司数据时应采用最小权限、可信仓库和定期清理策略。




七、外接模型、语音与共享屏幕:开放度和一体化各有取舍
当时的测试中,WorkBuddy支持添加OpenAI兼容协议模型,在模型自主权、成本选择和私有接口方面更开放;QoderWork主要提供内置模型档位;豆包更集中使用自家模型。这些能力会快速变化,正式选择前应再次查看设置页和官方说明。
语音通话与共享屏幕是豆包的差异化体验:用户可以边说边让AI理解屏幕内容,适合实时指导和轻量协作。QoderWork和WorkBuddy更偏向任务式远程控制,而不是持续语音陪同。
封闭套装的优势是体验统一,开放平台的优势是模型和工具更灵活。企业更应关心数据去向、调用日志、账号体系与退出成本。



八、价格与透明度:不要直接比较“积分数字”
三款产品采用不同的会员、积分、Token或模型额度体系,单个积分没有统一价值。原测试中的具体价格属于当时页面,当前可能已经调整,因此本文不把它们作为长期报价。
WorkBuddy在任务前给出消耗预估、任务后展示明细的做法值得肯定;但无论哪家,最可靠的方法都是用免费或试用额度跑同一个真实任务,记录成功率、重试次数、人工修改时间和最终可交付程度。
建议建立一个简单的“有效任务成本”指标:订阅费或积分成本 + 人工等待与修改时间 + 错误风险。标价最低但需要多次重做的产品,未必最省。



九、怎么选:没有全能冠军,只有更匹配的工作流
- 优先豆包:需要高质量PPT、图片和视频,希望语音与屏幕协作,并且团队已经在使用飞书或字节生态。
- 优先QoderWork:重视透明的任务监控、Skills与MCP扩展、IM远程接管,希望在本地文件和多工具间完成专业任务。
- 优先WorkBuddy:需要腾讯生态、多个IM渠道、模型开放度、专家与企业连接器,或计划建设可管理的企业Agent体系。
最终选择前,用三款产品各跑一次自己最高频的任务:同一份输入、同一交付标准、同一时间限制。比较完成率、修改次数、权限风险和实际费用,而不是只看营销Demo。


结论:豆包更偏强多模态的一体化套装,QoderWork更偏透明且可扩展的任务工作台,WorkBuddy更偏开放模型与企业生态连接。桌面Agent变化很快,本文给出的实测适合帮助建立选择框架,具体功能与价格请以三款产品当前页面为准。






