一、案例背景
2026年夏天,中国三家头部互联网企业几乎同时完成了一轮针对办公AI的组织手术。阿里巴巴将钉钉、MuleRun、CoderWork与千问办公纳入同一负责人体系,从多个团队抽取能力搭建千问办公;字节跳动把分散在飞书、TRAE Work、扣子中的相关能力向豆包体系集中,推出豆包工作;腾讯于9月2日上线开放平台,将WorkBuddy从桌面工具推向更完整的平台底座。
三款产品虽同属”办公Agent”品类,但战略定位迥异。腾讯WorkBuddy走To B平台路线,开放Skill、Expert和Connector,试图成为Agent时代的平台底座;阿里千问办公嵌入钉钉,依托组织入口和多模型供给建立优势;字节豆包工作则凭借飞书企业上下文,以独立客户端和手机远程操控电脑形成差异化。三家公司共同做出的选择是:下沉的是技术,分家的是产品。编程Agent与办公Agent被有意区隔——编程Agent生长在有编译器、有测试、有明确报错的世界里,而办公室没有这样的裁判。
这一战略分野有着深刻的市场逻辑。海外产品更容易从Slack、Google Workspace等标准化服务入口接入;中国真实的工作流却大量散落在即时通信、审批系统、本地Excel和各家互不相通的文档生态中。只活在一个网页里的Agent很难真正把活干完,它必须进入电脑,接触文件、浏览器和Office,甚至跨进另一家公司的生态。本次测试的三个macOS客户端安装后合计占用约3.5GB——它们不是三个更大的聊天框,而是三家公司分别在用户电脑里为Agent建造的执行身体。
2026年9月13日,雷峰网以”职场牛马”的身份,将同一份脏销售流水和同一句提示词同时交给了WorkBuddy AI 5.5.2、千问办公1.0.5和豆包工作2.29.7。测试按照同机、同网、默认档的统一规则进行。三家都交付了Excel、PPT和文字摘要,但算出的三个季度总额,最高比最低多出57.7%。除脏流水外,测试还要求三家核查五项近期公开信息并区分事件时间、报道时间和证据强度,又给了一份实际不存在的内部文件以观察缺少核心输入时的行为,随后拆开三个macOS安装包分析其执行环境。
……