企业AI竞争进入深水区:三方角力重塑办公生态格局

Deep News
Sep 10

9月2日,腾讯在深圳正式推出WorkBuddy开放平台,市场目光多聚焦于其生态合作伙伴阵容,但同日披露的开发者协议却透露出腾讯在办公AI领域的战略重心。该协议将WorkBuddy的生态数据划分为三类:开发者数据归属开发者,用户数据由开发者和用户共同约定,腾讯仅获取第三类数据——包括调用频次、资源消耗、响应时长、错误日志及反馈评价,用途限定于统计分析、质量评估和标注。值得注意的是,这家正全力争夺入口的公司主动放弃了用户数据,转而聚焦于任务执行过程中留下的"足迹"。

同一时期,千问办公公布首月成绩单,上线30天注册用户突破3000万,其中企业用户占比过半;百度库库AI独立端于8月14日发布,宣布AI办公月活超2500万;字节跳动豆包工作8月25日上线,与飞书深度整合。四款产品形态各异,但战略方向高度一致——抢占企业上下文这一核心资源。经过多年竞争,钉钉、飞书、企业微信的合计覆盖率已达92%,增量空间几乎枯竭,市场已进入存量博弈阶段。下一个十年的入口显然不再是OA系统,而是谁能通过AI帮助用户完成更多实际工作,而任何工作的完成都离不开上下文的支撑。

上下文并非同质化资源,它正形成三个稀缺性递增的战略高地,每一个都比前一个更难占据。

第一高地:数据的覆盖面

金山办公CEO章庆元在7月15日的AI生产力大会上直言:"大模型的每次对话都是一次重生,它没有记忆——所有的记忆和上下文,都存储在软件里。"他提出的分工是:大模型提供智力,软件提供上下文。"读得到"意味着让Agent能够看见企业内的信息——审批链、客户数据、会议纪要等散落于不同系统的内容,Agent若无法访问就无法执行任务。这曾是协同平台最大的竞争优势。企业使用钉钉的年限,即等同于上下文积累的年限。钉钉拥有约2亿月活用户和2000多万家企业组织,飞书2025年ARR超过30亿元且2026年二季度同比增长超100%,WPS则在6.76亿月活设备上沉淀了多年的文档资产。对这些平台而言,AI从诞生起就立于数据之上。

然而,这个高地正被平台自身削平。今年3月,企业微信开源了wecom-cli,覆盖消息、文档、智能表格、待办、日程、会议等核心品类;钉钉同期全面CLI化,将上千项核心能力改写为AI可直接调用的标准化指令;飞书也开源了CLI插件,宣布支持所有主流Agent工具。三家的初衷是强化自身AI能力,但通用协议一旦开放,任何人都能调用。8月18日,千问办公正式接入企业微信,用户授权后即可通过千问办公的对话界面读取企业微信的智能表格、创建文档等功能。这些协同OA的"院墙"并非被竞争对手翻越,而是平台为适应AI时代主动进行的改造。当上下文可被任何经授权的Agent读取,"能读取多少"便不再构成壁垒——尽管没有它什么都做不了,但它正变得像空气一样必需却难以定价。

第二高地:可验证的对错标准

企业愿意为Agent付费的前提,是能清晰判断任务完成是否正确。这一门槛远比"读得多"更高。Agent生成一份报告,内容看似合理,但数据口径是否准确?审批流推进一步,签批顺序是否符合公司制度?若缺乏确定性的判断依据,Agent不过是一台看似忙碌的机器。依托协同OA的组织骨架在此变得尤为珍贵——谁在何时审批了什么、组织架构如何嵌套、权限怎样继承、谁与谁在哪个项目上协作过,这些信息天然带有对错的标记。文档版本从A到B再到C有据可查,日程安排与实际签到可交叉验证,这类上下文能告诉Agent做得对不对。

钉钉和飞书在此高地上保持优势,2000多万家组织的权限链、审批链、协作关系沉淀已久;飞书升级而来的豆包工作伙伴,权限体系接近用户本人操作、全程可追溯,敏感操作需人工确认。相比之下,金山办公虽然在6.76亿月活设备上沉淀了数千亿份云文档,量级更大,但文档本质是只读语料——Agent读得懂、动不了,完成报告后是否正确缺少内在判据。在第一个高地上金山最为安全,在第二个高地上却最为悬空。若行业竞争止步于第一重,金山不可撼动;若竞争继续推进,金山的不确定性将显著增加。

WorkBuddy开放平台负责人于洪潇以财务自动化案例阐述了两个高地的本质区别。月底对账时,几千条流水需逐笔核对,错一笔就是事故。银行流水在银行网络、发票在税务系统、凭证在ERP中——Agent读不到这些数据,属于第一个高地的问题;对不上的那笔是漏记、重复还是款项仍在途中,判断留在财务人员脑中,则构成第二个高地的问题。数据够不着、Know-How无法获取,再聪明的模型也无从下手。WorkBuddy的应对策略是将第二高地外包给生态:开放平台首期推出五大模块——Buddy应用、专家、Skill、连接器和硬件。帆软将数据分析的Know-How接入,北森带入HR场景的判断力,罗格科技贡献税务合规经验。每个伙伴携带各自领域"何为正确"的判断标准,填补WorkBuddy自身欠缺的行业纵深。首批30余个Buddy应用覆盖金融、法律、医疗、教育、公益等20多个领域,100多家伙伴入驻。帆软战略副总裁沈涛认为这波机会比十年前简道云时代ToB SaaS窗口大十倍乃至百倍,主动提议全免费;微盟技术副总裁肖锋强调此入口必须占据;北森副总裁王瑶则冷静指出分成方案尚未明确;腾讯在发布会上也确认支付能力与分发通路仍在加速建设中。这是一幅坦率的图景:所有人都在赌未来,目前无人盈利。

第三高地:将失败转化为能力

当Agent执行任务出错,若错误能被分类、重跑、回馈至模型或调度引擎,它就不再只是一次失败,而是一份训练数据。这是上下文的第三重价值,也是唯一具有复利效应的价值。腾讯在开放平台协议中索取的第三类数据——调用频次、资源消耗、响应时长、错误日志、反馈评价,用途标注为统计分析、质量评估和标注,直指这一高地。标注意味着有人在为失败分类,将"这次为什么没跑完"转化为下一次的判断依据。

配套工程设施早已启动。腾讯由Youtu Lab、Keen Security Lab、WorkBuddy团队和云鼎安全实验室四个团队联合推出基准测试WorkBuddy Bench。260道题覆盖代码、Web、办公、安全四个子集,关键设计是双Harness并行:同一批任务分别在CodeBuddy Code和Claude Code两套执行框架上运行,实现框架变量与模型变量的分离实验。评测资产在Agent完成运行后才引入、全程断网、沙箱隔离,防止背答案。这套测试旨在非编码的企业工作场景中建立可复位、可重跑、可归因的评测环境。谁先拥有这样的环境,谁就能将用户日常踩坑系统性地转化为能力。

然而,这一高地仍面临系统性建设难度。WorkBuddy上线超过半年,用户时有反馈长程任务重复执行、技能记忆混乱等问题。测试基础目前更多停留在意图层面,从失败轨迹到标注再到模型改进的闭环,目前也更多停留在产品层面。钉钉和飞书在第三高地上反而具备结构性优势:平台内任务数据有优先条件回流至自家模型的训练和评测体系。例如用户在钉钉上执行任务出错,千问能从失败中学习,钉钉体验随之改善。7月30日字节跳动将飞书产品团队并入豆包,从组织层面打通了这一闭环;且其第二高地最强,意味着失败自带标签——审批走通与否就是天然标注,连标注环节都省去了。第三高地需要持续投入,关键问题在于资金从何而来。

转型与训练的错位

2026年夏天,三家参战大厂各自推进组织收敛。腾讯将QClaw产品中心的业务和团队划入WorkBuddy所在部门;阿里将QoderWork、悟空、MuleRun合并为千问办公,交由6月11日接任钉钉CEO的陈宇森操盘;字节跳动将飞书产品团队并入豆包,赵祺任一号位,随后进行第二次收敛,Trae和扣子整体并入豆包体系。三次调整方向各异——只有字节将协同平台的产品团队纳入模型侧,阿里将Agent交给协同平台负责人,腾讯调整的是两个Agent之间的关系。共同点只有一个:资源向单一Agent入口收拢。

收敛之后,各自的家底与矛盾逐渐暴露。钉钉、飞书目前的收入主要依赖"人头"租金——一家500人公司使用飞书,按席位付费,人数乘以单价,年年续约。这门生意稳定、可预期,支撑着平台持续维护组织权限体系、审批流和协作记录,即那些最值钱的上下文。但Agent的定价逻辑正离开人头:WorkBuddy采用积分制,用多少扣多少;章庆元在7月表示订阅加AI用量将长期并存;百度库库AI企业版按定制化打包。没有一家新入局的产品还在按席位收费。组织骨架越深厚,维护成本越高,对席位收入的依赖就越重;但矛盾在于,Agent越普及,企业越倾向为结果付费而非为人头付费。供养最值钱上下文的那门生意,恰恰是被Agent时代第一个改写的生意。

WorkBuddy走向另一个极端——手中没有组织骨架,也无需承担相应财务压力。腾讯表示不给团队设商业化KPI,仍处于投入阶段。机构数据显示WorkBuddy月活已突破2000万,虽领先诸多大厂企业Agent,但不代表上下文与任务质量足够深入,毕竟每个上下文来源几乎都需从头接入。开放平台策略似乎试图用广度弥补深度,白皮书中几种合作模式的独家性一栏三处均注明"非独家"。开放生态负责人林佐露解释,腾讯未给生态设定伙伴数量KPI,"开放是我们要做的工作,生态是一个结果"。生态规模起量虽快,但尚未到腾讯思考建立护城河的阶段。于是,拥有最佳训练素材的一方承受着最大转型压力;转型压力最小的一方,训练素材反而最薄。百度库库AI月活2500万、金山6.76亿月活设备,同样各自悬空——上下文的高地等级与变现路径各不相同。这意味着,目前没有一家大厂能同时占据这三块高地。

无法触及的那一层

有些场景是目前大厂几种模式都难以触达的,如金融风控、政务决策、国资合规等。这些场景的上下文质量可能更高——流程最刚性、后果最严重、对错最可归因,是Agent最想进入也最难进入的地方。在9月2日的生态发布会上,财税数智化服务商罗格科技展示了一台AI智能终端"罗拉超算盒",端侧可运行35B参数模型,封装了开箱即用的税务合规智能体。选择端侧还是云端使用,取决于客户对数据出域的要求。WorkBuddy的数据处理协议划出一条界线:不覆盖保留在开发者自有环境或第三方环境中的数据。在5.5.2版本更新中,WorkBuddy悄然在设置页底部上线本地模型Beta入口,首个可下载模型为Qwen3.6 35B-A3B,数据不出本机、不消耗云端额度。

端云分离让Agent能进入特定场景,但代价是端侧数据不进入腾讯的运行时,最有价值的失败轨迹无法被公有云看到,第三高地在此被锁死。协同平台对此场景的回应是私有化部署:钉钉可面向企业提供独享环境,飞书方案强调数据所有权与账号一致、操作全程可追溯。但私有化的本质是把平台搬进客户围墙内,规模效应和网络效应在此场景大打折扣。此时,合规开始成为竞争门槛。信通院8月6日公布首批办公智能体能力评估结果,围绕智能交互、全场景任务执行、安全防护和技能管理四个维度打分;千问办公成为国内首个通过16项测试的产品。8月25日豆包工作发布时强调已获取国内首批双认证;8月,湾擎·WorkBuddy在广东政务系统上线,广东省医保局等首批省直单位已开展数十个场景对接与试点。谁先拿到资质和交付案例,谁就在高敏场景招投标中多一张入场券;而在高敏场景中,交付的更多是信任。信任的生长速度与开放生态的扩张速度是两条平行轨道。这意味着,市场中Agent价值最大的场景未必形成赢家通吃局面,它将长期分散在少数具有交付能力和合规资质的公司手中,与开放平台的广度逻辑构成天然互补,也构成天然边界。

一场双向加速

腾讯为扩大生态宁愿放弃用户数据、只要失败痕迹,这一选择揭示的并非腾讯的独有策略,而是整个行业的共同处境。上下文存量正被开放协议拉平,体验层壁垒同样如此——大厂们争夺的东西越来越接近:将上下文转化为可靠执行力的能力,以及持续改进这一能力的机制。三个高地提供了一个排序标准:第一个高地已商品化,"读得到"不再是护城河;第二个高地形成过滤层,B端是否付费取决于Agent能否说清对错;第三个高地是唯一有复利的地方,但需前两个高地的支撑——没有足够上下文就没有足够执行,无法积累足够失败,更难以获取可观的复利经验。这条链条已不再单纯比较上下文的数量或质量,而是竞争谁先贯通三个高地、形成能力闭环。

但能力闭环的打造始终需要可持续现金流形成正反馈,不计回报仅适用于业务探索初期。过去,协同平台的席位制供养了最深的上下文,但席位制正被Agent逻辑侵蚀。如今,积分制和按量计费能匹配Agent时代的使用方式,但短期内撑不起协同平台十年积累的组织服务成本。谁先在收入结构中跑通非席位部分,谁才有资源持续投入第三高地,而非被旧模式惯性拖回。两条路线正以超预期的速度靠近:协同平台向外走——豆包工作继承飞书的权限体系和知识库,作为独立产品向所有人开放下载;千问办公同时运行于钉钉、飞书、企业微信之上。开放路线向内走——WorkBuddy的身份体系、跨端记忆、积分制制造使用惯性;Buddy应用和专家中心指向行业纵深与组织知识沉淀。大厂们的每一步都试图让上下文走得更远、登上更高高地。

章庆元在7月发布会上的一句话,对这场竞争中的每个参与者都适用:AI是未来几年唯一的、也是最重要的机会。

Disclaimer: Investing carries risk. This is not financial advice. The above content should not be regarded as an offer, recommendation, or solicitation on acquiring or disposing of any financial products, any associated discussions, comments, or posts by author or other users should not be considered as such either. It is solely for general information purpose only, which does not consider your own investment objectives, financial situations or needs. TTM assumes no responsibility or warranty for the accuracy and completeness of the information, investors should do their own research and may seek professional advice before investing.

Most Discussed

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10