千问办公引入智谱、DeepSeek,打响模型聚合大战

华尔街见闻
Yesterday

办公Agent正式进入模型聚合大战。

8月14日晚间,千问办公宣布上线GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。

加上此前已经接入的Qwen3.8-Max,目前千问办公的前沿模型已经同时覆盖阿里智谱和DeepSeek三家模型厂商。

其中,DeepSeek V4 Pro拥有100万Token上下文和最高384K输出,重点强化长程任务和Agent任务串联能力;GLM-5.3则进一步提升编程和长程复杂工程任务能力。

这意味着,在腾讯WorkBuddy、字节TRAE Work、百度库库AI之后,阿里旗下千问办公也进一步走向多模型聚合。

相比只绑定自有模型,聚合路线的逻辑在于不同模型的能力可以得到更好的发挥。因为各家模型在代码、复杂推理、长文本、搜索、响应速度和调用成本等都有不同长板,一项复杂Agent任务又往往需要连续完成多个步骤。

但模型装得越多,另一个问题也随之出现:到底该让谁来干活?

目前,千问办公主要还是由用户主动选择模型。按照产品划分,复杂方案、自动化工作流等任务可以选择“前沿模型”,快速调研、表格分析等轻量任务则可以使用成本更低的“经济模型”。

再往前一步,则是由Agent在后台自动完成模型选择,也就是“路由”。

理想状态下,用户不需要理解每一个模型的长短板,只需要提出任务,后台便可以根据任务难度、模型能力和调用成本进行调度:简单的信息提取交给速度更快、成本更低的模型,代码和复杂推理则交给能力更强的模型。

对于个人用户,这直接关系到任务完成效果、等待时间和积分消耗;到了企业场景,则进一步对应算力开支。

不仅如此,如果办公Agent进一步积累起足够大的用户规模,这一层还可能产生新的数据价值。

每一次真实任务都会留下模型表现的反馈:什么任务交给哪个模型成功率更高,需要多久、消耗多少Token,又在哪些环节更容易失败。在符合隐私、授权和数据治理要求的前提下,这些反馈又可以反过来优化路由策略。

目前,这场竞争还处在早期阶段。行业对于什么时候应该切换模型、应该按照单次请求还是一整段任务进行调度,都还没有形成统一答案。

但随着千问办公加入模型聚合路线的阵营,腾讯、字节、阿里、百度的办公Agent竞争逐渐站到同一站线上。

模型越来越多之后,下一场竞争可能就是谁更懂得“用模型”。

Disclaimer: Investing carries risk. This is not financial advice. The above content should not be regarded as an offer, recommendation, or solicitation on acquiring or disposing of any financial products, any associated discussions, comments, or posts by author or other users should not be considered as such either. It is solely for general information purpose only, which does not consider your own investment objectives, financial situations or needs. TTM assumes no responsibility or warranty for the accuracy and completeness of the information, investors should do their own research and may seek professional advice before investing.

Most Discussed

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10