办公Agent正式进入模型聚合大战。

8月14日晚间,千问办公宣布上线GLM-5.3和DeepSeek V4 Pro两款模型,用户可以在产品首页的“前沿模型”档位直接选择使用。

加上此前已经接入的Qwen3.8-Max,目前千问办公的前沿模型已经同时覆盖阿里、智谱和DeepSeek三家模型厂商。

其中,DeepSeek V4 Pro拥有100万Token上下文和最高384K输出,重点强化长程任务和Agent任务串联能力;GLM-5.3则进一步提升编程和长程复杂工程任务能力。

这意味着,在腾讯WorkBuddy、字节TRAE Work、百度库库AI之后,阿里旗下千问办公也进一步走向多模型聚合。

相比只绑定自有模型,聚合路线的逻辑在于不同模型的能力可以得到更好的发挥。因为各家模型在代码、复杂推理、长文本、搜索、响应速度和调用成本等都有不同长板,一项复杂Agent任务又往往需要连续完成多个步骤。

但模型装得越多,另一个问题也随之出现:到底该让谁来干活?

目前,千问办公主要还是由用户主动选择模型。按照产品划分,复杂方案、自动化工作流等任务可以选择“前沿模型”,快速调研、表格分析等轻量任务则可以使用成本更低的“经济模型”。

再往前一步,则是由Agent在后台自动完成模型选择,也就是“路由”。

理想状态下,用户不需要理解每一个模型的长短板,只需要提出任务,后台便可以根据任务难度、模型能力和调用成本进行调度:简单的信息提取交给速度更快、成本更低的模型,代码和复杂推理则交给能力更强的模型。

对于个人用户,这直接关系到任务完成效果、等待时间和积分消耗;到了企业场景,则进一步对应算力开支。

不仅如此,如果办公Agent进一步积累起足够大的用户规模,这一层还可能产生新的数据价值。

每一次真实任务都会留下模型表现的反馈:什么任务交给哪个模型成功率更高,需要多久、消耗多少Token,又在哪些环节更容易失败。在符合隐私、授权和数据治理要求的前提下,这些反馈又可以反过来优化路由策略。

目前,这场竞争还处在早期阶段。行业对于什么时候应该切换模型、应该按照单次请求还是一整段任务进行调度,都还没有形成统一答案。

但随着千问办公加入模型聚合路线的阵营,腾讯、字节、阿里、百度的办公Agent竞争逐渐站到同一站线上。

模型越来越多之后,下一场竞争可能就是谁更懂得“用模型”。

风险提示及免责条款
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。