千问办公标准模式上线,AI Agent进入成本竞争阶段

8月26日晚,企业级Agent产品“千问办公”正式上线标准模式,该模式由Qwen3.8-Flash模型提供支持。据千问办公披露,在真实办公场景测试中,标准模式完成单项任务的生成速度提升约100%,Token消耗平均减少75%。未来,千问办公约95%的日常任务将由标准模式完成,仅有约5%的复杂任务需要使用高级模式。这一产品调整标志着AI Agent行业正从功能竞争转向成本竞争阶段。

从回答问题到执行任务:成本难题浮出水面

这组数据背后,是AI Agent正在面对的一项共同难题:当产品从回答问题走向执行任务,模型调用量和使用成本也在快速增长。与普通大模型对话不同,Agent接到一项工作后,需要自主拆解目标、检索资料、调用工具、处理文件,并根据执行结果反复修改。一次任务可能触发多轮推理,消耗的Token数量也具有较大不确定性。

有研究发现,在部分Agent编程任务中,同一项任务不同运行之间的Token消耗可相差数十倍,投入更多Token也不一定能够带来更高的任务成功率。这种不可控的资源消耗,成为制约企业级AI Agent规模化落地的主要障碍之一。如何控制Agent成本,已成为国内外厂商共同面对的问题。

配图

行业应对:计费模式与资源调优双线并行

面对成本压力,海外科技巨头纷纷调整策略。微软已将Copilot Cowork转向按使用量收费,并表示此类长程Agent难以采用无限量使用模式;Google近期为Gemini Enterprise增加按量付费选项,希望降低企业试用AI的成本门槛;Salesforce的Agentforce则同时提供按行动、按对话和按用户收费等方案。OpenAI的Agent产品也通过任务次数和Credits限制高成本调用。

这些调整主要聚焦于计费方式,而千问办公此次升级更强调从任务执行环节降低资源消耗。千问大模型团队与千问办公团队针对多步规划、工具选择和上下文压缩等办公场景进行了联合优化,并通过推理流程和Harness架构适配,减少不必要的工具调用、重复推理和无效重试。换言之,基础模型负责提高单次推理效率,Agent系统则负责用更短的执行路径完成任务。

配图

标准模式与高级模式:按任务难度配置资源

标准模式和高级模式的划分,意味着千问办公开始根据任务难度配置模型资源。会议纪要、文件整理、常规数据分析和方案撰写等高频工作由标准模式承接,复杂的长程任务再调用高级模式。这种分层设计既保证了高频任务的响应速度与成本效率,又为少数复杂场景保留了充足的模型能力。

从实际效果看,标准模式的速度提升和Token消耗下降幅度相当可观。千问办公披露的数据显示,在真实办公场景测试中,标准模式完成单项任务的生成速度提升约100%,Token消耗平均减少75%。这意味着企业用户在处理日常办公任务时,可以显著降低资源开销,同时获得更快的响应体验。

成本竞争:AI办公走向高频使用的必然选择

当AI办公从尝鲜走向高频使用,竞争标准也在发生变化。模型能力仍然重要,但完成一项任务需要多少时间、消耗多少资源,以及能否稳定交付结果,正在成为衡量Agent产品的另一组核心指标。千问办公此次将约95%的日常任务交给标准模式,实际上是在为规模化商用铺路。

需要指出的是,速度提升100%、Token消耗减少75%目前属于千问办公公布的内部测试结果,实际效果仍与任务类型、文件规模和工具调用次数有关。不过,这一产品策略已经释放出明确信号:在AI Agent领域,成本控制能力正在成为与模型能力同等重要的竞争维度。随着更多厂商跟进,企业级AI Agent的落地门槛有望进一步降低。

数据来源:中国经营网(原文)

猜你喜欢