IT时代网8月27日消息,阿里旗下千问办公今天首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。
即日起,所有用户都能通过全新的标准模式体验Qwen3.8-Flash。换到新模型之后,完成同样的任务,积分消耗更少、Token吞吐速度更快。往后千问办公的模型供给会分成标准和高级两种模式,按官方给出的分工,95%的日常任务通过标准模式即可完成,仅5%的复杂任务需要动用高级模式。
体验提升来自两头——模型升级,加上Agent协同优化。从官方介绍看,全新架构的Qwen3.8-Flash以千亿级总参数实现了超越Claude Opus 4.6的性能。千问大模型团队与千问办公团队还联合推出了办公专属版本的Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等场景进行专项训练调优,再通过推理优化和定制Harness架构把吞吐效率往上顶。
真实办公场景的测试结果是:千问办公标准模式的单任务生成速度提升约100%,Token消耗平均减少75%。
在真实AI应用场景里,高性能通常意味着高成本和高延迟,想压成本又往往要以牺牲智能为代价。官方的说法是,Agent与模型的深度协同优化正在打破性能、成本和速度的“不可能三角”,Agent即将告别Token焦虑,迎来“量大管饱”的阶段。
注:本文综合自IT之家等,文中包含AI辅助创作的内容。