文章摘要
8月26日晚间,千问办公正式推出基于全新Qwen3.8-Flash模型的标准模式。该模型经架构升级、办公场景针对性调优与Agent协同适配,综合性能超越Claude Opus 4.6,测试显示单任务生成速度提升一倍、Token消耗减少75%,打破办公AI性能、成本、速度的不可能三角,后续平台仅保留两档位,标准模式可覆盖95%日常办公场景。

8月26日晚间,千问办公正式推出基于全新Qwen3.8-Flash模型的标准模式,所有用户即日起即可通过该模式体验最新版本的AI办公能力。相较于此前的服务方案,新模型能够帮助用户以更低的积分消耗、更快的Token吞吐速度完成各类办公任务。根据官方后续规划,千问办公的模型服务将仅保留标准和高级两种档位,其中标准模式可以覆盖95%的日常办公场景,仅剩下5%的高复杂度任务需要调用高级模式。

此次用户体验的大幅提升,核心来自两方面的深度优化:一是模型本身的性能升级,二是与Agent的协同适配调整。全新架构的Qwen3.8-Flash拥有千亿级总参数,其综合性能已经超越了Claude Opus 4.6。与此同时,千问大模型团队与千问办公团队联合打造了办公专属的Qwen3.8-Flash版本,针对多步任务规划、工具调用选择、上下文智能压缩等高频办公场景进行了针对性的训练调优,还通过推理流程优化和定制化的Harness架构进一步提升了整体吞吐效率。根据真实办公场景的测试数据,千问办公标准模式的单任务生成速度提升了约100%,Token的平均消耗则减少了75%。

在真实的AI应用场景中,长期以来都存在一个难以兼顾的“不可能三角”:想要实现高性能往往意味着高成本和高延迟,而追求低成本则通常需要牺牲部分智能表现。而此次Agent与模型的深度协同优化,正在打破这一僵局。随着模型智能密度的持续提升,再加上千问办公平台与模型的双向适配优化,AI办公领域即将告别Token消耗焦虑,迎来“量大管饱”的高效普惠时代。

以上内容不代表本平台立场,仅供读者参考