8 月 26 日晚,千问办公首发上线了刚刚发布的 Qwen3.8-Flash 模型,并同步推出“标准模式”。即日起,所有用户均可通过全新的标准模式体验 Qwen3.8-Flash。基于该最新模型,用户能够以更低的积分消耗和更快的 Token 吞吐速度完成任务。未来,千问办公的模型供给将简化为“标准”和“高级”两种模式,其中 95% 的日常任务通过标准模式即可高效完成,仅有 5% 的复杂任务需要调用高级模式。

用户体验的显著提升,得益于模型升级与 Agent 的协同优化。采用全新架构的 Qwen3.8-Flash 以千亿级总参数量,实现了超越 Claude Opus 4.6 的性能表现。同时,千问大模型团队与千问办公团队联合推出了办公专属版 Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等办公场景进行了专项训练与调优,并通过推理优化和定制化 Harness 架构进一步提升了吞吐效率。在真实办公场景的测试中,千问办公标准模式的单任务生成速度提升了约 100%,Token 消耗平均减少了 75%。
在真实的 AI 应用场景中,高性能往往伴随着高成本和高延迟,而低成本则通常需要以牺牲智能为代价。Agent 与模型的深度协同优化,正在打破性能、成本与速度之间的“不可能三角”。随着模型智能密度的持续提升,以及千问办公与模型的双向优化,Agent 即将告别 Token 焦虑,迎来“量大管饱”的新时代。