Skip to main content
Aggregate 雷锋网 人工智能 27 Aug 2026 - 11:30

千问办公首发上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

RSS 官方收录 · 可信分层展示

关键摘要

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。…

  • 未来,千问办公的模型供给将只有标准和高级两种模式,95%的日常任务通过千问办公标准模式即可完成,仅5%的复杂任务需要使用高级模式。
  • 用户体验的提升来自模型升级与Agent协同优化。
  • 8-Flash以千亿级总参数实现了超越Claude Opus 4.

摘要引擎:抽取

正文提要

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。未来,千问办公的模型供给将只有标准和高级两种模式,95%的日常任务通过千问办公标准模式即可完成,仅5%的复杂任务需要使用高级模式。

 

 

用户体验的提升来自模型升级与Agent协同优化。全新架构的Qwen3.8-Flash以千亿级总参数实现了超越Claude Opus 4.6的性能。同时,千问大模型团队与千问办公团队还联合推出了办公专属版本Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等场景进行专项训练调优,并通过推理优化和定制Harness架构进一步实现吞吐效率提升。在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约100%,Token消耗平均减少75%。

 

在真实AI应用场景,高性能通常意味着高成本和高延迟,低成本则需要以牺牲智能为代价。Agent与模型的深度协同优化,正在打破性能、成本和速度的“不可能三角”。随着模型智能密度的持续提升,以及千问办公与模型的双向优化,Agent即将告别Token焦虑,迎来“量大管饱”时代。


打开官方原文 站点原文页 可信分区 本信源更多 今日简报 分享图 RSS 稍后再看列表 官媒栏目