千问办公上线Qwen3.8-Flash:生成速度翻倍,Token消耗降低75%

2026/08/27 09:45阅读量 5

8月26日晚,千问办公首发上线Qwen3.8-Flash模型并推出“标准模式”,旨在通过模型与Agent的深度协同优化打破性能、成本与速度的平衡难题。实测数据显示,该模式下单任务生成速度提升约100%,Token消耗平均减少75%。未来千问办公将仅保留标准和高级两种模式,其中95%的日常任务可由标准模式覆盖。

事件概述

8月26日晚,千问办公正式首发上线最新发布的 Qwen3.8-Flash 模型,并同步推出“标准模式”。即日起,所有用户可通过该模式体验更低的积分消耗和更快的 Token 吞吐速度。根据规划,千问办公未来的模型供给将精简为“标准”和“高级”两种模式:95% 的日常办公任务将通过标准模式完成,仅 5% 的复杂任务需要使用高级模式。

核心技术与性能表现

此次体验升级主要得益于模型架构升级与 Agent(智能体)协同优化的双重驱动:

  • 模型性能基准:全新架构的 Qwen3.8-Flash 拥有千亿级总参数,其综合性能表现超越了 Claude Opus 4.6。
  • 办公场景专项调优:千问大模型团队与千问办公团队联合推出了办公专属版本。针对多步规划、工具选择、上下文压缩等高频办公场景进行了专项训练调优。
  • 推理效率优化:通过推理优化和定制 Harness 架构,进一步提升了吞吐效率。

在真实办公场景测试中,千问办公标准模式实现了以下关键指标提升:

  • 生成速度:单任务生成速度提升约 100%
  • 资源消耗:Token 消耗平均减少 75%

行业意义

高性能通常伴随高成本和高延迟,而低成本往往需要牺牲智能水平。此次 Qwen3.8-Flash 的上线标志着 Agent 与模型的深度协同正在打破这一“不可能三角”。随着模型智能密度的持续提升以及千问办公与模型的双向优化,AI 应用有望告别 Token 焦虑,进入兼顾高效、低成本与高智能的新阶段。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。