实测千问 Qwen3.8 预览版:国产模型追赶 Fable 5 的号角已吹响
2026/07/20 15:31阅读量 2
阿里千问发布新一代旗舰基座模型 Qwen3.8-Max-Preview,参数量 2.4T,官方声称仅次于 Fable 5。实测显示其在代码生成和简单 3D 任务中速度快但复杂场景效果欠佳;同时 Kimi K3、GLM-5.2 等国产模型密集发布,国产开源大模型在发布数量上已超过美国。模型差距正在缩小,竞争焦点或转向性价比。
事件概述
阿里千问团队发布 Qwen3.8-Max-Preview,参数量 2.4T,官方称“目前最强大的模型之一,仅次于 Fable 5”。该预览版已开放使用,接替 5 月发布的 Qwen3.7-Max。社区关注点集中在“能聊≠能用,承诺≠交付”,期待正式版权重和 benchmark 数据。
实测表现
- 代码生成与 3D 场景:通过 Qoder 应用测试,生成个人作品集网站效果较好,支持 161 种风格参考和画布编辑。
- Three.js 跑酷游戏:深度思考约 29 秒,整体生成快,但首版游戏体验差(速度控制问题),仅在 Qoder 环境交付可玩结果,其他平台因依赖缺失导致黑屏。
- 艺术世界生成(莫奈睡莲世界):交付结果抽象,碎片旋转;二次修改后勉强可辨认桥形,效果不理想。
- 复刻 Flighty App:仅展示几个航班,交互和 UI 简陋,功能缺失。
- 深度研究能力:与 Qwen3.7-Max 相比无明显差异。
结论:预览版能力尚不稳定,编程类任务表现优于复杂视觉生成。
行业趋势
- 国产开源大模型密集发布:已发布 GLM-5.2(接近 Opus 水平)、Kimi K3(可与 Fable 5 对表),本月还将迎来 Qwen3.8-Max 正式版、DeepSeek V4、GLM-5.5、MiniMax-M3-Pro,均以“对标 Fable 5”为目标。
- 发布数量对比:今年以来 39 次模型发布,国产 21 个、美国 18 个;开源模型 17 个中 13 个来自中国。
- 社区讨论:部分海外观点将国产模型进步归因于蒸馏,但实际差距正快速缩小。模型能力趋同后,价格竞争将成为关键。
