近期,人工智能领域迎来新一轮模型发布热潮,国产开源大模型表现尤为亮眼,引发海内外广泛关注。其中,Kimi K3凭借2.8T的万亿大参数模型,在部分测试项目中击败国外闭源模型,成为行业焦点。这一成果不仅展示了国产模型的技术实力,也为开源生态注入了新的活力。
紧随其后,千问团队推出了新一代旗舰基座模型Qwen3.8-Max的预览版,并开放给所有用户使用。该模型参数量达2.4T,团队宣称其兼容前沿AI技术,性能仅次于Fable 5。尽管正式版尚未发布,但预览版在社交平台X上已获得近600万次浏览,网友讨论热度不减。不过,多数用户更关注正式版的实际表现,包括基准测试数据、激活参数量及真实权重文件的发布。
为验证Qwen3.8-Max-Preview的潜力,测试团队通过其编程应用Qoder进行了多项实测。在设计个人作品集网站首页的任务中,模型不仅快速生成了符合要求的页面,还添加了缓入缓出渐变效果,提升了视觉体验。Qoder提供的161种风格参考,如Airbnb、Apple等,进一步简化了创作流程。用户可直接通过画布功能修改网页元素,包括排版、颜色和文本内容,操作便捷性获得认可。
在代码能力测试中,Qwen3.8-Max-Preview被要求开发一款基于Three.js的屋顶跑酷游戏。模型仅用数分钟便完成任务,生成的游戏支持即时游玩,风格与Fable 5相近。然而,首版因玩家移动速度失控导致体验不佳,经调整后问题得到改善。相比之下,其他平台因未针对编程优化或库文件加载失败,未能交付可用结果。
进一步测试中,模型尝试构建莫奈风格的3D艺术世界,但首次结果仅呈现旋转碎片,难以辨识具体元素。经二次修改后,画面中虽隐约可见桥梁轮廓,但整体仍显抽象。在复刻Flighty应用的测试中,模型生成的网页功能简陋,仅展示航班信息,未能还原原应用的交互设计和动效。
除编程场景外,Qwen3.8-Max-Preview在千问官网的深度研究能力测试中表现平稳。其生成的核心摘要、市场格局分析及行业趋势预测,与前代Qwen3.7-Max差异不大,显示预览版在复杂任务中的稳定性仍有提升空间。
国产开源模型的崛起已成为不可忽视的趋势。据统计,今年以来全球共发布39个大模型,其中国产模型占21个,美国模型18个。开源模型中,国产占比高达76%,包括GLM-5.2、Kimi K3等,部分模型性能已接近国际顶尖水平。例如,Kimi K3在Agent Coding测试中的表现可媲美今年一季度最佳公开模型,引发OpenAI战略主管Dean W. Ball的关注,他认为其性能难以用蒸馏技术简单解释。
随着Qwen3.8-Max、DeepSeek V4正式版、GLM-5.5及MiniMax-M3-Pro等模型的陆续发布,国产开源生态正加速缩小与海外闭源模型的差距。社交平台上,网友对中美模型竞争的讨论愈发热烈,甚至出现“中国模型靠蒸馏刷榜”“美国隐藏更强模型”等调侃。然而,数据表明,国产模型在数量和技术突破上已占据主动,未来竞争或将聚焦于成本控制与商业化落地。
当前,用户对最强模型的选择不再局限于少数海外闭源产品。随着技术差距缩小,更多模型、产品及本地部署方案涌现,价格或将成为决定AI普及程度的关键因素。这场没有硝烟的竞争,正推动整个行业向更开放、更高效的方向发展。










