阿里近日正式推出新一代基座大模型Qwen3.8,其总参数量达到2.4万亿,在编程和专业办公领域的能力实现显著跃升。此次发布首次开源Max级模型,标志着阿里在大模型开源领域迈出重要一步。根据Arena最新榜单数据,Qwen系列模型整体性能已跻身全球第一梯队,仅次于Anthropic的Claude系列。
技术突破方面,Qwen3.8将总参数量拓展至2.4T规模,激活参数达95B,在推理效率和速度上实现双重提升。该模型支持1M Tokens的上下文长度处理,并具备视觉理解能力。在基准测试中,Qwen3.8-Max在编程智能体评测PaperBench中取得93.0分,较前代提升28.2分;在通用智能体评测WideSearch和Agent's Last Exam中分别获得81.9分和52.4分,均处于行业领先水平。
实际应用场景中,Qwen3.8-Max展现出惊人的自主编程能力。在官方实测案例中,该模型仅需一句指令便完成Hermes级别自进化智能体系统的开发,通过16天持续运行构建出"oh-my-cli"框架。这个完全开源的项目在GitHub仓库公开了完整开发过程,支持人类工程师通过钉钉实时调整需求。更令开发者惊叹的是,有用户利用单HTML文件实现了"星系碰撞"N-body模拟,该程序可同时渲染6000多个粒子,精准模拟引力物理演算过程,并配备交互控制面板和实时数据展示功能。
在专业领域测试中,Qwen3.8展现出强大的金融分析能力。某研究团队利用该模型完成ETF轮动策略研究,模型通过自主调度并行智能体,在数小时内完成策略开发、回测分析和动态修正,最终实现规模化盈利。针对meta财报的解析测试显示,直接上传原始文件时模型能提供更全面的分析维度,而仅凭网络检索也能保证核心数据准确性和论述深度。
开源计划成为海外社区关注焦点。即将开源的Qwen3.8-27B版本被开发者预测将成为单卡消费级GPU部署的"新标杆",其权重开放消息引发X平台热烈讨论。多位技术大V认为,该模型有望填补当前开源社区在中等规模高性能模型领域的空白。
多模态能力方面,Qwen3.8-Max突破传统文本处理边界。测试显示,该模型可精准提取206页民法典文件的重点内容,对20分钟新闻视频的总结准确率高达98%,能在3分钟内完成关键信息梳理。在芯片设计领域,模型展现出持续迭代优化能力,可自主推进芯片架构演进。
商业落地层面,Qwen3.8已通过千问AI平台开放API服务,并接入新推出的"千问办公"Agent产品。定价策略显示,国内市场每百万Tokens输入12元、输出36元,隐式缓存命中仅需1.5元,国际价格仅为Opus5的40%和24%。硬件适配方面,阿里真武M890超节点已完成与Qwen3.8的深度优化,在Agentic推理场景中可实现最高1.5倍性能提升,同时降低推理成本。











