北京端侧大模型领域的独角兽企业面壁智能近日宣布,与OpenBMB开源社区联合推出新一代端侧语言基座模型MiniCPM5-2B。该模型以20亿参数规模实现多任务支持,包括工具调用、深度搜索和代码生成等功能,并在发布首日即完成与英特尔、瑞芯微、Arm等主流芯片及计算平台的适配工作。
根据第三方评测机构Artificial Analysis发布的榜单,MiniCPM5-2B以23分的综合得分位列全球40亿参数以下开源模型首位。其智能密度指标显著优于参数规模达其6倍的谷歌Gemma 4 12B模型,以及Qwen3.5 9B等更大规模模型。在智能体能力评估中,该模型取得20分的Agentic Index成绩,较同级别模型平均分高出1倍以上。
技术团队通过多项创新实现性能突破。在推理效率方面,该模型处理复杂任务时消耗2.1万Token即可获得23分智力评分,较同类模型减少30%以上计算资源消耗。真实任务评估显示,其891分的表现接近人类基准水平,较Gemma 4 12B模型提升37.7%。在涵盖代码推理、数学运算等34项基准测试中,平均得分达53.9分,持续保持同规模模型领先地位。
开源生态建设成为本次发布的重要亮点。除模型权重外,研发团队同步开放自研强化学习框架Meshy和基于奖励机制的JustRL II算法。Meshy框架通过去中心化架构设计,支持同步、异步及全异步三种训练模式自由切换,有效提升训练效率。JustRL II算法引入三阶段数据筛选机制和Critic信用分配模块,使模型在强化学习阶段的性能提升显著。
硬件适配层面,该模型已实现与主流计算平台的深度整合。在英特尔平台,通过OpenVINO工具套件优化异构计算资源,支持在AI PC设备本地部署;瑞芯微双芯平台方案利用RKNN3工具链完成模型量化,确保在嵌入式设备上稳定运行;Arm平台针对Armv9架构的SME2技术进行专项优化,使预填充和解码性能分别提升70%和20%。
开发工具链支持方面,模型提供完整的训练微调方案,兼容LlamaFactory、ms-swift等主流训练框架。推理部署层面,既支持SGLang、vLLM等专业推理引擎,也适配Hugging Face Transformers等通用工具库,同时提供自研的Arclight CPU推理框架选项。这种多层次支持体系使开发者可根据具体场景需求灵活选择部署方案。
数据显示,MiniCPM系列开源模型全球下载量已突破5000万次。此次发布的5-2B版本通过技术创新和生态建设,在保持端侧模型轻量化优势的同时,将通用智能体能力推向新高度。随着硬件适配的持续推进和开发工具的完善,该模型有望在办公自动化、智能终端等场景引发新一轮应用创新。











