
MiniCPM5-2B是面壁智能开源的2B参数端侧模型,通过高智能密度设计在Artificial Analysis评测中以23分登顶4B以下开源模型榜首,综合表现超越12B的谷歌Gemma 4,实现了小参数模型在工具调用、深度搜索等任务上的能力突破。
大模型竞赛的焦点,正在从单纯的参数规模比拼,转向对「智能密度」与端侧落地效率的极致追求。当行业普遍追逐千亿级参数时,一批聚焦端侧场景的国产模型,正试图用更小的体积撬动更强的能力,并重塑AI应用的成本结构。
近期,国内端侧大模型领域的代表性团队面壁智能联合OpenBMB开源社区,正式发布了新一代端侧语言基座模型MiniCPM5-2B。这款参数规模仅为2B的模型,凭借其在工具调用、深度搜索与代码生成等复杂任务上的表现,引发了业内对「小模型、大智能」可能性的新一轮讨论。
长久以来,业界普遍认为模型性能与参数规模呈正相关。然而,MiniCPM5-2B的发布似乎正在打破这一传统认知。根据独立评测机构Artificial Analysis公布的最新榜单数据,该模型以综合能力23分的成绩登顶全球4B以下开源模型榜首。这一得分不仅超越了同级别的众多3B-4B模型,甚至超过了参数规模约为其6倍的谷歌Gemma 4 12B模型,以及通义千问系列的Qwen3.5 9B。
从算力利用效率的维度审视,MiniCPM5-2B展现了惊人的「智能密度」。在消耗相近推理Token(约21k)的前提下,其智力得分(23分)相较于Granite 4.2 3B(14分)和LFM2.5-2.6B(11分)实现了近乎翻倍的增长。这意味着在同等算力开销下,该模型能提供更高价值的推理输出,这对于计算资源受限的端侧设备而言,意义尤为重大。
在更贴近真实应用场景的评测中,这种优势同样显著。以人类基线为1000分的真实任务评测框架下,MiniCPM5-2B获得了891分的高分,不仅稳居4B以下模型首位,更将Gemma 4 12B(647分)等大参数模型甩在身后。面壁智能公布的内部34项基准测试也显示,该模型在代码推理、数学逻辑、指令遵循及Agent任务等维度均展现出均衡且强大的综合实力。
如果说发布高性能权重是「授人以鱼」,那么面壁智能此次的开源策略则带有明显的「授人以渔」色彩。与模型同步亮相的,还有其自研的强化学习框架Meshy与基于奖励的强化学习策略JustRL II。这一举措旨在将模型背后的训练方法论公之于众,解决端侧模型在长思维链强化学习过程中面临的数据质量与信用分配两大核心痛点。
据悉,Meshy框架通过去中心化的对等服务架构,取代了传统的中央控制器,利用数据流驱动训练、推理与奖励计算环节,支持同步、异步及全异步三种模式灵活切换,极大地提升了训练效率与可扩展性。而JustRL II策略则通过三阶段数据筛选流水线保障训练数据纯净度,并在算法层面为GRPO引入Critic机制,实现了词元级(Token-level)的精细信用分配,从而确保了强化学习过程的稳定性与最终性能收益。
这种将「配方」与「食材」全盘托出的做法,为全球开发者提供了宝贵的复现与研究蓝本。截至2026年8月,MiniCPM系列的全球下载量已突破5000万次,此次开源生态的进一步完善,有望进一步巩固其在端侧AI开发者社区中的影响力。
对于端侧模型而言,算法能力必须依托硬件才能转化为实际生产力。MiniCPM5-2B在发布首日便完成了与英特尔、瑞芯微、Arm等多家主流芯片及计算平台的原生适配(Day0),展示了其产业落地的决心。
在英特尔平台侧,通过利用酷睿Ultra系列CPU、GPU与NPU的异构计算资源,并借助OpenVINO工具套件进行算子与内存调度优化,MiniCPM5-2B能够在AI PC上实现高效的本地化部署。在瑞芯微平台,模型则基于RK3588与RK1828双芯方案,通过RKNN3工具链完成量化适配,覆盖推理、搜索及代码生成等多样任务。针对Arm平台,模型已适配支持SME2技术的Armv9设备,据披露的测试数据显示,相关优化使预填充与解码阶段的性能分别提升至对照条件下的约1.7倍与1.2倍。
在软件生态方面,MiniCPM5-2B已全面接入主流开发工具链。无论是训练微调侧的LlamaFactory、ms-swift,还是推理部署侧的SGLang、vLLM、llama.cpp、Ollama及Hugging Face Transformers,开发者均可即插即用。此外,该模型还兼容面壁智能自研的Arclight CPU推理框架,为不同硬件条件的开发者提供了多样化的部署选择。
放眼国内AI大模型赛道,当多数厂商聚焦于云端千亿级大模型的军备竞赛时,以面壁智能为代表的端侧派系正走出一条差异化路径。这与国内近期涌现的DeepSeek、Kimi等强调高性价比推理的模型思路不谋而合——即在有限资源下最大化模型效能。
相较于云端模型高昂的调用成本与数据隐私风险,端侧模型在离线可用性、低延迟响应及数据安全方面具备天然优势。MiniCPM5-2B此次在2B规模上初步展现出的通用Agent能力雏形,预示着未来智能手机、PC乃至IoT设备有望在不依赖网络的情况下,自主完成复杂的任务规划与工具调用。这不仅将降低AI应用的使用门槛,更可能催生出全新的端侧应用生态。
MiniCPM5-2B的发布,是端侧AI模型从「能用」向「好用」迈进的一个关键注脚。它证明了通过算法创新与工程优化,小模型同样可以拥有大智慧。随着推理成本与硬件适配瓶颈的逐步突破,端侧AI Agent的规模化落地或许已不再遥远。
MiniCPM5-2B是面壁智能联合OpenBMB开源的新一代端侧语言基座模型,参数量为2B,专注于在低算力设备上实现工具调用、深度搜索与代码生成等复杂功能。
根据Artificial Analysis榜单,它以23分位列全球4B以下开源模型第一,智能密度高于Qwen3.5 9B和谷歌Gemma 4 12B等更大参数模型。
开发者可通过HuggingFace(https://huggingface.co/collections/openbmb/minicpm5)或GitHub(https://github.com/OpenBMB/MiniCPM)获取模型权重,并借助LlamaFactory、vLLM、Ollama等工具链进行微调和部署。
除了模型权重,还开源了自研强化学习框架Meshy、基于奖励的强化学习策略JustRL II,以及完整的训练配方和配套数据集,方便开发者复现训练过程。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

阶跃星辰 Step 5 Preview 以 600B 总参数、27B 激活参数的稀疏 MoE 架构切入 Agent 赛道,第三方榜单开源第三,单任务成本压至 Claude Opus 5 的八分之一,10 月 15 日开源。

阿里千问开源270亿参数的原生多模态模型Qwen3.8-27B,采用Dense架构,家用显卡即可运行。该模型在软件工程、Computer Use等Agent任务上表现超越部分千亿级闭源模型,标志着前沿AI能力开始向轻量级模型下放。

阿里通义千问正式开源 Qwen3.8-27B 模型,270 亿参数可在消费级显卡运行,编程与办公性能超越前代旗舰,采用 Apache 2.0 协议免费商用。
最新の SEO・GEO 情報をお届けします。
プライバシーを尊重します。いつでも購読を解除できます。