面壁智能近日发布了MiniCPM-Robot系列模型,这是一系列专为端侧机器人场景设计的多模态大模型。该系列模型基于其此前推出的MiniCPM-V 2.6架构,通过引入视觉-语言-动作(VLA)能力,使机器人能够直接理解视觉输入并生成动作指令,无需依赖额外的感知模块。

MiniCPM-Robot系列包括1B、3B和8B三个参数版本,均可在移动端或嵌入式设备上高效运行。在多个机器人任务基准测试中,该系列模型展现出与更大规模模型相当的性能,同时显著降低了推理延迟。面壁智能表示,该系列模型旨在推动具身智能的普及,让更多开发者能够低成本地开发智能机器人应用。