全球首个ViLLA架构具身智能模型开源,智元机器人GO-1降低技术门槛

9.23 据智元机器人介绍,虽然GO-1仅基于AgiBotG1机器人数据进行预训练,但该模型已经在松灵机器人方舟机器人Franka机械臂等不同本体上进行了充分的验证测试

“全球首个采用Vision-Language-Latent-Action(ViLLA)架构的通用具身智能模型向全球开发者免费开放。”9月23日,智元机器人正式宣布GO-1(Genie Operator-1)通用具身基座大模型全面开源。这标志着具身智能技术门槛大幅降低,行业有望迎来快速发展期。

 

GO-1采用的ViLLA架构是具身智能领域的重大技术突破。与传统的Vision-Language-Action(VLA)架构相比,ViLLA通过引入隐式动作标记,成功弥合了图像-文本输入与机器人执行动作之间的语义鸿沟。


2025-09-23_141417_341

 

这一创新使得机器人能够更好地理解人类意图,并将其转化为精确的动作执行。传统机器人技术中,从视觉识别到具体动作执行往往需要复杂的编程和调试过程,而ViLLA架构让这一过程变得更加直观和高效。

 

据智元机器人介绍,虽然GO-1仅基于AgiBot G1机器人数据进行预训练,但该模型已经在松灵机器人、方舟机器人、Franka机械臂等不同本体上进行了充分的验证测试。这些跨本体验证结果表明,GO-1具备良好的可移植性,能够适应不同机器人的运动学特性和控制接口。


2025-09-23_141926_878

 

GO-1模型的开源并非智元机器人在开源领域的首次尝试。今年7月底的2025世界人工智能大会上,智元机器人就发布了业界首个具身智能操作系统参考框架——“智元灵渠OS”开源计划。

 

灵渠OS构建了“南向适配具身硬件、北向支撑智能应用”的生态架构。底层基于智元已开源的高性能中间件AimRT,提供分布式群体实时通信、硬件抽象等基础服务框架。上层开放智能体服务框架,支持交互、作业、运动等智能基座模型的标准化对接。

 

“灵渠OS”开源计划将于今年第四季度逐步开源。该计划旨在解决当前机器人操作系统碎片化、适配成本高企、智能体服务协同困难等行业痛点。

 

智元机器人的开源战略借鉴了Google通过Android生态建立繁荣的移动互联网生态的成功经验,以“分层开源、共建共享”模式推进生态建设。

 

具身智能技术长期面临开发门槛高、适配成本大的挑战。机器人行业普遍陷于“专机专用”困局。GO-1模型的开源将极大降低具身智能的技术门槛,让全球开发者能够免费使用最先进的架构。

 

智元机器人今年已进入商务交付阶段,并正在探索海外市场拓展方向。公司正与北美、欧洲、中东、日韩及东南亚等地的合作伙伴推进产品本地化,以期实现全球化发展的战略目标。

 

具身机器人正经历从虚拟走向现实、由被动执行转向主动行动的历史性变革。以智元为首的具身智能头部企业通过构建开源技术生态,有望加速推动具身智能从实验室演练向工业制造、家庭服务等复杂场景的规模化落地。


https://genie.agibot.com/geniestudio 

https://github.com/OpenDriveLab/AgiBot-World 

https://huggingface.co/agibot-world/G0-1