开发者生态
OpenVLA
OpenVLA 由斯坦福、UC Berkeley 与 TRI 等团队开源,旨在提供可微调、可部署的通用机器人操作基座模型,降低 VLA 研究门槛。
项目说明
OpenVLA 是开源的视觉-语言-动作模型,将视觉与语言指令映射为机器人动作序列。
项目提供预训练权重、微调脚本与推理示例,可直接在真实机械臂或仿真中部署。
能力与适用场景
任务域
vlamanipulationimitation
框架 / 工具链
PyTorchHugging Face Transformers
主题标签
vlarobot-manipulationvision-language