论文
Do As I Can, Not As I Say: Grounding Language in Robotic Affordances SayCan 用大语言模型结合机器人可行性,实现长程任务规划。
- 会议/期刊
- CoRL
- 发表年份
- 2022
硅基参考论文库整理具身智能论文的作者、机构、会议、方法与代码关联;同一板块也可阅读论文解读跟进文章。
清华联合正行创新、无问芯穹提出 Harness VLA:记忆增强的 Harness 层把冻结 VLA 封装为可重试的接触丰富原语,与解析原语组合执行,零微调在 LIBERO-Pro 拿下 82.4%,低成本路线正面击败重训派。
蚂蚁灵波发布 LingBot-VA 2.0:以 SemVAE 统一视觉与动作分词、因果预训练配稀疏 MoE 骨干、异步推理实现高频闭环控制,真机验证少样本泛化。具身原生路线与暴力 Scaling 路线正面对照。
小米机器人团队发布Xiaomi-Robotics-1,用10万+小时UMI真实操作轨迹预训练VLA模型,RoboCasa365以57.4%刷新SOTA,代码与权重将开源。
SayCan 用大语言模型结合机器人可行性,实现长程任务规划。
RT-1 用 Transformer 学习真实机器人控制策略,13 万演示训练。
InstructGPT 用 RLHF 对齐 GPT-3,使模型按人类指令生成更有用回答。
提出 Chinchilla 缩放定律:数据与算力需同步增长,70B 模型可达更优性能。
Anthropic 提出 Constitutional AI,用 AI 反馈而非纯人类反馈实现无害对齐。
Cicero外交AI,结合语言模型与策略推理。
BEVDet多相机3D检测,自动驾驶感知。
MAE掩码自编码器,视觉自监督学习新范式。
JEPA自监督世界模型架构,LeCun对自主机器智能的路线图。
官网摘要称其利用 Denoising World Model 支持端到端强化学习人形机器人,并实现零样本 sim-to-real。