论文
Mastering the game of Go with deep neural networks and tree search AlphaGo 用深度神经网络与蒙特卡洛树搜索击败围棋世界冠军李世石。
- 会议/期刊
- Nature
- 发表年份
- 2016
- DOI
- 10.1038/nature16961
硅基参考论文库整理具身智能论文的作者、机构、会议、方法与代码关联;同一板块也可阅读论文解读跟进文章。
清华联合正行创新、无问芯穹提出 Harness VLA:记忆增强的 Harness 层把冻结 VLA 封装为可重试的接触丰富原语,与解析原语组合执行,零微调在 LIBERO-Pro 拿下 82.4%,低成本路线正面击败重训派。
蚂蚁灵波发布 LingBot-VA 2.0:以 SemVAE 统一视觉与动作分词、因果预训练配稀疏 MoE 骨干、异步推理实现高频闭环控制,真机验证少样本泛化。具身原生路线与暴力 Scaling 路线正面对照。
小米机器人团队发布Xiaomi-Robotics-1,用10万+小时UMI真实操作轨迹预训练VLA模型,RoboCasa365以57.4%刷新SOTA,代码与权重将开源。
AlphaGo 用深度神经网络与蒙特卡洛树搜索击败围棋世界冠军李世石。
多智能体学习通信,Foerster方向代表。
MTCNN人脸检测对齐联合模型,工业最广泛人脸检测之一。
TSN视频动作识别,中科院自动化所代表。
YOLO单阶段实时目标检测,工业最广泛检测器之一。
MC Dropout,用dropout近似贝叶斯推断。
ANYmal四足机器人,腿式机器人代表平台。
深度学习教科书,领域标准教材。
层归一化,Transformer训练的标准组件。
ResNet残差网络,超深网络训练与视觉识别里程碑。
Drake机器人优化与仿真工具,模型based设计环境。
剪枝+量化+哈夫曼压缩深度网络,高效AI奠基。
端到端深度视觉运动策略训练,深度RL机器人学习开山之作。
用GAN学习3D物体形状的潜在空间。
用神经网络学习可解释程序的递归执行框架。
原始音频波形生成的因果扩张卷积模型,奠定神经声码器方向。