当前标签:VLA
阿里Qwen-Robot 系列发布 让机器人会想会走会动手
阿里巴巴发布首个具身智能大模型Qwen-Robot系列,三大模型分别赋予机器人灵巧操作、自主导航与物理推理能力,为机器人迈向真实场景提供统一通用底座。
硬氪专访
VLA不会死,而是正从“感知-动作”进化到“预测-推演”的新阶段,世界模型则被视为下一代人工智能的基座模型,但数据匮乏、路线未收敛等瓶颈仍需攻克。
具身机器人研究全都错了?最新论文:不能只靠VLA和世界模型
VLA和世界模型都不是机器人智能的终极答案,最新研究指出融合架构和物理理解才是关键。
首次,纯人类视频预训练VLA灵巧操作,少量数据微调就能部署成功
本文介绍了微软亚洲研究院与清华大学合作提出的VITRA框架,首次实现从纯人类活动视频中预训练视觉-语言-动作(VLA)模型,仅需少量真实机器人数据微调即可在灵巧手上实现高成功率操作,并展现出强大的零样本泛化能力。