人型机器人之窗:从视觉模型剖析人型机器人进展

摘要

现阶段人型机器人模型发展重点包含视觉-动作学习模型(VLA)的优化,以及结合多元数据、提升指令解读与理解人类意图。在训练数据方面,主要透过世界模型、人类影片与VR远端训练等方式,并更著重「第一人称视角」,以增强其感知能力。尽管人型机器人的最终目标是实现通用性,但现阶段模型发展仍面临诸多挑战,使欧美与中国厂商各自发展出不同的路径。

一. 视觉模型为机器人感知核心
二. 人型机器人模型厂商布局动态
三. 拓墣观点

图一 人型机器人模型运作示意图
图二 人型机器人训练资料说明
图三 Apple HAT模型说明
图四 ViLLA架构说明

表一 第一人称视角和第三人称视角算法比较
表二 第一人称资料集举要

 

人型机器人之窗:从视觉模型剖析人型机器人进展

请输入您的会员账号与密码,即可浏览全文

Login 如何购买 下载完整报告档案 1.23MB PDF

会员专属
您好,该资料属会员权益方可浏览,您需成为会员且购买此产业项目权限才可观看,详细说明如下:
  • 拓墣产业研究院之「产业数据库」为付费的会员服务,若您尚未具备会员身份,欢迎您申请加入或是与我们的客服联络了解。
  • 若您所属公司机关已具有拓墣会员身份,并且设定予贵公司人员在线申请,请先行移至「申请会员账号」填写申请数据后送出,我们会尽快为您审核办理。若未开放在线申请,请您询问贵公司的承办联系人处理,谢谢。
  • 由于贵公司无采购此产业项目,因此您将无法浏览此篇文章,欲查询贵公司所购买的产业项目明细,请至「会员权益」查询,谢谢。
  • 客户服务专线: 02 8978-6498 ext.822
    客户服务信箱:

宣传推广

产业洞察

2Q25新能源车销量年增30%,BYD领先、Tesla衰退

根据TrendForce最新调查,2025年第二季全球纯电动车(BEV)、插电混合式电动车 [...]

2025年AI需求独强,2026年电子产业恐面临低速成长

根据TrendForce最新调查,2025年全球电子产业市场极为分歧,由资料中心建置驱动的 [...]

固态电池商业化加速,硫化物电解质路线最受关注

固态电池因兼具高能量密度和高安全性,被视为「梦想电池」,近年随著技术突破与产业化进展,这种 [...]

预估Blackwell将占2025年NVIDIA高阶GPU出货逾80%,液冷散热渗透率续攀升

根据TrendForce最新调查,近期整体server市场转趋平稳,ODM均聚焦AI se [...]

品牌加速布局牵动折叠手机市占变化,2026年苹果入局可能刺激市场爆发

根据TrendForce最新预估,2025年折叠手机出货量将达1,980万支,渗透率约1. [...]

Baidu
map