诠视科技联合数据堂亮相IROS 2026,以空间感知能力回应具身智能数据采集之问
2026年9月27日至10月1日,全球机器人领域顶级会议IROS 2026在美国匹兹堡举行。在这场汇聚全球顶尖学者与产业力量的盛会上,“数据采集”被反复推至舞台中央。诠视科技以十年空间计算积淀为根基,联合战略合作伙伴数据堂亮相IROS 2026,展出SeerFusion系列数据采集终端,向全球具身智能行业宣告:诠视科技的空间计算能力,正从XR领域延伸至具身智能数据基础设施,打开更广阔的市场空间。

IROS 2026:数据采集成为具身智能的核心议题
本届IROS释放出清晰的行业信号——具身智能的竞争正从模型和算法进一步延伸到真实世界数据。大会主题演讲中,多位学者强调大规模具身数据对智能涌现的关键作用,以及数据质量与结构在机器人学习中的决定性意义。IROS 2026期间的两场专题研讨会——“Physical World Models for Scaling Embodied AI”和“Building Scalable Infrastructure for Robot Learning”——均聚焦数据采集与规模化基础设施。海外媒体Rockingrobots在报道中指出,触觉传感器和新的数据采集方式成为IROS 2026反复出现的主题,硬件正被设计来生成改进未来模型所需的数据集。
十年空间计算积淀,从XR迈向具身智能
2016年诠视科技在硅谷成立,以空间计算和感知交互为核心,专注3D人机交互解决方案,自空间计算能力衍生出SeerLens系列MR眼镜、SeerSense系列智能感知模组和SeerFusion系列数据采集终端三大产品线。

.jpg)
2026年,诠视科技在多个行业场合的亮相,呈现出从XR向具身智能延伸的清晰脉络。6月,SeerFusion One亮相美国AWE展会,首次向业界展出面向物理AI与世界模型训练的Ego-Centric数据采集终端。7月,诠视科技在WAIC期间与数据堂正式达成战略合作,并作为首批成员单位加入由飞捷科思牵头的国内首个物理智能创新联合体。此次IROS之行,则是诠视科技向机器人行业展示空间计算能力延伸至具身智能领域的关键一步。
“从AWE到WAIC再到IROS,我们希望新老用户看到的是:诠视科技的技术根基没有变,空间计算能力一脉相承,但我们的市场空间已经从XR拓展到了具身智能这一更广阔的领域。”诠视科技创始人林瓊表示。
面对IROS 2026的学术追问,诠视科技的回答
IROS 2026的Workshop议题划出了具身智能数据基础设施的几个关键门槛。围绕这些学术界热议的话题,诠视科技以SeerFusion系列产品矩阵给出了自己的答案。
“Physical World Models for Scaling Embodied AI” Workshop指出,具身智能缺的不是“更多数据”,而是一种能把物理经验规模化生产、组织和复用的基础设施。现有的三条数据获取路径各有天花板:真机遥操作数据最真实但贵且慢;仿真器可无限生成却受限于sim-to-real gap;互联网视频有观测但无动作标签和物理反馈。
诠视科技的观点是:数据采集设备的核心能力不是“多一个摄像头”,而是高精度时·空定位与同步。空间精度决定了数据“在哪里发生”,时间同步决定了数据“何时发生”——而具身智能数据与语言模型数据最根本的差异,正在于前者是“带动作、带反馈、带物理后果的交互经验”,每一个动作都对应着明确的空间位置和时间节点。
SeerFusion全系产品基于空间计算技术,具备独立6DoF追踪能力,可实现毫米级空间定位精度与毫秒级数据同步性能——这意味着每一个采集到的像素、每一个关节数据,都同时锚定在真实可信的空间坐标和时间轴上。
而空间与时间的精确对齐,直接服务于一个更深层的数据训练需求:因果关系的学习。物理AI和世界模型要真正理解真实世界,不仅需要知道“发生了什么”,还需要知道“什么导致了什么”——肢体动作与物体位移之间的因果链条、身体运动与环境反馈之间的因果关系。如果多模态数据(视觉、关节位置、手部姿态、空间轨迹)在时间轴上存在漂移或错位,因果关系就无法被可靠地学习。诠视科技以统一的核心算法底座和毫秒级同步能力,确保视觉、动作、空间轨迹等多模态数据在采集时即严格对齐,简化后道二次处理环节,为模型提供可学习因果关系的高质量结构化数据。
Workshop同时将“从真实场景与第一视角的人类示范中提取任务目标、物体affordance、动作片段、接触事件与交互先验”列为关键方向。这意味着Human-Centric数据的结构性要求是全身性的——手的精细操作、头的视野覆盖、身体的空间轨迹、关节的运动状态,必须在统一的时空框架下同步采集。
诠视科技的回答是构建头手身协同的完整采集方案。
· SeerFusion One提供第一视角视野与空间基准,在线标定能力。
· SeerFusion Gripper(UMI夹爪)与SeerFusion Glove(数据手套)覆盖手部操作的追踪与头手同步,其中Glove的自带相机专门弥补SeerFusion One的视野盲区——这是对“手部数据在头部视野中经常被遮挡或丢失”这一实际问题的结构性回应;
· SeerFusion Traq(自追踪定位追踪器)可安装于手肘、膝盖、脚踝等关节,配合SeerFusion One实现全身动作捕捉。全系产品共享同一空间计算技术底座,毫米级空间定位精度与毫秒级数据同步性能,确保不同设备采集的数据在时空维度上严格对齐,使多模态数据具备可学习因果关系的结构化基础。
共建具身智能数据采集新能力
诠视科技与数据堂的战略合作,将数据采集能力从设备层延伸到数据服务层。数据堂专注于数据服务,已建设8,000㎡+的 Physical AI数据工厂,部署200余台人形机器人和300余套灵巧手操作设备,Ego-Centric与UMI数据有效月产能达到50,000+小时,覆盖家居、工厂、办公室、商超、仓储、酒店、医院、餐饮、物流等多种场景。诠视科技的产品已在数据堂所有采集场景经过实际验证并落地使用,为VLA、世界模型及机器人基础模型研发提供稳定、可扩展的数据支持。
从设备到数据服务闭环
IROS 2026上的学术讨论已经清晰地划出了具身智能数据基础设施的关键门槛:空间精度、全身协同、数据可用性闭环。围绕这些门槛,以十年空间计算的积淀为基座,通过SeerFusion系列产品矩阵提供从空间真值采集到全身协同、再到云端后处理与数据服务的完整能力。SeerFusion Cloud云端数据后处理平台承担从原始数据到可训练数据集的转换环节,与数据堂的合作则将这一链路延伸到数据服务层,形成“设备+平台+数据服务”的闭环结构。
“诠视科技不是简单地在为行业‘添加更多的采集设备’,而是在做具身智能数据基础设施中‘空间感知层’的开拓者。我们的产品已在服务全球头部的物理AI与具身模型厂商。”林瓊表示,“我们的空间计算的技术底座不仅支撑了XR产业,如今已迁移到数据采集场景,诠视科技迎来了更广阔的市场成长空间。”