诠视科技SeerFusion One亮相WAIC 2026,推出高性能可穿戴具身智能数据采集终端及处理管线。
2026 WAIC展会现场,具身智能的热度仍在攀升。一个显著的趋势信号正在形成共识:业界正从端到端具身模型,加速迈向“世界模型对齐”的新阶段。其核心命题,是让机器理解物理世界的因果律——即让AI在行动前能预判物理世界的后续变化。相应的,这对数据采集的要求从“看见动作”升级为“精确记录空间位姿与接触几何”。UMI等手持方案在多视角对齐与连续位姿追踪上已逼近上限,行业需要新一代采集方案。
01.
空间计算的“基因传承”
诠视科技是一家专注于空间计算与感知交互的技术企业,核心技术覆盖高速高精度VSLAM引擎 ,深度引擎,三维重建,手势及骨骼提取,头手协同,数据离线处理和标注等领域。深耕XR和机器人感知交互领域多年。
这段多年前的影像记录,是诠视技术在全球头部足式机器人身上的实测验证。彼时具身智能尚未成为主流赛道,诠视已是机器人“感知-行动”闭环中的关键一环。这套历经长期验证的技术框架,如今在数据采集场景中释放出新价值——多模态感知与实时端处理,可实现多视角毫米级精度,数据在端侧硬件层完成时间同步,有效抑制遮挡与漂移问题。这些技术积累指向一个明确方向。
02.
SeerFusion One:为物理AI和世界模型而生的数据采集终端
这个方向,在今年6月美国AWE展会上已向业界展出——SeerFusion One,诠视科技面向具身智能与世界模型训练打造的Ego-Centric数据采集终端,本次为国内市场首次公开亮相。
本次WAIC期间,诠视科技联合数据堂(北京)科技股份有限公司,展出基于SeerFusion One的Ego数据采集方案,展示其数据采集,预览及后处理的全栈能力。结合数据堂的业务需求,落地各类数据采集场景
全栈自研的空间智能技术底座
SeerFusion One的背后,是诠视科技围绕空间智能构建的全栈自研硬软件和算法体系——从底层多传感器融合,追踪定位,到上层环境语义理解与交互逻辑,实现了感知-认知-交互全链路的算法自研。这意味着从数据源头的时空同步到最终输出的精准6DoF位姿信息,每一层算法均来自多年的积累,保证了端到端的精度可控与持续迭代能力。
从硬件配置上,SeerFusion One展现出鲜明的“空间感知”基因:
- 双目2MP彩色全局快门相机,构建立体视觉并输出带深度信息的彩色图像;
- 可选项包括一颗ToF深度相机(940nm波段,精度误差1%),补充近距离高精度深度数据;
- 四目VGA全局快门相机,专用于头部6DoF实时追踪,并支持手部25关节实时出界检出,;
- 高速9轴IMU,与所有相机实现毫秒级时间戳同步。

这一传感器矩阵让SeerFusion One不再是“戴在头上的摄像头”,而是一台可穿戴的空间探测器——它同时记录“看到了什么”和“在什么空间位置看到的”,并将两者精确绑定。
在交互层面,SeerFusion One支持通过手柄、手环、数据手套等多种方式实现高精度头手6DoF协同追踪。双麦克风与双扬声器的配置则用于音频交互与多模态数据融合及语音提示
而在产品定义上,SeerFusion One针对数采场景做了大量专业化优化:
- 轻量化结构:整机重量控制在350g以内,适配长时间佩戴采集;
- 边缘端实时计算:内置独立8核SOC计算单元,实时完成6DoF解析,无需依赖外部主机;
- 大容量本地存储:配备2TB TF卡,即录即存,支持读卡器直读,数据流转高效;
- 7×24小时连续作业:支持热插拔换电,整机功耗仅3~6W。
它不是在MR头显上修修补补,而是重新定义了一台数据采集专用设备。
03.
当“录像”升级为“测量空间”
人形机器人一旦进入家庭、酒店、商超和康养场景,任务就不再只是简单的抓取和放置——它要学会在狭窄通道里侧身通过,在低矮货架前弯腰下蹲,在人与物频繁流动的环境中不断调整姿态和重心,完成取物、递送、整理、搀扶等一连串动作。
如果说传统数采设备的工作是“录像”——把操作过程记录下来交给模型去“猜”背后的空间关系,那么SeerFusion One的工作则是“精准空间测量”——以RGB图像、IMU数据、全身关节空间定位轨迹、3D场景点云提供精确空间拓扑关系多模态数据。

这一差异直接影响模型训练的质量。
具身大模型要学习的不是像素间的统计相关性,而是动作与物理结果之间的因果映射。这种映射必须以精确的空间关系为锚点——手与物体的距离、相对朝向、接触点的位置变化。如果输入数据在空间维度上是模糊的、漂移的、未对齐的,那么无论模型架构多先进,都难以收敛出可靠的物理理解。
SeerFusion One的价值,正在于从数据源头保证了这种空间精度。 毫米级的定位精度、毫秒级的多传感器同步、6DoF的完整位姿信息,三者共同构成了世界模型训练所需的“物理因果数据”的基础要素。
用诠视科技团队的话来说:“我们的目标不是做一款更轻便的相机,而是为物理AI提供一个可穿戴的空间数据入口平台。”
04.
不只是数据精度,更是佩戴自由
数据质量是硬指标,但数据采集不是实验室里的短跑,而是真实场景中的马拉松。诠视团队为此做了两件看似不起眼、实则影响深远的事。
供电解耦,实现“无界采集”——SeerFusion One的供电交由外部设备承担,手机、充电宝、电脑皆可即插即用。这意味着头部不再承载电池,安全隐患彻底排除;也意味着无论室内室外、采集时长多久,设备永不因电量而中断。
佩戴体验,做到“零压感”——配合创新的前后额托设计,通过多面支撑将重量均匀分散。长时间、高强度的连续作业,不再是采集人员的负担。
这两者共同回答了一个被很多人忽视的问题:好的采集设备,不仅要让机器学得准,也要让人戴得久。
结语
SeerFusion One在行业生态中的定位——在具身智能从“卷模型架构”走向“卷数据质量”的当下,数据采集设备不再是简单的记录工具,而是决定模型能力上限的战略基础设施。
世界模型的训练需要海量的、带物理因果标注的真实交互数据。而这些数据的质量,取决于采集设备能否精确记录每一次接触、每一个位移、每一帧空间关系的变化。诠视科技用十余年空间感知交互技术积累给出的答案是:让机器真正理解物理世界,从采集有精准时空关系的数据开始。
而这,或许正是人工智能走向“物理智能”的第一步。