诠视科技:以XR为“感官入口”,以Human-Centric整体方案卡位具身智能数据采集新基建

当AI从“语言智能”走向“行动智能”,一个全新的技术范式正在形成:AI是智能的“大脑”,负责理解、推理与决策;具身智能是AI在物理世界的“身体”,让智能从云端思考落地为现实行动;XR则是连接虚实、为智能体提供感知与交互的“感官接口”。三者深度融合,正在推动人工智能从单纯的语义理解,跨越到能够感知、决策并执行的行动智能。
在光博会《物理AI与具身智能时代XR的机会与挑战》主题分享中,诠视科技明确提出:谁掌握高质量、多模态、时空对齐的人类操作数据,谁就掌握具身智能进化的钥匙。而XR,正是打开这把钥匙的核心入口。
XR:具身智能的“感官接口”与“数据入口”
在诠视科技看来,AI大模型赋予机器理解复杂语义、生成知识与推理判断的能力,但要让智能真正落地物理世界,还需要具身智能作为执行载体,更需要XR作为感知与交互接口。XR不仅是AI的“眼睛和耳朵”,也是人类与智能体自然交互的“双手和嘴巴”,更是低成本、高效率的智能体训练与验证数字训练场。
更重要的是,XR以消费级价格提供了专业级空间计算能力,是目前少有的能同时提供视觉、力觉、空间位姿精确对齐数据的交互方案。它把AI训练空间从“二维像素平面”拉进“三维物理宇宙”,让机器人不再只靠仿真数据“凭空学习”,而是能够学习人类在真实环境中的操作示范。
这正是诠视科技的前瞻性布局所在:以XR技术为核心,以人为中心,构建面向具身智能的数据采集、处理、训练与部署整体解决方案。
Human-Centric:让人类示范成为机器人训练资产
具身智能的核心瓶颈之一,是高质量真实世界交互数据的稀缺。传统机器人训练依赖昂贵真机试错,成本高、周期长、场景覆盖有限。诠视科技选择了一条更符合人类学习逻辑的路径——Learning from Humans,以人为中心采集数据。
通过SeerFusion™具身智能数据采集终端,如SeerFusion One头戴设备,操作者可以在真实环境中自然完成任务。设备同步采集第一人称双目RGB、多路鱼眼、IMU、深度、手部追踪等多模态原始数据,完整记录“人—行动—环境—时空”的交互过程。再通过云端平台,将这些数据加工为可直接用于VLA等具身大模型训练与仿真的结构化三维运动数据。这意味着,人类完成一次任务,不再只是一次操作,而是一次可复用、可训练、可迁移的数据生产。诠视科技正在打通“人类示范—仿真训练—现实执行”的完整闭环。
整体方案:终端+云端+SDK,一站式数据生产线
诠视科技的优势,不是单一硬件,而是覆盖数据采集、处理、标注、训练与部署的整体解决方案。在终端侧,SeerFusion One、SeerFusion Gripper、SeerFusion Glove、SeerFusion Traq等产品矩阵,覆盖头手眼身、视觉与触觉、全身动捕、高精度头手追踪等多模态采集需求。其中,SeerFusion One承担第一人称多模态数据采集的中枢,同步记录双目RGB、多路鱼眼、IMU、深度与手部追踪等信息,完整还原人类操作过程中的“人—行动—环境—时空”交互链条;SeerFusion Gripper面向精细操作场景,捕捉抓取、装配等手部动作与力觉反馈;SeerFusion Glove提供高精度手部关节与触觉数据,让灵巧操作从“看得见”走向“摸得着”;SeerFusion Traq则实现高精度头手6DoF追踪与空间位姿对齐。由此形成从第一人称操作、手部精细动作、触觉反馈到全身动捕、毫米级与亚毫秒级高精度头手追踪的时空同步,为具身智能训练提供高质量、多模态、时空对齐的数据入口。

在云端,SeerFusion云端数据处理平台提供一站式在线服务:注册即用、零部署、按需GPU、多区域就近处理、多租户数据隔离、一键直传云盘。用户只需浏览器上传数据,选择处理流程,即可把第一人称多传感器原始数据转化为训练级三维运动数据,让“人类完成任务的真实交互”高效转化为可训练资产。
在平台侧,开放SDK与生命周期管理支持主流OS、设备管理、版本控制、仿真与机器人主控接口,帮助客户从单次硬件采购升级为长期平台关系。
硬核技术:时空同步、端侧质检、自动标注、隐私计算

具身智能数据采集,难点不在“采”,而在“采得准、对得齐、标得快、用得安全”。
诠视科技围绕高精度多模态时空同步感知构建核心技术底座:硬件时钟、快门控制、内外参标定、跨设备坐标对齐,统一时间轴和坐标系,保证行为因果链与真值一致性。系统支持VIO/VSLAM、重定位、深度融合、三维重建与空间锚点,输出6DoF、深度、地图、点云和空间关系。
在端侧,诠视科技自研算法,实现空间解算、异常检测、质量评分与现场实时反馈,把事后抽检变为过程控制,减少返工。在数据标注环节,智能预标注、辅助工具集与质量智能把关,让整体处理效率大幅提升,综合标注成本大幅下降。
在数据安全与隐私层面,诠视科技通过多方安全计算、联邦学习、同态加密等技术,在“数据可用不可见”的前提下实现联合计算,符合GDPR、CCPA等全球主流数据隐私法规要求,构建安全可信的数据协作生态。
前瞻布局:2026数据规模化元年,迈向通用具身智能
诠视科技判断,2026年将被视为“具身智能数据规模化的元年”。数据量的指数级增长,将突破算法瓶颈,驱动具身智能从感知理解走向自主决策。未来的方向,是从“专用智能”迈向“通用智能”,从单一任务走向多变环境、多技能自主适应。
人机协作将成为主流工作模式:人类负责战略决策与创意规划,具身智能作为精准、高效的物理执行者。更长远的未来,脑机接口有望实现“意念操控”,打破传统交互的物理限制。

自2016年在美国硅谷成立,2017年总部迁至上海,诠视科技已形成中国、美国、欧洲的全球化布局。公司以“空间智能是通往物理世界的桥梁”为使命,从Perception AI、Generative AI LLM、Agentic AI走向Physical AI,构建物理AI的空间智能底层技术平台。旗下SeerSense®、SeerLens®、SeerFusion™三大产品线,正在服务全球Physical AI、Robot与XR客户。
我们正站在人机共生新时代的起点。诠视科技将继续以XR技术为核心,以Human-Centric整体数据采集解决方案为路径,携手产业伙伴,把人类示范转化为机器智能,把空间智能转化为物理世界的生产力,共同开启具身智能与通用机器人进化的新篇章。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”
