华云数科,通向万物互联的智能世界 ·状态页 ·文档

EMBODIED INTELLIGENCE · 具身智能

四大场景,让机器在物理世界自主行动

移动底盘 · 协作臂 · 巡检 · 交互 — 端侧模型本地推理、毫秒级闭环,断网可控、云边协同。从感知到执行,一套底座覆盖仓储、产线、能源与服务空间。

MOBILE BASE· COBOT ARM· INSPECTION· INTERACTION

Solutions Overview

具身 4 场景总览

同一套端侧运行时 + 云边协同底座,四种形态按需组合。卡片即场景入口,每卡标注端侧模型与端到端时延,选型一目了然。

端侧模型 4 个 · INT8 量化平均端侧时延 < 80 ms断网可控 · 本地闭环8 TOPS 边缘盒子实测
移动底盘具身场景
WheelPilot-VLA 0.8B35 ms
01移动底盘

移动底盘 MOBILE BASE · AMR

VLA 导航模型端侧推理,动态避障与多机调度本地闭环,弱网不丢轨。

自主导航动态避障多机调度
端侧模型
0.8B VLA · INT8
端到端时延
≤35 ms 20 Hz 闭环
查看详情 →8 TOPS 实测
协作臂具身场景
GraspFormer-S 1.1B28 ms
02协作臂

协作臂 COBOT ARM · 6-DOF

视觉-力位混合模型,抓取位姿端侧生成,1 kHz 力控闭环,拖动示教即学即用。

视觉抓取力位混合拖动示教
端侧模型
1.1B ViT+Diffusion
端到端时延
≤28 ms 力控 1kHz
查看详情 →INT8 · 本地闭环
巡检具身场景
PatrolEye-VLM 1.3B50 ms
03巡 检

巡检 INSPECTION · 轮式/足式

VLM 缺陷识别与自主巡航一体,表计、渗漏、异响端侧判别,数字孪生联动。

自主巡航缺陷识别孪生联动
端侧模型
1.3B VLM · 蒸馏
端到端时延
≤50 ms 端侧全量
查看详情 →480p / 30fps
交互具身场景
ChatEdge-TT 0.7B180/320 ms
04交 互

交互 INTERACTION · 服务/导览

多模态对话 + 手势识别端侧融合,唤醒与语音响应本地完成,离线可用。

多模态对话手势识别离线可用
端侧模型
0.7B ASR+LLM+TTS
端到端时延
180/320 ms 唤醒/响应
查看详情 →离线可用

SCENARIO 01 · 移动底盘 MOBILE BASE

仓储与场内物流的自主足迹

WheelPilot-VLA 0.8B INT8 · 端侧端侧时延 ≤35 ms · 20 Hz 闭环

8 TOPS 边缘盒子实测 · 480p 双目 + 2D 激光 · 断网可控、弱网不丢轨

基于 VLA 视觉-语言-动作模型的移动底盘方案,导航与避障完全端侧闭环。支持语义指令(“去 A 货位取料”)直接驱动,多机调度本地仲裁,无需回云决策。

  • 01
    端侧 VLA 导航0.8B VLA 模型本地推理,语义指令直达轮速,路径重规划 ≤35 ms。
  • 02
    动态避障与人群跟随双目 + 激光融合,行人轨迹预测端侧完成,急停响应 <100 ms。
  • 03
    多机调度本地化调度策略边缘仲裁,断网持续作业,回云后自动对账与孪生同步。
35ms 端到端时延 · 20Hz 闭环
0.8B 端侧 VLA 参数量 · INT8
预约移动底盘演示
移动底盘 AMR 端侧 VLA 导航场景
移动底盘 · WheelPilot-VLA 0.8B · 35 ms 闭环

SCENARIO 02 · 协作臂 COBOT ARM

产线柔性抓取与装配

GraspFormer-S 1.1B ViT+Diffusion · 端侧抓取推理 ≤28 ms · 力控 1 kHz

6-DoF 协作臂 + 2D/3D 相机 · 端侧位姿生成 · 拖动示教零代码

视觉抓取与力位混合控制一体,GraspFormer 端侧生成 6D 抓取位姿,力控闭环 1 kHz,适配无序分拣、上下料与精密装配,换线无需重编程。

  • 01
    端侧视觉抓取1.1B GraspFormer-S 本地生成抓取位姿,≤28 ms,支持透明/反光件。
  • 02
    力位混合 1 kHz力控闭环 1 kHz,柔性装配与打磨,碰撞检测 <8 ms 安全停机。
  • 03
    拖动示教即学即用人手拖动示教 3 次即生成技能,技能包云边分发、端侧离线执行。
28ms 抓取推理时延
1kHz 力控闭环频率
预约协作臂演示
协作臂 GraspFormer 视觉抓取场景
协作臂 · GraspFormer-S 1.1B · 28 ms 抓取

SCENARIO 03 · 巡检 INSPECTION

能源与场站的自主巡航

PatrolEye-VLM 1.3B VLM 蒸馏 · 端侧缺陷识别 ≤50 ms · 端侧全量

轮式/足式/挂轨多形态 · 可见光+红外 · 数字孪生联动告警

VLM 多模态巡检模型端侧判别表计读数、渗漏、异响与设备缺陷,自主规划巡航路径,异常片段端侧切片、云端复核,弱网先存后传。

  • 01
    端侧 VLM 缺陷识别1.3B PatrolEye-VLM 本地识别 40+ 缺陷类型,单帧 ≤50 ms,准确率 96%+。
  • 02
    自主巡航与越障激光+视觉融合定位,动态越障与自动回充,单次续航 4–8 小时。
  • 03
    孪生联动与工单闭环异常自动生成工单、推送孪生大屏,处置过程全量可追溯。
50ms 单帧识别时延
40+ 缺陷类型覆盖
预约巡检演示
巡检 PatrolEye-VLM 缺陷识别场景
巡检 · PatrolEye-VLM 1.3B · 50 ms 识别

SCENARIO 04 · 交互 INTERACTION

服务空间的多模态伙伴

ChatEdge-TT 0.7B ASR+LLM+TTS · 端侧唤醒 ≤180 ms · 响应 ≤320 ms

6 麦阵列 + RGB-D · 端侧多模态融合 · 离线可用、云边持续进化

面向导览、接待与陪伴场景,语音、手势与表情端侧融合理解,离线可对话、可带路、可递送,联网后知识与技能持续更新。

  • 01
    端侧多模态对话0.7B ChatEdge 本地 ASR+LLM+TTS,唤醒 ≤180 ms,首字响应 ≤320 ms。
  • 02
    手势与表情识别RGB-D 手势与情绪识别端侧完成,支持 12 种交互手势与多轮上下文。
  • 03
    云边知识进化离线可用,联网增量更新知识库与技能包,数据不出场可私有化部署。
180ms 端侧唤醒时延
320ms 语音首字响应
预约交互演示
交互 ChatEdge 多模态对话场景
交互 · ChatEdge-TT 0.7B · 180/320 ms 响应

让具身智能,从试点到规模化

同一底座,四种形态。我们提供端侧模型适配、硬件选型与云边联调,一站式交付。

How To Choose

具身 4 场景,怎么选?

按作业对象与环境复杂度选形态,按时延与离线要求选模型。同一底座可混搭,试点成功后平滑扩展。

MOBILE

移动底盘

适合仓储、厂内物流与场站搬运。关注导航时延与多机调度,VLA 模型语义指令直达。

COBOT

协作臂

适合上下料、分拣与装配。关注抓取时延与力控频率,GraspFormer 端侧位姿生成。

PATROL

巡检

适合能源、管廊与园区巡检。关注识别时延与缺陷覆盖,VLM 端侧全量判别。

CHAT

交互

适合导览、接待与康养陪伴。关注唤醒/响应时延,多模态离线可用是关键。

Delivery Process

四周完成模型到试点

端侧模型适配与硬件联调并行,每个阶段都有可验收产出。

场景与模型选型

梳理作业流程、时延与离线要求,选定形态与端侧模型(INT8/蒸馏)。

端侧适配

模型量化、硬件烧录与本地闭环验证,时延达标方可出场。

联调上线

真机接入云边底座,跑通感知-决策-执行与工单闭环。

复盘推广

用试点时延与成功率数据验证 ROI,规划多机/多场景复制。

FAQ

具身方案常见问题

四种具身场景可以混搭部署吗?
可以。移动底盘、协作臂、巡检与交互基于同一云边底座与端侧运行时,按需组合,支持从单机到多机协作平滑扩展。
端侧模型是否必须联网?
不需要。端侧模型本地推理、断网可控;联网时云边协同持续优化模型与策略,弱网下自动降级保障安全停机。
时延指标在什么硬件上测得?
基于华云 IoT 边缘盒子(8 TOPS)与机器人控制器实测;不同算力平台时延线性可预期,支持 INT8 量化与模型蒸馏适配。
交付周期通常多久?
标准场景 4 周完成模型适配、联调与试点;定制末端执行器或作业流程需额外 2–4 周。