ZX EMBODIED FOUNDATION MODEL · 3.0

一个大模型,
驱动每种机器形态。

智械具身大模型将感知、推理、规划与控制连接起来,让机器人理解开放世界,并把人的意图转化为安全、可靠的行动。探索模型 API →
智械具身大模型空间理解与动作规划可视化
WORLD MODEL · SPATIAL REASONING · ACTION PLANNING

MODEL ARCHITECTURE

从世界理解,到真实执行。

视觉 / 语言 / 触觉多模态编码器世界模型任务规划器动作 / 控制 / 反馈
01

多模态理解

在同一上下文中理解自然语言、图像、视频、三维空间、触觉与机器人本体状态。

6 类模态
02

任务规划

把开放式指令拆解为可验证的技能序列,动态处理失败、约束和环境变化。

128 步规划
03

视觉—动作生成

从第一视角观察直接预测末端轨迹、抓取姿态和全身协同动作。

30 Hz 策略
04

持续学习

把真实执行数据回流到仿真与训练系统,在安全评估后获得新技能。

4,200+ 技能

DATA ENGINE

真实数据与仿真世界,共同训练。

智械数据引擎融合遥操作、真实任务日志、程序化仿真和互联网视频,并使用自动质量评估与隐私清洗形成可追溯训练集。
28M机器人任务片段6.4B多模态训练 Token12,000+并行仿真环境

SAFETY FIRST

模型提出行动,
安全系统决定能否执行。

01动作边界验证02人机距离约束03工具权限控制04异常状态回退