跳到主要内容

LeRobot 数据集与训练

LeRobot 是 Hugging Face 维护的机器人学习数据与策略训练框架。平台把已标注的录制数据导出为 LeRobot 数据集,交由平台训练服务或平台外的 LeRobot 训练栈使用。

支持的模型与数据集版本​

适用场景​

读者关心什么入口
算法工程师数据集字段、版本兼容、模型与训练入口数据导出、模型训练
训练运维训练镜像、GPU 与挂载、日志与 checkpoint模型训练
项目经理交付数据格式、可选模型范围数据导出

核心能力​

能力说明入口
数据集导出导出 LeRobot v3.0 或 v2.1,可配置图像格式、采样频率与子任务数据 → 导出
在线预览浏览器内播放已入库的 LeRobot 数据数据 → LeRobot
格式校验以 LeRobotDataset 加载或经 LeRobot Studio 检查目录与元数据见「数据集校验」
平台内训练选择模型与框架发起训练,查看日志与 checkpoint模型 → 训练

数据 → LeRobot 的预览入口见 LeRobot 可视化。

模型与框架​

平台训练服务注册 11 个策略模型。模型标识、训练框架与数据集版本如下。

模型标识训练框架数据集版本专项页
actact、lerobotv2、v3ACT 模型训练
diffusionlerobotv2、v3Diffusion Policy 模型训练
grootlerobotv2、v3—
pi0lerobot、jaxv2、v3π0 与 π0.5 模型微调
pi05lerobot、jaxv2、v3π0 与 π0.5 模型微调
reward_classifierlerobotv2、v3—
saclerobotv2、v3—
smolvlalerobotv2、v3SmolVLA 模型微调
spirit-v1.5spiritrobochallenge、v2、v3Spirit-v1.5 模型微调
tdmpclerobotv2、v3—
vqbetlerobotv2、v3—

「—」表示暂无专项页,参数与限制以 LeRobot 官方文档为准。

数据集版本​

LeRobot 数据集版本由导出选项决定,与 Python 包版本无关。

导出选项数据格式版本说明
v3.0(默认)v3.0支持子任务模式;部分模型尚不支持
v2.1v2.1兼容性最好;不支持子任务模式

界面选项 v3.0 对应导出参数 version=latest,v2.1 对应 version=v2.1。训练服务使用 v2、v3 两个数据集版本标识。版本差异见 LeRobot v2 与 v3 格式差异。

训练准备​

训练镜像​

平台训练服务按数据集版本选择 LeRobot 训练镜像,默认值如下,可由部署环境覆盖。

数据集版本默认镜像训练入口
v2lerobot:v0.3.3/lerobot/.venv/bin/lerobot-train
v3lerobot:v0.4.4/lerobot/.venv/bin/lerobot-train
未指定lerobot:latest/lerobot/.venv/bin/lerobot-train

训练任务将 v2 数据转换为 v3 时,使用 v3 默认镜像。单卡以外使用 accelerate launch 进入同一入口。以下模型使用专用镜像。

模型默认镜像
pi0ioaitech/train_openpi:pi0
pi05ioaitech/train_openpi:pi05
actioaitech/train_act:cuda
spirit-v1.5ioaitech/train_spirit:1.5

训练链路​

数据集校验​

导出后先做一次校验,再接入训练。优先用 LeRobot Studio 打开归档或解压目录;脚本化校验可直接加载数据集。

from lerobot.datasets import LeRobotDataset

dataset = LeRobotDataset("local/my_dataset", root="/path/to/lerobot_dataset")
print(dataset.num_frames, dataset.num_episodes)

能加载不等于适合训练,但可先排除目录层级、元数据缺失与文件缺号。

数据集导出要点​

导出配置​

数据选择与参数面板见下图。

选择要导出的数据

导出参数

参数取值说明
数据采样频率1–60 Hz,默认 30越低数据集越小,推荐 10–30
图像格式MP4、JPG默认 MP4;MP4 相对 JPG 约省 80% 存储
严格匹配模型输入输出允许 / 禁止开启后裁切观测与指令一一对应,减少噪声
自动模糊人脸允许 / 禁止开启后模糊画面人脸,用于数据合规
启用子任务允许 / 禁止开启后每条标注成为 episode 内的子任务,仅 v3.0
适配映射允许 / 禁止配置后按映射生成字段,strict_match 被忽略
LeRobot 版本v3.0、v2.1版本差异见上一节

完整格式与配额说明见 数据导出。

字段映射​

平台按 ROS 话题名后缀推断状态与动作字段。话题命名不同时,在录制阶段统一命名;已有数据无法改名时,用适配映射补齐。

数据集字段话题名后缀依据
observation.state/joint_state、/joint_states、/arm_joint_statetools/mcap2lerobot/mcap2lerobot.py
action/joint_commandtools/mcap2lerobot/mcap2lerobot.py

导出结果​

导出完成后下载归档并解压到独立目录。--dataset.root 指向含 meta/info.json 的目录。

导出结果

新建目录

解压数据

your_dataset/
├── meta/
│ └── info.json
├── data/
└── videos/

使用限制​

导出与训练受以下既有边界约束。

项目限制说明
导出格式版本v3.0、v2.1界面选项 v3.0 对应参数 version=latest,v2.1 对应 version=v2.1
子任务模式仅 v3.0勾选启用子任务后仅可选 v3.0,创建任务时选择 v2.1 也会被拒绝
数据采样频率1–60 Hz,默认 30推荐 10–30;频率越低数据集越小
图像格式MP4、JPG默认 MP4
严格匹配配置适配映射后忽略两条设置互斥,以适配映射为准
适配映射大小256 KiB 以内超出上限时拒绝创建导出任务
模型图像输入vqbet、tdmpc 仅保留一张图像训练时多余图像被忽略并记录日志
质检门禁默认开启质检未通过的数据集禁止导出
人脸模糊依赖 SCRFD 模型且仅用 CPU模糊失败时中止本次导出
训练数据集版本v2、v3spirit-v1.5 另支持 robochallenge,见「支持的模型与数据集版本」

阅读顺序​

  1. 导出数据集:数据导出
  2. 校验数据:LeRobot 可视化
  3. 安装环境:安装 LeRobot
  4. 选择模型:ACT、Diffusion Policy、π0 与 π0.5、SmolVLA、Spirit-v1.5
  5. 发起训练:模型训练

相关页面​