Spirit-v1.5 模型微调
Spirit-v1.5 是 Spirit AI 的视觉-语言-动作(Vision-Language-Action,VLA)策略。平台以模型标识 spirit-v1.5 注册,使用 spirit 训练框架,支持 robochallenge、LeRobot v2 与 v3 数据集。
适用角色与前提
适用角色
| 角色 | 是否可创建训练任务 | 说明 |
|---|---|---|
| 管理员 | 是 | 不受模块权限限制 |
| 项目经理 | 需授权 | 由管理员在模块权限中授予 「创建训练任务」 |
| 标注员 | 需授权 | 同上 |
| 审核员 | 需授权 | 同上 |
| 采集员 | 需授权 | 同上 |
仅查看训练任务与指标需「查看训练」。
前置条件
| 项 | 要求 |
|---|---|
| 数据集版本 | robochallenge、LeRobot v2、v3。RoboChallenge 布局可直接训练,LeRobot 数据在训练前转换为 RoboChallenge 布局 |
| 框架 | spirit |
| 显存 | 无固定下限;建议多卡训练。默认每卡 batch_size 为 1 |
| 依赖 | 平台的模型训练服务已启用并配置至少一个训练位置;训练镜像内置 Spirit-v1.5 基座权重 |
| 状态字段 | observation.state 至少 8 维:前 7 维为末端位姿,第 8 维为夹爪宽度 |
| 视频字段 | 需提供三路 RGB 视频,映射到 main_realsense_rgb、handeye_realsense_rgb、side_realsense_rgb |
| 权限 | 创建需「创建训练任务」,查看需「查看训练」 |
关节角状态的数据不能直接训练 Spirit-v1.5,需先完成状态空间适配。