尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

用publish命令一条命令发布策略:Microduck RL到HF Hub再到真机安装

用publish命令一条命令发布策略:Microduck RL到HF Hub再到真机安装 用publish命令一条命令发布策略Microduck RL到HF Hub再到真机安装【免费下载链接】microduck_rlRL training environments for Microduck (mjlab)项目地址: https://gitcode.com/GitHub_Trending/mi/microduck_rlmicroduck_rl是 Microduck 双足机器人约 800 g、14 个 XL330 舵机的强化学习训练环境仓库。在这里训练出的策略如何送上真机答案就一条命令uv run publish。它会自动完成导出 ONNX、安全检查、生成 manifest、上传 HF Hub 全套流程另一端的机器只需一句robotctl命令即可安装无需发布新的固件版本。 一条命令背后的 4 道关卡publish不是简单的传文件。在上传任何东西之前它会按顺序执行 4 道关卡见 src/mjlab_microduck/publish/cli.py形状检查确认网络图是[1,61] → [1,14]——61 维观测48 维本体感知 13 维指令、14 路动作这正是真机守护进程能加载的唯一形状。旧的 51 维策略会被明确拒绝并提示原因。冒烟运行用合理的输入实际跑一遍网络拒绝输出 NaN 或永远不变的坏模型。manifest 校验按 schema 2 生成manifest.json并自校验逻辑在 src/mjlab_microduck/publish/manifest.py守护进程拒绝的字段组合在这里就提前报错。防覆盖仓库里已有policy.onnx时不加--force直接拒绝避免误伤。上传后仓库里是三个文件policy.onnx观测归一化器已烘焙进图中喂原始观测即可、manifest.json、以及一份自动生成的 README——后者写明真机安装命令永远不会过期。 三种发布姿势从 wandb 训练记录发布推荐路径训练完直接指向 wandb runpublish内部走唯一安全的导出路径归一化器自动烘焙uv run publish --task Mjlab-PoliteBow-Flat-MicroDuck \ --wandb-run-path entity/project/run_id --checkpoint 3000 \ --repo user/microduck-polite-bow --kind episodic --duration-s 4.0 \ --description Bows from a two-foot stand and comes back up.从已有 ONNX 文件发布已经用 scripts/export.py 导出过的 ONNX 可以直接发布只做校验、不重新导出这条路径甚至不需要 GPUuv run publish --onnx output.onnx --repo user/microduck-flamingo \ --kind perpetual --unwind-s 1.5先干跑再真发不放心就先--dry-run所有内容写入本地publish-name/目录完全不碰 Hubuv run publish --onnx output.onnx --repo user/microduck-bow \ --kind episodic --duration-s 4.0 --dry-run其他常用参数--no-private公开发布、--tag v1给版本打标签、--force覆盖已有policy.onnx。publish命令本身注册在 pyproject.toml 的入口点里与train、play一样开箱即用。 --kind 到底在说什么这是发布时最重要的决策它决定了真机端的行为kind行为需要的参数典型场景episodic跑满--duration-s后自己回到站立姿态--duration-s必填按住按钮连放可加--chain踢球、空翻、鞠躬perpetual步态一直运行直到被替换--slot walk或 stand 等新走法perpetual保持姿态按住时保持松手后先驱动 idle 指令再交还--unwind-s火烈鸟单脚站立 真机端一句 robotctl 装好发布成功后publish会直接打印真机安装命令。三种形态各对应一句# episodic 技能时长从 manifest 里读 sudo robotctl policy add polite-bow user/microduck-polite-bow robotctl robot do polite-bow # 保持姿态安装时自己决定保持多久 sudo robotctl policy add flamingo user/microduck-flamingo --hold 5 # 步态载入对应插槽 sudo robotctl policy load walk user/microduck-my-walk也就是说你训练好一个动作后从点下 publish 回车键到另一台 Microduck 学会这个动作中间没有任何手工环节。 相关代码与文档src/mjlab_microduck/publish/cli.py —publish命令行入口与完整流程src/mjlab_microduck/publish/manifest.py — schema 2 manifest 构造、ONNX 形状门、冒烟运行tests/test_publish_manifest.py — 锁死写出去的正是守护进程能读的回归测试README.md — Publishing a policy 一节的完整官方说明 注意只有常数指令类策略可以这样发布相位驱动的动作如地面拾取和姿态标志类坐↔站由守护进程自己驱动属于官方策略集合不开放社区发布。【免费下载链接】microduck_rlRL training environments for Microduck (mjlab)项目地址: https://gitcode.com/GitHub_Trending/mi/microduck_rl创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表