📢 X投稿文
Microduck用RL環境。MuJoCo Warp+PPOで訓練し、ONNXにエクスポート。ドメインランダミゼーション搭載で、シム・ツー・リアル展開可能
https://github.com/pollen-robotics/microduck_rl
🤖 AI考察
■ **概要**
小型二足歩行ロボット向けのRL学習環境で、MuJoCo Warp上でPPOで学習した政策をONNXでエクスポートし実ロボットに展開する完全なsim2real実装。
■ **特徴・用途**
- **学習の実用性**: mjlab経由でGPUでスケーラ学習(4096環境並列)、1-2時間で実用的な歩行ポリシー獲得。
- **Sim2Real技術統合**: BAMアクチュエータ物理、ドメイン固有化、バックラッシュシミュレーションなど実装済み、CLAUDE.mdで設計ノウハウも公開。
- **本番デプロイまで一貫**: 学習→ONNX変換→実ロボット実行まで、GUIやAPI(W&Bでトレース)を備えた実用的なパイプライン。
■ **結論**
ロボット制御のRL研究で「学習環境の設計」「Sim2Real移行」が実装+ノウハウともに具体的に開示された、実行可能な参考実装の上質なOSS。