Microduck RL en Jetson

Esta demo construye un flujo de trabajo completo de aprendizaje de robots para Microduck en un Seeed reComputer con NVIDIA Jetson Orin NX 16GB. Cubre el despliegue del entorno con GPU, el entrenamiento PPO con MuJoCo, la visualización de checkpoints locales, la inferencia controlada por teclado con políticas oficiales ONNX y el desarrollo de nuevos movimientos personalizados.
La plataforma de referencia verificada utiliza JetPack 7.2, Ubuntu 24.04, CUDA 13.2, Python 3.12 y MuJoCo 3.10. Este tutorial se basa en el repositorio jjjadand/microduck_rl, que contiene el código fuente, el script de despliegue, las políticas oficiales ONNX y los checkpoints entrenados en Jetson utilizados a lo largo de la guía.
Opciones de hardware
El tutorial se reprodujo en Jetson Orin NX 16GB. Los siguientes sistemas de Seeed Studio proporcionan plataformas Jetson adecuadas para seguir el flujo de trabajo. El reComputer Classic J5011 ofrece capacidad adicional de GPU y memoria, mientras que el rendimiento exacto de entrenamiento depende del modo de potencia seleccionado y del número de entornos paralelos.
Elige un capítulo
Haz clic en una tarjeta para abrir el capítulo correspondiente. Solo esta página de inicio aparece en la barra lateral de Physical AI; los tres capítulos siguen siendo páginas enfocadas a las que se accede desde aquí.
Lo que vas a reproducir
- Un entorno de entrenamiento de Microduck con CUDA en Jetson Orin NX.
- Entrenamiento PPO con entornos MuJoCo en paralelo.
- Visualización de simulación nativa y basada en navegador.
- Inferencia oficial ONNX para caminar, estar de pie, sentarse/levantarse, recoger del suelo, voltereta, patadas y movimientos con rodillos.
- Entrada de comandos por teclado y cambio de comportamiento en vivo.
- Un flujo de trabajo reutilizable para crear un movimiento personalizado basado en fases, como una reverencia.
Arquitectura de la demo
Jetson Orin NX
├── JetPack 7.2 / CUDA 13.2
├── uv project environment
├── mjlab + MuJoCo Warp + rsl_rl
├── Microduck task configurations
├── PPO checkpoint (.pt)
└── Exported policy (.onnx)
├── MuJoCo inference rehearsal
└── Microduck runtime deployment
Para la validación más rápida, despliega el entorno, ejecuta la prueba rápida de humo de 64 entornos y cinco iteraciones, y luego inicia la demo oficial de teclado ONNX. Puedes completar el capítulo de movimiento personalizado después.

