Наткнулся на Madrona — графический движок, который довел оптимизацию массивно параллельной симуляции для обучения RL до предела: https://madrona-engine.github.io
Тысячи инстансов окружения собираются в одно мега-ядро и работают на GPU параллельно, одновременно.
На Hide and Seek (где ИИ учится играть в прятки) достигает пиковой производительности более 1.9 млн шагов в секунду на RTX 4090. Это в 11 раз быстрее SOTA и в 270 раз быстрее реализации от OpenAI (это с симуляцией физики твердого тела и лидара).
https://madrona-engine.github.io/shacklett_siggraph23.pdf
https://github.com/shacklettbp/gpu_hideseek
7
1
1September 1, 2026 124 3