#training-infrastructure 2 пункта 27 июл Molt: масштабируемый PyTorch-native фреймворк для обучения агентного reinforcement learning NVIDIA research 18 авг ClawGym II: исследование чёрно-ящичного RL на обвязке агента Renmin University of China research