#training-infrastructure 2 items 27 июл Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning NVIDIA research 18 авг ClawGym II: Exploring Black-Box RL on Agent Harness Renmin University of China research