#long-horizon
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру research
- StateM: масштабирование harness поднимает GPT-5.6 Sol до 95,3% на Terminal-Bench 2.1, и тот же harness адаптируется к DeepSeek-V4 Flash при общих затратах $15 research
- Apodex 1.1: масштабирование агентного интеллекта для сложных задач Apodex research
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру Zhejiang University research
- EchoWM: открытые и входимые omnimodal-модели мира JD.com research
- AutoSaddler: автоматическая оптимизация харнесса с устойчивыми обновлениями по трассам исполнения агента Microsoft research
- LongHorizon-Harness: развитие агентов для долгих горизонтов в реальных задачах research
- Agentic ESOpt: файнтюн long-horizon LLM-агентов с минимальными требованиями к GPU National University of Singapore (Zhi Zheng, Wee Sun Lee et al.) research