Prime Agent: самоулучшающийся RLM-харнесс

Prime Intellect

исследования офиц. + СМИ 3 ист. ~1 мин

Open-source харнесс для долгосрочных воркфлоу кодинга и оценки. Персистентный IPython REPL реализует абстракцию Recursive Language Model; Continual Harness сохраняет истории/памяти/навыки/спецификации сабагентов между траекториями; рекурсивные сабагенты координируются через прямое агент-агент сообщение. На ARC-AGI-3 RHAE Best@1 харнесс поднимает базовую модель с 30% до 95.5% и соответствует или превосходит нативные и популярные харнессы в долгом контексте при кодинге, генерации GPU-ядер, конструировании эмуляторов и автономных спидранах nanoGPT.

Почему это важно

Доклад HF Daily с 18.2k кумулятивных upvotes — единственный выбор харнесса достаточен, чтобы более чем утроить результат на ARC-AGI-3, что говорит о частичной артефактности многих цифр «возможностей модели». Продемонстрированы уточнение и параллелизованные сабагенты на Factorio.

Важность: 2/5

default

Источники

официальный arXiv abstract
официальный Prime Intellect code release