Macaron-V1: к открытому непрерывному обучению с самоулучшением и Mixture-of-LoRA

Mind Lab

исследования официальный 2 ист. ~1 мин

Mind Lab представляет семейство открытых агентных моделей, которые продолжают обучаться после развёртывания благодаря архитектуре Mixture-of-LoRA: замороженная базовая модель комбинирует специализированные LoRA-адаптеры (чат, кодинг, агент, GenUI), выбираемые для каждого хода, а данные использования со временем дистиллируются обратно в адаптеры.

Почему это важно

37 голосов в HuggingFace Daily Papers; конкретный открытый рецепт непрерывного обучения после развёртывания без переобучения всей модели.

Важность: 2/5

Заметная статья (37 голосов в HF Daily Papers, ниже порога в 100 голосов для повышения важности).

Источники