Macaron-V1: к открытому непрерывному обучению с самосовершенствованием и Mixture-of-LoRA
Открытая система агентной модели для непрерывного обучения после развёртывания, сочетающая базу GLM-5.2 на 744B параметров с архитектурой Mixture-of-LoRA, которая комбинирует специализированные адаптеры для чата, агентных задач, кодинга и генеративного UI; меньший вариант на 50B на базе Qwen3.6 поддерживает локальное развёртывание.
Почему это важно
324 голоса на HuggingFace Daily Papers; представляет полноценный совместно спроектированный стек (платформа пост-тренинга MinT, RL для длинного контекста LongStraw, агентный RL MindForge), а не отдельную изолированную технику.
Важность: 3/5
HuggingFace Daily Papers с 324 голосами (применён бамп-порог ≥100).
Источники
официальный
Macaron-V1 on HuggingFace Daily Papers