#fine-tuning
- MinT: управляемая инфраструктура для обучения и обслуживания миллионов LLM Mind Lab research
- Program-as-Weights: компиляция спецификаций задач в LoRA-адаптеры для инференса на устройстве University of Waterloo / Harvard research
- Super Weights в LLM: почему высокосалиентные параметры не работают как цели дообучения Amazon research
- «Супервеса» в LLM и провал избирательного обучения Amazon Web Services research
- Code2LoRA: гиперсеть генерирует репозиторно-специфичные адаптеры для code LM без накладных расходов на инференс University of Waterloo research
- Agentic ESOpt: файнтюн long-horizon LLM-агентов с минимальными требованиями к GPU National University of Singapore (Zhi Zheng, Wee Sun Lee et al.) research