-
DeepSeek V4: официальный open-source релиз с Day-0 адаптацией под Huawei Ascend
DeepSeek
models-llm
-
xAI завершила выкатку Grok 4.3 в API: контекст 1M, нативное видео и снижение цены ~40%
xAI
models-llm
-
MiniMax выпускает M3: открытая фронтирная модель с контекстом 1M токенов и архитектурой MSA
MiniMax
models-llm
-
NVIDIA Nemotron 3 Ultra: открытая модель 550B MoE теперь доступна для агентных задач
NVIDIA
models-llm
-
MiniMax M3 с открытыми весами: контекст 1M, MoE и кодирование на уровне лучших моделей
MiniMax
models-llm
-
Zhipu AI открывает GLM-5.2 под лицензией MIT с контекстом 1M токенов
Zhipu AI
models-llm
-
Zhipu AI выпускает открытые веса GLM-5.2: 753B MoE с контекстом 1M токенов под лицензией MIT
Zhipu AI / Z.ai
models-llm
-
Moonshot AI выпустила Kimi K3 — модель с открытыми весами на 2,8 трлн параметров
Moonshot AI
models-llm
-
Apodex 1.1: масштабирование агентного интеллекта для сложных задач
Apodex
research
-
SU-01: рассуждения на уровне золотой медали олимпиады через curriculum SFT и двухэтапный RL
SU-01 Team
research
-
Систематический анализ гибридного линейного внимания: исследование 72 моделей
ByteDance Seed
research
-
DeepSeek-V4-Pro reaches general availability, prices jump up to 1,100% from Aug 16
DeepSeek
models-llm
-
RoPE доказуемо не справляется с длинными контекстами: locality bias и согласованность токенов нарушаются
research
-
Moonshot AI выпускает Kimi K2.7-Code: открытая модель с 1T параметрами для программирования и поддержкой зрения
Moonshot AI
models-llm
-
MiniMax Sparse Attention: сокращение вычислений в 28 раз при контексте 1M токенов без потери качества
MiniMax
research
-
Технический отчёт Kimi K3: подробности об архитектуре Kimi Delta Attention и Stable LatentMoE
Moonshot AI
research
-
MemLens: бенчмарк мультимодальной долгосрочной памяти для моделей визуального языка
NVIDIA
research
-
Echo-Infinity: генерация бесконечного видео в реальном времени через обучаемый Memory Query
research
-
GitHub Copilot получает контекстное окно в 1M токенов и настраиваемые уровни рассуждений
GitHub / Microsoft
tools
-
vLLM добавляет поддержку MiniMax M3 с открытыми весами в день выхода: разреженное внимание с контекстом 1M токенов
MiniMax
tools
-
CompactionRL: обучение с подкреплением с компакцией контекста для long-horizon-агентов
Zhipu AI / Tsinghua University
research
-
Metis: базовая модель памяти
MemTensor, Renmin University, NUS, Shanghai Jiao Tong University, Tongji University
research
-
Demystifying Agent Skills: почему они работают — пока не перестают
UC San Diego (Zhiyuan Jiang, Mengdi Wang, Yijiang Li et al.)
research
-
Do Language Models Need Sleep? Offline Recurrence as Memory Consolidation for Improved Inference
Google / CMU
research
-
Zhipu AI выпускает GLM-5.2: MoE с 744B параметрами, контекстом 1M токенов и фокусом на программирование
Zhipu AI
models-llm
-
AgenticSTS: тестовый стенд с ограниченной памятью для LLM-агентов с длинным горизонтом
Alaya Studio
research
-
Jet-Long: эффективное расширение контекстного окна с динамическим Bifocal RoPE
MIT / NVIDIA
research
-
Intern-S2-Mobius: фундаментальная модель с разделёнными знаниями и рассуждением
Shanghai AI Lab
research
-
Prime Agent: самоулучшающийся RLM-харнесс
Prime Intellect
research
-
ReWorld: интерактивная модель мира с долгосрочной памятью
TongyiLab (Alibaba)
research
-
SubtleMemory: бенчмарк выявляет систематические провалы агентов в тонком реляционном запоминании
research
-
SearchSwarm: обучаемое делегирование для LLM-агентов в долгосрочных исследовательских задачах
research
-
FlashMorph: управляемое данными размещение слоёв гибридного внимания через обучаемые гейты
ByteDance Seed
research
-
LongStraw: RL с длинным контекстом свыше 2М токенов при фиксированном GPU-бюджете
Mind Lab
research
-
vLLM представляет предварительную поддержку промышленного масштаба для Kimi K3 от Moonshot AI перед релизом весов
vLLM / Moonshot AI
tools
-
Motif 3: технический отчёт
Motif Technologies
research