Ежедневный дайджест

18 пунктов · ~18 мин · Неделя 2026-W35

Обязательно к прочтению (2)

Apodex 1.1: масштабирование агентного интеллекта для сложных задач

Apodex
исследования офиц. + СМИ 2 ист. ~1 мин

Технический отчёт, определяющий «рабочую способность» — устойчивый верифицируемый прогресс в долгосрочных реальных задачах, затрагивающих файлы, источники и код. Масштабируется по двум осям: масштабирование среды (исполнительные верификаторы файлов/поиска/кода) и масштабирование агентной координации (декомпозиция, асинхронная делегация, перепланирование). Общий AgentOS-харнесс поддерживает состояние задачи и происхождение между инструментами и агентами; 35B-параметров Apodex 1.1 Mini сохраняет эту способность локально.

Почему это важно
Доклад HF Daily с 219 upvotes на 25 августа — №1 доклад HF Daily в тот день. Очерчивает видение «Heavy-Duty Solver» и показывает, что меньшая открытая модель конкурентоспособна с фронтирными системами на бенчмарках по финансам/исследованиям/математике/коду/поиску.

Alibaba выпускает видеомодель Wan 3.0 с 30-секундной генерацией за один проход и нативным аудио

Alibaba (Tongyi Lab)
видео офиц. + СМИ 8 ист. ~1 мин

Alibaba Cloud выпустила Wan 3.0 2026-08-24 в виде вызываемого API на Model Studio / Qwen Cloud и в песочнице create.wan.video. Модель генерирует до 30 секунд за один проход (вдвое больше 15-секундного потолка Wan 2.7), выдаёт нативное 1080p-видео со звуком, отрендеренным в том же проходе, и принимает текстовые, графические, видео-, аудио- и документные (PDF / слайд / веб-страница) входы. Для документных входов требуется режим 'thinking', который позволяет модели рассуждать о композиции до рендеринга. На запуске доступны три эндпоинта — T2V, I2V (с опциональным управлением конечным кадром) и reference-to-video — принимающие до 10 референсных изображений, 5 референсных видеоклипов (всего 15 с при 16 fps+) и 5 референсных аудиодорожек (всего 15 с). Цены: $0.05/$0.10/$0.20 за секунду при 480p/720p/1080p, тариф 'Prime' — $0.068/$0.14/$0.28. Публичная бета шла с 2026-08-06; понедельничный анонс совпал с закрытием доразмещения Alibaba на HK$80 млрд — крупнейшего в Гонконге с 2021 года.

Почему это важно
Wan 3.0 удваивает потолок длины видео за один проход, заданный предыдущим поколением Wan, и добавляет нативное аудио в том же проходе, выводя флагманскую видеомодель Alibaba в одну функциональную категорию с ByteDance Seedance 2.5 и Hailuo H3. Референсная композиция (изображения / видеоклипы / аудиоклипы / документы как входы первого класса) позиционирует её как единую мультимодальную модель, а не чистую text-to-video систему. Wan остаётся API-only — Wan 2.2 по-прежнему последний open-weights флагман, так что для open-source потребителей это пока не drop-in замена.

Стоит знать (3)

Claude Code v2.1.239 — крупный релиз с надбавкой за резидентность данных, межсессионными сообщениями в Windows, ListAgents

Anthropic
инструменты официальный 1 ист. ~1 мин

21 августа Anthropic выпустила Claude Code v2.1.239 (50+ изменений): оценки стоимости (/cost, status line, --max-budget-usd) теперь включают наценку 1.1x за инференс только в США для воркспейсов с резидентностью данных; новая команда /claude-api upgrade мигрирует Python-проекты с anthropic 0.x на 1.x; Alpine/musl-сборки теперь подгружают нативные аддоны для вставки изображений, буфера обмена и захвата аудио; межсессионные сообщения расширены на Windows (раньше только macOS/Linux); /goal check-ins теперь отступают (30 мин -> 1 ч -> 2 ч) вместо срабатывания каждые 30 мин; ListAgents / /list-agents показывает активных тиммейтов; keybindingFlavor 'readline' соответствует поведению word-key в Bash. Также исправлены: биллинг стриминга в Bedrock, задержка Edit/Write в JetBrains, обрезка MCP elicitation и фрагментация трейсов OpenTelemetry.

Почему это важно
Это крупнейший релиз Claude Code за рассматриваемый период и первый, выводящий ценообразование за резидентность данных прямо в CLI — значимое изменение для enterprise-пользователей на Bedrock/Vertex. Расширение межсессионных сообщений на Windows вместе с /goal-backoff в совокупности сигнализируют, что Anthropic инвестирует в долгоживущие мультиагентные воркфлоу Claude Code, а не в односессионные чаты.

Anthropic Python SDK v1.0.0 — первый стабильный мажор; апгрейд httpx2 с ломающими изменениями

Anthropic
инструменты официальный 1 ист. ~1 мин

Первый стабильный мажор Anthropic Python SDK, выпущен 20 августа. Апгрейд на httpx2 с ломающими изменениями, описанными в MIGRATION.md. Также прекращает предупреждение об output_format= в хелперах parse/stream/tool_runner и восстанавливает исходные импорты событий в lib/streaming/_types.py.

Почему это важно
Переход на новый мажор официального Python SDK — сигнал для downstream-проектов, привязанных к 0.x: пины придётся пересмотреть. Стоит отметить всем, кто держит production-код на этом SDK.

Anthropic TypeScript SDK v0.119.0 — Files и Skills API становятся GA; тулы computer-use и browser-use

Anthropic
инструменты официальный 1 ист. ~1 мин

Релиз TypeScript SDK от 19 августа (v0.119.0, зеркалирован как bedrock-sdk v0.33.0). Files и Skills API теперь GA. Добавляет тулы computer-use и browser-use. За ним 19 августа вышел v0.120.0 с конфигом веб-поиска managed-агентов и памятью self-hosted песочницы. Несколько Bedrock/Vertex/Foundry/AWS SDK вышли синхронно.

Почему это важно
Files + Skills, ставшие GA, вместе с новыми тулами computer-use и browser-use — это API-поверхность, поддерживающая направление Claude Code по MCP-коннекторам с managed-auth. Для потребителей SDK это канонический вход для новых инструментов.
Справочно (13)

Mistral и HUMAIN объявляют о стратегическом сотрудничестве в сфере суверенного ИИ в Саудовской Аравии

Mistral
индустрия офиц. + СМИ 3 ист. ~1 мин

24 августа 2026 года Mistral и HUMAIN объявили о стратегическом сотрудничестве на сотни миллионов евро для продвижения суверенного ИИ в Саудовской Аравии и на Ближнем Востоке в целом. Первоначальные направления: кибербезопасность, голосовые технологии, фронтирные арабоязычные модели и регулируемые отрасли. Mistral изучит возможность использования инфраструктуры дата-центров HUMAIN для локальных вычислений; стороны запустят совместный выход на рынок, ориентированный на регулируемые саудовские отрасли.

Почему это важно
Отражает экспансию Mistral в сделки по суверенному ИИ в Персидском заливе, дополняя её более раннее расширение европейских вычислительных мощностей с Microsoft; позиционирует арабоязычные модели как фронтирный дифференциатор для неамериканских провайдеров, конкурирующих на регулируемых рынках.

Яндекс открывает медицинского ИИ-ассистента для всех российских врачей

Yandex
индустрия офиц. + СМИ 6 ист. ~1 мин

Яндекс открыл бета-доступ к своему медицинскому ИИ-ассистенту (Yandex Med) для всех практикующих врачей в России, расширив его за пределы прежнего пилота только для клиник-партнёров. Ассистент транскрибирует диалог врача и пациента в медицинские записи, ищет по 1000+ верифицированным медицинским источникам и включает 20+ клинических калькуляторов и шкал тяжести (например, CURB-65). Пайплайн использует архитектуру Classifier→Router→Reranker для снижения галлюцинаций. Построен на Yandex AI Studio, Yandex SpeechKit и Yandex GPT. Доступен через веб и Android-приложение Yandex Med в RuStore; iOS-версия планируется.

Почему это важно
Первый общероссийский запуск медицинского ИИ-ассистента от российской лаборатории для всего корпуса практикующих врачей, а не только для клиник-партнёров. Развивает выделение Yandex Med в отдельное юридическое лицо 4 августа 2026 года, сигнализируя о выделенном направлении healthcare-AI бизнеса в Яндексе.

Prime Agent: самоулучшающийся RLM-харнесс

Prime Intellect
исследования офиц. + СМИ 3 ист. ~1 мин

Open-source харнесс для долгосрочных воркфлоу кодинга и оценки. Персистентный IPython REPL реализует абстракцию Recursive Language Model; Continual Harness сохраняет истории/памяти/навыки/спецификации сабагентов между траекториями; рекурсивные сабагенты координируются через прямое агент-агент сообщение. На ARC-AGI-3 RHAE Best@1 харнесс поднимает базовую модель с 30% до 95.5% и соответствует или превосходит нативные и популярные харнессы в долгом контексте при кодинге, генерации GPU-ядер, конструировании эмуляторов и автономных спидранах nanoGPT.

Почему это важно
Доклад HF Daily с 18.2k кумулятивных upvotes — единственный выбор харнесса достаточен, чтобы более чем утроить результат на ARC-AGI-3, что говорит о частичной артефактности многих цифр «возможностей модели». Продемонстрированы уточнение и параллелизованные сабагенты на Factorio.

ReWorld: интерактивная модель мира с долгосрочной памятью

TongyiLab (Alibaba)
исследования офиц. + СМИ 2 ист. ~1 мин

Интерактивная видео-модель мира, которая разделяет краткосрочное управление и неограниченную память при обучении и ограничивает их на инференсе. Смешанное per-head внимание направляет большинство голов в недавнее прошлое, тогда как несколько глобальных голов обращаются ко всей истории; фиксированного бюджета pose-indexed landmark KV-кэш удерживает всё прошлое в постоянном бюджете памяти; дистилляция с сопоставлением распределений в LoRA-адаптере сжимает сэмплинг до 4 шагов. Стримит 704x1280 видео в реальном времени.

Почему это важно
На 64-секундных разворотах туда-обратно фиксированный 12-чанковый кэш восстанавливает начальный вид там, где скользящие окна теряют данные, а full-KV внимание падает по OOM. Лучшая точность управления (ошибка поворота 11.95 градусов) и лучшее качество генерации против шести недавних базлайнов моделей мира.

Графовая инженерия в эпоху LLM-агентов: от индивидуального интеллекта к системному

исследования офиц. + СМИ 3 ист. ~1 мин

Позиционный/обзорный доклад 35 авторов из Jilin University, HKUST, NTU, Westlake и других. Утверждает, что одноагентные парадигмы (Prompt / Context / Harness / Loop Engineering) упираются в структурный потолок на задачах, требующих разнородной экспертизы, параллельного исполнения, независимой верификации и постоянного состояния. Вводит «System Intelligence» и предлагает «Graph Engineering» — явные, динамические, развивающиеся графовые структуры для задач, агентов и состояния рантайма, организованные вокруг видов Task Organization, Agent Coordination и Runtime State Management.

Почему это важно
Парадигмообразующий обзор с открытым awesome-list (DEEP-JLU/Awesome-Graph-Engineering). Попадание в HF Daily 24 августа с 39 upvotes. Скорее всего, закрепит следующую волну докладов по мультиагентным системам.

InfinityEdit: бесконечный видеомонтаж с лёгким Edit-Ignition-адаптером

Alibaba (Tongyi)
исследования офиц. + СМИ 2 ист. ~1 мин

Формализует «бесконечный видеомонтаж»: дан предыдущий сегмент и запрос на монтаж, модель должна сгенерировать следующий сегмент, продолжающий поток в рамках этого монтажа, и так бесконечно. Лёгкий адаптер с тремя attention-блоками (history cross-attention, causal temporal self-attention, edit cross-attention) селективно активируется только в чанке, где приходит монтаж; последующие чанки возвращаются к базовой модели с reset-анкером.

Почему это важно
Переводит видеомонтаж с допущения «на месте» на клип к потоковой формулировке, открывая воркфлоу длинных форм и живого монтажа. Доклад HF Daily с 33 upvotes 24 августа; команда Alibaba/Taobao из 12 авторов.

Claude Code v2.1.245 — исправление стартового краша на Linux glibc 2.44

Anthropic
инструменты официальный 1 ист. ~1 мин

Последний релиз Claude Code от 25 августа. Исправляет стартовый краш на Linux-дистрибутивах с glibc 2.44 (Arch Linux, CachyOS, Fedora Rawhide).

Почему это важно
Разблокирует Claude Code на самых свежих Linux-дистрибутивах с новейшим glibc — актуально для пользователей rolling-release дистрибутивов, которые сталкивались с крашем на предыдущих версиях.

OpenCode v1.18.22 — чистка цен OpenCode Go, исправление device-login, защита textVerbosity в OpenAI-compat

SST
инструменты официальный 1 ист. ~1 мин

Релиз SST OpenCode от 24 августа. Удаляет устаревшие сообщения/цены о скидке за первый месяц OpenCode Go. Исправляет ссылки device-login, когда серверы возвращают относительные URL верификации или используют базовый путь. Прекращает отправку textVerbosity провайдерам с OpenAI-совместимым API, которые её не поддерживают (коммит сообщества от @joelstucki-taulia). Обновляет провайдер Amazon Bedrock для совместимости. Desktop: сохраняет заголовки провайдера модели видимыми при прокрутке выбора модели.

Почему это важно
Чистит ценовую поверхность OpenCode Go (сообщения были устаревшими) и исправляет две проблемы надёжности — device-login с относительными URL и неподдерживаемый textVerbosity на OpenAI-compat эндпоинтах — которые ломали бы настройку на распространённых конфигурациях провайдеров.

Zed v1.16.2 — исправление побега из песочницы файловой системы, GitHub Copilot Chat в GitHub Enterprise Cloud

Zed
инструменты официальный 1 ист. ~1 мин

Stable-релиз Zed от 24 августа (v1.16.2). Исправляет потенциальный побег из песочницы файловой системы при запуске расширений (#63147); исправляет аутентификацию GitHub Copilot Chat и маршрутизацию API для GitHub Enterprise Cloud (#63142); исправляет игнорирование проектных настроек языкового сервера расширениями, собранными на extension API вплоть до v0.1.0 (#63083); исправляет открытие посторонних файлов при запусках Flatpak CLI из-за бага конструирования аргументов (#62959). Pre-релиз v1.17.0-pre (19 августа) добавил табличные превью CSV/TSV/PSV/SSV, новые действия git blame/stash и сниженное потребление памяти на больших файлах.

Почему это важно
Исправление побега из песочницы — это security note, заслуживающая внимания: всем, кто запускает недоверенные расширения на 1.16.x и старше, стоит обновиться. Исправление маршрутизации Copilot Chat в GHE разблокирует enterprise-пользователей, которые сталкивались со сбоями аутентификации в Zed.

LangChain core 1.6.0 — стандартные типы исключений моделей, отложенные аннотации StructuredTool, десериализация RunnablePick

LangChain
инструменты официальный 1 ист. ~1 мин

LangChain core 1.6.0 выпущен 19 августа. Стандартные типы исключений моделей (принятые в тот же день langchain-openai 1.6.0, langchain-anthropic 1.6.0, langchain-fireworks 1.6.0); отложенные аннотации StructuredTool; десериализация RunnablePick. langchain 1.3.16 (20 августа) добавил стандартные типы исключений моделей и кастомный token_counter в ContextEditingMiddleware. langchain-perplexity 1.4.1 (21 августа) добавляет type='message' к элементам Responses, сохраняет extra_body и поднимает pillow. langchain 1.3.17 (25 августа) добавляет кастомные причины отказа HITL.

Почему это важно
Стандартизация типов исключений моделей между провайдерами — реальное кросс-пакетное улучшение качества API: код, перехватывающий один и тот же класс исключений, теперь работает с OpenAI, Anthropic и Fireworks без провайдер-специфичных веток. Стоит отметить всем, кто поддерживает агентов, работающих с несколькими провайдерами.

LlamaIndex v0.14.24 — Claude Sonnet 5 / Opus 5 / GPT-5.6; gemini 3.7 Flash по умолчанию; mcp 2.x

LlamaIndex
инструменты официальный 1 ист. ~1 мин

LlamaIndex v0.14.24 выпущен 19 августа. llama-index-llms-anthropic 0.11.10 добавляет Claude Sonnet 5, исправляет function calling для Sonnet 5, добавляет Opus 5 в allowlist'ы и корректирует контекстное окно Opus 4.6 до 1M. llama-index-llms-bedrock-converse 0.14.18 зеркалит allowlist'ы Sonnet 5 + Opus 5 и добавляет тип thinking 'disabled'. llama-index-llms-google-genai 0.10.0 по умолчанию использует gemini 3.7 Flash и исправляет сигнатуры мыслей. llama-index-llms-openai 0.7.10 добавляет модели GPT-5.6. llama-index-protocols-ag-ui 0.4.0 поддерживает мультимодальный пользовательский ввод (изображения/аудио/видео/документы). llama-index-tools-mcp 0.5.0 мигрирует на mcp 2.x.

Почему это важно
Один релиз, который одновременно приносит Sonnet 5 / Opus 5 / GPT-5.6 / gemini 3.7 Flash в экосистему LlamaIndex. Миграция на mcp 2.x — заметный bump зависимости для всех, кто использует MCP-тулы через LlamaIndex.

llama.cpp b10603-b10615 — GLM-4.5-Air MTP, Deepseek 4 -sm tensor, тюнинг Metal flash-attn vec для M1 Pro/M2 Ultra/M5 Max

ggml-org
инструменты официальный 1 ист. ~1 мин

Серия master-сборок llama.cpp 23-24 августа. Из заметного: b10603 добавляет поддержку MTP (multi-token prediction) для GLM-4.5-Air; b10604 добавляет поддержку Deepseek 4 '-sm tensor'; b10608 исправляет mtmd-video moov atom в конце файла; b10610 укорачивает именование виртуальных устройств в CUDA и Metal; b10614 разделяет per-op Metal-исходники для параллельной компиляции и добавляет ядра для col2im_1d, set_rows, Q2_0, CONV_2D_DW, fused snake activation, FWHT; b10615 добавляет per-device тюнинг (Q, NE) flash-attn vec, включая FA-vec тюнинги для M1 Pro, M2 Ultra и M5 Max.

Почему это важно
GLM-4.5-Air MTP и Deepseek 4 -sm tensor — это модель-специфичные пути производительности, важные для всех, кто запускает эти архитектуры локально. Тюнинг Metal flash-attn vec для M5 Max — это взгляд в будущее: пользователи Apple silicon на новейших чипах получат ощутимые ускорения без изменения кода.

SGLang v0.5.18

SGLang
инструменты официальный 1 ист. ~1 мин

SGLang v0.5.18 выпущен 22 августа. Подробный changelog не удалось получить через WebFetch — включено для полноты; конкретные возможности не верифицированы.

Почему это важно
SGLang — один из крупных open-source движков инференса наряду с vLLM и llama.cpp. Новый релиз в этом окне заслуживает упоминания для всех, кто следит за версиями движков инференса, но отсутствие деталей означает, что перед обновлением стоит обратиться к release notes напрямую.