Ежедневный дайджест
18 пунктов · ~18 мин · Неделя 2026-W35
Обязательно к прочтению (2)
Apodex 1.1: масштабирование агентного интеллекта для сложных задач
ApodexТехнический отчёт, определяющий «рабочую способность» — устойчивый верифицируемый прогресс в долгосрочных реальных задачах, затрагивающих файлы, источники и код. Масштабируется по двум осям: масштабирование среды (исполнительные верификаторы файлов/поиска/кода) и масштабирование агентной координации (декомпозиция, асинхронная делегация, перепланирование). Общий AgentOS-харнесс поддерживает состояние задачи и происхождение между инструментами и агентами; 35B-параметров Apodex 1.1 Mini сохраняет эту способность локально.
Alibaba выпускает видеомодель Wan 3.0 с 30-секундной генерацией за один проход и нативным аудио
Alibaba (Tongyi Lab)Alibaba Cloud выпустила Wan 3.0 2026-08-24 в виде вызываемого API на Model Studio / Qwen Cloud и в песочнице create.wan.video. Модель генерирует до 30 секунд за один проход (вдвое больше 15-секундного потолка Wan 2.7), выдаёт нативное 1080p-видео со звуком, отрендеренным в том же проходе, и принимает текстовые, графические, видео-, аудио- и документные (PDF / слайд / веб-страница) входы. Для документных входов требуется режим 'thinking', который позволяет модели рассуждать о композиции до рендеринга. На запуске доступны три эндпоинта — T2V, I2V (с опциональным управлением конечным кадром) и reference-to-video — принимающие до 10 референсных изображений, 5 референсных видеоклипов (всего 15 с при 16 fps+) и 5 референсных аудиодорожек (всего 15 с). Цены: $0.05/$0.10/$0.20 за секунду при 480p/720p/1080p, тариф 'Prime' — $0.068/$0.14/$0.28. Публичная бета шла с 2026-08-06; понедельничный анонс совпал с закрытием доразмещения Alibaba на HK$80 млрд — крупнейшего в Гонконге с 2021 года.
Стоит знать (3)
Claude Code v2.1.239 — крупный релиз с надбавкой за резидентность данных, межсессионными сообщениями в Windows, ListAgents
Anthropic21 августа Anthropic выпустила Claude Code v2.1.239 (50+ изменений): оценки стоимости (/cost, status line, --max-budget-usd) теперь включают наценку 1.1x за инференс только в США для воркспейсов с резидентностью данных; новая команда /claude-api upgrade мигрирует Python-проекты с anthropic 0.x на 1.x; Alpine/musl-сборки теперь подгружают нативные аддоны для вставки изображений, буфера обмена и захвата аудио; межсессионные сообщения расширены на Windows (раньше только macOS/Linux); /goal check-ins теперь отступают (30 мин -> 1 ч -> 2 ч) вместо срабатывания каждые 30 мин; ListAgents / /list-agents показывает активных тиммейтов; keybindingFlavor 'readline' соответствует поведению word-key в Bash. Также исправлены: биллинг стриминга в Bedrock, задержка Edit/Write в JetBrains, обрезка MCP elicitation и фрагментация трейсов OpenTelemetry.
Anthropic Python SDK v1.0.0 — первый стабильный мажор; апгрейд httpx2 с ломающими изменениями
AnthropicПервый стабильный мажор Anthropic Python SDK, выпущен 20 августа. Апгрейд на httpx2 с ломающими изменениями, описанными в MIGRATION.md. Также прекращает предупреждение об output_format= в хелперах parse/stream/tool_runner и восстанавливает исходные импорты событий в lib/streaming/_types.py.
Anthropic TypeScript SDK v0.119.0 — Files и Skills API становятся GA; тулы computer-use и browser-use
AnthropicРелиз TypeScript SDK от 19 августа (v0.119.0, зеркалирован как bedrock-sdk v0.33.0). Files и Skills API теперь GA. Добавляет тулы computer-use и browser-use. За ним 19 августа вышел v0.120.0 с конфигом веб-поиска managed-агентов и памятью self-hosted песочницы. Несколько Bedrock/Vertex/Foundry/AWS SDK вышли синхронно.
Справочно (13)
Mistral и HUMAIN объявляют о стратегическом сотрудничестве в сфере суверенного ИИ в Саудовской Аравии
Mistral24 августа 2026 года Mistral и HUMAIN объявили о стратегическом сотрудничестве на сотни миллионов евро для продвижения суверенного ИИ в Саудовской Аравии и на Ближнем Востоке в целом. Первоначальные направления: кибербезопасность, голосовые технологии, фронтирные арабоязычные модели и регулируемые отрасли. Mistral изучит возможность использования инфраструктуры дата-центров HUMAIN для локальных вычислений; стороны запустят совместный выход на рынок, ориентированный на регулируемые саудовские отрасли.
Яндекс открывает медицинского ИИ-ассистента для всех российских врачей
YandexЯндекс открыл бета-доступ к своему медицинскому ИИ-ассистенту (Yandex Med) для всех практикующих врачей в России, расширив его за пределы прежнего пилота только для клиник-партнёров. Ассистент транскрибирует диалог врача и пациента в медицинские записи, ищет по 1000+ верифицированным медицинским источникам и включает 20+ клинических калькуляторов и шкал тяжести (например, CURB-65). Пайплайн использует архитектуру Classifier→Router→Reranker для снижения галлюцинаций. Построен на Yandex AI Studio, Yandex SpeechKit и Yandex GPT. Доступен через веб и Android-приложение Yandex Med в RuStore; iOS-версия планируется.
Prime Agent: самоулучшающийся RLM-харнесс
Prime IntellectOpen-source харнесс для долгосрочных воркфлоу кодинга и оценки. Персистентный IPython REPL реализует абстракцию Recursive Language Model; Continual Harness сохраняет истории/памяти/навыки/спецификации сабагентов между траекториями; рекурсивные сабагенты координируются через прямое агент-агент сообщение. На ARC-AGI-3 RHAE Best@1 харнесс поднимает базовую модель с 30% до 95.5% и соответствует или превосходит нативные и популярные харнессы в долгом контексте при кодинге, генерации GPU-ядер, конструировании эмуляторов и автономных спидранах nanoGPT.
ReWorld: интерактивная модель мира с долгосрочной памятью
TongyiLab (Alibaba)Интерактивная видео-модель мира, которая разделяет краткосрочное управление и неограниченную память при обучении и ограничивает их на инференсе. Смешанное per-head внимание направляет большинство голов в недавнее прошлое, тогда как несколько глобальных голов обращаются ко всей истории; фиксированного бюджета pose-indexed landmark KV-кэш удерживает всё прошлое в постоянном бюджете памяти; дистилляция с сопоставлением распределений в LoRA-адаптере сжимает сэмплинг до 4 шагов. Стримит 704x1280 видео в реальном времени.
Графовая инженерия в эпоху LLM-агентов: от индивидуального интеллекта к системному
Позиционный/обзорный доклад 35 авторов из Jilin University, HKUST, NTU, Westlake и других. Утверждает, что одноагентные парадигмы (Prompt / Context / Harness / Loop Engineering) упираются в структурный потолок на задачах, требующих разнородной экспертизы, параллельного исполнения, независимой верификации и постоянного состояния. Вводит «System Intelligence» и предлагает «Graph Engineering» — явные, динамические, развивающиеся графовые структуры для задач, агентов и состояния рантайма, организованные вокруг видов Task Organization, Agent Coordination и Runtime State Management.
InfinityEdit: бесконечный видеомонтаж с лёгким Edit-Ignition-адаптером
Alibaba (Tongyi)Формализует «бесконечный видеомонтаж»: дан предыдущий сегмент и запрос на монтаж, модель должна сгенерировать следующий сегмент, продолжающий поток в рамках этого монтажа, и так бесконечно. Лёгкий адаптер с тремя attention-блоками (history cross-attention, causal temporal self-attention, edit cross-attention) селективно активируется только в чанке, где приходит монтаж; последующие чанки возвращаются к базовой модели с reset-анкером.
Claude Code v2.1.245 — исправление стартового краша на Linux glibc 2.44
AnthropicПоследний релиз Claude Code от 25 августа. Исправляет стартовый краш на Linux-дистрибутивах с glibc 2.44 (Arch Linux, CachyOS, Fedora Rawhide).
OpenCode v1.18.22 — чистка цен OpenCode Go, исправление device-login, защита textVerbosity в OpenAI-compat
SSTРелиз SST OpenCode от 24 августа. Удаляет устаревшие сообщения/цены о скидке за первый месяц OpenCode Go. Исправляет ссылки device-login, когда серверы возвращают относительные URL верификации или используют базовый путь. Прекращает отправку textVerbosity провайдерам с OpenAI-совместимым API, которые её не поддерживают (коммит сообщества от @joelstucki-taulia). Обновляет провайдер Amazon Bedrock для совместимости. Desktop: сохраняет заголовки провайдера модели видимыми при прокрутке выбора модели.
Zed v1.16.2 — исправление побега из песочницы файловой системы, GitHub Copilot Chat в GitHub Enterprise Cloud
ZedStable-релиз Zed от 24 августа (v1.16.2). Исправляет потенциальный побег из песочницы файловой системы при запуске расширений (#63147); исправляет аутентификацию GitHub Copilot Chat и маршрутизацию API для GitHub Enterprise Cloud (#63142); исправляет игнорирование проектных настроек языкового сервера расширениями, собранными на extension API вплоть до v0.1.0 (#63083); исправляет открытие посторонних файлов при запусках Flatpak CLI из-за бага конструирования аргументов (#62959). Pre-релиз v1.17.0-pre (19 августа) добавил табличные превью CSV/TSV/PSV/SSV, новые действия git blame/stash и сниженное потребление памяти на больших файлах.
LangChain core 1.6.0 — стандартные типы исключений моделей, отложенные аннотации StructuredTool, десериализация RunnablePick
LangChainLangChain core 1.6.0 выпущен 19 августа. Стандартные типы исключений моделей (принятые в тот же день langchain-openai 1.6.0, langchain-anthropic 1.6.0, langchain-fireworks 1.6.0); отложенные аннотации StructuredTool; десериализация RunnablePick. langchain 1.3.16 (20 августа) добавил стандартные типы исключений моделей и кастомный token_counter в ContextEditingMiddleware. langchain-perplexity 1.4.1 (21 августа) добавляет type='message' к элементам Responses, сохраняет extra_body и поднимает pillow. langchain 1.3.17 (25 августа) добавляет кастомные причины отказа HITL.
LlamaIndex v0.14.24 — Claude Sonnet 5 / Opus 5 / GPT-5.6; gemini 3.7 Flash по умолчанию; mcp 2.x
LlamaIndexLlamaIndex v0.14.24 выпущен 19 августа. llama-index-llms-anthropic 0.11.10 добавляет Claude Sonnet 5, исправляет function calling для Sonnet 5, добавляет Opus 5 в allowlist'ы и корректирует контекстное окно Opus 4.6 до 1M. llama-index-llms-bedrock-converse 0.14.18 зеркалит allowlist'ы Sonnet 5 + Opus 5 и добавляет тип thinking 'disabled'. llama-index-llms-google-genai 0.10.0 по умолчанию использует gemini 3.7 Flash и исправляет сигнатуры мыслей. llama-index-llms-openai 0.7.10 добавляет модели GPT-5.6. llama-index-protocols-ag-ui 0.4.0 поддерживает мультимодальный пользовательский ввод (изображения/аудио/видео/документы). llama-index-tools-mcp 0.5.0 мигрирует на mcp 2.x.
llama.cpp b10603-b10615 — GLM-4.5-Air MTP, Deepseek 4 -sm tensor, тюнинг Metal flash-attn vec для M1 Pro/M2 Ultra/M5 Max
ggml-orgСерия master-сборок llama.cpp 23-24 августа. Из заметного: b10603 добавляет поддержку MTP (multi-token prediction) для GLM-4.5-Air; b10604 добавляет поддержку Deepseek 4 '-sm tensor'; b10608 исправляет mtmd-video moov atom в конце файла; b10610 укорачивает именование виртуальных устройств в CUDA и Metal; b10614 разделяет per-op Metal-исходники для параллельной компиляции и добавляет ядра для col2im_1d, set_rows, Q2_0, CONV_2D_DW, fused snake activation, FWHT; b10615 добавляет per-device тюнинг (Q, NE) flash-attn vec, включая FA-vec тюнинги для M1 Pro, M2 Ultra и M5 Max.
SGLang v0.5.18
SGLangSGLang v0.5.18 выпущен 22 августа. Подробный changelog не удалось получить через WebFetch — включено для полноты; конкретные возможности не верифицированы.