Ежедневный дайджест
13 пунктов · ~13 мин · Неделя 2026-W34
Обязательно к прочтению (3)
Stripe приобретает OpenRouter более чем за $7 млрд, объединяя маршрутизацию AI-моделей и платежи под одной крышей
Сообщено 16-17 августа 2026 года Bloomberg, Forbes и Quartz. Stripe покупает стартап по маршрутизации AI-моделей OpenRouter более чем за $7 млрд (по некоторым источникам — до $8 млрд) — одна из крупнейших сделок года в сфере AI. OpenRouter агрегирует сотни передовых и открытых моделей за единым API; поглощение ставит платежи и AI-инференс за одного поставщика, что Forbes описывает как построение Stripe «реестра AI».
MegaParts: масштабирование 3D-генерации объектов с учётом частей до 300 частей через токен-эффективное авторегрессионное моделирование
Shanghai AI LabMegaParts масштабирует генерацию объектов с учётом частей до объектов с до 300 частями и последовательностями в 256k токенов через токен-эффективный векторно-квантованный токенизатор форм и унифицированную LLM, которая выдаёт боксы объектов, боксы частей и токены форм частей в одной структурированной последовательности. Она превосходит диффузионные и предыдущие авторегрессионные базлайны по точности мешей, сохраняя компактность дискретных токенов частей.
Hazmat: контейнеризация уровня ОС с открытым исходным кодом для Claude Code, Codex, OpenCode и Cursor Agent
Выпущен 17 августа 2026 года Денисом Редозубовым (dredozubov). Go CLI, который запускает Claude Code, Codex, OpenCode, Cursor Agent или любую пользовательскую обвязку агента в отдельной учётной записи пользователя ОС с профилем sandbox-exec для macOS, файрволом pf и DNS-блоклистом; расшарен только выбранный каталог проекта, поэтому SSH-ключи и облачные учётные данные остаются недоступны. Сводка перед запуском показывает доступные на запись/чтение пути, сетевой доступ и статус резервного копирования; делает снапшот на сессию для отката. Поставляется с формальной спецификацией модели контейнеризации на TLA+ (~5.5%) и демо, которое намеренно пытается прочитать приватный ключ для проверки изоляции. Linux работает нативно; бэкенд на Apple-контейнерах экспериментальный.
Стоит знать (6)
Tencent открыто публикует базовые модели GUI-агентов UI-Mate-27B и UI-Mate-9B
TencentTencent загрузил UI-Mate-27B и UI-Mate-9B на Hugging Face (Apache-2.0, построены на Qwen3.6-27B и 9B-бэкбоне, дообучены supervised fine-tuning с онлайн-RL): они наблюдают за скриншотами в реальном времени и выдают структурированные действия клавиатуры и мыши, совместимые с pyautogui. UI-Mate-27B набирает 77.0 на OSWorld-Verified, 66.2 на WindowsAgentArena и 41.00 strict / 76.86 progress на OSWorkerBench; одноразовое демонстрационное руководство удваивает strict-успех на OSWorkerBench-Subset (с 17.17 до 35.35) и поднимает progress на OSWorld-Subset с 40.27 до 65.75.
Статья ByteDance Seed исследует, как часто высококачественные доменные данные следует повторять при масштабировании LLM
ByteDanceКоманда ByteDance Seed опубликовала работу Scaling Domain Data Repetition in LLM Pretraining (arXiv 2608.14071, отправка на HF paper-page 17 августа, листинг arXiv 14 августа). При фиксированном количестве токенов на параметр оптимальное число повторений слегка увеличивается с размером модели; оптимальное повторение сильно отрицательно коррелирует с валидационными потерями по доменам; значения, подобранные на меньших прокси-моделях с тем же TPP, переносятся на более крупные модели.
ClawGym II: исследование чёрно-ящичного RL на обвязке агента
Renmin University of ChinaУнифицированный фреймворк чёрно-ящичного RL для обучения агентов на долгосрочных задачах, обёрнутых сложными обвязками, построенный на песочничном исполнении, обслуживающем прокси, который захватывает вызовы модели, и древовидной реконструкции траекторий, поддерживающей как PPO, так и critic-free GRPO. На Qwen3-30A3B он получает +9.98 Pass@1 на OpenClaw и +14.81 на Claude Code, стабильно на протяжении 200-400 шагов; приросты также переносятся на JobBench и OfficeQA.
Tencent EVIE-Preview-4.5B возглавляет ViDoRe V3 с компактным 128-мерным мультиязычным визуальным поиском документов
TencentEVIE-Preview-4.5B — это мультиязычная модель визуального поиска документов, построенная на Qwen3.5-4B (позднее взаимодействие в стиле ColBERT, чередующиеся Gated DeltaNet с полным вниманием), генерирующая 128-мерные мультивекторные эмбеддинги токенов. Она набирает 64.40 nDCG@10 в среднем на ViDoRe V3 (лидирует в 7 из 8 доменов) и 85.93 в среднем на ViDoRe V1 и V2, охватывая EN, FR, DE, IT, ES, PT, ZH.
Сбер и Группа Синара провели промышленный хакатон GigaChat в Sber Technohub Екатеринбург, сгенерировав 40+ инициатив GenAI
Sber17 августа 2026 года Сбер и Группа Синара провели хакатон в Технохабе Сбера в Екатеринбурге, где ~30 участников с заводов Синары (Калугапутьмаш, Уралхиммаш, Уральские локомотивы) и студентов УрФУ и УрГУПС разработали более 40 инициатив GenAI на платформе GigaCowork Сбера. Среди решений: NL-ассистент, сокращающий подготовку производственных/складских/финансовых отчётов с часов или дней до ~1 минуты, AI-агент, автоматизирующий 1,5-часовые ручные проверки конструкторской документации, и селектор сварочных технологий, сопоставляющий 3D-модели с утверждёнными процессами и нормами материалов.
Claude Code v2.1.234 добавляет CLAUDE_CODE_PROJECT_DIR_NAME, значок футера MR GitLab и усиление защиты путей NTLM
AnthropicВыпущен 17 августа 2026 года. Добавляет CLAUDE_CODE_PROJECT_DIR_NAME для конфигурационных каталогов на сессию, действие keybinding selection:clear и значок merge request GitLab в футере/statusline; автоматически продолжает работу при сбросе лимитов использования claude.ai. Исправление безопасности отклоняет пути Windows NT-namespace (\??\) для устранения вектора утечки учётных данных NTLM. Исправления ошибок охватывают повторные сетевые проверки режима auto-mode песочницы после компактирования, теряемые ответы разрешений в области сессии в промптах фоновых сабагентов и сбои из-за некорректных ответов API; пользовательские промпты теперь рендерятся как markdown, как и ответы. Снижает объём контекста встроенного навыка claude-api с ~200k+ токенов до ~25k.
Справочно (4)
VibeWorlding: могут ли мультимодальные агенты создавать 3D-открытые миры от начала до конца?
TencentУнифицированный фреймворк плюс VWE-BENCH (2 616 ассетов, 323 начальных мира, 6 828 запросов) и VibeWorlding-Gym (песочница + верификатор рубrikи) для обучения мультимодальных агентов, которые выводят намерение, вызывают 3D-инструменты и рефлексируют по обратной связи. Даже GPT-5.5 и Qwen3.8-Max набирают ниже 60%; обученный через RL VibeWorlder-30B-A3B берёт лучший Pass@1 в целом, превосходя модели с закрытым исходным кодом.
HarnessEval-W: агентное превращение оценки визуальных миров
NTU / MirroS-Lab consortiumЗаменяет brute-force скалярные метрики для развёртываний world-model агентным конвейером: родительский агент разбивает каждую оценку на подзадачи, порождает специализированных сабагентов с адаптированным контекстом и диагностическими инструментами, затем валидирует и суммирует дерево доказательств. Применённый к 18 world-моделям на 330 случаях, его вердикты согласуются с человеческими предпочтениями, одновременно раскрывая посылочное рассуждение для каждого развёртывания.
Google отключает API генерации изображений Imagen 4 и перенаправляет пользователей на модель изображений Gemini
Google17 августа 2026 года Google в плановом порядке вывела из эксплуатации три эндпоинта Imagen 4.0 API — imagen-4.0-generate-001, imagen-4.0-ultra-generate-001 и imagen-4.0-fast-generate-001 — перенаправив вызовы на свою модель изображений Gemini. Замена не является прямой drop-in заменой и стоит примерно на 67% дороже, чем Imagen 4 Standard в стандартном разрешении, с токенной тарификацией, которая масштабируется в зависимости от разрешения.
OpenRouter выпускает Activity Dashboard и Analytics API для расходов на агента и модель
OpenRouterВыпущено 17 августа 2026 года. Новый Activity Dashboard разбивает расходы команды по каждому агенту, модели и запросу, позволяет сохранять часто перестраиваемые графики и переходить с любого столбца прямо к базовым логам запросов. Сопутствующий Analytics API предоставляет тот же набор данных скриптам и терминалам, так что те же запросы можно повторно выполнять из CLI.