#world-models
- NVIDIA выпускает Cosmos 3: открытая омнимодальная фундаментальная модель для физического AI NVIDIA research
- Kairos: полноценный стек мировых моделей для физического AI ACE Robotics research
- Orca: общая фундаментальная модель мира от BAAI, обученная на 125K часов видео BAAI research
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру research
- World Action Models: обзор National University of Singapore research
- Qwen-AgentWorld: языковые world-модели для универсальных агентов в семи средах Alibaba/Qwen research
- GigaWorld-1: дорожная карта для построения моделей мира для оценки роботизированных политик GigaAI research
- AlayaWorld: генерация интерактивных видеомиров с длинным горизонтом (открытый исходный код) AlayaWorld Team research
- Alibaba Amap запускает ABot-World Studio: генерацию бесконечного интерактивного видео и 3D-миров на одной видеокарте Alibaba video
- DreamX-Phi 1.0 побеждает на WorldArena 2.0 Track 1 с action-conditioned видео world model для робототехнической манипуляции Alibaba research
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру Zhejiang University research
- τ₀-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation Shanghai Innovation Institute research
- EchoWM: открытые и входимые omnimodal-модели мира JD.com research
- InternVLA-A1.5: объединение понимания, латентного предвидения и действия для композиционной генерализации InternRobotics research
- Мультиплеерные интерактивные мировые модели с репрезентационными автоэнкодерами research
- ABot-World-0: бесконечный интерактивный мир на одном настольном GPU Alibaba AMAP CV Lab research
- Causal Forcing++: 2-шаговая дистилляция для генерации интерактивного видео в реальном времени Tsinghua University research
- SANA-WM: мировое моделирование 720p длительностью в минуту на одном GPU NVIDIA research
- DreamX-World 1.0: интерактивная модель мира общего назначения с управлением камерой 6DoF AMAP-ML (Alibaba Maps AI Lab) research
- From Pixels to States: переосмысление интерактивных world models как игровых движков research
- N0-TWAM: масштабирование тактильно-нативной world-action модели для манипуляций с контактом NeoteAI / Fudan TEAI research
- WorldClaw: агентная генерация 3D-открытых миров в промышленном масштабе Tencent Hunyuan research
- Google Project Genie World Model Now Simulates Real Places Using Street View Google DeepMind research
- Astra: VLM с RL-обучением запрашивает симулятор мира для пространственных рассуждений research
- Галлюцинации в моделях мира предсказуемы и предотвратимы UC San Diego research
- WorldDirector: управляемый симулятор мира с постоянной памятью динамических объектов research
- HarnessEval-W: агентное превращение оценки визуальных миров NTU / MirroS-Lab consortium research
- ForgeWM: Progressive Causal Training для Few-Step Action-Conditioned Video World Models research
- ReWorld: интерактивная модель мира с долгосрочной памятью TongyiLab (Alibaba) research
- Echo-Memory: контролируемое исследование механизмов памяти в видеомоделях мира с условием на действие Microsoft Research research
- PhysisForcing: мировые модели с физическими ограничениями повышают успешность манипуляций роботов на 50% Peking University / NVIDIA research
- Quo Vadis, World Modeling? На пути к интерактивным прокси мира для непрерывно совершенствующихся агентов Shanghai AI Laboratory research
- WorldClaw генерирует агентные 3D открытые миры в масштабе Tencent Hunyuan research
- EnvACE усваивает динамику среды через «репетицию мира» для агентного RL research