#world-models
- NVIDIA выпускает Cosmos 3: открытая омнимодальная фундаментальная модель для физического AI NVIDIA research
- Kairos: полноценный стек мировых моделей для физического AI ACE Robotics research
- Orca: общая фундаментальная модель мира от BAAI, обученная на 125K часов видео BAAI research
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру research
- Долгосрочная аудиовизуальная генерация для persistent stories и интерактивных миров research
- Обучение постоянству объекта в world-моделях research
- GigaBrain-0.7: масштабирование embodied foundation-моделей к эмерджентным способностям через трёхсистемную архитектуру GigaAI research
- World Action Models: обзор National University of Singapore research
- Qwen-AgentWorld: языковые world-модели для универсальных агентов в семи средах Alibaba/Qwen research
- GigaWorld-1: дорожная карта для построения моделей мира для оценки роботизированных политик GigaAI research
- AlayaWorld: генерация интерактивных видеомиров с длинным горизонтом (открытый исходный код) AlayaWorld Team research
- Alibaba Amap запускает ABot-World Studio: генерацию бесконечного интерактивного видео и 3D-миров на одной видеокарте Alibaba video
- DreamX-Phi 1.0 побеждает на WorldArena 2.0 Track 1 с action-conditioned видео world model для робототехнической манипуляции Alibaba research
- Alaya-EVOKE: от линейно масштабируемого обучения к бесконечному миру Zhejiang University research
- τ₀-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation Shanghai Innovation Institute research
- EchoWM: открытые и входимые omnimodal-модели мира JD.com research
- VGI-Bench: проверка визуального интеллекта в моделях генерации видео research
- Runway представила Solaris — свою первую Interface World Model Runway video
- Runway показывает генерацию видео в реальном времени: поток стримится по мере описания Runway video
- Black Forest Labs выпускает FLUX 3 Action — open-weights world-action модель 7B для управления роботами Black Forest Labs video
- InternVLA-A1.5: объединение понимания, латентного предвидения и действия для композиционной генерализации InternRobotics research
- Мультиплеерные интерактивные мировые модели с репрезентационными автоэнкодерами research
- ABot-World-0: бесконечный интерактивный мир на одном настольном GPU Alibaba AMAP CV Lab research
- Agentic-разработка игр как верифицируемый движок траекторных данных для масштабирования world models NUS research
- WMRL: масштабирование автоматических research-агентов через world-модели University of Illinois / NVIDIA research
- Vidu S2: realtime-интерактивная, редактируемая и пространственная видеогенерация ShengShu Intelligence research
- WorldCrafter: согласованная видео world-модель с неявной 3D-осведомлённой памятью Tencent ARC Lab research
- Causal Forcing++: 2-шаговая дистилляция для генерации интерактивного видео в реальном времени Tsinghua University research
- SANA-WM: мировое моделирование 720p длительностью в минуту на одном GPU NVIDIA research
- DreamX-World 1.0: интерактивная модель мира общего назначения с управлением камерой 6DoF AMAP-ML (Alibaba Maps AI Lab) research
- From Pixels to States: переосмысление интерактивных world models как игровых движков research
- N0-TWAM: масштабирование тактильно-нативной world-action модели для манипуляций с контактом NeoteAI / Fudan TEAI research
- WorldClaw: агентная генерация 3D-открытых миров в промышленном масштабе Tencent Hunyuan research
- Runway представила GWM Worlds 2 — интерактивную world-модель реального времени Runway video
- Programmable World Model: программируемое агентами постоянное состояние для интерактивного видео Alaya Lab research
- Может ли MiniMax-H3 рассуждать о физическом мире? research
- Google Project Genie World Model Now Simulates Real Places Using Street View Google DeepMind research
- Astra: VLM с RL-обучением запрашивает симулятор мира для пространственных рассуждений research
- Галлюцинации в моделях мира предсказуемы и предотвратимы UC San Diego research
- WorldDirector: управляемый симулятор мира с постоянной памятью динамических объектов research
- HarnessEval-W: агентное превращение оценки визуальных миров NTU / MirroS-Lab consortium research
- ForgeWM: Progressive Causal Training для Few-Step Action-Conditioned Video World Models research
- ReWorld: интерактивная модель мира с долгосрочной памятью TongyiLab (Alibaba) research
- PAWBench: как далеко мы от вероятностно согласованного world-моделирования? research
- Echo-Memory: контролируемое исследование механизмов памяти в видеомоделях мира с условием на действие Microsoft Research research
- PhysisForcing: мировые модели с физическими ограничениями повышают успешность манипуляций роботов на 50% Peking University / NVIDIA research
- Quo Vadis, World Modeling? На пути к интерактивным прокси мира для непрерывно совершенствующихся агентов Shanghai AI Laboratory research
- WorldClaw генерирует агентные 3D открытые миры в масштабе Tencent Hunyuan research
- EnvACE усваивает динамику среды через «репетицию мира» для агентного RL research
- DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation Alibaba Group research
- Основатель ByteDance лично возглавил работу над world-моделью для пространственного видео в реальном времени — запуск возможен уже в октябре ByteDance video