Odyssey-3 генерує віртуальні світи в реальному часі — ними можна ходити просто в браузері

Компанія Odyssey відкрила публічний доступ до Odyssey-3 — нової world model, яка генерує оточення за текстовим описом і продовжує перебудовувати його під час взаємодії. На відміну від звичайного генератора відео, тут користувач може переміщатися створеним світом, змінювати положення камери й додавати нові події прямо під час генерації. Дослідницька версія Odyssey-3 Flash працює в браузері без локального встановлення. odyssey.systems
Публічний запуск відбувся 8 жовтня. Як пояснює Odyssey, модель враховує попередні кадри та нові дії користувача, намагаючись передбачити, як має змінитися сцена далі. Доступні навігація від першої та третьої особи й окреме керування камерою. odyssey.systems
Це принципова відмінність від заздалегідь згенерованого ролика: зображення не просто відтворюється, а продовжує створюватися в міру того, як користувач досліджує оточення.
Odyssey-3 очолила тест на розуміння фізики
В основі Odyssey-3 лежить авторегресійний diffusion transformer. Для навчання компанія використала інтернет-відео з розміткою подій, записи ігрового процесу із синхронізованими натисканнями клавіш і рухами миші, а також симуляції взаємодії твердих тіл. Завдання такої моделі — не лише створювати правдоподібну картинку, а й враховувати рух об’єктів, причинно-наслідкові зв’язки та попередні події. odyssey.systems
Найпомітніший результат отримала версія Odyssey-3 Pro у Physics-IQ Verified — бенчмарку для перевірки фізичної поведінки генеративних відеомоделей. Він використовує записи реальних експериментів із рідинами, твердими тілами, світлом, магнітними явищами та іншими фізичними процесами.
Odyssey-3 Pro посіла перше місце в категорії video-to-video з результатом 66,10 бала. Але тут є суттєве застереження: рекордний показник отримано методом best-of-8, коли обирається найкращий варіант із восьми генерацій. За звичайного запуску з тими самими користувацькими промптами результат Pro становить близько 63,37 бала. Базова Odyssey-3 у схожій конфігурації отримала 61,56 бала. Ці значення вже внесені до офіційного рейтингу Physics-IQ Verified.
У власному тестуванні Odyssey модель також посіла перше місце в трьох із чотирьох розділів WorldMark, який оцінює виконання команд, візуальну якість і збереження інформації про світ. Водночас самі розробники наголошують, що такі бенчмарки перевіряють лише окремі властивості генерації й не доводять універсального розуміння реальної фізики. odyssey.systems
Today we’re launching Odyssey-3, the most powerful foundation world model yet. It sets a new state of the art on Physics-IQ, and powers robots, trains AIs, and generates interactive experiences. It’s really cool. Experience the model today, all for free! https://t.co/LHWa7MPbKi
— Odyssey (@odysseyml) October 8, 2026
Від віртуальних світів до роботів і автомобілів
Для Odyssey інтерактивні світи — лише одне із застосувань моделі. Компанія вже адаптує її для керування фізичними пристроями.
В експериментах Odyssey-3 використовували для роботизованих маніпуляторів, а партнер Odyssey — Flexion — побудував на моделі систему керування людиноподібними роботами. Для автомобільного сценарію розробники навчили керівну політику на 20 годинах даних, залишивши саму базову Odyssey-3 без змін, після чого автомобіль випробовували в замкнутому контурі на реальних дорогах Індії. odyssey.systems
Розробники розглядають подібні world models як віртуальне середовище, де роботи та ШІ-агенти зможуть набувати досвіду без необхідності щоразу проводити дорогі фізичні випробування. Але опубліковані демонстрації поки що залишаються дослідницькими експериментами, а не доказом готовності системи до масового використання.
Звичайним користувачам доступна саме Odyssey-3 Flash, тоді як рекорд Physics-IQ належить важчій Pro-версії з роздільною здатністю 1280 × 720 пікселів. Тому можливості публічного браузерного прев’ю не варто напряму порівнювати з результатами флагманської моделі.
Odyssey-3 також поки не можна вважати заміною Unity, Unreal Engine чи іншому повноцінному ігровому рушію: модель генерує змінний відеосвіт, а не готову 3D-сцену зі звичними об’єктами, геометрією та ігровими системами. Але можливість створювати оточення й одразу його досліджувати показує, куди може рухатися генеративний ШІ після зображень і звичайного відео.