Atlas превращает один кадр в управляемый 3D-мир. И наконец отдаёт режиссёру камеру
Новость опубликована 03.09.2026 ⦁ источник
World Labs, стартап Фей-Фей Ли, представил Atlas — единую модель, обученную с нуля работать с текстом, изображениями, видео и 3D. Она не просто дорисовывает правдоподобные кадры, а удерживает общую пространственную сцену и понимает, где в ней находится камера.
По заявлению компании, из одного или нескольких изображений Atlas создаёт видео длиной до минуты в 1440p по заранее заданной траектории камеры. Положение и угол камеры подаются модели напрямую — получается скорее виртуальная съёмочная площадка, чем привычный генератор с кнопкой «авось красиво».
Atlas также восстанавливает сцены в виде облаков точек и 3D Gaussian splats, позволяет менять ракурс видео, снятого всего на три–пять обычных камер, и строить среды для обучения роботов. Самое интересное здесь не очередная нейросеть для роликов, а попытка собрать в одном движке кино, игры, 3D-дизайн и робототехнику.
Пока осторожнее с фанфарами: сравнительные тесты опубликовала сама World Labs, а Atlas доступен только избранным партнёрам в раннем доступе. Массового продукта ещё нет — есть довольно убедительная заявка на то, чем генеративное видео хочет стать после эпохи эффектных, но плохо управляемых демороликов.