Tencent выпустила ИИ-модель для создания 3D-миров из одного изображения

  • 11.09.2025 00:17
  • 2.1k+

Китайская компания Tencent представила открытую ИИ-модель HunyuanWorld-Voyager, которая позволяет генерировать видеоряд с 3D-эффектом на основе одного исходного изображения.

Алгоритм формирует до 49 кадров, что составляет около двух секунд видео, и объединяет их в последовательности длительностью несколько минут. При этом создаётся эффект движения камеры в реальном 3D-пространстве: объекты сохраняют свои позиции, а перспектива изменяется корректно.
HunyuanWorld-Voyager одновременно генерирует цветное видео и карты глубины (RGB-D), что позволяет использовать данные для реконструкции трёхмерных облаков точек. В основе работы лежит сопоставление шаблонов с геометрическими ограничениями: каждый кадр преобразуется в точечную 3D-модель, которая затем проецируется обратно в 2D для согласования с новыми изображениями. Такой подход обеспечивает более высокую пространственную согласованность по сравнению с другими ИИ-генераторами видео.
По данным Tencent, обучение модели проводилось на базе более 100 тыс. видеоклипов, в том числе созданных на движке Unreal Engine. По сути, ИИ-алгоритм обучили имитировать движение 3D-камер в среде видеоигр.
Система требует значительных вычислительных ресурсов: не менее 60 ГБ видеопамяти для генерации сцен в разрешении 540p и 80 ГБ — для более высокого качества.
Исходный код HunyuanWorld-Voyager и документация размещены на платформе Hugging Face. Использование алгоритма сопровождается лицензионными ограничениями: модель запрещено применять в странах ЕС, Великобритании и Южной Корее, а коммерческое использование с аудиторией свыше 100 млн пользователей требует отдельного лицензирования.


29.09.2025 12:19
7.4k+

Ученые создают ИИ, который будет генерировать исторически достоверные изображения

Профессор древней истории Цюрихского университета Феликс К. Майер вместе с программистом Филиппом Штребелем разрабатывают генератор изображений на базе искусственного интеллекта, способный создавать максимально достоверные сцены из Древнего Рима и Древней Греции...

20.09.2025 06:52
878

OpenAI займется разработкой гуманоидных роботов и уже ищет специалистов

Компания OpenAI формирует новую команду по робототехнике, в том числе для работы над гуманоидными системами. Об этом сообщает Wired. По данным издания, компания активно привлекает специалистов в области управления роботами...

27.08.2025 15:44
5k+

Китай строит первый в мире подводный дата-центр для искусственного интеллекта

В Китае ведется строительство первого в мире подводного центра обработки данных для искусственного интеллекта. Объект находится в 10 км от побережья Шанхая, а его питание будет обеспечивать близлежащая морская ветроэлектростанция, передает Live Science...

22.08.2025 08:10
1k+

Google добавила в Gemini инструмент для озвучивания документов

Разработчики Google внедрили в сервис «Google Документы» новую функцию, позволяющую преобразовывать текст в аудиоформат. Инструмент работает на базе модели искусственного интеллекта Gemini. Опция «Аудио» появилась в меню «Инструменты» в верхней части рабочего пространства...