реклама
Теги → панорамы

Intel Labs представила нейросеть для генерации панорамных изображений с 360-градусным обзором

Intel Labs в сотрудничестве с Blockade Labs представили латентную диффузионную ИИ-модель для создания панорамных трёхмерных изображений (LDM3D) с 360-градусным обзором, которая первой в отрасли обеспечивает отображение глубины сцены. LDM3D может произвести революцию в создании реалистичного визуального 3D-контента, приложениях метавселенной и цифровом опыте, найти применение в широком спектре отраслей — от развлечений и игр до архитектуры и дизайна.

 Источник изображения: Intel Labs

Источник изображения: Intel Labs

LDM3D была обучена на наборе данных, созданном из подмножества 10 000 образцов базы данных LAION-400M, которая содержит более 400 миллионов пар изображений и подписей к ним. Для отображения точной относительной глубины каждого пикселя была использована разработанная Intel Labs модель Dense Prediction Transformer (DPT). Набор данных LAION-400M создан, чтобы обеспечить возможность широкомасштабного тестирования модели для широкого круга исследователей и других заинтересованных сообществ.

Модель LDM3D обучалась на суперкомпьютере Intel AI на базе процессоров Intel Xeon и ускорителей Intel Habana Gaudi AI. Полученная модель и конвейер объединяют сгенерированное изображение и карту глубины для создания 360-градусных панорамных представлений.

Чтобы продемонстрировать потенциал LDM3D, исследователи разработали приложение DepthFusion, которое использует стандартные 2D-фотографии RGB и карты глубины для создания интерактивной 360-градусной панорамы. Для превращения текстовых подсказок в 3D-панорамы применяется язык визуального программирования TouchDesigner на основе узлов для интерактивного мультимедийного контента в реальном времени. Модель LDM3D объединяет изображение RGB и его карту глубины, что приводит к экономии памяти и ускорению работы.

Примеры панорамных изображений с 360-градусным обзором

«Технология генеративного ИИ направлена на расширение человеческого творчества и экономию времени. Однако большинство сегодняшних моделей ИИ ограничены созданием 2D-изображений. В отличие от них LDM3D позволяет пользователям генерировать изображение и карту глубины из заданной текстовой подсказки. Это обеспечивает более точную относительную глубину для каждого пикселя по сравнению со стандартными методами постобработки и экономит разработчикам значительное время при разработке сцен», — пояснил Васудев Лал (Vasudev Lal), научный сотрудник Intel Labs.

Это исследование может революционизировать взаимодействие с цифровым контентом, позволяя пользователям отображать текстовые подсказки ранее немыслимыми способами. Изображения и карты глубины, сгенерированные LDM3D, позволяют пользователям превратить текстовое описание безмятежного тропического пляжа, современного небоскрёба или научно-фантастической вселенной в детализированную панораму. Способность создавать карту глубины изображения может мгновенно повысить общий реализм и погружение, позволяя создавать инновационные приложения для различных отраслей, от развлечений и игр до дизайна интерьеров и каталогов недвижимости, а также виртуальных музеев и иммерсивной виртуальной реальности.

Внедрение LDM3D и DepthFusion прокладывает путь к дальнейшему развитию генеративного ИИ и компьютерного зрения. Intel продолжит исследования генеративного ИИ для расширения человеческих возможностей и создания экосистемы разработок в области ИИ с открытым исходным кодом, которая демократизирует доступ к этой технологии. LDM3D предоставляется с открытым исходным кодом через сообщество HuggingFace.

Perseverance сделал 2,5-гигапиксельный снимок — фото Марса с такой детализацией ещё не было

Американское космическое агентство NASA опубликовало самый детализированный снимок Марса за всю историю. Разрешение панорамного фото составило 2,5 гигапикселя — на нём запечатлены марсианский грунт, камни, скалы, небо и следы ровера Perseverance, с помощью которого и было получено изображение.

 Источник изображения: nasa.gov

Источник изображения: nasa.gov

Снимок был сделан в кратере Езеро, и специалисты NASA опубликовали краткий видеообзор подробнейшей марсианской панорамы, а член исследовательской группы Рэйчел Кроняк (Rachel Kronyak) в комментариях познакомила зрителей с достопримечательностями дельты реки, которая предположительно протекала здесь в древние времена. Госпожа Кроняк рассказала об осадочных породах, скалах, утёсах, показала следы марсохода и места забора проб.

Предыдущий рекорд по разрешению панорамного снимка поставил марсоход Curiosity в 2020 году — он получил 1,8-гигапиксельное изображение кратера Гейла. Новое 2,5-гигапиксельное фото было составлено из 1118 отдельных изображений, полученных системой камер Mastcam-Z, которые установлены на «голове» Perseverance. Снимки делались в период с 12 по 20 июня. Полная версия снимка имеет размер 3,85 Гбайт — скачать его с сайта NASA может любой желающий.

Дельта древней реки имеет большое значение для науки: специалисты NASA надеются, что Perseverance поможет ответить на вопрос, была ли когда-нибудь на Марсе жизнь, хотя бы микроорганизмы. Здесь аппарат собирает образцы, которые впоследствии будут доставлены на Землю для изучения.

window-new
Soft
Hard
Тренды 🔥
Paradox перенесла на неопределённый срок симулятор жизни Life by You от команды ветерана The Sims, но игроки даже рады 22 мин.
Кибершпионаж на дне океана: США заподозрили Китай в краже данных через морские интернет-кабели 2 ч.
«Пять лет разработки пролетели как один миг»: стратегия Songs of Conquest в духе «Героев Меча и Магии» попрощалась с ранним доступом и взяла курс на консоли 2 ч.
Microsoft представила Recall — функцию записи всех действий пользователя в Windows 11 2 ч.
Флибустьеры поневоле: в 2024 году почти три четверти российских игроков оказались пиратами 4 ч.
«Образ Джокера на Железном троне останется со мной навсегда»: релизный трейлер MultiVersus взбудоражил фанатов перед воскрешением игры 5 ч.
Подписка требует жертв: инсайдеры предупредили о подорожании Game Pass из-за Call of Duty 6 ч.
OpenAI отключила в ChatGPT голос Sky в из-за удивительного сходства с голосом Скарлетт Йоханссон 6 ч.
Google обвинила Microsoft в неспособности защитить клиентов от кибератак 6 ч.
Опубликованы первые тесты видеокарт в бенчмарке 3DMark Steel Nomad, который выйдет завтра 7 ч.
Microsoft анонсировала планшет Surface Pro с Arm-процессоом Snapdragon X и множеством ИИ-функций 10 мин.
Intel рассказала, насколько процессоры Lunar Lake будут быстрее конкурентов 45 мин.
Antec выпустит портативную приставку Core HS — это переименованная и подешевевшая AyaNeo Slide 2 ч.
Microsoft отказалась от AI PС и представила Copilot Plus PC — ИИ-ноутбуки будущего 3 ч.
NASA доставит на Марс европейский ровер «Розалинд Франклин» вместо «Роскосмоса» 4 ч.
FPGA с HBM2e: AMD без лишнего шума выпустила ускоритель Alveo V80 стоимостью всего $9,5 тыс. 5 ч.
Asus выпустила первый в мире WOLED-монитор с глянцевым экраном без бликов — 26,5-дюймовый ROG Strix OLED XG27AQDMG 5 ч.
HMD Global готовит смартфон с дизайном легендарного Nokia Lumia 920 5 ч.
В погоне за ИИ: большинство строящихся в Северной Америке ЦОД арендуют ещё до того, как они готовы, несмотря на рост цен 6 ч.
Глава Asus: эволюция ИИ ПК пойдёт сложным путём 7 ч.