AMD предложила генерировать глобальное освещение одношаговой диффузионной моделью

Исследователи AMD представили нейросетевой метод генерации непрямого освещения с учётом геометрии, материалов и предыдущих кадров. Прототип сохраняет стабильность изображения при движении, но на GeForce RTX 3090 пока выдаёт лишь около 3,45 кадра/с при разрешении 512 × 512 пикселей.

Исследователи AMD описали метод Temporally Stable Generative Illumination with a One-Step Diffusion Model. Он рассматривает экранную аппроксимацию глобального освещения (global illumination, GI) как задачу условной генерации изображений. Речь идёт не о полной замене трассировки лучей, а о генерации непрямого освещения, включая мягкие тени и свет, отражённый от окружающих поверхностей.

Прямое освещение, результат модели AMD и эталонное глобальное освещение

В основе метода лежит одношаговая латентная диффузионная модель. Она получает кадр с прямым освещением, а также данные о нормалях, альбедо, шероховатости и металлических свойствах материалов. Временной декодер вариационного автоэнкодера (TVAE) использует векторы движения и результат обработки предыдущего кадра, чтобы подавлять мерцание и сохранять геометрию сцены.

Схема генерации глобального освещения моделью AMD

Модель обучили на 31 тыс. кадров интерьерных сцен, созданных в Blender Cycles. Сцены содержали от одного до 30 источников света и движущиеся объекты. По оценке AMD, метод лучше нескольких сравниваемых подходов сохраняет структуру изображения и показывает более высокие результаты по метрикам PSNR, SSIM, LPIPS и временной стабильности.

Обработка кадра размером 512 × 512 пикселей на GeForce RTX 3090 занимает около 0,29 секунды, или примерно 3,45 кадра/с, и требует 8–9 Гбайт видеопамяти. Поскольку это время относится только к этапу глобального освещения, пока технология остаётся исследовательским прототипом, а не готовым компонентом игрового рендеринга. Работа подготовлена для конференции ECCV 2026.

Источник: gpuopen.com

Связь с редакцией