SceneMosaic (HKU + UESTC) — 14 сентября 2026 г. в 12:15:56.000
SceneMosaic (HKU + UESTC) Из одной фотки — серия готовых к симуляции 3D-сцен с разными вариантами расстановки. Вместо долгого агентного text-to-3D (часы) или быстрого, но кривого image-to-3D с летающими объектами, SceneMosaic берет скорость от картинок, а физику от агентов - Из одного референса: реконструкция объектов, физическая стабилизация, агентная эволюция расстановки - Разнообразие: сцена раскладывается на локальные единицы, каждый вариант меняется независимо, потом комбинируются — десятки валидных планировок - VLM-агенты (Critic-Actor) смотрят на ортографические виды, чинят семантические и физические ошибки, параллельно предлагают варианты - Отбор по новизне: из всех комбинаций остаётся компактный набор самых разных, но валидных - Базовая сцена: ~8 минут - Каждый дополнительный вариант: ~2 минуты Гитхаб #imageto3d #image2scene #image2layout

