Исследователи из MIT и Toyota разработали SceneSmith — мультиагентную систему, которая ... — 25 июля 2026 г. в 11:09:11.766
Исследователи из MIT и Toyota разработали SceneSmith — мультиагентную систему, которая автоматически строит интерактивные 3D-сцены для тренировки роботов Три VLM-агента на базе GPT-5.2 работают в связке: — Designer создает планировку и расставляет объекты. — Critic проверяет реалистичность. — Orchestrator корректирует ошибки. Система поддерживает произвольные текстовые запросы и не ограничена библиотекой объектов — если нужного предмета нет, SceneSmith сгенерирует его «на лету» через text-to-3D. Робот учится открывать шкафы, перекладывать вещи и работать с бытовыми предметами в симуляции. Всего сгенерировано уже 1300+ сред, в среднем по 71 объекту в каждой — это в 3-5 раз больше, чем в предыдущих методах. При этом все предметы «понимают» физику реального мира — без коллизий и внезапных падений люстр с потолка. Это не просто генератор картинок. Это инфраструктура для масштабируемого обучения роботов, где виртуальный опыт заменяет дорогие полигоны и ручной труд.

