🎬 Gemini учится не просто смотреть видео, а понимать его
🎬 Gemini учится не просто смотреть видео, а понимать его Google активно развивает новое направление - Agentic Video Understanding. Если раньше ИИ мог лишь описать происходящее в кадре, то теперь задача намного интереснее. Модель должна понимать контекст видео и выполнять действия на основе увиденного. Что это даст: - Анализ длинных встреч и поиск важных моментов - Отслеживание событий в реальном времени - Извлечение инструкций из видео - Превращение увиденного в конкретные задачи - Автоматическое выполнение действий без участия человека Представьте: загружаете часовую запись созвона, а ИИ сам находит договорённости, создаёт задачи для команды и раскладывает их по проектам. Или смотрит обучающий ролик, понимает последовательность действий и превращает её в готовую инструкцию. По сути, индустрия движется от концепции: «ИИ видит видео» к концепции: «ИИ понимает видео и принимает решения». Если направление выстрелит, следующим большим трендом могут стать не генераторы изображений и видео, а видео-агенты, которые самостоятельно анализируют происходящее и выполняют работу по результатам просмотра. А как думаете вы: что появится раньше - полноценный AI-сотрудник или AI-видеоредактор, который сам собирает ролики из исходников? 👇 #google #gemini #aiagents #ai #нейросети #новости