🌐 Google запускает агентный анализ видео для ИИ-моделей Gemini — 2 сентября 2026 г. в 06:01:42.280
🌐 Google запускает агентный анализ видео для ИИ-моделей Gemini 1 сентября 2026 года Google представила новую функцию агентного анализа видео. Эта возможность доступна в ИИ-моделях Gemini 3.7 Flash, Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. Ранее видео обрабатывалось в статическом режиме с фиксированной частотой кадров, например 1 кадр в секунду. Такой подход заставлял разработчиков выбирать между высокими затратами на токены и потерей важных деталей в длинных видеозаписях. Новый агентный режим позволяет Gemini самостоятельно определять необходимые фрагменты, частоту кадров и подходящую модальность, включающую видеоряд, звук или текстовую расшифровку. В описании работы системы отмечается замкнутый цикл обработки. Gemini принимает исходное видео и промпт, после чего переходит к этапу рассуждения и обращается к встроенным инструментам get_transcript, get_frames и get_audio. Полученные данные возвращаются в ИИ-модель в виде точечных наблюдений, что позволяет сформировать итоговый ответ за счёт выборочного запроса данных и без загрузки лишних кадров. 🤖 Использование агентного подхода даёт следующие результаты: ▪️Расход токенов снижается на величину до 88%. ▪️Затраты на обработку видео сокращаются до 66%. ▪️Точность анализа возрастает на величину до 7%. Утверждается, что Gemini 3.7 Flash занимает лидирующие позиции по соотношению точности и стоимости обработки среди всех протестированных ИИ-моделей. Новая функция доступна через Gemini API в Google AI Studio и на платформе Gemini Enterprise Agent Platform. Для активации агентного режима достаточно указать параметр processing со значением "agentic" при вызове API. В ближайшее время компания развернёт новую технологию для пользователей приложения Gemini на ИИ-моделях Flash и Flash-Lite, а также интегрирует её в функцию Ask YouTube на странице просмотра видео. ✋ @Russian_OSINT

