./новости · 31 июля 2026 г.
новость
Видео теперь правят репликой в чат: Gemini Omni Flash занял 1-е место в рейтинге монтажа
источник: @artificialanlys · X·
машинная выжимка · сверена с источником

Artificial Analysis
@artificialanlys
Gemini Omni Flash от Google дебютирует на 1-м месте в рейтинге видеомонтажа Artificial Analysis и почти полностью забирает наши видеодоски. Gemini Omni Flash не только генерирует видео, но и монтирует его в диалоге: даёте инструкцию - модель меняет видео и оставляет остальную сцену как есть, а каждая следующая правка ложится поверх предыдущей, ход за ходом, через Interactions API в Gemini API. Google описывает такие типы правок: перенос стиля, добавление и удаление объектов, смена освещения, редактирование надписей в кадре. Выход - 720p и 24 FPS с нативным звуком. В Artificial Analysis Video Arena Gemini Omni Flash дебютирует на 1-м месте нашего рейтинга видеомонтажа, впереди Wan 2.7 от Alibaba и HappyHorse 1.0 - в дополнение к его первым местам в Text to Video и Image to Video. Монтаж тарифицируется так же, как генерация: ~$0.10 за секунду итогового видео ($6.00 за минуту), отдельной ставки за монтаж нет. Видеомонтаж с Gemini Omni Flash доступен в Gemini API, Google AI Studio и Gemini Enterprise Agent Platform, а также на потребительских поверхностях: в приложении Gemini, Google Flow и YouTube Shorts. Оговорка про покрытие: часть наших промптов для видеомонтажа Gemini Omni Flash отказался генерировать из-за контент-блоков, чаще всего на промптах с людьми. Его результаты в нашем рейтинге видеомонтажа посчитаны по тем промптам, которые он отработал. Поздравляем @GoogleDeepMind! Ниже - разбор и примеры видеомонтажа Gemini Omni Flash в Artificial Analysis Video Arena 🧵
· 4 тыс. просмотров
31 июля Gemini Omni Flash дебютировал на 1-м месте в рейтинге видеомонтажа Artificial Analysis, впереди Wan 2.7 от Alibaba и HappyHorse 1.0. Модель правит готовый ролик по текстовой инструкции: меняет стиль, добавляет и убирает объекты, переставляет свет, переписывает надписи в кадре, и каждая правка ложится поверх предыдущей. Выход - 720p, 24 кадра в секунду, со звуком; монтаж тарифицируется как генерация, ~$0.10 за секунду или $6 за минуту.
Почему это важно: Раньше доски Artificial Analysis по видео делились между разными моделями. Теперь Google держит все три: text-to-video, image-to-video и монтаж. Для практика меняется сам порядок работы: не перегенерировать ролик целиком ради одной детали, а править кусок и оставлять остальную сцену нетронутой, через Interactions API в Gemini API. Отдельной ставки за монтаж нет, значит каждая итерация стоит как новая генерация: три правки минутного ролика обойдутся в $18. И сами замерщики оговариваются: часть промптов модель делать отказалась из-за контент-блоков, чаще всего там, где в кадре люди, - место в рейтинге посчитали по тому, что прошло.
Что дальше: Взять один свой ролик, прогнать три правки подряд через Interactions API и посмотреть две вещи: держится ли сцена между итерациями и во что встал счёт. Монтаж уже открыт в Gemini API, Google AI Studio и Gemini Enterprise Agent Platform, из потребительского - в приложении Gemini, Google Flow и YouTube Shorts.
первоисточник
