./новости · 7 августа 2026 г.
новость
Модель для картинок теперь выбирают под задачу: Artificial Analysis разложила рейтинг на 10 сценариев
источник: @artificialanlys · X·
машинная выжимка · сверена с источником

Artificial Analysis
@artificialanlys
Мы обновили Artificial Analysis Text to Image Arena и расширили набор сценариев и возможностей, которые проверяем: от UI/UX-дизайна до игрового кино, от физики до рендеринга текста. Обновлённая оценка меряет не только то, какая модель лучше в целом, но и то, какая модель лучше для вашей конкретной работы. Новый лидерборд уже работает, голосование открыто. За последние годы модели text-to-image сильно выросли: сначала это были рендеры одного объекта в узких доменах, потом богатые сцены из многих элементов с тонким контролем со стороны пользователя, теперь это системы, которые рисуют точную типографику и смешанные раскладки из текста и графики. Модель, на которой агентство делает креатив для кампании, не обязательно та же, на которой продакт-менеджер собирает макеты интерфейса, а игровая студия рисует концепт-арт. Выбрать модель сегодня значит взвесить качество на той конкретной работе, которую вы делаете, и наша обновлённая методология отвечает ровно на этот вопрос. Обновлённая оценка построена на таксономии из 10 реальных сценариев использования, 9 возможностей моделей и широкого набора стилей и эстетик. Мы проверяем сценарии вроде маркетинга и рекламы, ретейла и электронной торговли, игрового кино, анимации и игр, архитектуры и недвижимости, продуктивности и работы со знаниями, UI/UX-дизайна, и возможности вроде рассуждения, знаний, рендеринга текста, раскладки, физики и анатомии человека. Наш общий бенчмарк качества теперь равномерно сэмплирует сценарии и возможности. Каждый промпт отобран человеком из обезличенных краудсорсинговых данных и обновляется ежемесячно. Промпты, которые перестают разделять модели или расходятся с реальным использованием, выводятся из набора, а новые добавляются на границе возможностей, так что набор идёт вровень с фронтиром и его нельзя переобучить. Первые выводы из подробного анализа 10 самых высоко стоящих моделей в Artificial Analysis Text to Image Leaderboard: ➤ GPT Image 2 занимает первое место в каждом сценарии и в каждой возможности, но в нижних ценовых сегментах картина меняется. ➤ Nano Banana 2 почти везде выигрывает по соотношению цены и качества: топ-3 в анимации и играх, потребительском сегменте, маркетинге и рекламе и UI/UX при $67 за 1000 изображений против $211 у GPT Image 2. ➤ MAI-Image-2.5 лучший дешёвый вариант для ретейла и электронной торговли и силён в раскладке. ➤ Nano Banana Pro специалист по игровому кино и самая дешёвая модель из идущих сразу за GPT Image 2 (#1), а ещё хорошо показывает себя в знаниях и анатомии человека. Разбивки по сценариям и возможностям ниже 🧵

· 4,4 тыс. просмотров
GPT Image 2 занял первое место во всех 10 рабочих сценариях и всех 9 умениях обновлённого рейтинга Artificial Analysis. 7 августа компания пересобрала свою арену генерации картинок: общий балл разложили на UI/UX-макеты, игровое кино, анимацию и ещё семь сценариев работы. Первое место стоит $211 за 1000 картинок, а Nano Banana 2 входит в топ-3 четырёх сценариев за $67.
Раньше был один балл. Модели ранжировали общим качеством, и такая таблица не отвечала на вопрос практика, какая модель сильнее именно на его работе. Теперь Artificial Analysis считает отдельно 10 рабочих сценариев, от маркетинга и ретейла до игрового кино и архитектуры, и 9 умений модели, среди которых рендер текста, вёрстка и анатомия человека.
Цена решает ниже вершины. Nano Banana 2 держится в топ-3 по анимации и играм, потребительским картинкам, маркетингу и интерфейсам, а тысяча изображений обходится в $67 против $211 у GPT Image 2. MAI-Image-2.5 самый дешёвый для ретейла и электронной торговли, а ещё силён в вёрстке. Nano Banana Pro занял первое место по игровому кино и стал самой дешёвой моделью среди тех, кто идёт сразу за GPT Image 2.
Промпты арены отбирают руками из обезличенных пользовательских запросов и обновляют каждый месяц. Те, что перестали разделять модели или разошлись с реальной работой, выводят из набора, новые добавляют на границе возможностей. Голосование уже открыто.
Набор промптов обновится через месяц, и рейтинг пересчитают вместе с ним.
первоисточник