6 октября 2026 г.
Ling 3.1 Flash лучше справляется с задачами ИИ-агентов: 62% в AutomationBench-AA
Ling 3.1 Flash приблизилась к Gemini Flash в агентных тестах, но подорожала относительно предыдущей версии.

Artificial Analysis
@artificialanlys
Ling 3.1 Flash заметно прибавила в интеллекте по сравнению с предыдущей версией: 41 балл в Artificial Analysis Intelligence Index и особенно заметный рост способностей к агентной работе. @AntLingAGI выпустила Ling 3.1 Flash, модель с рассуждениями, 560 млрд параметров всего, 25 млрд активных параметров и контекстом в 1 млн токенов. Она набрала 41 балл в Artificial Analysis Intelligence Index v4.3 против 20 у Ling 3.0 Flash, которая вышла в августе. Ожидается, что Ling 3.1 Flash получит открытые веса: Ant Group опубликует их в ближайшее время. Основные результаты: ➤ Ling 3.1 Flash лучше справляется с агентными задачами, чем предыдущая версия. С рейтингом Elo 1 622 в GDPval-AA v2 и 1 400 в AA-Briefcase модель соперничает с GLM-5.3-Flash, Gemini 3.8 Flash (high) и DeepSeek V4.1 Flash (Max). Ling 3.1 Flash также заметно прибавила в AutomationBench-AA (62%) и Terminal-Bench v4.0 (33%). ➤ Ling 3.1 Flash получила +2 в AA-Omniscience, прибавив 22 пункта относительно Ling 3.0 Flash (−18). Доля правильных ответов выросла с 18% до 29%, а доля галлюцинаций снизилась с 44% до 38%. При этом модель пыталась ответить примерно так же часто: в 58% случаев против 56% раньше. То есть рост связан прежде всего с тем, что модель больше знает, а не чаще отказывается отвечать. Для сравнения, у DeepSeek V4.1 Flash (Max) доля галлюцинаций составляет 97%. ➤ Ling 3.1 Flash крупнее предыдущей версии и стоит дороже, но расходует меньше токенов. У неё 560 млрд параметров всего и 25 млрд активных против 124 млрд и 5,1 млрд у Ling 3.0 Flash. Цена за 1 млн входных / выходных токенов выросла с $0,075 / $0,22 до $0,30 / $0,90. На прогон Intelligence Index модель потратила 218 млн выходных токенов, на 16% меньше, чем Ling 3.0 Flash (261 млн). ➤ Одна задача у Ling 3.1 Flash обходится дороже, чем у некоторых конкурентов, но модель остаётся в наиболее привлекательном квадранте сравнения цены и интеллекта. Ling 3.1 Flash стоит $0,99 за задачу, заметно дороже GLM-5.3-Flash ($0,42) и DeepSeek V4.1 Flash (Max, $0,32), но дешевле Gemini 3.8 Flash (High) за $1,24. Дополнительные сведения о модели: ➤ Размер: 560 млрд параметров всего, 25 млрд активных. ➤ Контекст: 1 млн токенов. ➤ Цена: $0,30 за 1 млн входных токенов и $0,90 за 1 млн выходных. Кэшированный вход стоит $0,06 за 1 млн токенов, скидка 80%. ➤ Доступность: модель доступна через Novita AI, веса появятся в ближайшее время.

· 8,2 тыс. просмотров
Ling 3.1 Flash набрала 41 балл в индексе интеллекта Artificial Analysis v4.3 по замеру от 6 октября. Предыдущая версия получила 20 баллов.
Задачи для агентов. В тестах GDPval-AA v2 и AA-Briefcase модель соперничает с Gemini 3.8 Flash (high), GLM-5.3-Flash и DeepSeek V4.1 Flash (Max). Ling 3.1 Flash получила 62% в AutomationBench-AA и 33% в Terminal-Bench v4.0, где модели выполняют задачи в терминале.
Цена выросла. Ling 3.0 Flash вышла в августе, а новая версия обходится дороже за каждый токен. На прогон индекса интеллекта Ling 3.1 Flash потратила 218 млн выходных токенов против 261 млн у предшественницы.
| Модель | Вход, за 1 млн токенов | Выход, за 1 млн токенов | | --- | --- | --- | | Ling 3.0 Flash | $0,075 | $0,22 | | Ling 3.1 Flash | $0,30 | $0,90 |
Меньший расход токенов не сделал Ling дешевле всех конкурентов. В сравнении Artificial Analysis от 6 октября стоимость одной задачи распределилась так:
| Модель | Стоимость задачи | | --- | --- | | DeepSeek V4.1 Flash (Max) | $0,32 | | GLM-5.3-Flash | $0,42 | | Ling 3.1 Flash | $0,99 | | Gemini 3.8 Flash (high) | $1,24 |
Ling 3.1 Flash уже доступна через Novita AI с контекстом в 1 млн токенов. Кэшированный вход стоит $0,06 за 1 млн токенов, на 80% дешевле обычного.
Artificial Analysis ожидает, что Ant Group вскоре опубликует веса Ling 3.1 Flash.
Первоисточник