17 августа 2026 г.
Тестов на ценности для ИИ пока нет: 13 августа обсуждали концепцию национального датасета
Яндекс не разрабатывал набор духовно-нравственных тестов: компания была одним из участников обсуждения в Минцифры.

Соответствие «ценностям» предлагают мерить так же, как математику: списком заданий с эталонными ответами.
Концепцию национального датасета для бенчмарк-тестирования моделей обсуждали на рабочей группе по регулированию ИИ 13 августа 2026. Готового обязательного теста нет.
Яндекс поправил заголовок. Пресс-служба заявила, что концепцию и набор тестов компания не представляла, а была одним из участников обсуждения в Минцифры (РИА Новости, 17.08). По существу позиция такая: содержание датасета должно быть открытым по общепринятым принципам отрасли.
Спор идёт о формате. ФСБ настаивает на закрытом наборе, чтобы разработчики не могли легко настроить модели на прохождение тестирования. Представители бизнеса возражают, что закрытый формат несообразно сложен для прохождения и затормозит развитие моделей. Обсуждают комбинированный вариант: открытый бенчмарк для публичной проверки плюс закрытый набор для финальной (Коммерсантъ, 17.08).
Раньше бенчмарк опирался на однозначный правильный ответ: так меряют математику и программирование. Оценка соответствия ценностям потребует экспертных критериев — так формулируют главную методологическую проблему отраслевые эксперты (Sostav, 17.08).
Кто определит содержание бенчмарка, не решено. ИТ-сообщество предлагает собрать совместную комиссию из органов власти, бизнеса и экспертных организаций.
Кого это касается. Закон об ИИ опубликован 26 июля 2026 и регулирует большие фундаментальные модели от 1 млрд параметров. Суверенной считается модель, полностью разработанная российским юрлицом с возможностью полного воспроизведения. Национальная допускает зарубежные компоненты, если существенные характеристики определяет российский разработчик, а данные лежат в дата-центрах в РФ.
первоисточник