2 сентября 2026 г.
Минюст США поддержал OpenAI в деле NYT: обучение моделей на чужих текстах назвал fair use
20 страниц поданы 1 сентября 2026: обязательной силы у записки нет, но позиция правительства теперь лежит в деле.
Минюст США просит суд отклонить саму идею, что обучение моделей на защищённых текстах нарушает копирайт.
Записка на 20 страницах легла в консолидированное дело о копирайте против OpenAI в федеральном суде Нью-Йорка. В нём решается, на каких текстах законно учить большие модели.
Что просят у суда. Обучение на защищённых текстах правительство называет преобразующим использованием, а такое использование закон США относит к fair use. Подача идёт по 28 U.S.C. § 517: разрешения суда она не требует и обязательной силы для судьи не имеет.
Fair use — американское исключение из копирайта. Чужой материал можно взять без спроса, если результат меняет его назначение.
Вход и выход разведены. По позиции Минюста, NYT оспаривает только то, на чём модель училась, а не то, что она выдаёт в ответах. Отдельные ответы преобразующими могут и не быть, оценивать их правительство предлагает по одному. Защита в записке накрывает тренировку, а не любой вывод модели.
Обязательное лицензирование данных правительство отвергает: платить за корпуса смогут только крупнейшие компании, а сборы, по записке, достанутся прежде всего старым медиа. Публике не нужна «олигополия на обучение LLM» из-за входного барьера, говорится в подаче. Реализуем ли платный режим на практике, Минюст позиции не занимает.
Раньше в деле спорили двое. Теперь рядом с ответчиком лежит позиция правительства, и NYT ответила, что администрация встала на сторону горстки триллионных ИИ-компаний за счёт американских авторов, «чью работу они украли».
Цифры спора. 3 сентября 2026 OpenAI, Microsoft и пять групп издателей подали ходатайства о summary judgment. Истцы насчитали 10,8 млн скопированных статей, из них 6 030 928 принадлежат NYT. OpenAI отвечает, что по расчётам самих экспертов истцов в обучении использовано 6,3 млн.
Главное число защиты OpenAI: дословное воспроизведение статей нашлось в 24 случаях на выборке из 20 млн чат-логов, то есть в 0,00012% разговоров.
Истцы отвечают данными Cloudflare: краулер OpenAI обходит сайты 1500 раз на один переход к издателю, у Google это 18 к 1.
Дата суда присяжных не назначена, следующая веха — ответ судьи на сентябрьские ходатайства о summary judgment.
Первоисточник