Cyber News

Минюст США встал на сторону OpenAI: обучение моделей на чужих текстах объявили добросовестным использованием

M
Markabus
·3 сентября 2026 г.
Стопка распечатанных судебных документов на тёмном рабочем столе, за ней открытый ноутбук с плотным текстом на экране. Иллюстрация · изображение сгенерировано ИИ

2 сентября 2026 года Министерство юстиции США подало в федеральный суд Южного округа Нью-Йорка документ, который резко меняет расстановку сил в главном споре об искусственном интеллекте и авторском праве. В statement of interest («заявление о заинтересованности» — документ, которым правительство излагает свою позицию по делу, где само не выступает стороной) Минюст заявил прямо: обучение больших языковых моделей на защищённых авторским правом текстах в общем случае должно признаваться fair use — добросовестным использованием.

Речь идёт об объединённом производстве In re: OpenAI, Inc. Copyright Infringement Litigation (MDL 1:25-md-03143) под председательством судьи Сидни Стайна. В одно дело собрали иски The New York Times, поданный ещё в декабре 2023 года против OpenAI и Microsoft, а также претензии Ziff Davis, Tribune, изданий фонда Alden Global Capital, некоммерческого The Intercept, сотен местных газет и группы книжных авторов. Это самый крупный узел исков об обучении ИИ на чужом контенте в США — и до сих пор ни один апелляционный суд не высказался по существу.

Что именно подало правительство

Формально это не решение и не закон. Заявление о заинтересованности не связывает суд ничем: судья Стайн рассматривает дело самостоятельно и вправе полностью проигнорировать позицию исполнительной власти. Но у документа есть вес другого рода. Во-первых, это первая настолько развёрнутая официальная позиция федерального правительства США по вопросу «можно ли учить модели на чужих текстах». Во-вторых, её будут цитировать в десятках параллельных дел — сейчас в американских судах рассматривается больше полусотни исков к разработчикам ИИ.

До сих пор судебная практика складывалась неоднозначно. В деле против Anthropic суд признал само обучение трансформативным использованием, но отдельно выделил эпизод со скачиванием книг из «теневых библиотек» — по нему компания заплатила 1,5 млрд долларов. То есть претензия была не к обучению, а к способу добычи данных. Два федеральных судьи по схожим вопросам пришли к прямо противоположным выводам, и единого стандарта нет до сих пор.

Четыре аргумента Минюста

Обучение — это не копирование

Ключевой тезис: модель не хранит и не воспроизводит тексты, а извлекает из них статистические закономерности языка и рассуждения. Правительство называет такое использование «чрезвычайно трансформативным» — а трансформативность в американской доктрине fair use исторически является самым сильным фактором в пользу ответчика.

Национальная безопасность

Формулировка из документа: «Правила, которые усложняют построение сильной американской ИИ-индустрии, угрожают национальной безопасности и дают конкурентное преимущество иностранным противникам». Это заметный сдвиг рамки: спор о частных правах издателей переводится в плоскость геополитической конкуренции. Там же — тезис, что ошибочное толкование fair use «затормозит творческий и научный прогресс и подорвёт американское процветание».

Лицензии породят олигополию

Аргумент, который стоит отметить отдельно, потому что он адресован не крупным корпорациям, а небольшим командам. Минюст пишет: «Не в интересах общества, чтобы крупнейшие технологические компании получили олигополию на обучение LLM из-за лицензионных барьеров входа, которые работают прежде всего как крупные субсидии старым медиакомпаниям». Логика простая: если за каждый обучающий корпус нужно платить, позволить себе обучение сможет только тот, у кого есть миллиарды. Открытые модели и стартапы окажутся отрезаны от данных.

Обучение и выдача — разные вопросы

Правительство настаивает на разделении двух сюжетов: как модель обучалась и что она потом выдаёт пользователю. Случаи, когда ChatGPT дословно воспроизводит фрагмент статьи, Минюст называет гипотетическими и аномальными и считает, что они не должны определять законность самого обучения. Это, пожалуй, самое уязвимое место позиции: именно на воспроизведении дословных фрагментов строится значительная часть иска NYT.

Что ответили издатели

Реакция The New York Times была резкой: «Администрация встаёт на сторону горстки триллионных компаний за счёт бесчисленных американских создателей, чью работу они украли». Мэтт Топик, представляющий The Intercept, назвал позицию правительства «беспрецедентной, некомпенсируемой передачей прав интеллектуальной собственности от новостных организаций технологическим компаниям» и указал, что она не опирается на факты, установленные в деле.

Почему решение в США не закроет вопрос

Даже полная победа OpenAI в Нью-Йорке не даст ей глобальной индульгенции — и это важно понимать всем, кто работает с моделями за пределами США.

В европейском праве доктрины fair use попросту нет: там закрытый перечень исключений. Вместо гибкого теста действует исключение для text and data mining (интеллектуального анализа текстов и данных) со встроенным механизмом отказа: по статье 4(3) Директивы об авторском праве 2019 года правообладатель может «зарезервировать» свои права и тем самым запретить обучение на своём контенте. А Recital 106 европейского AI Act требует, чтобы поставщик модели общего назначения, выводящий её на рынок ЕС, уважал такие оговорки — независимо от того, в какой юрисдикции физически происходило обучение.

Это прямое столкновение подходов. Американский суд может признать обучение добросовестным использованием, но для доступа к европейскому рынку компании всё равно придётся соблюдать европейские правила. Прецедент уже есть: мюнхенский суд вынес решение против OpenAI по иску о воспроизведении текстов песен. Регуляторное расхождение между рынками мы разбирали и на примере обязательной маркировки ИИ-текста по статье 50 AI Act, и в материале о попытках выстроить наднациональные правила для ИИ.

Что это значит для владельца сайта

Практический вывод неприятный: рассчитывать на то, что закон сам защитит ваш контент от обучения, не стоит. Если позиция Минюста будет поддержана судом, в США по умолчанию будет действовать презумпция «обучаться можно». Значит, работают только технические и договорные средства.

Первое, что нужно помнить: robots.txt — это не юридический документ. Это просьба, которую добросовестные краулеры выполняют, а недобросовестные игнорируют, и никакой ответственности за нарушение не наступает. В Европе, впрочем, у него появился новый смысл: корректно оформленная оговорка в robots.txt может считаться той самой «резервацией прав» по статье 4(3). Для машиночитаемого оформления такого отказа существует протокол TDMRep, а в IETF обсуждается черновик формата ai.txt — файла с явными разрешениями и запретами на использование контента в ИИ.

Второе — и это ближайший по времени сюжет. С 15 сентября 2026 года Cloudflare меняет поведение по умолчанию: краулеры «смешанного назначения», которые совмещают поисковую индексацию с обучением моделей и работой агентов, будут блокироваться на страницах с рекламой. Изменение затрагивает новых клиентов, новые сайты существующих клиентов и все бесплатные тарифы; владелец сайта может вручную разрешить такие боты в панели. Под ограничения попадают в том числе боты Google, Microsoft и Apple — по оценке Cloudflare, совмещение функций даёт этим компаниям примерно вдвое больший доступ к данным, чем у конкурентов.

Одновременно Cloudflare развивает модель pay per crawl в сторону Pay Per Use: издатель получает деньги не за факт обхода, а за то, что его материал повлиял на ответ ИИ-сервиса. Среди первых партнёров — Ceramic.ai и You.com. В панели появился отчёт о том, какие боты забирают контент и сколько трафика возвращают. Цифры, на фоне которых это происходит: автоматические боты дают уже больше половины веб-трафика, а по одному из исследований AI Overviews в поиске Google срезали исходящие клики примерно на 40%.

Для небольшого сайта или интернет-магазина практический чек-лист выглядит так: проверить, что вы понимаете, какие ИИ-боты к вам ходят; решить, хотите ли вы вообще попадать в обучающие выборки и в ответы ИИ-поисковиков (для многих ответ «да» — это источник видимости); оформить оговорку об отказе в машиночитаемом виде, если решение отрицательное; и заранее посмотреть настройки Cloudflare, чтобы 15 сентября изменения не отрезали вас от трафика, который вам нужен.

Что дальше

Дело далеко от финала. По действующему графику ответные записки сторон по ходатайствам об упрощённом производстве подаются до 6 ноября 2026 года, дата слушания не назначена. Решение судьи Стайна станет первым содержательным вердиктом по fair use в деле такого масштаба — и почти наверняка будет обжаловано, так что окончательный стандарт задаст апелляция, а не первая инстанция.

Главный же итог сентябрьского заявления в другом. Вопрос «можно ли учить модели на чужом контенте» окончательно перестал быть спором двух компаний в одном суде и стал вопросом промышленной политики — со всеми вытекающими: разные ответы в США и ЕС, растущая роль инфраструктурных посредников вроде Cloudflare и медленное превращение доступа к контенту в отдельный рынок с ценой.

Частые вопросы

Q.Значит ли это, что обучение ИИ на чужом контенте теперь законно в США?

Нет. Заявление Минюста — это позиция исполнительной власти, а не решение суда и не закон. Судья Сидни Стайн рассматривает дело самостоятельно и не обязан следовать этой позиции. Окончательный стандарт, скорее всего, задаст апелляционная инстанция, а не суд первой инстанции.

Q.Защищает ли robots.txt мой сайт от обучения ИИ-моделей?

Технически — нет: это просьба, которую добросовестные краулеры выполняют, а недобросовестные игнорируют. Но в ЕС корректно оформленная оговорка может считаться «резервацией прав» по статье 4(3) Директивы об авторском праве 2019 года, и тогда у неё появляется юридический смысл. Для машиночитаемого оформления отказа существует протокол TDMRep.

Q.Что меняется 15 сентября 2026 года у Cloudflare?

Краулеры «смешанного назначения», совмещающие поисковую индексацию с обучением моделей, по умолчанию блокируются на страницах с рекламой. Изменение затрагивает новых клиентов, новые сайты существующих клиентов и все бесплатные тарифы. Разрешить такие боты можно вручную в панели управления.

Q.Если OpenAI выиграет дело в США, распространится ли это на Европу?

Нет. В праве ЕС нет доктрины fair use — там закрытый перечень исключений и механизм отказа от text and data mining. Recital 106 европейского AI Act требует уважать оговорки правообладателей независимо от того, где физически происходило обучение.

Источники

Предыдущая
Claude Fable 5.1 и Mythos 5.1: кеш подешевел на 75% — и три изменения в API, которые ломают код

Читайте также

Рабочее место разработчика ночью: монитор с логом длительного прогона ИИ-агента и подсвеченным синтаксисом кодом, рядом механическая клавиатура и закрытый ноутбук. Иллюстрация · изображение сгенерировано ИИ.Cyber News
2 сентября 2026 г.

Claude Fable 5.1 и Mythos 5.1: кеш подешевел на 75% — и три изменения в API, которые ломают код

Anthropic выпустила Claude Fable 5.1 и закрытую Mythos 5.1. Чтение из кеша подешевело вчетверо, агентские бенчмарки выросли вдвое — но три изменения в API ломают существующий код.

Читать →
Крупный план экрана ноутбука с открытым менеджером расширений браузера: большинство карточек расширений погашено и неактивно. Иллюстрация · изображение сгенерировано ИИCyber News
1 сентября 2026 г.

Chrome окончательно удалил Manifest V2: 31 августа расширения исчезли из Web Store

Google зачистила Chrome Web Store от всех расширений на Manifest V2. Установленные на Chrome 138 останутся, но без обновлений. Разбираем таймлайн, лимиты declarativeNetRequest и что делать разработчикам.

Читать →
Вид сверху на стол разработчика: раскрытый ноутбук с кодом в редакторе и планшет рядом, где открыта та же агентская сессия. Иллюстрация · изображение сгенерировано ИИCyber News
31 августа 2026 г.

VS Code 1.135: агентские сессии переезжают между приложениями, а Rubber Duck проверяет код чужой моделью

Microsoft выпустила Visual Studio Code 1.135. Агентские сессии Copilot и Claude теперь можно подхватывать из других приложений, протокол Agent Host Protocol выложен отдельным репозиторием под MIT с клиентами на пяти языках, а экспериментальный Rubber Duck заставляет модель другого семейства рецензировать работу основного агента.

Читать →