ChatGPT и Microsoft знали о риске для веба и трафика
В новых судебных документах по иску New York Times к OpenAI и Microsoft появились внутренние оценки, где компании прямо говорят о вреде для веба и издателей. В материалах также обсуждается падение переходов на сайты и то, что ответы ИИ все чаще заменяют поиск по ссылкам.
Что выяснилось из документов
Речь идет о материалах, которые недавно были раскрыты в суде. Из них следует, что внутри OpenAI и Microsoft заранее понимали: массовое использование чужих текстов для обучения ИИ может ударить по сайтам, которые эти тексты создают и публикуют.
В документах встречаются очень жесткие формулировки. Среди них — предупреждение о «doom loop» для веба, оценка сбора данных как крупнейшего присвоения результатов человеческого труда и мнение, что защита такого подхода делает понятие fair use почти бессмысленным.
Почему это важно для издателей и авторов
Особенно заметны слова, связанные с поиском и трафиком. Внутренние материалы Microsoft признают, что чатботы меняют поведение пользователей: люди получают ответ сразу и меньше переходят на исходные сайты. Для новостных и медиа-проектов это означает риск потери аудитории и доходов.
В документах OpenAI также упоминается, что ChatGPT может воспроизводить защищенные материалы почти дословно. Там же есть признание, что GPT-4 запоминала много данных и поэтому способна очень точно их повторять. Для редакций, блогов и всех, кто публикует полезный контент, это прямой сигнал: их тексты могут использоваться как сырье, но не обязательно приводить к новым визитам на сайт.
Что это меняет для обычных пользователей и бизнеса
Для читателя вывод простой: ИИ-ответы становятся удобной заменой поиску, но за кулисами это меняет экономику всего интернета. Если меньше людей кликают по ссылкам, у сайтов становится меньше мотивации создавать подробные материалы, а у компаний — меньше причин инвестировать в контент.
Для бизнеса это еще и напоминание, что ИИ-сервисы стоит использовать аккуратно. Если вы строите маркетинг, обучение или поддержку клиентов на чужом контенте, важно понимать, откуда берутся данные, есть ли лицензии и не исчезнет ли у вас трафик, который раньше приходил из поиска. Похожие задачи — быстрое резюме материалов, ответы клиентам, черновики текстов — можно решать с ИИ, но лучше держать под контролем источники и права на данные.