Эксперт объяснил, почему ИИ не может обучаться на закрытом контенте

Искусственный интеллект не способен обучаться на материалах, которые доступны только по платной подписке или закрыты от обычных пользователей, сообщил РИА Новости амбассадор интернет-площадок в «Поиске Яндекса» Михаил Сливинский.
По его словам, у ИИ-систем нет какого-то особого доступа к сайтам: поисковый робот и чат-бот получают информацию в интернете одинаковым способом — отправляют запрос серверу и видят только те данные, которые сервер сам решает вернуть.
Эксперт пояснил, что если полный текст статьи, книги или другого материала доступен лишь авторизованным подписчикам, то робот увидит ровно столько же, сколько и пользователь без авторизации.
При этом он отметил, что ограничения доступа бывают разными. Важно отличать настоящий технический пейволл, где открытой остается только часть текста, от визуальной заглушки, которая не является полноценной защитой.
В первом случае сервер сначала проверяет наличие подписки и только потом принимает решение, отправлять ли полный текст. Если подписки нет, материал вообще не покидает сервер.
Во втором случае сайт сначала передает текст целиком, а затем в браузере закрывает его, например, всплывающим окном с предложением войти в личный кабинет, которое можно просто закрыть. В такой ситуации данные уже были переданы пользователю — независимо от того, человек это или автоматизированная система, подчеркнул Сливинский.
Он подвел итог, что корректно настроенную серверную защиту нейросеть не сможет обойти в рамках обычного сбора данных для обучения.
Источник и фото - ria.ru





