back to top

Reddit заблокує Internet Archive

Reddit вживає заходів щодо обмеження доступу до своїх даних

Reddit повідомляє, що виявив випадки, коли компанії, що займаються штучним інтелектом, використовували дані з його платформи через Wayback Machine від Інтернет-архіву. Внаслідок цього, Reddit має намір почати блокування Інтернет-архіву від індексації більшої частини свого контенту. Wayback Machine більше не зможе сканувати сторінки деталей постів, коментарів або профілів; натомість вона зможе індексувати лише домашню сторінку Reddit.com. Це означає, що Інтернет-архів зможе лише архівувати інформацію про те, які новини та пости були найпопулярнішими у певний день.

Представник Reddit Тім Ратшмідт зазначив: “Інтернет-архів надає послуги відкритій мережі, але ми стали свідками випадків, коли компанії штучного інтелекту порушують політики платформ, у тому числі і наші, і використовують дані з Wayback Machine”.

Мета Інтернет-архіву полягає в збереженні цифрового архіву веб-сайтів в інтернеті та “інших культурних артефактів”. Wayback Machine є інструментом для перегляду сторінок так, як вони виглядали на певні дати, але Reddit вважає, що не весь його контент повинен бути заархівований. Ратшмідт переконаний: “Поки Інтернет-архів не зможе забезпечити захист свого сайту та дотримуватись політик платформ (наприклад, повага до конфіденційності користувачів, стосовно видалення контенту), ми обмежимо їх доступ до даних Reddit, щоб захистити наших користувачів”.

Обмеження почнуть “збільшуватись” вже сьогодні, і Reddit заявило, що “заздалегідь” повідомило Інтернет-архів про ці обмеження. За словами Ратшмідта, Reddit також висловлював “турботу” щодо можливості вилучення контенту з Інтернет-архіву в минулому.

В останні роки Reddit неодноразово обмежував доступ до інструментів-скреперів, оскільки компанії штучного інтелекту почали масово їх використовувати. Проте Reddit готовий надавати ці дані за умови оплати. Минулого року Reddit уклав угоду з Google щодо даних для пошуку та навчання штучного інтелекту, а декілька місяців потому почав блокувати великі пошукові системи від сканування своїх даних без оплати. Reddit також зазначив, що зміни в API, що відбулися у 2023 році, які змусили деякі сторонні програми закритися, були здійснені через зловживання цими API для навчання AI-моделей.

Reddit також уклав угоду з OpenAI, але подав позов проти Anthropic в червні, стверджуючи, що Anthropic продовжував вилучати дані з Reddit, навіть після того, як компанія запевнила, що цього не робить.

Директор Wayback Machine Марк Грехем у своїй заяві зазначив: “У нас давні стосунки з Reddit, і ми продовжуємо обговорення цього питання”.

Ще більше новин

Останні новини