Wireva

Автор скрипта, який зібрав дані з анти-AI-застосунку Cara, передумав і видалив датасет

Користувач Reddit, який зібрав увесь контент фотографічного застосунку Cara в датасет для навчання ШІ, змінив рішення після критики спільноти та видалив зібрані дані.

Історія навколо застосунку Cara, створеного фотографами як захист від використання їхніх робіт для навчання штучного інтелекту, отримала несподіване продовження. Користувач Reddit, який минулого тижня зібрав увесь контент платформи в датасет для тренування ШІ-моделей, передумав і видалив зібрані дані. Це сталося після того, як історія набула розголосу в професійній спільноті.

Минулого тижня PetaPixel повідомила, що Cara, яка позиціонує себе як платформа, що забороняє використання опублікованих робіт для навчання нейромереж, зазнала повного скрапінгу. Увесь обсяг опублікованого контенту був зібраний стороннім користувачем у єдиний набір даних, попри те, що платформа прямо не надавала згоди на таку практику. Цей випадок викликав широке обговорення в спільноті фотографів та розробників.

Після публікації матеріалу та хвилі критики автор скрипта переглянув свою позицію. Він видалив датасет із відкритого доступу та заявив, що не планує використовувати зібрані дані. У своєму повідомленні він пояснив, що спочатку не вважав свої дії порушенням, оскільки технічно контент був доступний публічно, однак після пояснень щодо політики платформи та етичних аспектів використання робіт фотографів він вирішив відмовитися від своєї ініціативи.

Ситуація навколо Cara є показовою для ширшої дискусії про межі використання публічного контенту для навчання штучного інтелекту. Платформа була створена як альтернатива великим соціальним мережам, які часто використовують завантажені користувачами зображення для тренування власних алгоритмів без явної згоди авторів. Cara натомість пропонує фотографам простір, де вони можуть публікувати роботи, знаючи, що вони не стануть частиною навчальних вибірок для генеративних моделей.

Інцидент із скрапінгом показав, що навіть спеціалізовані платформи не захищені від автоматизованого збору даних, якщо контент технічно доступний через відкриті вебсторінки. Водночас реакція спільноти та рішення автора скрипта видалити датасет свідчать про зростання чутливості до питань авторських прав у контексті розвитку штучного інтелекту.

Розробники Cara поки що не коментували, чи планують вони впроваджувати додаткові технічні заходи для запобігання подібним інцидентам у майбутньому. Однак сам факт того, що історія завершилася видаленням даних, дає підстави говорити про те, що тиск професійної спільноти може бути ефективним інструментом у захисті прав фотографів.