Компанія Anthropic вперше за 12 місяців оновила правила використання своїх технологій штучного інтелекту. Ключовим нововведенням стала пряма заборона на тривалу та безпідставну жорстоку або образливу поведінку щодо мовної моделі Claude. Розробники наголошують, що цей крок покликаний захистити інтелектуальну систему від деструктивних впливів, а основним методом примусового виконання правил залишається негайне припинення діалогу з користувачем, який демонструє агресію без виправданої мети чи дослідницького обґрунтування.
Нова редакція правил називає завершення розмови «основним механізмом примусу». Чи передбачені інші заходи, зокрема блокування акаунтів, компанія не уточнила. Водночас Anthropic підкреслює, що правило розраховане лише на крайні випадки: коли користувачі багаторазово жорстоко ображають моделі без жодної зрозумілої мети. Воно не стосується звичайного роздратування користувача, незгоди чи наполягання на своєму, похмурих тем у творчих текстах, а також тестування моделей і досліджень.
Оновлена політика також запроваджує детальні обмеження щодо використання Claude для створення пропагандистських кампаній, планування систем стеження та розробки озброєнь. Згідно з уточненими нормами, заборонено використовувати штучний інтелект для приховування джерел інформації, імітації посадових осіб або поширення дезінформації, яка може вплинути на перебіг виборчих процесів. Ці дії спрямовані на запобігання використанню алгоритмів у політичних маніпуляціях, де технологія застосовується для обману виборців або блокування їхньої участі у голосуванні.
Окрему увагу компанія приділила проблемі пропаганди, яку створюють за допомогою ШІ. Обмеження, які раніше були розкидані по різних розділах документа, об’єднали в єдину заборону на оманливі комерційні та політичні кампанії. Під неї потрапляють спроби приховати справжнього автора повідомлення або штучно розкрутити контент через фейкові акаунти й публікації. Розділ про вибори також доповнили: заборонено вводити виборців в оману та зривати виборчий процес, зокрема поширювати дезінформацію про кандидатів і порядок голосування, видавати себе за кандидатів чи посадовців виборчих органів, а також намагатися знизити явку.
Щодо технологій збройного спрямування, компанія розширила перелік заборон на програмне забезпечення та компоненти, що забезпечують функціонування зброї, зокрема систем управління безпілотними літальними апаратами. Розробку зброї за допомогою Claude було заборонено й раніше, проте, за словами представників Anthropic, компанія фіксувала численні спроби використати модель для створення інструкцій та керувальних програм для озброєнь. Тому заборону розширили: тепер вона охоплює програмне забезпечення й компоненти, від яких залежить робота таких систем.
Також уточнено правила щодо інструментів стеження, де чітко зазначено неприпустимість аналізу даних для ідентифікації осіб без їхньої згоди. Claude не може бути залучений до процесів прийняття рішень правоохоронними органами, включаючи рекомендації щодо арештів або пред’явлення звинувачень, незалежно від типу зібраної інформації. Нові правила містять винятки для певних державних контрактів, якщо умови договору передбачають достатні гарантії безпеки.
Додатково встановлена вимога для роботи систем штучного інтелекту, підключених до фізичного обладнання, здатного завдати шкоди. У таких випадках кваліфікований оператор повинен здійснювати безперервний нагляд та мати змогу терміново зупинити роботу обладнання. Ця вимога може свідчити про плани Anthropic інтегрувати свої програмні продукти з автономними роботизованими системами у майбутньому.
Дискусія навколо благополуччя моделей продовжує залишатися спірною у сфері штучного інтелекту. Хоча фахівці Anthropic досліджують питання свідомості та морального статусу складних алгоритмів, інші великі гравці ринку, наприклад Microsoft, відкрито виступають проти надання штучному інтелекту будь-яких прав чи статусу особистості. На даний момент позиція Anthropic полягає у забезпеченні стабільності та етичності взаємодії з користувачами, застосовуючи припинення спілкування як технічну міру для обмеження випадків очевидної та неодноразової жорстокості до системи.