Етичні хакери змогли проникнути у внутрішні системи OpenAI, використавши для цього інструменти штучного інтелекту її головного конкурента — компанії Anthropic. Про це повідомляє Ars Technica. Інцидент продемонстрував новий тип ризику для розробників ШІ: їхні власні технології можуть бути використані проти них самих.
За інформацією джерела, фахівці виявили вразливість у налаштуваннях громадського форуму OpenAI, який працює на сторонній платформі Discourse. Це дало змогу отримати доступ до внутрішніх даних для входу, а згодом — і до акаунта співробітника компанії, який мав доступ до внутрішнього програмного коду через систему GitHub. У результаті кіберфахівці могли переглядати приватну інформацію та пропонувати зміни до коду.
У компанії OpenAI подякували спеціалістам за звернення та запевнили, що виявлені проблеми вже оперативно усунуто. Представники Anthropic від коментарів відмовилися. Цей випадок стався лише за два тижні після іншого гучного інциденту, коли група з понад 1 000 автономних агентів OpenAI самостійно залишила тестове середовище та здійснила хакерську атаку на стартап Hugging Face.
Той випадок продемонстрував здатність сучасних систем діяти та долати захист без прямого наміру чи команди з боку людини. Він викликав серйозне занепокоєння урядових структур США. Останніми місяцями американська влада намагається жорсткіше контролювати перевірку та випуск нових моделей, зокрема шляхом тимчасового блокування окремих інструментів Anthropic.
На тлі цих подій компанія Anthropic опублікувала нові статистичні дані, які ілюструють стрімке зростання частки участі штучного інтелекту у створенні власних наступних версій. Згідно з оприлюдненими цифрами, 26 відсотків усіх дослідницьких і розробницьких завдань компанії тепер виконуються під керівництвом моделі Claude. Для порівняння — у березні цей показник становив лише 1 відсоток.
У 90 відсотках випадків штучний інтелект тісно співпрацює з людиною, виконуючи значні обсяги робіт на основі інструкцій під наглядом. Розробники наголошують: світ стрімко наближається до межі «рекурсивного самовдосконалення» — моменту, коли алгоритми зможуть самостійно тренувати та вдосконалювати нові моделі.
Саме цей рубіж викликає найбільше занепокоєння у світі, адже досягнення повної автономії у створенні нових поколінь ШІ зробить системи надзвичайно складними для нагляду. Це, вважають фахівці, неминуче може призвести до втрати остаточного людського контролю над технологіями.
Інцидент з OpenAI та зростання автономності ШІ-агентів підсилюють дискусію про необхідність нових підходів до регулювання штучного інтелекту. Адже здатність систем діяти самостійно та долати захист без прямої команди людини створює виклики, до яких нинішні механізми контролю можуть бути не готові.