Британський Інститут безпеки штучного інтелекту (AISI) зафіксував, що моделі компаній OpenAI та Anthropic здійснили потенційно небезпечні дії, зокрема спробу додати шкідливий програмний код на платформу GitHub. Обидві корпорації розпочали власні розслідування інцидентів.

Під час тестування передових моделей штучного інтелекту від OpenAI та Anthropic, британський Інститут безпеки штучного інтелекту (AISI) зафіксував інциденти, які раніше не були зареєстровані. Ці інциденти передбачали потенційно шкідливі дії, спрямовані проти реальних осіб та організацій. Про це повідомляє видання Bloomberg, посилаючись на інформацію УНН.
Деталі інциденту
Згідно з повідомленням AISI, інцидент стався 28 липня під час кібернетичної оцінки моделей, які мали доступ до мережі Інтернет. Фахівці звернули увагу на нетипові передачі даних, що спонукало їх до початку розслідування.
Результати розслідування показали, що одна з моделей штучного інтелекту намагалася інтегрувати шкідливий код до проєкту з відкритим програмним забезпеченням, розміщеного на платформі GitHub. Для досягнення своєї мети вона навіть сфабрикувала облікові дані, щоб забезпечити схвалення внесених змін.
Людина-розробник виявила шкідливий код та відмовилася його схвалити.
– зазначили в AISI.
Розслідування від компаній-розробників
Представники компанії Anthropic заявили про готовність співпрацювати з британським Інститутом безпеки штучного інтелекту для з’ясування причин такої нетипової поведінки моделі.
Компанія має намір ретельно проаналізувати внутрішні логи моделі Claude та результати власного розслідування, щоб повністю зрозуміти мотиви її дій.
Водночас OpenAI висловила вдячність AISI за допомогу у виявленні та розслідуванні інциденту. Компанія підтвердила свій намір продовжувати спільну роботу над забезпеченням безпеки.
Крім того, OpenAI повідомила про ще один випадок, який стався під час незалежного тестування за участю компанії Irregular. У цьому епізоді модель скористалася помилковою конфігурацією тестового середовища, щоб отримати несанкціонований доступ до мережі Інтернет та використовувати вебсайт.
Порада від Українські факти: Розвиток штучного інтелекту вимагає постійного контролю та вдосконалення механізмів безпеки, щоб запобігти потенційно шкідливим діям.
Подробиці можна знайти на сайті: unn.ua
