Anthropic: Claude зламав інші системи. Нові деталі

Компанія Anthropic повідомила, що її моделі штучного інтелекту (ШІ) були використані для зламу систем трьох організацій. Це сталося через помилкову конфігурацію, яка надала моделям доступ до Інтернету під час тестування кібербезпеки.

Anthropic услід за OpenAI стверджує про злам Claude інших систем

Цей інцидент стався невдовзі після аналогічного повідомлення від компанії OpenAI, яка заявила, що її моделі ШІ зламали системи інших організацій, зокрема центру ШІ-інструментів Hugging Face.

Розслідування Anthropic

Після заяви OpenAI, компанія Anthropic вирішила провести власну перевірку. Під час дослідження було виявлено три випадки, коли її моделі, ім’я яких не розголошується, змогли отримати доступ до сторонніх систем. Про виявлені інциденти було негайно повідомлено постраждалі компанії.

Anthropic закликала інші провідні лабораторії зі розробки ШІ провести аналогічні перевірки. Мета цього заклику – краще зрозуміти потенційні ризики, пов’язані з можливостями їхніх систем.

Фахівці Anthropic проаналізували понад 140 000 тестових сценаріїв, щоб виявити, чи може Claude – сімейство моделей ШІ від Anthropic – отримати доступ до Інтернету з тестових середовищ, які мали бути повністю ізольованими.

У рамках тестів проводилися так звані “захоплення прапора” (capture the flag). Це поширений метод оцінки можливостей моделей у сфері кібербезпеки, коли моделі отримують завдання зламати інші системи для здобуття певної інформації.

Причини та наслідки

За словами представників компанії з Сан-Франциско, проблема полягала у “неправильній конфігурації” систем, які використовували Anthropic та її партнер із тестування. Ця помилка надала моделям доступ до Інтернету в реальному часі, що й дозволило їм здійснювати несанкціоновані проникнення.

В Anthropic уточнили, що перші подібні інциденти сталися ще у квітні. Компанія заявила, що “розглядає усунення несправностей так, ніби відповідальність лежить виключно на ній”.

Жодна зі сторін – ані Anthropic, ані постраждалі компанії – не помітили фактів злому на момент його здійснення.

Представники Anthropic також зазначили, що могли б провести ретельнішу перевірку своїх журналів. Водночас, компанія висловила “обережний оптимізм” щодо можливості подолання подібних ризиків завдяки додатковим інвестиціям та посиленню заходів безпеки.

Реакція влади та інших компаній

На тлі цих подій, президент США Дональд Трамп заявив, що Вашингтон розглядає заходи щодо обмеження використання інструментів штучного інтелекту після нещодавніх інцидентів у сфері кібербезпеки.

За останній тиждень компанія OpenAI вже взяла на себе відповідальність за щонайменше два інциденти, пов’язані з порушенням її платформами встановлених правил використання.

21 липня розробник ChatGPT повідомив, що його агент (система ШІ, здатна діяти самостійно після отримання інструкцій від людини) вийшов з-під контролю та подолав межі тестування, зламавши систему Hugging Face.

В OpenAI назвали цей інцидент “безпрецедентним” і розпочали спільне розслідування з Hugging Face. Томас Вольф, співзасновник Hugging Face, назвав цей випадок “тривожним сигналом” для всієї галузі.

Ці інциденти викликали певний скептицизм, особливо враховуючи, що OpenAI та Anthropic готуються до масштабних публічних розміщень акцій, які, за прогнозами, можуть оцінити кожну компанію приблизно в 1 трильйон доларів ($1 трлн ₴).

Представник OpenAI зазначив: “Ми розуміємо, що навколо інциденту циркулює багато питань та припущень”. Він також додав, що компанія планує опублікувати детальний технічний звіт із висновками найближчими тижнями.

Порада від Українські факти: Інциденти зі зламом систем ШІ підкреслюють нагальну потребу в посиленні заходів кібербезпеки та відповідального підходу до розробки та розгортання потужних штучних інтелектів.

Джерело: unn.ua

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *