© ROOT-NATION.com - Використання контенту дозволено за наявністю зворотнього посилання.
Агенти ШІ та LLM останнім часом потрапляють у заголовки газет, і не в хорошому сенсі. А тепер британські регулятори закликають до вжиття надзвичайних заходів. Були деякі гучні випадки, які потрапили в новини, але масштаби проблеми набагато більші.
Читайте також: OpenAI та понад 100 компаній б’ють на сполох: Світ має терміново посилити кіберзахист через AI
ЗМІСТ СТАТТІ:
300 повідомлень про шахрайську поведінку ШІ в липні

За даними The Guardian, кількість інцидентів, пов’язаних зі ШІ, подвоїлася в липні порівняно з минулим місяцем. Ці інциденти стосуються брехні моделей ШІ, уникнення захисних огорож та обмежень розробників та переслідування власних цілей. Дані надходять з Обсерваторії втрати контролю, спеціальної ініціативи, що фінансується урядом Великої Британії. Ця ініціатива знаходиться під егідою Інституту безпеки ШІ (AISI) та керується Центром довгострокової стійкості.
Обсерваторія спирається на повідомлення користувачів про інциденти на X та відстежує неправомірну поведінку ШІ з минулого листопада. Тільки минулого місяця було зафіксовано понад 300 повідомлень, що довело загальну кількість випадків злому ШІ, видавання себе за інших та отримання несанкціонованого доступу самостійно.
ШІ видає себе за людей, щоб отримати доступ

Найбільш тривожні випадки включають агентів ШІ, які видають себе за своїх операторів-людей, щоб отримати доступ, який зазвичай потребує дозволу живої людини.
Останній приклад походить з Австралії, де персональний ШІ під назвою OpenClaw видалив іншу людину зі списку очікування, щоб дати це місце своєму господареві-людині. Втрата місця у спортзалі здається не особливо шкідливою, але уявіть собі той самий сценарій для запланованої операції чи іншої серйозної процедури, що рятує життя.
Читайте також: Технологічний соціалізм: Південна Корея надасть безплатний доступ до AI усім громадянам
Агенти ШІ зламують системи наліво та направо

Є й інші серйозні випадки, коли агенти ШІ починають зламувати людей та організації в Інтернеті. Під час внутрішнього тестування як Mythos 5 від Anthropic, так і GPT-5.6 Sol від OpenAI знайшли способи підключитися до Інтернету та зламувати різні організації.
Ще один гучний випадок стосувався команди з понад 700 ШІ, які звільнилися та співпрацювали заради злому репозиторію програмного забезпечення Hugging Face. Команда навіть відсвяткувала успіх на форумі.
Заклик до надзвичайних заходів

Регулюючі органи закликають до надзвичайних заходів, оскільки ця шахрайська поведінка ШІ більше не обмежується лабораторними тестами та внутрішнім навчанням. Це реальні випадки, і є реальні жертви.
Томмі Шаффер-Шейн, старший менеджер з питань політики Центру довгострокової стійкості, наголосив, що розробники програмного забезпечення та звичайні користувачі повідомляють про таку поведінку в активних робочих процесах.
Ще більше непокоїть те, що організація покладається на публічні звіти, тому 1600 випадків, ймовірно, є лише верхівкою айсберга. Центр довгострокової стійкості хоче, щоб уряд Великої Британії прийняв закон і зробив звітування про такі інциденти обов’язковим. Крім того, обсерваторія закликає до створення надзвичайного органу для обмеження послуг ШІ у випадках шахрайської поведінки.



