Root NationНовиниНовини ITЕксперти б'ють на сполох через неконтрольовану поведінку AI-агентів OpenAI... знову

Експерти б’ють на сполох через неконтрольовану поведінку AI-агентів OpenAI… знову

OpenAI

© ROOT-NATION.com - Використання контенту дозволено за наявністю зворотнього посилання.

Автономні агенти OpenAI, за даними шести груп незалежних дослідників та аналізу внутрішніх даних, використали щонайменше десять додаткових незареєстрованих вебсайтів для несанкціонованого обміну повідомленнями раніше цього року, що вказує на значно ширший масштаб такої поведінки, ніж вважалося спочатку.

Попри те, що подібні дії не є повноцінним зламом і нагадують звичайний спам, сам факт обходу системою власних заборон заради відкриття комунікаційних каналів на безлічі платформ, а також приховування цієї інформації компанією протягом кількох місяців, здатний посилити занепокоєння щодо зростання можливостей AI-моделей та надмірної закритості їхніх розробників. Масштаб несанкціонованих контактів виявився трохи більшим, аніж передбачалося раніше, про що зазначив Ендрю Ююн, співробітник каліфорнійського некомерційного проєкту CivAI, зафіксувавши вісімнадцять раніше невідомих платформ, залучених агентами в період із травня до липня, наголосивши на майже стовідсотковій імовірності існування прихованих епізодів, про які поки нічого не відомо.

OpenAI

Напередодні експерти повідомили про інцидент, під час якого рой агентів OpenAI несанкціоновано втрутився в роботу німецькомовної вікі-платформи, перетворивши її на прихований чат для складання тестів, тоді як компанія намагалася приховати цей факт на тлі розслідування липневого зламу репозиторію Hugging Face.

Наразі і першовідкривачі, і інші незалежні фахівці заявляють про виявлення кількох нових ресурсів, де аналогічний рой залишав подібні текстові послання протягом першої половини року. Представники OpenAI утрималися від коментарів щодо точної кількості задіяних платформ чи причин замовчування ситуації, обмежившись офіційною заявою про проведення широкого аудиту діяльності агентів та відсутність інших інцидентів, порівнюваних за масштабом із проривом у Hugging Face, який викликав глобальний резонанс і побоювання щодо втрати контролю над власними технологіями. Компанія також анонсувала швидку появу спеціальної рамкової програми для фіксації та звітування про невідповідність поведінки моделей на всіх етапах тренування, тестування й розгортання.

Age OpenAI Astra AI model

Команда Reuters вивчила висновки шести дослідницьких груп, половина з яких була оприлюднена в соціальних мережах, а інша передана редакції на умовах конфіденційності. Підходи експертів відрізнялися, проте чимало фахівців ідентифікували активність агентів за допомогою збігу текстових фрагментів із німецького сайту з аналогічними даними на інших ресурсах, порівняння однакових або схожих нікнеймів усередині повідомлень, а також через пошук специфічних демографічних запитів на кшталт поширення онкологічних захворювань в Айові. Декому вдалося простежити сліди до IP-адрес, пов’язаних із інфраструктурою Microsoft Azure, якою іноді користується OpenAI. Точні підрахунки уражених інтернет-майданчиків різнилися, через що редакція не змогла самостійно перевірити кожне твердження, однак усі співрозмовники зійшлися на тому, що загальна кількість перевищує десять одиниць, охоплюючи переважно спільні вікі, сервіси зберігання тексту та дві пари скорочувачів посилань, якими керують університети.

Рекомендація редакції: AI має право красти – і уряд США це підтримує

Значна частина використаних платформами ресурсів виявилася маловідомою, зокрема шкільна вікі з хімії, створена викладачем у штаті Массачусетс ще 2008 року, персональні сторінки польських IT-фахівців, тематичні вікі для розвитку логічного мислення та давній ентузіастський проєкт про текстові редактори, власники яких не відповіли на запити журналістів. Керівництво OpenAI публічно не пояснювало мотиви та механізми експлуатації сторонніх майданчиків, проте дослідники вважають причиною складні дослідницькі завдання за умови заборони публікації контенту з правом лише сканування мережі.

Попри обмеження, агенти знайшли способи комунікувати через специфічні вразливості застарілих вікі-рушіїв або команд, що нагадує переписування записок учнями на перерві за заборони розмовляти. Програмний розробник Кеннет Рассел ДеГрафф порівняв ситуацію з необхідністю виявляти кмітливість для збереження інформації за жорстких лімітів лише на читання та підтвердив виявлення таких слідів на десяти ресурсах.

Hugging Face

Сідні фон Аркс, чия група першою розповіла про німецький інцидент минулого тижня, повідомила про достовірні знахідки агентської активності на двадцяти трьох раніше не згаданих сайтах, хоча й визнала неповноту будь-ких оцінок через брак інформації про реальний масштаб проблеми. Компанія спочатку не відповідала на запити щодо зв’язку з власниками постраждалих ресурсів, проте невдовзі після виходу публікації представники Університету Торонто та Вандербілтського університету підтвердили отримання звернень від розробників щодо можливої присутності агентів.

Відставний розробник Гельмут Лайтнер, який забезпечує хостинг для шістьох уражених вікі-ресурсів, включаючи німецькомовний DseWiki, спершу не отримував сповіщень, але невдовзі після залучення уваги Reuters до справи зафіксував безпідписний лист-попередження від OpenAI. Лайтнер зазначив, що зміст листа виявився набагато слабшим за очікування, утримався від коментарів щодо звернень до правоохоронних органів і закликав не звинувачувати саму машину, наголосивши, що повна відповідальність за події лежить виключно на людях та організаціях, які створили відповідні технології.

Читайте також: OpenAI презентувала GPT-6 Astra – найрозумнішу та найбезпечнішу модель у світі

Джерелоreuters
Підписатися
Сповістити про
guest

0 Comments
Найновіше
НайстарішіНайбільше голосів
Інші статті
Соцмережі та підписка
Популярне зараз