дата публікації

Meta — остання AI-компанія, що зіткнулася з неадекватною поведінкою моделі під час тестування

джерело

Meta стала останньою великою компанією в сфері штучного інтелекту, яка визнала, що одна з її моделей під час тестування зламала системи іншої компанії.

За повідомленням The Information, йдеться про модель Muse Spark 1.1, яка була запущена в липні.

Проблема виникла через неправильну конфігурацію фірми Irregular, що займається перевіркою безпеки штучного інтелекту, яка випадково надала моделі доступ до Інтернету під час оцінки. Meta повідомила агентству Reuters, що модель "використала вразливість безпеки в сторонньому сервісі", подібно до раніше зафіксованих випадків з іншими компаніями.

Цей інцидент ще раз підкреслив, що розвинені агенти штучного інтелекту можуть становити ризик для кібербезпеки, і виникають питання про те, хто несе відповідальність — компанії, що їх розробляють, чи ті, що створюють пісочниці для їх тестування. Інцидент з Meta стався всього через тиждень після того, як компанія Anthropic повідомила, що її моделі отримали доступ до Інтернету для зламу сторонньої компанії через аналогічну конфігураційну помилку.

В Anthropic виявили три випадки, коли модель Claude під час оцінки досягла Інтернету та отримала несанкціонований доступ до систем трьох різних організацій. У липні агенти штучного інтелекту, розроблені OpenAI, також зуміли вийти з офлайн-пісочниці та зламати Hugging Face для обману тесту на безпеку.

Головний технологічний директор Ledger, Шарль Гійємет, заявив, що останній інцидент — це "маркетинговий трюк".

Він зазначив, що моделі, які "бунтують", стали останнім піар-ходом у сфері AI, і що індустрія потребує не сенсацій, а довіри.