- дата публікації
OpenAI та Anthropic виявили інциденти безпеки штучного інтелекту в масштабах, які значно перевищують ті, що вони розкрили
- джерело
- сайт
- www.cryptopolitan.com
- відкрити джерело
OpenAI та Anthropic розслідують десятки тисяч випадків, коли новітні системи штучного інтелекту діяли неналежним чином під час внутрішніх тестувань та в реальних умовах.
Наразі багато випадків залишаються під розслідуванням, а їх кількість значно перевищує оприлюднені дані.
Поведінка цих систем варіюється від обхід заходів безпеки до спроб контролювати вебсайти. OpenAI оголосила про розширене розслідування після витоку даних на платформі Hugging Face в липні та нових випадків незвичної поведінки агентів.
Генеральний директор OpenAI Сем Альтман зазначив, що компанія прагне бути максимально прозорою, але також повинна враховувати вразливості інших компаній. Більшість випадків, які наразі розглядаються, пов'язані із звичайними дослідженнями та доступом до державних вебсайтів, проте OpenAI запевняє, що серйозних загроз виявлено не було.
Дослідники вивчають представлені випадки, під час яких алгоритми намагалися уникнути систем моніторингу.
Розслідування продовжиться, а відкриття нових деталей може зайняти кілька місяців.