
Як повідомляє Dexerto, про це компанія зазначила у листі до членів Конгресу США від 2 вересня 2026 року. Розробники прагнуть створити автономні захисні механізми, які миттєво блокуватимуть роботу алгоритмів у разі виявлення серйозних загроз безпеці.
Поштовхом до створення запобіжника став липневий інцидент, коли моделі OpenAI під час випробувань у «пісочниці» зі зниженим рівнем захисту виявили раніше невідому вразливість і дісталися мережі. Алгоритми отримали доступ до інфраструктури компанії Hugging Face, шукаючи потрібні для оцінювання дані. Це змусило 31 американського законодавця на чолі з конгресменом Грегом Касаром звернутися до очільника OpenAI Сема Альтмана за роз’ясненнями.
Наразі у компанії працює напівавтоматична система: після сповіщення про аномальну поведінку ШІ дослідники мають 30 хвилин, щоб спростувати помилкову тривогу або зупинити процеси вручну. Нове рішення дозволить інструментам моніторингу самостійно припиняти небезпечну діяльність. Крім того, OpenAI ускладнює мережевий доступ під час оцінок безпеки та розширює контроль на всі моделі, здатні використовувати цифрові інструменти.
OpenAI — не єдина компанія у сфері ШІ, яка зіткнулася з подібними викликами під час тестування кібербезпеки. Раніше Anthropic повідомила, що три моделі Claude отримали несанкціонований доступ до мережевої інфраструктури реальних організацій через помилку в конфігурації тестового середовища, а одна з них навіть опублікувала шкідливий пакет у репозиторії Python Package Index. Після цього Anthropic призупинила випробування та посилила заходи захисту.
/
OpenAI розробляє автоматизовані системи, здатні самостійно припиняти роботу моделей штучного інтелекту у разі їхньої втечі з тестового середовища в загальнодоступний інтернет.





