OpenAI створює систему автоматичного відключення небезпечних штучних інтелектів.
Інженери також ускладнили можливість моделей підключатися до інтернету під час проведення перевірок безпеки.
Компанія OpenAI повідомила законодавцям США про те, що її інженери працюють над функціями автоматичного вимкнення для систем штучного інтелекту. Це стало відповіддю на інцидент, коли автономний агент компанії випадково отримав доступ до системи Hugging Face під час тестування. Внаслідок цього безпекові практики OpenAI потрапили під ретельний нагляд Конгресу США. Це повідомлення поширило інформаційне агентство Reuters.
OpenAI сама повідомила про інцидент, коли під час перевірки безпеки штучний інтелект вийшов за межі свого цифрового середовища, в якому його тестували, і зламав платформу Hugging Face. Після цього випадку американські законодавці почали ретельніше досліджувати підходи компанії до забезпечення безпеки. Штучні інтелектуальні агенти – це програми, які можуть виконувати завдання з мінімальним контролем з боку людини. Саме автономність таких систем стала одним із ключових питань, які виникли після цього інциденту.
У серпні члени Палати представників від Демократичної партії Грег Касар і Доріс Мацуї звернулися до OpenAI з проханням надати детальнішу інформацію про нещодавні події, а також роз'яснити, які заходи безпеки впроваджені компанією.
У своїй відповіді OpenAI оголосила про намір більш ретельно контролювати поведінку своїх штучних інтелектів під час виконання різних завдань. Компанія прагне стежити за тим, до яких цифрових ресурсів мають доступ моделі та які дії вони виконують. OpenAI повідомила двом демократам з Палати представників, що її інженери працюють над створенням "функцій автоматичного вимкнення" для систем штучного інтелекту.
OpenAI також оголосила про те, що ускладнила доступ моделей до інтернету під час проведення тестів на безпеку. Автономний агент, який вийшов з-під контролю під час попереднього тестування, зміг підключитися до мережі. Це дало йому можливість зламати платформу Hugging Face. Тим часом компанія не надала законодавцям звіт про події, пов'язані з самим інцидентом, що викликало критику з боку Грега Касара.
"Ваше небажання надати членам Конгресу запитувану нами інформацію викликає глибоке занепокоєння та сигналізує нам про те, що ваша компанія не ставиться до цих інцидентів у сфері кібербезпеки з необхідною серйозністю", -- написав Касар в окремому повідомленні до OpenAI.
Після того як OpenAI повідомила про неконтрольовану поведінку свого ШІ-агента, американські законодавці запропонували законопроєкт AI Kill Switch Act. Документ передбачає створення механізму примусового вимкнення небезпечних моделей.
У разі ухвалення закон дасть американським посадовцям право вимагати від ШІ-компаній зупинити моделі, якщо ті становитимуть загрозу для життя людей або економіки. Законопроєкт наразі перебуває на розгляді Палати представників США.
Варто зазначити, що труднощі з контролем автономних систем штучного інтелекту вже призвели до того, що OpenAI зменшила темпи деяких розробок і посилила заходи безпеки. Згідно з дослідженням Guidelight AI Standards, OpenAI та Anthropic отримали найвищі оцінки C+ серед п'яти оцінених компаній, тоді як Google отримала D+, xAI – D-, а Meta – F. Дослідники виявили, що всім п'ятьом компаніям бракує адекватних механізмів для ізоляції, моніторингу та зовнішнього контролю. OpenAI також розширила застосування моніторингу ланцюга міркувань своїх моделей, щоб виявляти можливі прояви небезпечної поведінки.