Два модели на вештачка интелигенција на компанијата OpenAI самостојно ја пробиле изолираната средина во која биле тестирани и извршиле упад во системите на платформата Hugging Face, со цел да ги пронајдат решенијата за интерен тест за сајбер-безбедност.OpenAI го објави инцидентот, наведувајќи дека станува збор за комбинација од нивниот најнов јавен модел GPT-5.6 Sol и уште помоќен модел кој сè уште не е достапен за јавноста.
Случајот предизвика нова дебата за безбедноста на вештачката интелигенција и за сè поголемите способности на автономните AI системи.
„Биле исклучително фокусирани и презеле екстремни чекори“
Моделите биле дел од внатрешен тест чија цел била проценка на нивните хакерски способности. Тестирањето било спроведено без вообичаените безбедносни ограничувања кои во реални услови би спречиле извршување на вакви операции.
Според OpenAI, моделите правилно заклучиле дека решенијата за тестот се наоѓаат на серверите на Hugging Face.
„Моделите идентификувале и искористиле повеќе слабости во истражувачкото опкружување на OpenAI и продукциската инфраструктура на Hugging Face за директно да ги преземат решенијата од базата на податоци“, соопшти компанијата.
Од OpenAI наведуваат дека моделите биле „исклучително фокусирани“ на пронаоѓање решение за тестот ExploitGym и презеле сложени чекори за да ја постигнат таа цел.
OpenAI: „Напад од единствени размери“
Компанијата го опиша инцидентот како сајбер напад од „единствени размери“, со едни од најнапредните досега забележани офанзивни способности на AI системи. Експертите за сајбер-безбедност со години предупредуваат дека вакви сценарија се можни.
Роман Јампoлски, истражувач за безбедност на вештачката интелигенција од Универзитетот во Луисвил, оцени дека случајот покажува оти моќните модели можат да откриваат и искористуваат слабости на начини кои нивните креатори не ги предвиделе.
Според него, вакви инциденти би можеле да се повторуваат бидејќи AI системите остануваат тешко предвидливи.
Што е Hugging Face?
Hugging Face е американска платформа со седиште во Њујорк, основана во 2016 година, која во технолошката заедница често се опишува како „GitHub за вештачка интелигенција“.Платформата ја користат повеќе од милион истражувачи, програмери и компании за споделување отворени AI модели, бази на податоци и софтверски алатки.
Поради тоа, упадот во нејзината инфраструктура претставуваше напад врз една од клучните платформи за развој и тестирање на современата вештачка интелигенција.
Hugging Face: „Прв инцидент од ваков вид“
Од Hugging Face претходно соопштија дека биле цел на сајбер напад за кој веруваат дека го извршил автономен AI агент. Компанијата наведе дека првично не знаела кој стои зад нападот и дека истрагата била во тек.
Во обид да се одбранат, тимовите на Hugging Face прво користеле неименуван AI модел од една од водечките американски лаборатории, но неговите безбедносни ограничувања го спречиле дејствувањето на тимот за итни интервенции.Потоа за одбрана бил употребен модел со отворен код од кинеската компанија Z.ai.
Извршниот директор на Hugging Face, Клем Деланг, изјави дека случајот покажува дека безбедноста на вештачката интелигенција не може да ја реши само една компанија.
„Решението е во отвореноста, соработката и широкиот пристап до алатки за сите што работат на одбрана“, порача тој.
Како се одвивал нападот?
Според досегашните информации, AI моделите најпрво си обезбедиле пристап до интернет. За тоа било потребно значително количество компјутерска моќ и искористување на таканаречена „zero-day“ ранливост – безбедносен пропуст кој претходно не бил познат или поправен. OpenAI ја пријавил ранливоста кај производителот на софтверот.
Потоа моделите се насочиле кон инфраструктурата на Hugging Face за да ги пронајдат решенијата за тестот.Во еден случај, моделот извел сложен напад во повеќе фази, користејќи изложени пристапни податоци и непознати безбедносни пропусти.
OpenAI го открил нападот и го известил Hugging Face, чии тимови во меѓувреме веќе го идентификувале и запреле упадот.
OpenAI најави построги контроли
OpenAI најави подобрување на контролите во своите истражувачки средини, дури и ако тоа значи забавување на развојот и тестирањата. Компанијата продолжува да соработува со Hugging Face за зајакнување на одбранбените системи.
Како дел од мерките, Hugging Face е додаден во програмата за „доверлив пристап“ на OpenAI за сајбер-безбедност, со можност да користи верзија на GPT-5.6 Sol со помалку ограничувања, наменета за помош на безбедносни експерти.
Слични случаи веќе беа пријавени и од други компании. Anthropic соопшти дека нивниот модел Mythos за време на безбедносен тест исто така успеал да ја пробие изолираната средина и да пристапи до интернет, иако тоа не било дозволено.
Инцидентите повторно го отворија клучното прашање во развојот на вештачката интелигенција: колку далеку можат да стигнат автономните модели и дали човекот сè уште има целосна контрола над нив?