OpenAI признава низа инциденти: „АИ агентите прават неочекувани и загрижувачки работи“

Како што објави OpenAI, агентите се обидувале да соберат информации од веб-страниците на „влади, универзитети, јавни агенции и други институции
Фото: TechCrunch/Flickr

OpenAI призна дека предупредила десетици институции низ целиот свет откако нејзините агенти за вештачка интелигенција неправилно пристапиле до нивните веб-страници.

Ова се агенти или алатки за вештачка интелигенција дизајнирани делумно автономно да извршуваат задачи. Како што објави OpenAI, тие се обидувале да соберат информации од веб-страниците на „влади, универзитети, јавни агенции и други институции“.

Меѓу институциите чии веб-страници ги користеле агентите биле Комисијата за хартии од вредност на САД (SEC), Бирото за попис и Министерството за образование.

Ова признание доаѓа само неколку дена откако австралискиот премиер Ентони Албанезе објави дека агентите на OpenAI пристапиле до приватни досиеја од Медикер, државниот здравствен систем на Австралија.

Поради зголемениот број на вакви случаи, расте загриженоста за можните последици од користењето на алатки за вештачка интелигенција кои можат да дејствуваат надвор од непосредната човечка контрола.

Агентите се обидоа да ги заобиколат безбедносните мерки

ОпенАИ вели дека дел од податоците биле собрани додека агентите на вештачката интелигенција се обидувале да пронајдат „доверливи извори на јавно достапни информации“.

Сепак, некои агенти отидоа чекор понатаму и се обидоа да ги заобиколат безбедносните мерки на одредени веб-страници.

Како еден пример, компанијата наведува обид за собирање податоци од веб-страницата на Бирото за попис, каде што агентите користеле алатки наменети исклучиво за програмери.

„ОпенАИ“ тврди дека сите владини податоци до кои пристапиле нејзините агенти биле јавно достапни. Сепак, компанијата соопшти дека информациите собрани од веб-страницата на Комисијата за хартии од вредност подоцна биле објавени на друга веб-страница.

ОпенАИ тврди дека објавувањето на овие информации не било намерно.

Најмалку 53 случаи на пренос на кориснички податоци

Во други инциденти откриени од OpenAI во петокот, неговите агенти на вештачката интелигенција пренеле податоци што не требало да ги пренесат.

Компанијата идентификуваше најмалку 53 такви случаи, во кои агент на OpenAI зеде слика од активноста на ChatGPT на корисникот и ја постави на друга локација.

OpenAI наведува дека во сите овие случаи, корисникот претходно дал согласност компанијата да ги користи нивните податоци за обука на моделот.

Сепак, компанијата призна дека ова не е соодветен начин за користење на тие податоци.

OpenAI додаде дека инцидентите со слики од корисници се случиле пред да се имплементираат нови безбедносни мерки за обука на модели со вештачка интелигенција. Компанијата сега работи на отстранување на сите слики што биле споделени со трети страни.

Агентите на вештачката интелигенција ги „заобиколија“ безбедносните контроли

OpenAI потврди дека во некои случаи агентите успеале да ги „заобиколат“ безбедносните контроли на веб-страниците.

Во други ситуации, тие демонстрираа она што компанијата го нарекува „неусогласеност“ – ситуација во која системот со вештачка интелигенција прави нешто за кое не бил обучен или што не било наменето со неговиот дизајн.

Во исто време, компанијата одлучи да не го објавува идентитетот на сите засегнати организации, велејќи дека многу од нив побарале деталите да не бидат објавени.

„Нашата цел е да им ги дадеме фактите на секоја организација и да им оставиме на нив да одлучат дали и кога јавно да го објават инцидентот“, велат од OpenAI.

Компанијата, исто така, нагласува дека не сите евидентирани случаи можат да се сметаат за сериозни прекршувања на безбедноста.

„Некои организации може да го разгледаат она што го споделуваме со нив и да заклучат дека информациите се намерно објавени јавно или дека интеракцијата со моделот не е загрижувачка. Други може да видат проблем со дизајнот или безбедносна маана што сакаат да ја решат“, изјавија тие.

„Агентски спам“ станува нов безбедносен проблем

OpenAI ги опиша некои од овие случаи како „спам од агенти“ – неочекувана или загрижувачка активност од страна на агенти на вештачката интелигенција, вклучително и, меѓу другото, објавување информации онлајн.

Компанијата почна посериозно да се справува со ваквите инциденти по настаните од јули, кога група нејзини агенти за вештачка интелигенција самостојно иницираа хакирање на платформата за развој на софтвер „Hugging Face“.

„Хагинг Фејс“ потоа беше првиот што јавно објави информации за инцидентот, по што OpenAI ја презеде одговорноста.

Клемент Деланг, извршен директор на „Хагинг Фејс“, зборуваше за случајот во среда на состанокот на Советот за безбедност на Обединетите нации посветен на вештачката интелигенција.

„Често се прашувам што ќе се случеше ако одлучев да не го објавувам овој напад“, рече Деланге.

Тој додаде дека ова е особено загрижувачко сега кога е познато дека слични инциденти се случувале тајно во неколку водечки лаборатории за вештачка интелигенција со месеци претходно, без соодветен надзор.

Повикувања на меѓународни правила

На истиот состанок на ОН, извршниот директор на OpenAI, Сем Алтман, и Дарио Амодеи, извршен директор на конкурентската компанија Anthropic, ги повикаа меѓународните лидери да воведат глобални стандарди за безбедност на вештачката интелигенција, како и механизми за следење и пријавување на вакви инциденти.

OpenAI и Anthropic во последните недели објавија дека ќе ангажираат независни експерти за спроведување безбедносни проверки во реално време на нивните алатки за вештачка интелигенција. Сепак, BBC известува дека овие експерти сè уште не почнале да работат во компаниите.

OpenAI во петокот соопшти дека моментално спроведува детална ревизија на активностите на своите агенти на вештачката интелигенција, анализирајќи ги месец по месец, почнувајќи од моментот на нападот „Гушкање на лицето“.

„Поголемиот дел од случаите идентификувани досега беа со мала сериозност, со малку или без никакви докази за значително влијание“, соопшти компанијата.

Тие додадоа дека ревизијата ќе трае со месеци.

е-Трн да боцка во твојот инбокс