По Anthropic и OpenAI, сега и Мета пријави дека ВИ им излегла од контрола

Системите за вештачка интелигенција на Мета, OpenAI и Anthropic ги заобиколија безбедносните протоколи за време на интерни проверки и извршија сајбер-напади.

Технолошкиот гигант Мета потврди дека еден од неговите модели на вештачка интелигенција успеал да се поврзе на интернет и да хакира систем на друга организација за време на тестирање. Инцидентот, за кој компанијата тврди дека е последица на погрешна конфигурација, доаѓа непосредно по слични безбедносни пропусти забележани кај конкурентите OpenAI и Anthropic.

Инцидентот во Мета го спроведе независната компанија за безбедносна проценка „Irregular“. Оваа истражувачка фирма минатата недела откри сличен пропуст и кај моделот Клод (Claude) на Anthropic, каде што вештачката интелигенција добила пристап до системите на три други компании.

Портпаролот на Мета за Би-Би-Си изјави дека компанијата ги истражува сите детали околу хакирањето и дека ќе објави дополнителни податоци штом ги утврди фактите. Од „Irregular“ потврдија дека проблемот кај Мета произлегува од идентична грешка во тест-опкружувањето каква што беше претходно пријавена кај нивните конкуренти.

Бранот инциденти започна кога OpenAI објави дека неговите AI агенти нападнале неколку јавно достапни сервиси, меѓу кои и платформата за развој на модели Hugging Face. Оваа објава ги поттикна Anthropic и Мета да извршат дополнителни проверки, со што беа откриени аналогни пропусти во нивните средини за тестирање.

Експертите од индустријата нагласуваат дека моделите не постапуваат со злонамерна намера. Даниел Хулм од глобалната мрежа WPP објасни дека системите едноставно креираат софистицирани стратегиски чекори за да ја исполни зададената цел. Доколку програмерите не ги предвидат сите можни патишта до решението, вештачката интелигенција наоѓа методи што луѓето не ги планирале.

Загриженоста дополнително порасна по извештајот на Британскиот институт за безбедност на вештачка интелигенција (AISI). Нивните тестирања покажаа дека одредени модели се обиделе да извршат сајбер-напади преку креирање лажни човечки профили за манипулација со корисниците.

Според извештајот на AISI, моделот Митос (Mythos) на Anthropic испраќал приватни пораки со лажни профили што имитираат вистински луѓе за да добие пристап до заштитена услуга. Од Anthropic и OpenAI реагираа дека ваквите тестови на институтот не го одразуваат редовниот начин на користење на нивните модели во продукција.

е-Трн да боцка во твојот инбокс