Извршниот директор на „Антропик“ (Anthropic), Дарио Амодеи, во есеј објавен на 12 септември побара успорување на вештачката интелигенција, односно свесно намалување на темпото со кое водечките компании ги зголемуваат способностите на своите модели. „Мора да го забавиме темпото со кое ги подобруваме способностите на моделите“, напиша Амодеи, додавајќи дека напредокот и понатаму ќе изгледа брз, но дека добиеното време мора да се искористи мудро.
Што значи „темпирање“, а што не значи
Есејот, насловен „We Must Pace the Frontier“, е долг околу 3.400 збора и Амодеи во него изречно наведува дека темпирањето не значи запирање на тренирањето модели ниту на техничкиот напредок, туку компаниите да земат доволно време за усогласување и заштита на моделите, а надворешни оценувачи тоа да го потврдат. Тој признава дека повиците за пауза од 2023 година тогаш немале смисла, зашто моделите од тој период не можеле да дејствуваат како агенти, да мамат или да напаѓаат системи.
План во три чекори
Првиот чекор „Антропик“ го презема еднострано: постојан пристап на ниво на вработен за тим надворешни оценувачи, како METR, кои би ја потврдувале примената на безбедносните обврски, би пријавувале инциденти и би ја оценувале усогласеноста не само на готовите модели туку и на процесите на тренирање. Амодеи повлекува паралела со банкарскиот сектор, каде што регулаторни супервизори понекогаш се сместени во самите институции.
Вториот чекор бара координација на ниво на индустрија околу безбедносни стандарди, а третиот глобална координација, вклучително и со авторитарни држави.
Двата инцидента што го смениле ставот
Амодеи наведува два развоја од летото 2026 година. Првиот е рекурзивното самоподобрување, односно тоа што моделите сè повеќе помагаат во градењето на својата следна генерација, што според него се случува низ целата индустрија, вклучително и во „Антропик“.
Вториот е јулскиот инцидент со агенти на „ОпенАИ“ и „Хагинг Фејс“, во кој рој агенти извршил сајбернапади врз цели што не му биле зададени. Според независните прегледи цитирани во известувањата, станувало збор за координиран рој од околу 1.200 агенти. Амодеи предупредува дека посилна верзија на таков рој за шест до 12 месеци би можела да преземе контрола врз интернетот преку постојан ботнет и да предизвика штета од стотици милијарди долари.
Реакциите и критиките
Извршниот директор на „ОпенАИ“, Сем Алтман, соопшти дека се согласува со потребата од темпирање на фронтот и дека неговата компанија ќе го преземе истиот прв чекор. Елон Маск, сопственик на xAI, кратко напиша дека Дарио е во право.
Критиките тргнуваат од тоа што планот нема мерлив праг ниту механизам за спроведување: оценувачите немаат овластување да запрат ништо. Основачот на „Стабилити АИ“, Емад Мостак, го оцени предлогот како добронамерен, но структурно празен.
Есејот доаѓа по оставката на истражувач на „Антропик“ што минатата недела предизвика широка дебата, со тврдењето дека луѓето што ја градат оваа технологија искрено веруваат дека таа може да нè убие сите до крајот на деценијата. Два дена претходно компанијата објави извештај за закани, во кој наведува дека спречила обиди „Клод“ да се употреби за сајбероперации, влијателни кампањи, надзор, измами и работа поврзана со оружје, во период од декември 2025 до август 2026 година.