Вградени проценувачи на вештачка интелигенција: безбедносна проверка без моќ да запре
Најважното ново работно место во вештачката интелигенција можеби ќе дојде со службена легитимација, преносен сметач и пристап до некои од најстрого чуваните системи во технологијата — големите јазични модели на лидерите како „Антропик“ и „ОпенAI“. Она што можеби нема да го добие е моќта да ги запре.
Извршниот директор на „Антропик“, Дарио Амодеи, предложи вградување на проценувачи на безбедноста од трети страни во компаниите кои развиваат најнапредни модели на вештачка интелигенција, како дел од план за забавување на напредокот на сè помоќните системи. Овој предлог дојде откако поранешниот истражувач во „Антропик“, Џејкоб Коксон, поднесе оставка со предупредување дека лабораториите за најнапредни модели се натпреваруваат кон системи што можеби нема да можат да ги контролираат.
Во есеј објавен минатиот викенд, Амодеи се обврза дека „Антропик“ ќе им обезбеди на проценувачите од трети страни пристап споредлив со оној на внатрешните тимови за ризик, како и право да ги објавуваат своите наоди без уредничка контрола на компанијата, со ограничени цензури. Тој експлицитно го наведе примерот на вградените банкарски супервизори, пишувајќи дека неговиот предлог „има преседан во банкарската индустрија, која понекогаш вклучува регулаторни ’супервизори‘ вградени заедно со вработените“.
Сепак, Џули Андерсен Хил, деканка на Правниот факултет на Универзитетот во Вајоминг и експертка за банкарска регулатива, тврди дека без моќ да го „вклучат прекинувачот“ за целата операција, споредбата со банкарската регулатива не е точна. „Ако не им дадете таква моќ, не знам што прават“, рече Хил. Таа објаснува дека во најголемите банки владините испитувачи имаат канцеларии во самата институција, пристап до внатрешните системи и вработени и постојано присуство. Тие можат да наложат банка да прекине одредена практика, да го ограничат нејзиниот раст, да наметнат промени во раководството, а во екстремни случаи и да ја затворат.
Предложените проценувачи на „Антропик“ би можеле да истражуваат и да известуваат, но планот на Амодеи не им дава споредлива извршна моќ ниту правно овластување да спречат модел да биде трениран или објавен. „Тоа е фундаментално различно, бидејќи банкарските регулатори имаат многу поголема моќ од тоа“, рече Хил.
Амодеи напиша дека проценувачите се потребни за да обезбедат „неутрална трета страна која навистина може да ги види деталите“, но призна дека „Антропик“ сè уште одлучува што вклучува и што изоставува од своите постоечки јавни обелоденувања. Досега објавените детали укажуваат дека проценувачите би имале извонреден пристап до најнапредните системи, но ограничено формално овластување над компаниите што ги развиваат. Ниту предлогот на „Антропик“, ниту постоечката рамка за проценка од трети страни на „ОпенAI“ не им даваат на надворешните проценувачи независно овластување да го запрат развојот или распоредувањето на модел. „Антропик“ и „ОпенAI“, кој исто така се обврза на сличен безбедносен аранжман, но сè уште не објави детали за тоа како ќе функционира неговата нова обврска за вградени проценувачи, не одговорија на барањата за коментар.
Алберт Циглер, раководител за вештачка интелигенција во компанијата за кибербезбедност XBOW, која води тим што ги проценува можностите на моделите, изјави дека неговата фирма добила ран пристап до необјавени модели од „Антропик“, „ОпенAI“ и други големи развивачи, и дека лично учествувал во тие проценки. XBOW ја врши работата во сопствена средина, наместо како нарачано тестирање, и генерално ги споделува наодите со давателите на моделите. Секојдневната реалност, барем досега, е помалку кинематографска од егзистенцијалната рамка, рече Циглер. Амодеи напиша дека новите регулаторни вградувања се неопходни бидејќи во рок од шест до 12 месеци, неусогласен рој агенти потенцијално би можел да заземе големи делови од интернетот и да нанесе штета од стотици милијарди долари. Циглер вели дека неговиот тим може да открие дека моделот произведува бесмислици при невообичаено барање за форматирање или дека надворешниот проверувач на безбедност треба почесто да интервенира.