Над 100 експерти за ВИ бараат независна проверка на безбедноста на моделите
Над 100 експерти и евалуатори за вештачка интелигенција се обединија со предупредување дека нема да имаат потребните ресурси и заштита за да ја тестираат безбедноста на технологијата за вештачка интелигенција. Групата во петокот објави јавно писмо на оваа тема, кое ексклузивно го сподели со CNBC.
Потписниците, меѓу кои се и имиња како Џефри Хинтон и претставници на организации како Универзитетот Џон Хопкинс, Универзитетот Стенфорд и непрофитниот евалуатор METR, бараат од провајдерите на фундаментални модели да им овозможат на независните евалуатори на вештачка интелигенција потребната „научна објективност, транспарентност, независност и цврста заштита“ за ефективно и веродостојно извршување на нивната работа.
Конрад Стош, претседател на конзорциумот AI Evaluator Forum што го организираше писмото, изјави дека целта е да се демонстрира заедничка основа за основните принципи и да се осигура дека независниот надзор може да биде значајна алатка за управување со ризиците од вештачката интелигенција. Според него, станува збор за обид компаниите што развиваат фундаментални модели да бидат одговорни за нивните неодамнешни ветувања за поддршка на потемелно тестирање на безбедноста од трети страни.
Потписниците сакаат работата на евалуаторите да се изведува независно од бизнисите, со поголема транспарентност за технологиите и „да бидат заштитени од одмазда од компаниите во кои се вградени“, се вели во писмото. Стош нагласи дека евалуаторите од трети страни не се замислени како замена за внатрешните напори за евалуација, а призна и дека е можно компаниите за фундаментални модели да го игнорираат јавното писмо.
Вињ Нгујен, висок соработник на Советот за надворешни односи за вештачка интелигенција и поранешен главен директор за вештачка интелигенција на Националната безбедносна агенција, кој го потпиша писмото, изјави дека независните евалуатори се потребни за откривање клучни информации што можат да помогнат во ублажување на потенцијални безбедносни пропусти и економски катастрофи. „Кога неколку моќни лаборатории контролираат способности што можат да ја загрозат сајбер-безбедноста, критичната инфраструктура и системите на кои се потпираат нашата национална безбедност и економија, владата и јавноста не можат да зависат од сопствената сметка на тие лаборатории за тоа што е безбедно“, рече Нгујен.
Дискусијата доби на интензитет откако извршниот директор на Anthropic, Дарио Амодеи, претходно изнесе идеја некои евалуатори да добијат „пристап сличен на вработен“ за да ги прегледуваат и ревидираат најсовремените фундаментални модели и нивните развојни процеси. Според Стош, предлогот на Амодеи изгледа дека вклучува значително поголем пристап од досегашниот, вклучително пристап до компјутерите на компанијата, искрени разговори со вработените и увид во чувствителни внатрешни податоци и необјавени системи.