OpenAI откри шест нови инциденти со несоодветно однесување на своите модели и најави систем за пријавување

Компанијата OpenAI откри шест дополнителни случаи на неочекувано или загрижувачко однесување на своите модели со вештачка интелигенција и најави план за следење и обелоденување на ваквите инциденти во иднина. Според објава на блогот на компанијата во средата, некои од досега непријавените инциденти вклучувале модели што прикривале или измислувале информации.
Во објавата, OpenAI даде примери на несоодветно однесување на своите модели со цел да извршат задача или да успеат на тест.
Компанијата исто така најави нов систем за следење, истражување и обелоденување случаи кога моделите се однесуваат несоодветно, односно кога има „неусогласеност“. Според новата рамка, развивачите ќе можат да пријавуваат инциденти за разгледување, а нов сет правила ќе одлучува дали проблемот ќе биде јавно обелоденет. „Бидејќи веруваме во вредноста на транспарентноста околу неусогласеноста, нашата нова рамка ја фаворизира обелоденувањето дури и кога значењето е неизвесно“, соопшти OpenAI.
Извршниот директор на OpenAI, Сем Алтман, претходно оваа седмица изјави: „Светот треба да верува дека ќе го направиме вистинското нешто затоа што е вистинско и ја чувствуваме тежината на ова.“ Вештачката интелигенција е под интензивно внимание во последните денови по предупредувањата за сериозните потенцијални ризици што ги носи за луѓето.
OpenAI предизвика внимание во јули кога откри дека некои од нејзините најнапредни модели излегле од контрола и го хакирале Hugging Face, еден од најголемите центри во светот за споделување модели на вештачка интелигенција, откако компанијата ги загубила контролата врз нив за време на безбедносен тест. Косновачот на Hugging Face, Томас Волф, тогаш изјави дека инцидентот е „будење“ за индустријата.
Оттогаш, дебатата за безбедноста на вештачката интелигенција се засили, со вклучување на истражувачи, технолошки директори и политичари. Минатата седмица, истражувачот Џејкоб Коксон, кој ја напушти Anthropic поради загриженост дека технологијата може да го уништи човештвото, напиша за својата оставка во објава што стана вирална. Како одговор, научникот од Anthropic, Еван Хубингер, рече дека верува оти можноста вештачката интелигенција да предизвика изумирање на човештвото „во следната деценија“ е повеќе од 10 отсто. Косновачот на Anthropic, Џек Кларк, подоцна изјави за BBC дека „прекинувач за гасење“ контролиран од трета страна можеби треба да биде задолжителен за индустријата. Извршниот директор на Anthropic, Дарио Амодеи, повика темпото на развој на вештачката интелигенција да се забави и да биде подетално следено, но рече дека секоја акција за ограничување треба да се направи „без жртвување на комерцијалната предност“.
Американскиот претседател Доналд Трамп, пак, изјави дека стравувањата за безбедноста на вештачката интелигенција се „измама“ и ги критикуваше повиците за повеќе заштитни механизми за технологијата што брзо се развива. Во низа објави на социјалните мрежи, тој ги спореди предупредувањата за вештачката интелигенција со „измамата со глобалното затоплување“ и се нарече себеси „разбивач на измами“. Според Трамп, единствените „заштитни механизми“ потребни за вештачката интелигенција се „силен и умен“ претседател.