Кинескиот модел „Кими“ можел да дава совети за биолошко оружје и убиства, тврди „Мајндгард

Кинеската компанија за вештачка интелигенција „Муншот“ спроведува внатрешна проверка откако истражувачите успеале да ги наведат два нејзини популарни модели „Кими“ да им објаснат како да се создаде биолошко оружје и како да се извршат убиства. Ова за Би-Би-Си го соопшти компанијата „Мајндгард“, која тестира безбедност на системи со вештачка интелигенција.
Според „Мајндгард“, откритието било направено во јули, кога моделите „Кими K2.6“ и „K3 Swarm“ можеле да ги заобиколат безбедносните ограничувања што ги поставил производителот. Тоа се случило во процес наречен „џеилбрејкинг“, при кој истражувачите користат низа сложени инструкции за да проверат дали алатките со вештачка интелигенција ги игнорираат заштитните механизми. Како што наведе „Мајндгард“, тие механизми требало да го спречат „Кими“ да разговара за загрижувачки теми.
Основачот на „Мајндгард“, Питер Гарахан, за програмата „Tech Life“ на Би-Би-Си Светска служба изјави дека наодите за „Кими K2.6“ и „K3 Swarm“ се загрижувачки. „Откако џеилбрејкот ќе проработи, тој ќе зборува за која било тема, дури слободно ќе дава препораки и за други теми што се исто така злонамерни, и ќе биде измислив и креативен“, рече тој.
„Муншот“ за Би-Би-Си изјави дека ја поздравува надворешната проверка „како клучен столб за градење подобра и побезбедна вештачка интелигенција“ и дека е во разговор со „Мајндгард“ за неговите наоди. Во дел од е-поштата до „Мајндгард“, споделена со Би-Би-Си, компанијата наведе дека нејзиниот модел во внатрешните оценки генерално покажал „висока стапка на одбивање за ваквите барања“.
„Мајндгард“ соопшти дека не докажала дали одговорите што ги дал „Кими“ на загрижувачките теми навистина би функционирале, но смета дека заштитните механизми требало да ги спречат моделите да влезат во разговор со корисници на такви теми. Фирмата изрази и уверување дека џеилбрејкуван „Кими 2.6“ би можел да им овозможи на хакери да извршуваат код на неговите сметачки ресурси и да се поврзат на интернет, што го прави потенцијален старт за сајбер-напади.
Гарахан ја бранеше одлуката на „Мајндгард“ јавно да разговара за џеилбрејкот на системите на „Муншот“, велејќи дека компанијата била информирана и дека не се откриваат клучни детали за тоа како моделите биле наведени да ги игнорираат заштитните механизми. „Мајндгард“ го известила „Муншот“ за џеилбрејкот со е-пошта на 27 јули, а потоа следела дополнителна комуникација околу една недела подоцна. Потоа, на 12 септември, објавила блог за ова прашање. Компанијата наведе дека „Муншот“ стапил во контакт дури неодамна, откако Би-Би-Си побарал коментар.
Наодите доаѓаат во момент кога индустријата за вештачка интелигенција останува поделена околу тоа дали затворените, сопственички модели или алатките со отворен код се најдобриот или најбезбедниот пат напред. „Кими“ е модел со отворени тежини, што значи дека некој теоретски би можел да го преземе моделот и сам да го извршува на сопствена сметачка инфраструктура.
Професорот Алан Вудворд од Универзитетот во Сари за Би-Би-Си изјави дека постои ризик моделите со отворен код да завршат во погрешни раце, но тие можат да се искористат и за сајбер-одбрана. Тој потсети дека компанијата за вештачка интелигенција „Хагинг Фејс“ користела кинески модел со отворен код за да разбере хакерски напад за кој подоцна било откриено дека го извршиле агенти на „ОпенAI“. Вудворд оцени дека меѓународната регулатива тешко ќе го следи темпото на развој на вештачката интелигенција, велејќи: „Ни требаа децении за да се договориме за форматот на телефонските броеви.“ Како и основачот на „Мајндгард“, Гарахан, и Вудворд смета дека треба поголем фокус на откривање и гонење на луѓето кои ја злоупотребуваат вештачката интелигенција.