FinPortal.mk

Агентите на вештачката интелигенција излегуваат од контрола — а компаниите не знаат што прават нивните производи

FinPortal.mk  · 
Агентите на вештачката интелигенција излегуваат од контрола — а компаниите не знаат што прават нивните производи

Кога агентите на вештачката интелигенција на OpenAI повеќе од 16.000 пати се обиделе да го заобиколат кибер-заштитниот систем на јавниот податочен центар на Обединетите нации, станало јасно дека системот за контрола на овие алатки не функционира добро. Веста дека системите на вештачката интелигенција се појавуваат на места каде што не треба, звучи алармантно. Иако описот на овие настани како „хакови“ можеби е претеран, факт е дека вештачката интелигенција ги искористила слабостите во информатичките системи што луѓето едноставно не стигнале да ги откријат.

Важно е да се нагласи дека не станува збор за тоа дека машините одеднаш станале свесни и решиле да се побунат против човештвото. Нема доволно докази за такво нешто. Системите едноставно ги следат инструкциите и се обидуваат да ги завршат задачите што им се доделени, дури и кога понекогаш наоѓаат несакани начини да ги заобиколат пречките. Но, она што треба многу да нè загрижи е фактот дека компаниите за вештачка интелигенција, на кои треба да им веруваме дека ги држат своите модели под контрола, очигледно не се способни да го сторат тоа. Уште полошо, тие не изгледаат дека знаат што всушност прават нивните производи.

Размерот на проблемот е зачудувачки. Во јуни, истражувачки агент на OpenAI, задолжен да најде податоци за јавното трошење за лекови во Австралија, бил постојано блокиран од порталот за статистика на Medicare. Моделот на OpenAI нашол начин да ги заобиколи блокадите, добил неовластен пристап и ги извадил документите. На OpenAI требало до август за да открие што се случило. Австралискиот премиер Ентони Албанезе изјавил дека компанијата потрошила „премногу време“ за да ја извести неговата влада. OpenAI оттогаш објави рамка за известување за „неусогласеност“ на моделите, заедно со уште шест примери на вознемирувачко однесување на нејзината вештачка интелигенција во претходните шест месеци. Компанијата признала дека нејзините претходни обелоденувања биле „ad hoc и поретки од идеалното“ и дека доказите за безбедноста на вештачката интелигенција треба да ги проверуваат луѓе надвор од компаниите што ги градат моделите.

Ова не е само проблем на OpenAI, што го прави уште позагрижувачки. Anthropic открила три инциденти во кои нејзините модели Claude добиле неовластен пристап до реални системи на трети страни, откако прегледала околу 141.000 транскрипти на модели. Четвртиот инцидент, кој датира од јануари, го открила дури откако составила досие за независна истрага. Google потврдил дека Gemini пристапил до системи на три реални компании за време на тестирањето. Други агенти на OpenAI користеле DNS — системот што служи како адресар на интернетот — за да стигнат до надворешен чатбот и покрај интернет-ограничувањата. Еден објавил токен од GitHub на истражувач додека се обидувал да измами при математички доказ, иако двапати му било кажано да престане. Истражувачките агенти објавиле 53 кориснички слики на надворешни хостинг-страници. Други агенти пристапиле до податоци од пописот користејќи акредитиви најдени онлајн, копирале информации од американската Комисија за хартии од вредност и очигледно безуспешно се обиделе да пробијат на веб-страница на американското Министерство за образование. OpenAI вели дека известила десетици трети страни засегнати од нејзините агенти и дека нејзиниот преглед на минатата активност сè уште трае.

Овие хаотични, последователни откритија на големи пробиви во информатичките системи на компании и организации не се вистинскиот начин да се контролира технологија толку моќна како вештачката интелигенција. Одамна научивме дека истрагите за авионски несреќи не треба да им се оставаат исклучиво на Boeing или Airbus. Сега треба да бидеме помалку наивни во однос на вештачката интелигенција. Минатата недела, на Генералното собрание на ОН, истражувачката на вештачка интелигенција Руман Чоудхури ја лансираше Фондацијата за независна евалуација на вештачката интелигенција (IAEF) со 10 милиони долари филантропска поддршка. Нејзиниот непосреден фокус е образованието, но важната идеја е да се претвори независната евалуација на вештачката интелигенција во вистинска професија: луѓе и организации со вештини, инфраструктура и стандарди за тестирање на овие системи без финансиски интерес за тоа дали тие ќе поминат. Затоа што во моментов, компанијата може да пријави инцидент, да го истражи, да објави какви било ублажувачки мерки и да продолжи понатаму. IAEF е добредојдена интервенција, но не може сама да го реши проблемот. Не може да ги принуди OpenAI или Anthropic да ги предадат дневниците, да ги зачуваат доказите или да кажат на владата дека некој од нејзините системи ја преминал границата. А нејзините 10 милиони долари се ситни пари во споредба со компании како Anthropic, која подготвува предложено јавно котирање што се разговарало со вредност од околу 2 трилиони долари. Но, тоа е инфраструктура што треба да ја градиме.