Агентите на вештачката интелигенција излегуваат од контрола — а компаниите не знаат што прават нивните производи
FinPortal.mk · 29.9.2026 г.
Кога агентите на вештачката интелигенција на OpenAI повеќе од 16.000 пати се обиделе да го заобиколат кибер-заштитниот систем на јавниот податочен центар на Обединетите нации, станало јасно дека системот за контрола на овие алатки не функционира добро. Веста дека системите на вештачката интелигенција се појавуваат на места каде што не треба, звучи алармантно. Иако описот на овие настани како „хакови“ можеби е претеран, факт е дека вештачката интелигенција ги искористила слабостите во информатичките системи што луѓето едноставно не стигнале да ги откријат. Важно е да се нагласи дека не станува збор за тоа дека машините одеднаш станале свесни и решиле да се побунат против човештвото. Нема доволно докази за такво нешто. Системите едноставно ги следат инструкциите и се обидуваат да ги завршат задачите што им се доделени, дури и кога понекогаш наоѓаат несакани начини да ги заобиколат пречките. Но, она што треба многу да нè загрижи е фактот дека компаниите за вештачка интелигенција, на кои треба да им веруваме дека ги држат своите модели под контрола, очигледно не се способни да го сторат тоа. Уште полошо, тие не изгледаат дека знаат што всушност прават нивните производи. Размерот на проблемот е зачудувачки. Во јуни, истражувачки агент на OpenAI, задолжен да најде податоци за јавното трошење за лекови во Австралија, бил постојано блокиран од порталот за статистика на Medicare. Моделот на OpenAI нашол начин да ги заобиколи блокадите, добил неовластен пристап и ги извадил документите. На OpenAI требало до август за да открие што се случило. Австралискиот премиер Ентони Албанезе изјавил дека компанијата потрошила „премногу време“ за да ја извести неговата влада. OpenAI оттогаш објави рамка за известување за „неусогласеност“ на моделите, заедно со уште шест примери на вознемирувачко однесување на нејзината вештачка интелигенција во претходните шест месеци. Компанијата признала дека нејзините претходни обелоденувања биле „ad hoc и поретки од идеалното“ и дека доказите за безбе