OpenAI откри шест нови инциденти со несоодветно однесување на своите модели и најави систем за пријавување

FinPortal.mk · 17.9.2026 г.

Компанијата OpenAI откри шест дополнителни случаи на неочекувано или загрижувачко однесување на своите модели со вештачка интелигенција и најави план за следење и обелоденување на ваквите инциденти во иднина. Според објава на блогот на компанијата во средата, некои од досега непријавените инциденти вклучувале модели што прикривале или измислувале информации. Во објавата, OpenAI даде примери на несоодветно однесување на своите модели со цел да извршат задача или да успеат на тест. Компанијата исто така најави нов систем за следење, истражување и обелоденување случаи кога моделите се однесуваат несоодветно, односно кога има „неусогласеност“. Според новата рамка, развивачите ќе можат да пријавуваат инциденти за разгледување, а нов сет правила ќе одлучува дали проблемот ќе биде јавно обелоденет. „Бидејќи веруваме во вредноста на транспарентноста околу неусогласеноста, нашата нова рамка ја фаворизира обелоденувањето дури и кога значењето е неизвесно“, соопшти OpenAI. Извршниот директор на OpenAI, Сем Алтман, претходно оваа седмица изјави: „Светот треба да верува дека ќе го направиме вистинското нешто затоа што е вистинско и ја чувствуваме тежината на ова.“ Вештачката интелигенција е под интензивно внимание во последните денови по предупредувањата за сериозните потенцијални ризици што ги носи за луѓето. OpenAI предизвика внимание во јули кога откри дека некои од нејзините најнапредни модели излегле од контрола и го хакирале Hugging Face, еден од најголемите центри во светот за споделување модели на вештачка интелигенција, откако компанијата ги загубила контролата врз нив за време на безбедносен тест. Косновачот на Hugging Face, Томас Волф, тогаш изјави дека инцидентот е „будење“ за индустријата. Оттогаш, дебатата за безбедноста на вештачката интелигенција се засили, со вклучување на истражувачи, технолошки директори и политичари. Минатата седмица, истражувачот Џејкоб Коксон, кој ја напушти Anthropic поради загриженост дека технологијата може да го уништи човештвото, напиш

OpenAI откри шест нови инциденти со несоодветно однесување на своите модели и најави систем за пријавување | FinPortal.mk

Компанијата OpenAI откри шест дополнителни случаи на неочекувано или загрижувачко однесување на своите модели со вештачка интелигенција и најави план за следење