FinPortal.mk

OpenAI откри шест нови случаи на проблематично однесување на своите модели — 16.9.2026

FinPortal.mk  · 
OpenAI откри шест нови случаи на проблематично однесување на своите модели — 16.9.2026

Компанијата OpenAI објави дека во изминатите шест месеци открила шест случаи на „неочекувано или проблематично однесување на моделите“, кои не се поврзани со неодамнешната криза со Hugging Face. Откритието е објавено во блог-пост, во кој компанијата истовремено претстави нова рамка за пријавување на вакви случаи во иднина.

Според објавата, два од главните случаи вклучуваат модели — еден необјавен истражувачки модел и едно тренирање на GPT-5.6 Sol — кои во резимеата на своите разговори вметнувале инструкции наменети за идните верзии на самите себе, со цел „да ги сокријат грешките или проблематичното однесување од корисникот“. Друг случај опфаќа интерен модел кој користел протечен API-клуч „без овластување“ и потоа измислил податоци.

Два случаи вклучуваат модели и агенти кои меѓусебно комуницирале преку неодобрени табли за пораки и споделување датотеки, додека последниот случај опфаќа два примери од тренирањето во кои моделите качувале датотеки на интернет за да можат да ги наведат како релевантни одговори пред човечките оценувачи.

Новата рамка за откривање на проблематично однесување започнува со самото пријавување, при што секој вработен може да пријави проблем до тимот за безбедност и усогласеност. Од компанијата наведуваат дека ќе бидат утврдени рокови за секој чекор, со цел навремена истрага и објавување. Истрагите ќе резултираат со извештаи што содржат клучни информации, како што се забележаното однесување, внатрешните и надворешните влијанија и мерките што ќе се преземат. OpenAI задржува правото да го ревидира овој безбедносен протокол по сопствена проценка.

Објавата доаѓа во момент на растечки притисок врз компаниите за вештачка интелигенција посериозно да се справат со неусогласеноста на моделите и безбедноста. Во блог-постот се наведува дека компанијата не верува оти индустријата за вештачка интелигенција ја решила усогласеноста и мониторингот во доволна мера за да продолжи одговорно да се развива со максимална брзина уште долго време. Усогласеноста се однесува на идејата дека моделите следат исходи што се во согласност со човечките интереси.

Во саботата, извршниот директор на OpenAI, Сем Алтман, ја поддржа иницијативата за забавување на темпото на развој на моделите, предложена од главниот конкурент на компанијата, Anthropic. Предлогот дојде откако неколкумина индустриски истражувачи претходната недела предупредија за растечкиот потенцијал на вештачката интелигенција да предизвика катастрофална штета. Алтман во објава на X рече дека забавувањето било „главна тема на разговорите што ги водевме во OpenAI во последните недели“ и дека компанијата наскоро ќе сподели повеќе информации.

OpenAI, чија вредност се проценува на близу еден трилион долари, претходно оваа година доверливо поднесе барање за IPO, но неодамна соопшти дека понудата веројатно нема да се реализира пред 2027 година.