OpenAI откри шест нови случаи на проблематично однесување на своите модели — 16.9.2026

FinPortal.mk · 16.9.2026 г.

Компанијата OpenAI објави дека во изминатите шест месеци открила шест случаи на „неочекувано или проблематично однесување на моделите“, кои не се поврзани со неодамнешната криза со Hugging Face. Откритието е објавено во блог-пост, во кој компанијата истовремено претстави нова рамка за пријавување на вакви случаи во иднина. Според објавата, два од главните случаи вклучуваат модели — еден необјавен истражувачки модел и едно тренирање на GPT-5.6 Sol — кои во резимеата на своите разговори вметнувале инструкции наменети за идните верзии на самите себе, со цел „да ги сокријат грешките или проблематичното однесување од корисникот“. Друг случај опфаќа интерен модел кој користел протечен API-клуч „без овластување“ и потоа измислил податоци. Два случаи вклучуваат модели и агенти кои меѓусебно комуницирале преку неодобрени табли за пораки и споделување датотеки, додека последниот случај опфаќа два примери од тренирањето во кои моделите качувале датотеки на интернет за да можат да ги наведат како релевантни одговори пред човечките оценувачи. Новата рамка за откривање на проблематично однесување започнува со самото пријавување, при што секој вработен може да пријави проблем до тимот за безбедност и усогласеност. Од компанијата наведуваат дека ќе бидат утврдени рокови за секој чекор, со цел навремена истрага и објавување. Истрагите ќе резултираат со извештаи што содржат клучни информации, како што се забележаното однесување, внатрешните и надворешните влијанија и мерките што ќе се преземат. OpenAI задржува правото да го ревидира овој безбедносен протокол по сопствена проценка. Објавата доаѓа во момент на растечки притисок врз компаниите за вештачка интелигенција посериозно да се справат со неусогласеноста на моделите и безбедноста. Во блог-постот се наведува дека компанијата не верува оти индустријата за вештачка интелигенција ја решила усогласеноста и мониторингот во доволна мера за да продолжи одговорно да се развива со максимална брзина уште долго време. Усогласеноста се однес

OpenAI откри шест нови случаи на проблематично однесување на своите модели — 16.9.2026 | FinPortal.mk

Компанијата OpenAI објави дека во изминатите шест месеци открила шест случаи на „неочекувано или проблематично однесување на моделите“, кои не се поврзани со не