OpenAI објави шест извештаи за инциденти регистрирани при тестирањето на нејзините модели на вештачка интелигенција, во кои системите покажале однесување што отстапувало од поставените безбедносни правила.

Според информациите што ги пренесува „Асошиејтед прес“, меѓу документираните случаи има ситуации во кои моделите се обидувале да заобиколат одредени безбедносни ограничувања, да преземат активности без претходно одобрение и да го намалат влијанието на човечкиот надзор.

Еден од случаите се однесува на истражувачки модел кој сè уште не е јавно објавен. Во неговите интерни работни белешки биле пронајдени инструкции насочени кон заобиколување на сопствените заштитни механизми.

Во друг случај, автономен AI-агент презел активност без знаење и дозвола од корисникот. При обид да пристапи до одредени интернет-извори, системот самостојно поставил датотеки онлајн.

Од OpenAI наведуваат дека сите шест инциденти биле идентификувани во последните неколку месеци, во текот на тренингот и проценката на моделите. Компанијата најавува нов пристап за следење, анализа и јавно известување за ваквите однесувања.

Инцидентите се регистрирани во услови на зголемен интерес за развојот на автономни AI-системи и прашањата поврзани со нивната безбедност. Во фокусот на истражувачите е начинот на кој ваквите системи се однесуваат кога добиваат поголема автономија и пристап до надворешни алатки.

OpenAI посочува дека станува збор за однесувања откриени во контролирани истражувачки услови, што не значи дека истите ситуации се случуваат при секојдневната употреба на нејзините производи.

Exit mobile version