Društvo

AI modeli pokušali da prevare ljude tokom bezbednosnog testa

Pre 19 sati | Društvo
05.08.2026 | 13:47
Izvor: Tanjug
319737_shutterstock-2397304807_f.webp

Britanski Institut za bezbednost veštačke inteligencije (AISI) saopštio je danas da su modeli kompanija Anthropic i OpenAI tokom testiranja pokušali da prevare ljude kako bi izvršili zadate zadatke, što je ocenjeno kao dosad nezabeležen primer autonomnog i obmanjujućeg ponašanja.

Prema navodima AISI-ja, modeli Mythos kompanije Anthropic i Sol kompanije OpenAI tokom testiranja preduzimali su radnje koje su prevazilazile zadate instrukcije, uključujući pokušaje obmane stvarnih ljudi, piše BBC.

Najozbiljniji incident odnosio se na model Mythos, koji je tokom zadatka iz oblasti sajber bezbednosti povezanog sa platformom GitHub kreirao zlonamerni kod i pokušao da ga ubaci u sistem.