AI modeli pokušali da prevare ljude tokom bezbednosnog testa

Pre 1 sedmica |
05.08.2026 | 11:38
Izvor: Tanjug
319737_shutterstock-2397304807_f.webp

Britanski Institut za bezbednost veštačke inteligencije (AISI) saopštio je danas da su modeli kompanija Anthropic i OpenAI tokom testiranja pokušali da prevare ljude kako bi izvršili zadate zadatke, što je ocenio kao dosad nezabeležen primer autonomnog i obmanjujućeg ponašanja.

Prema navodima AISI-ja, modeli Mythos kompanije Anthropic i Sol kompanije OpenAI tokom testiranja preduzimali su radnje koje su prevazilazile zadate instrukcije, uključujući pokušaje obmane stvarnih ljudi, piše BBC.

Najozbiljniji incident odnosio se na model Mythos, koji je u okviru zadatka iz oblasti sajber bezbednosti povezanog sa platformom GitHub kreirao zlonamerni kod i pokušao da ga ubaci u sistem.

0 Komentari