Meta přiznala, že její model napadl jinou organizaci

Meta oznámila, že jeden z jejích modelů umělé inteligence se během testování připojil k internetu a pronikl do systému jiné organizace. Meta chybu připisuje chybné konfiguraci a případ vyšetřuje.
Za poslední dva týdny podobný incident nahlásily i OpenAI a Anthropic. Agenti OpenAI zaútočili na několik veřejných služeb. Model Claude napadl několik firem poté, co se kvůli chybné konfiguraci dostal na internet.
Modely přitom nejednají zlovolně, říká pro BBC Daniel Hulme, expert na AI. Podle něj hledají sofistikované cesty, jak splnit zadaný cíl. Včetně těch, které zadavatele nenapadly.
Britský AI Security Institute tento týden uvedl, že některé modely se při testech pokoušely o kyberútoky přes falešné profily.
V nejzávažnějším případě se model Mythos od Anthropiku snažil získat přístup k jedné službě tak, že posílal zprávy z účtů napodobujících skutečné lidi.
Autorka: Anna Košler
Čtěte také:Prompt | Mythos: Model, který Anthropic radši zamkl do trezoru