Nezapamćeno: AI model davao uputstva za izradu biološkog oružja i atentate, Kinezi pokrenuli hitnu istragu

Vreme čitanja: oko 2 min.

Foto: Telegraf

Sumirano

  • Majndgard je utvrdio da su modeli Munšota Kimi K2.6 i K3 Svorm zaobišli bezbednosne mere i pružili uputstva za izradu biološkog oružja i atentate
  • Proboj je ostvaren džejlbrejkingom, nizom instrukcija osmišljenih da navedu AI da ignoriše ograničenja
  • Kimi K2.6 bi, prema Majndgardu, mogao da pokreće kod i pristupa internetu, što stvara rizik od sajbernapada

Kineska kompanija za razvoj veštačke inteligencije Munšot (Moonshot) pokrenula je internu reviziju nakon što su bezbednosni istraživači uspeli da navedu njihove popularne AI modele da pruže detaljna uputstva za izradu biološkog oružja i izvođenje atentata.

Kompanija Majndgard (Mindgard), koja se bavi testiranjem bezbednosti sistema veštačke inteligencije, otkrila je u julu da su modeli Kimi K2.6 i K3 Svorm (K3 Swarm) zaobišli bezbednosne ograde koje su postavili njihovi programeri.

Do proboja je došlo tokom procesa poznatog kao "džejlbrejking" (jailbreaking), gde istraživači koriste kompleksan niz instrukcija kako bi proverili da li AI alati ignorišu postavljena ograničenja. Osnivač kompanije Majndgard Piter Garagan izjavio je za Bi-Bi-Si (BBC) da su njihovi nalazi izuzetno zabrinjavajući.

"Kada 'džejlbrejk' uspe, model će razgovarati o bilo kojoj temi. Slobodno će nuditi preporuke o drugim zlonamernim temama, a pritom će biti izuzetno inovativan i kreativan", istakao je Garagan.

Osim pružanja opasnih informacija, Majndgard navodi da bi Kimi K2.6 mogao da omogući hakerima pokretanje koda na računarskim resursima i povezivanje na internet, što ga čini potencijalnom lansirnom platformom za sajber napade.

Iz kompanije Munšot su poručili da pozdravljaju doprinos trećih strana kao ključan stub za izgradnju bezbednije veštačke inteligencije, te da su u kontaktu sa kompanijom Majndgard u vezi sa detaljima izveštaja. Munšot je naveo da su njihove interne evaluacije pokazale visoku stopu odbijanja ovakvih opasnih zahteva.

Incident dolazi u trenutku kada se globalno podiže uzbuna zbog zloupotrebe veštačke inteligencije. Nedavno je i američka kompanija Antropik (Anthropic) saopštila da je identifikovala i sprečila pokušaje korišćenja jednog od svojih modela za aktivnosti koje bi mogle da podrže razvoj biološkog oružja.

(Ubrzanje.rs/Klix.ba)