Bijela kuća i Anthropic i dalje u sukobu oko modela Claude Fable 5
Trumpova administracija zadržava izvozna ograničenja nakon neuspješnih pregovora
Pregovori između Trumpove administracije i tehnološke tvrtke Anthropic završili su bez dogovora o ukidanju nedavno nametnutih izvoznih ograničenja. Vlada Sjedinjenih Američkih Država i dalje ograničava izvoz najnaprednijih AI modela tvrtke Anthropic, prvenstveno zbog straha od sigurnosnih ranjivosti i mogućnosti zaobilaženja postavljenih zaštitnih mehanizama ("jailbreaking").
Ključni detalji
Dužnosnici Trumpove administracije zaključili su pregovore s Anthropicom bez ukidanja izvoznih ograničenja koja su nametnuta ranije, a tiču se naprednog modela Claude Fable 5. Prema izvorima upoznatim sa situacijom, administracija vjeruje da postoje načini za onemogućavanje nekih zaštitnih mjera ("guardrails") u modelu Claude Fable 5. To bi korisnicima moglo omogućiti pristup naprednijim i potencijalno opasnijim sposobnostima kibernetičke sigurnosti koje se inače nalaze u snažnijem modelu, Mythos.
S druge strane, iz Anthropica već danima tvrde da su brige administracije preuveličane. Njihovi predstavnici ponovili su ovaj stav tijekom radnih sastanaka održanih u Ministarstvu trgovine (Commerce Department), na kojima su sudjelovali i vladini istraživači iz Centra za standarde i inovacije u umjetnoj inteligenciji, kao i Ured nacionalnog kibernetičkog direktora.
Zašto je to važno
Ovaj sukob naglašava rastuću napetost između brzog tehnološkog razvoja AI industrije i vladinih napora da kontrolira potencijalno opasne tehnologije. Odluka o zadržavanju izvoznih ograničenja za Claude Fable 5 šalje snažnu poruku svim AI tvrtkama o važnosti robusnih i nezaobilaznih sigurnosnih mehanizama, osobito kada su u pitanju modeli s naprednim mogućnostima u području kibernetičke sigurnosti.
Tehnička pozadina
Sigurnost naprednih jezičnih modela složen je izazov koji uključuje nekoliko ključnih koncepata:
- Guardrails (Zaštitne mjere): Softverska pravila i ograničenja ugrađena u model kako bi se spriječilo generiranje štetnog, ilegalnog ili opasnog sadržaja, uključujući zlonamjerni kod.
- Jailbreaking: Tehnike koje korisnici primjenjuju, često putem specifično oblikovanih upita (prompts), kako bi prevarili model i zaobišli njegove ugrađene zaštitne mjere.
- Pristup sposobnostima: U ovom slučaju, vlada strahuje da bi probijanje zaštite modela Claude Fable 5 moglo otključati naprednije mogućnosti kibernetičke sigurnosti koje su inače rezervirane za moćniji model Mythos.
Širi kontekst
Hitni pregovori i zadržavanje sankcija dolaze u politički osjetljivom trenutku za Anthropic. Tvrtka je već duže vrijeme u sporu s Pentagonom oko toga mogu li se njezini AI modeli koristiti za određene vojne primjene. Uz to, uključivanje visokih dužnosnika, poput ministra trgovine Howarda Lutnicka, ukazuje na to da vlada ovo pitanje tretira kao prioritet nacionalne sigurnosti. Ministarstvo trgovine izrazilo je spremnost da se pronađe način za vraćanje modela Fable 5 u potrošačku upotrebu, no to će vjerojatno ovisiti o tome hoće li Anthropic u potpunosti riješiti probleme s "jailbreakingom".
Što slijedi
Očekuje se da će Anthropic morati provesti dodatna sigurnosna testiranja i potencijalno implementirati strože zaštitne mehanizme kako bi zadovoljio zahtjeve administracije. U međuvremenu, ostale tvrtke koje razvijaju umjetnu inteligenciju pažljivo prate rasplet ove situacije, s obzirom na to da bi ishod mogao postaviti novi presedan za regulaciju i izvoz naprednih AI sustava iz Sjedinjenih Američkih Država. Obje strane ističu kako brzo rade na rješavanju problema.
Izvor: Wired Objavljeno na portalu Umjetna Inteligencija Blog by ShtefAI, autor: Shtef



