AI vijesti3 min čitanja

Bijela kuća i Anthropic i dalje u sukobu oko modela Claude Fable 5

Pregovori Trumpove administracije i tvrtke Anthropic završili su bez ukidanja izvoznih ograničenja za Claude Fable 5 zbog zabrinutosti oko sigurnosti.

S

Autor

Shtef

Objavljeno

Zgrada Bijele kuće i AI tehnologija

Bijela kuća i Anthropic i dalje u sukobu oko modela Claude Fable 5

Trumpova administracija zadržava izvozna ograničenja nakon neuspješnih pregovora

Pregovori između Trumpove administracije i tehnološke tvrtke Anthropic završili su bez dogovora o ukidanju nedavno nametnutih izvoznih ograničenja. Vlada Sjedinjenih Američkih Država i dalje ograničava izvoz najnaprednijih AI modela tvrtke Anthropic, prvenstveno zbog straha od sigurnosnih ranjivosti i mogućnosti zaobilaženja postavljenih zaštitnih mehanizama ("jailbreaking").

Ključni detalji

Dužnosnici Trumpove administracije zaključili su pregovore s Anthropicom bez ukidanja izvoznih ograničenja koja su nametnuta ranije, a tiču se naprednog modela Claude Fable 5. Prema izvorima upoznatim sa situacijom, administracija vjeruje da postoje načini za onemogućavanje nekih zaštitnih mjera ("guardrails") u modelu Claude Fable 5. To bi korisnicima moglo omogućiti pristup naprednijim i potencijalno opasnijim sposobnostima kibernetičke sigurnosti koje se inače nalaze u snažnijem modelu, Mythos.

S druge strane, iz Anthropica već danima tvrde da su brige administracije preuveličane. Njihovi predstavnici ponovili su ovaj stav tijekom radnih sastanaka održanih u Ministarstvu trgovine (Commerce Department), na kojima su sudjelovali i vladini istraživači iz Centra za standarde i inovacije u umjetnoj inteligenciji, kao i Ured nacionalnog kibernetičkog direktora.

Zašto je to važno

Ovaj sukob naglašava rastuću napetost između brzog tehnološkog razvoja AI industrije i vladinih napora da kontrolira potencijalno opasne tehnologije. Odluka o zadržavanju izvoznih ograničenja za Claude Fable 5 šalje snažnu poruku svim AI tvrtkama o važnosti robusnih i nezaobilaznih sigurnosnih mehanizama, osobito kada su u pitanju modeli s naprednim mogućnostima u području kibernetičke sigurnosti.

Tehnička pozadina

Sigurnost naprednih jezičnih modela složen je izazov koji uključuje nekoliko ključnih koncepata:

  • Guardrails (Zaštitne mjere): Softverska pravila i ograničenja ugrađena u model kako bi se spriječilo generiranje štetnog, ilegalnog ili opasnog sadržaja, uključujući zlonamjerni kod.
  • Jailbreaking: Tehnike koje korisnici primjenjuju, često putem specifično oblikovanih upita (prompts), kako bi prevarili model i zaobišli njegove ugrađene zaštitne mjere.
  • Pristup sposobnostima: U ovom slučaju, vlada strahuje da bi probijanje zaštite modela Claude Fable 5 moglo otključati naprednije mogućnosti kibernetičke sigurnosti koje su inače rezervirane za moćniji model Mythos.

Širi kontekst

Hitni pregovori i zadržavanje sankcija dolaze u politički osjetljivom trenutku za Anthropic. Tvrtka je već duže vrijeme u sporu s Pentagonom oko toga mogu li se njezini AI modeli koristiti za određene vojne primjene. Uz to, uključivanje visokih dužnosnika, poput ministra trgovine Howarda Lutnicka, ukazuje na to da vlada ovo pitanje tretira kao prioritet nacionalne sigurnosti. Ministarstvo trgovine izrazilo je spremnost da se pronađe način za vraćanje modela Fable 5 u potrošačku upotrebu, no to će vjerojatno ovisiti o tome hoće li Anthropic u potpunosti riješiti probleme s "jailbreakingom".

Što slijedi

Očekuje se da će Anthropic morati provesti dodatna sigurnosna testiranja i potencijalno implementirati strože zaštitne mehanizme kako bi zadovoljio zahtjeve administracije. U međuvremenu, ostale tvrtke koje razvijaju umjetnu inteligenciju pažljivo prate rasplet ove situacije, s obzirom na to da bi ishod mogao postaviti novi presedan za regulaciju i izvoz naprednih AI sustava iz Sjedinjenih Američkih Država. Obje strane ističu kako brzo rade na rješavanju problema.


Izvor: Wired Objavljeno na portalu Umjetna Inteligencija Blog by ShtefAI, autor: Shtef

Povezano

Pročitajte i ovo

Još nekoliko objava koje šire kontekst oko tema, kompanija i AI trendova iz ove priče.

Ilustracija AI agenata i poslovne primjene
Analiza

AI agenti u 2026. godini: Od velikih obećanja do stvarne primjene

Analiza zašto općenamjenski AI agenti još uvijek nisu spremni za poslovnu primjenu. Prava vrijednost dolazi iz usko specijaliziranih alata pod ljudskim nadzorom.

Ilustracija tehnološkog balona i stabilizacije industrije umjetne inteligencije
Analiza

Generativna umjetna inteligencija: Kraj balona ili novi početak?

Zašto je trenutno usporavanje AI industrije zapravo najbolja stvar koja se mogla dogoditi tržištu i korisnicima.

Ilustracija zdravstvenih podataka integriranih u ChatGPT sučelje
AI vijesti

OpenAI lansirao Health integraciju unutar ChatGPT-a

OpenAI je za korisnike u SAD-u uveo značajku Health u ChatGPT koja omogućuje sigurno povezivanje Apple Healtha i medicinskih kartona za personalizirane savjete.