Anthropic vraća model Claude Fable 5 u javnu upotrebu
Nakon dogovora s američkom vladom, ukinuta su izvozna ograničenja
Nakon tjedana pregovora s Trumpovom administracijom, Anthropic je dobio odobrenje za vraćanje modela Claude Fable 5 u javnu upotrebu. Američko Ministarstvo trgovine ukinulo je izvozna ograničenja, omogućivši korisnicima diljem svijeta ponovni pristup ovom moćnom AI sustavu.
Ključni detalji
Anthropic je početkom lipnja bio prisiljen suspendirati Fable 5 zbog zabrinutosti vlade oko potencijalnih sigurnosnih propusta (tzv. jailbreaka) koje su otkrili istraživači iz Amazona. Kako bi riješila taj problem, tvrtka je trenirala poboljšani sigurnosni klasifikator koji sada uspješno blokira više od 99% spornih zahtjeva. Korisnici čiji zahtjevi budu blokirani bit će preusmjereni na stariji model Opus 4.8.
Zašto je to važno
Ovaj dogovor predstavlja važan presedan u načinu na koji će se regulirati napredni AI modeli s potencijalnim sigurnosnim implikacijama. Pokazuje da je moguća suradnja između tehnoloških kompanija i vlade u osiguravanju sigurnosti bez trajnog zaustavljanja inovacija, iako uz značajne ustupke od strane industrije.
Tehnička pozadina
Da bi udovoljio zahtjevima administracije, Anthropic je implementirao nekoliko novih mehanizama:
- Integracija naprednog sigurnosnog klasifikatora za sprječavanje zloupotreba.
- Pristanak na predizdanja (pre-release) evaluacije modela od strane vlade.
- Uspostava tima za 24-satni nadzor ključnih kanala za prijavu sigurnosnih propusta.
Širi kontekst
Ova situacija događa se u ključnom trenutku za Anthropic, koji se priprema za inicijalnu javnu ponudu (IPO). Pored Fable 5 modela, vlada je nedavno odobrila i povratak moćnijeg modela Mythos 5, ali samo za unaprijed odobreni popis organizacija, što ukazuje na slojevit pristup regulaciji umjetne inteligencije.
Što slijedi
Anthropic se obvezao raditi s vladom i drugim vodećim AI laboratorijima na stvaranju zajedničkog standarda za sigurnost i evaluaciju modela. Iako upozoravaju da je nemoguće učiniti bilo koji model potpuno otpornim na napade, očekuje se nastavak bliske suradnje i strožeg nadzora pri budućim izdanjima novih sustava.
Izvor: The Verge Objavljeno na portalu Umjetna Inteligencija Blog by ShtefAI, autor: Shtef



