AI vijesti3 min čitanja

Anthropicov model Claude Fable 5 ponovno dostupan korisnicima

Nakon pregovora s Trumpovom administracijom, ukinuta su izvozna ograničenja i Anthropic vraća Fable 5 u javnu upotrebu s boljim sigurnosnim mjerama.

S

Autor

Shtef

Objavljeno

Anthropic Claude AI model

Anthropic vraća model Claude Fable 5 u javnu upotrebu

Nakon dogovora s američkom vladom, ukinuta su izvozna ograničenja

Nakon tjedana pregovora s Trumpovom administracijom, Anthropic je dobio odobrenje za vraćanje modela Claude Fable 5 u javnu upotrebu. Američko Ministarstvo trgovine ukinulo je izvozna ograničenja, omogućivši korisnicima diljem svijeta ponovni pristup ovom moćnom AI sustavu.

Ključni detalji

Anthropic je početkom lipnja bio prisiljen suspendirati Fable 5 zbog zabrinutosti vlade oko potencijalnih sigurnosnih propusta (tzv. jailbreaka) koje su otkrili istraživači iz Amazona. Kako bi riješila taj problem, tvrtka je trenirala poboljšani sigurnosni klasifikator koji sada uspješno blokira više od 99% spornih zahtjeva. Korisnici čiji zahtjevi budu blokirani bit će preusmjereni na stariji model Opus 4.8.

Zašto je to važno

Ovaj dogovor predstavlja važan presedan u načinu na koji će se regulirati napredni AI modeli s potencijalnim sigurnosnim implikacijama. Pokazuje da je moguća suradnja između tehnoloških kompanija i vlade u osiguravanju sigurnosti bez trajnog zaustavljanja inovacija, iako uz značajne ustupke od strane industrije.

Tehnička pozadina

Da bi udovoljio zahtjevima administracije, Anthropic je implementirao nekoliko novih mehanizama:

  • Integracija naprednog sigurnosnog klasifikatora za sprječavanje zloupotreba.
  • Pristanak na predizdanja (pre-release) evaluacije modela od strane vlade.
  • Uspostava tima za 24-satni nadzor ključnih kanala za prijavu sigurnosnih propusta.

Širi kontekst

Ova situacija događa se u ključnom trenutku za Anthropic, koji se priprema za inicijalnu javnu ponudu (IPO). Pored Fable 5 modela, vlada je nedavno odobrila i povratak moćnijeg modela Mythos 5, ali samo za unaprijed odobreni popis organizacija, što ukazuje na slojevit pristup regulaciji umjetne inteligencije.

Što slijedi

Anthropic se obvezao raditi s vladom i drugim vodećim AI laboratorijima na stvaranju zajedničkog standarda za sigurnost i evaluaciju modela. Iako upozoravaju da je nemoguće učiniti bilo koji model potpuno otpornim na napade, očekuje se nastavak bliske suradnje i strožeg nadzora pri budućim izdanjima novih sustava.


Izvor: The Verge Objavljeno na portalu Umjetna Inteligencija Blog by ShtefAI, autor: Shtef

Povezano

Pročitajte i ovo

Još nekoliko objava koje šire kontekst oko tema, kompanija i AI trendova iz ove priče.

Ilustracija AI agenata i poslovne primjene
Analiza

AI agenti u 2026. godini: Od velikih obećanja do stvarne primjene

Analiza zašto općenamjenski AI agenti još uvijek nisu spremni za poslovnu primjenu. Prava vrijednost dolazi iz usko specijaliziranih alata pod ljudskim nadzorom.

Ilustracija tehnološkog balona i stabilizacije industrije umjetne inteligencije
Analiza

Generativna umjetna inteligencija: Kraj balona ili novi početak?

Zašto je trenutno usporavanje AI industrije zapravo najbolja stvar koja se mogla dogoditi tržištu i korisnicima.

Ilustracija zdravstvenih podataka integriranih u ChatGPT sučelje
AI vijesti

OpenAI lansirao Health integraciju unutar ChatGPT-a

OpenAI je za korisnike u SAD-u uveo značajku Health u ChatGPT koja omogućuje sigurno povezivanje Apple Healtha i medicinskih kartona za personalizirane savjete.