Google predstavio nove Gemini modele 3.6 Flash i 3.5 Flash-Lite
Novi modeli donose veću učinkovitost za skaliranje AI agenata
Google je objavio nove modele iz serije Gemini, uključujući 3.6 Flash i 3.5 Flash-Lite. Cilj novih izdanja je pružiti veću učinkovitost, manju latenciju i pouzdanije performanse za programere koji grade AI agente na velikoj skali.
Ključni detalji
Gemini 3.6 Flash je glavni model namijenjen za programiranje i obradu informacija, s poboljšanim mogućnostima i nižom cijenom po tokenu u odnosu na prethodnika. S druge strane, 3.5 Flash-Lite je najbrži i najisplativiji model iz serije 3.5, idealan za zadatke koji zahtijevaju visoku propusnost.
Zašto je to važno
Razvoj učinkovitijih modela ključan je za široku primjenu autonomnih agenata u poslovnim procesima. Smanjenje troškova i latencije omogućuje tvrtkama isplativiju implementaciju složenih AI sustava koji mogu obavljati više zadataka u stvarnom vremenu.
Tehnička pozadina
- 3.6 Flash model donosi poboljšanja u programiranju, radu sa znanjem i multimodalnim performansama, koristeći 17% manje izlaznih tokena od verzije 3.5 Flash.
- Model 3.5 Flash-Lite generira 350 izlaznih tokena u sekundi, nadmašujući prethodne generacije u agentskim radnim procesima.
- Novi modeli omogućuju skaliranje agenata bez kompromitiranja učinkovitosti.
Širi kontekst
Ova objava pokazuje jasan fokus industrije na optimizaciju resursa. Dok se i dalje razvijaju sve veći modeli, kompanije prepoznaju potrebu za bržim i jeftinijim rješenjima koja su dovoljno sposobna za rješavanje praktičnih problema bez prevelikih troškova infrastrukture.
Što slijedi
Očekuje se da će novi modeli potaknuti brži razvoj i primjenu AI agenata u poslovanju, omogućujući tvrtkama stvaranje pouzdanijih i jeftinijih rješenja.
Izvor: Google Blog Objavljeno na portalu Umjetna Inteligencija Blog by ShtefAI, autor: Shtef



