Nem a csúcsmodell jött: itt a Gemini 3.6 Flash
- A Google 2024. július 21-én három új Gemini-modellt adott ki: a 3.6 Flash-t, a 3.5 Flash-Lite-ot és a zárt, kiberbiztonsági 3.5 Flash Cyber-t, miközben a régóta várt zászlóshajó Gemini 3.5 Pro továbbra is korlátozott tesztelés alatt áll.
- A Gemini 3.6 Flash a 17%-kal jobb tokenhatékonyságával (Artificial Analysis Index) és alacsonyabb árazásával (input: $1,50/1M token, output: $7,50/1M) a költséghatékony, nagy volumenű alkalmazások fejlesztőinek jelentős megtakarítást hozhat.
- A Google a Gemini 4 fejlesztésének megkezdését is bejelentette, de a piac csúcsát jelenleg az Anthropic Claude Fable 5-je uralja, és a riválisok (Grok 4.5, GPT-5.6) új modelljei miatt a Google nyomás alatt van a következő nagy dobással.
Rendszer fókusz: A speciális 3.5 Flash Cyber modell korlátozott elérhetősége (CodeMender pilot) miatt, ha a szervezeted a kiberbiztonsági feladatok automatizálására használna ilyen modellt, érdemes nyomon követni a partnerré válás feltételeit, és addig is a nyíltan elérhető, biztonsági finomhangolású modellek (pl. a 3.6 Flash natív eszközhasználatával) A/B-tesztelésével felmérni, pontosabb kódot és kevesebb hibás módosítást eredményez-e a jelenlegi megoldásodnál.
Ez a cikk több nemzetközi forrás alapján, mesterséges intelligencia közreműködésével készült szerkesztett összefoglaló, amely nem azonos egyetlen konkrét forrás tartalmával sem. A szöveg csak szerkesztői átolvasás után jelenik meg, ennek ellenére tartalmazhat pontatlanságokat; a felhasznált források lentebb olvashatók.
A Google július 21‑én három új Gemini modellt adott ki, de a figyelmet legalább annyira az kapja, ami nem érkezett meg, mint az, ami igen. A DeepMind a Gemini 3.6 Flash-t, a 3.5 Flash‑Lite-ot és egy kiberbiztonságra hangolt, 3.5 Flash Cyber nevű modellt mutatott be – miközben a régóta ígért zászlóshajó, a Gemini 3.5 Pro (eredetileg júniusra várt) továbbra is csak korlátozott partneri tesztelésben érhető el.
Gemini 3.6 Flash: Az új alapértelmezett igásló
A frissítés központi eleme a Gemini 3.6 Flash, amelyet a Google az új alapértelmezett „igáslómodellként” pozicionál. A Gemini 3.5 Flash-re épül, és a kódolásban, a tudásmunkában, valamint a multimodális feladatokban ígér jobb teljesítményt.
A leglényegesebb újítás a hatékonyság: az Artificial Analysis Index mérése szerint a 3.6 Flash körülbelül 17 % kevesebb kimeneti tokent használ, mint elődje, és kevesebb gondolkodási lépéssel, illetve eszközhívással old meg egy-egy többlépéses munkafolyamatot.
17 % tokencsökkenés közvetlenül a számlán is megmutatkozik.
Ez a megtakarítás a költségekben is tükröződik:
- Input díj: $1,50 / 1 millió token
- Output díj: $7,50 / 1 millió token (szemben a 3.5 Flash $9,00-os kimeneti árával)
- Kontextusablak: 1 millió token, 64 ezer tokenes maximális kimenettel
- Képességek: natív multimodális bemenet és beépített eszközhasználat, köztük a Computer Use funkció
Benchmarkok és gyártói mérések
A Google saját kódolási és ügynökös benchmarkjain a Gemini 3.6 Flash felülmúlja elődjét:
- DeepSWE kódolási teszt: 49 % (a korábbi 37 % helyett)
- OSWorld számítógép‑használati teszt: 83 % (a korábbi 78,4 % helyett)
Fontos azonban a kontextus: ezek gyártói, a Google által közzétett belső mérések, nem független tesztek, és külső értékelő egyelőre nem reprodukálta őket. Ráadásul a benchmarkok azt mutatják, hogyan viszonyul az új modell a régihez, nem pedig, hol áll a versenytársak csúcsmodelleihez képest.
A Google kifejezetten úgy fogalmaz, hogy a 3.6 Flash pontosabb kódot ad, kevesebb nemkívánatos kódmódosítással és kevesebb végrehajtási hurokkal, ami az ügynökös munkafolyamatoknál különösen fontos.
Költséghatékony belépőszint és zárt kiberbiztonság
A másik két modell a szélső eseteket célozza meg:
- Gemini 3.5 Flash‑Lite: a sorozat legköltséghatékonyabb tagja $0,30 input‑ és $2,50 output‑árral. Ez a modell a Google Keresésbe és a Gemini appba is bekerül.
- Gemini 3.5 Flash Cyber: speciálisan szoftversebezhetőségek megtalálására és javítására hangolt modell. Kizárólag kormányzati szereplők és megbízható partnerek férnek hozzá a korlátozott CodeMender pilotprogram keretében; nyilvános API-ja és önkiszolgáló hozzáférése egyelőre nincs.
Piaci helyzetkép: Hiányzik a csúcsmodell
Ez a húzás jól illeszkedik a szélesebb iparági mintázatba: a piac a tokenhatékony, olcsó modellek felé tolódik, mert a legtöbb valós feladathoz nem a legdrágább gondolkodó modell szükséges.
A Google éppen ezt a réteget erősíti – csakhogy a mostani kiadás nem zárja be azt a rést, amely a piac tetejét meghatározta. Míg a Google inkrementális Flash‑frissítéseket adott ki, alig egy hét alatt megjelent a Grok 4.5, az OpenAI GPT‑5.6 három variánsa és a kínai Moonshot Kimi K3‑a. A nyilvános ranglisták élén továbbra is az Anthropic Claude családja áll, élén a Fable 5 – vagyis pontosan az a szint, amely felett a Google Flash‑modelljei elhelyezkednek. Az a modell, amely valóban felvenné a versenyt a mezőny tetején, továbbra is hiányzik.
Összegzés és kilátások
A Google ugyanakkor a jövőre nézve is tett egy jelzést: elindította azt, amit „eddigi legambiciózusabb előtanítási futásának” nevez a Gemini 4 fejlesztésének keretében. Egyelőre azonban ez is csak ígéret.
A helyes olvasat kettős: a Gemini 3.6 Flash valódi, kézzelfogható előrelépés ott, ahol a legtöbb fejlesztő dönt – az árban és a tokenhatékonyságban.
Aki nagy volumenű, ügynökös terhelést futtat Geminin, annak érdemes gyors A/B‑teszttel összevetnie a jelenlegi beállításával.
Aki viszont a Google‑től a piac tetejét megcélzó nagy dobásra várt, annak továbbra is várnia kell: az augusztus már a Gemini 3.5 Pro – vagy a Gemini 4 első valódi jeleinek – hónapja lehet.
Kövesd a témát
Értesítést kapsz a profilodban és a heti hírlevélben, ha új cikkünk jelenik meg a követett témáidban.
A követéshez jelentkezz be.
Gyakori kérdések az AI hírekről
Hol olvashatóak a legfrissebb AI hírek magyarul?
A KakasTech AI Hírek rovata naponta frissül: a mesterséges intelligencia legújabb fejlesztései, modell-bejelentések és iparági elemzések magyar nyelven, ellenőrzött nemzetközi források alapján olvashatóak nálunk.
Milyen témákat fednek le a KakasTech AI hírei?
A nagy AI-laborok (OpenAI, Anthropic, Google DeepMind) bejelentéseitől a chipeken és a robotikán át a hazai és nemzetközi szabályozásokig minden lényeges területet követünk.
Hogyan értesülhetek azonnal a legújabb AI változásokról?
Feliratkozhatsz a heti összefoglaló hírlevelünkre a lap alján, vagy követheted az AI API-árkalkulátorunkat és az AI-modell összehasonlító oldalunkat a legfrissebb technikai adatokért.
Hozzászólások 0
Még nincsenek hozzászólások. Írd meg te az elsőt!