Nem a legdrágább modell a legjobb: mikor melyik Claude-ot használd a Claude Code-ban
- Az Anthropic 2026 közepére három Claude-modellt – Sonnet 5, Opus 4.8 és Fable 5 – kínál, áruk 2–10 $ input és 10–50 $ output tokenenként.
- Egy AI-ügynök költsége 25 $‑ról 500 $‑ra nőtt, ha minden feladatot a legdrágább modellre irányították, ami rámutat a költségoptimalizálás kritikus szerepére.
- A jövőben a Sonnet 5 legyen alapszint, Opus 4.8 „xhigh” módra, Fable 5 csak komplex feladatokra, a szabályokat CLAUDE.md‑ben rögzítve és a számlákat havonta ellenőrizve.
Rendszer fókusz: Állíts be automatikus modell‑routingot a kódfeldolgozás típusai szerint (pl. Sonnet 5 alapfeladatok, Opus 4.8 „xhigh” komplex, Fable 5 csak kritikus) egy CLAUDE.md konfigurációs fájlban, és aktiváld a havi költség‑figyelmeztetést az Anthropic dashboardon, hogy token‑túllépés esetén azonnal alacsonyabb modellt válassz.
Ez a cikk több nemzetközi forrás alapján, mesterséges intelligencia közreműködésével készült szerkesztett összefoglaló, amely nem azonos egyetlen konkrét forrás tartalmával sem. A szöveg csak szerkesztői átolvasás után jelenik meg, ennek ellenére tartalmazhat pontatlanságokat; a felhasznált források lentebb olvashatók.
Az Anthropic 2026 közepére szokatlan helyzetet teremtett: egyszerre három csúcskategóriás Claude-modellt kínál, amelyek ára ötszörös sávban mozog. A fejlesztők ösztönös reflexe, hogy a legnagyobb, legokosabb és legdrágább modellt állítják be alapértelmezettnek mindenre – ám ez a szokás a havi API-számlán bosszulja meg magát.
Egy sokat idézett példa szerint egy állandóan futó AI-ügynök havi költsége nagyjából 25 dollárról 500 dollár fölé ugrott pontosan ugyanazért a munkáért, csak azért, mert mindent a legdrágább modellre irányítottak.
A tanulság nem az, hogy le kell mondanunk a modellekről, hanem az, hogy meg kell tanulnunk, melyik feladat melyik modellhez tartozik.
A Claude-ökoszisztéma három szintje
A három modell nem egyszerű ranglétra, hanem inkább egy rétegzett, egymásra épülő készlet.
Claude Sonnet 5 – A végrehajtó
Kiegyensúlyozott alapértelmezés a mindennapi kódoláshoz, kódellenőrzéshez, adatkinyeréshez és eszközhasználathoz. Ár: 2 dollár input / 10 dollár output (1 millió tokenenként).
Fontos nüansz: A Sonnet 5 az Anthropic új tokenizálóját használja, amely ugyanazt a szöveget több tokenre bontja, mint a korábbi verziók. Emiatt az effektív ára a névlegesnél valamivel magasabb lehet.
Claude Opus 4.8 – A helyesség munkalova
A természetes lépcsőfok a Sonnet felett. Kifejezetten a hosszú, több lépésből álló, órákig futó autonóm feladatokra épült. Ár: 5 dollár input / 25 dollár output (1 millió tokenenként). Kontextusablak: 1 milliós kontextus, 128 ezer tokenes maximális kimenettel.
Ügynökfunkciók: Támogat egy extra, „xhigh” nevű erőfeszítési szintet, amelyet az Anthropic kifejezetten a nehéz kódolási feladatokhoz ajánl. Emellett képes fogadni a menet közbeni rendszerüzeneteket, így egy hosszú futás közben is átadható új kontextus anélkül, hogy megtörne a prompt cache.
Claude Fable 5 – A csúcsértelmiségi
A Mythos-kategória nyilvánosan elérhető, biztonsági osztályozóval ellátott változata. A Fable 5 gondolkodása mindig aktív, ezért egyetlen válasz is percekig tarthat – cserébe a legnehezebb, hosszú távú, nagy tétű munkákra való. Ár: 10 dollár input / 50 dollár output (1 millió tokenenként) – ezzel a kínálat legdrágább modellje.
Elérhetőség: A hozzáférhetőség státusza dinamikusan változik. Az Egyesült Államokon kívüli exportkorlátozások miatti átmeneti felfüggesztést követően július 1-jével visszaállították. A hírek szerint a modell a fix havidíjas csomagokból kikerülhet, és elsősorban használatalapú elszámolással marad elérhető.
A gyakorlati stratégia: Az eszkalációs létra
A bevált fejlesztői logika egyszerű: a Sonnet elvégzi a munkát, az Opus ellenőrzi a munkát, a Fable pedig a rémisztően nehéz feladatokat viszi.
A legtöbb kódolási munkafolyamatnál érdemes a Sonnet 5-tel indítani a megvalósításnál és a hibakeresésnél. Ha a modell elakad, az Opus 4.8-cal kell ellenőrizni vagy eszkalálni a problémát, és a Fable 5-öt csak akkor szabad bevetni, ha a plusz költséget tényleg indokolja egy rendkívül összetett architektúra-tervezés. A cél az, hogy minden kérést a legolcsóbb olyan modellre terheljünk, amely még magabiztosan megüti a szükséges szintet.
A rejtett trükk: Az erőfeszítési szint szabályozása
Sokan elfelejtik tudatosan állítani a modell erőfeszítési szintjét. Az Anthropic dokumentációja szerint a Fable 5 alacsonyabb erőfeszítési beállításai is kiemelkedően teljesítenek, gyakran felülmúlva a korábbi modellek maximumát. Vagyis ha egy munka meg is követeli a Fable-t, a rutinszerű részeket futtathatod alacsonyabb fokozaton, és a maximális beállítást a valóban kritikus logikai csomópontokra tartogathatod.
Az Opusnál ugyanez fordítva igaz: mielőtt a méregdrága Fable-höz nyúlnál, előbb érdemes az Opust „xhigh” fokozatra tekerni.
A javasolt fejlesztői létra:
- Sonnet magas erőfeszítésen
- Opus „xhigh” fokozaton
- Fable a feladat komplexitása szerint skálázva
Hogyan építsd be a rendszerbe?
Ne bízd ezt a döntést a pillanatnyi hangulatodra. Érdemes az útválasztási logikát és a szabályokat előre rögzíteni a projekt konfigurációjában – például egy CLAUDE.md fájlban –, hogy a rendszer automatikusan tudja, melyik részfeladat melyik modellhez tartozik. Végül pedig: bármit is gondolsz az útválasztásodról, a valóságot az első heti API-számla fogja megmutatni – onnan érdemes a valós számok alapján finomhangolni a rendszert.
Kövesd a témát
Értesítést kapsz a profilodban és a heti hírlevélben, ha új cikkünk jelenik meg a követett témáidban.
A követéshez jelentkezz be.
Gyakori kérdések az AI hírekről
Hol olvashatóak a legfrissebb AI hírek magyarul?
A KakasTech AI Hírek rovata naponta frissül: a mesterséges intelligencia legújabb fejlesztései, modell-bejelentések és iparági elemzések magyar nyelven, ellenőrzött nemzetközi források alapján olvashatóak nálunk.
Milyen témákat fednek le a KakasTech AI hírei?
A nagy AI-laborok (OpenAI, Anthropic, Google DeepMind) bejelentéseitől a chipeken és a robotikán át a hazai és nemzetközi szabályozásokig minden lényeges területet követünk.
Hogyan értesülhetek azonnal a legújabb AI változásokról?
Feliratkozhatsz a heti összefoglaló hírlevelünkre a lap alján, vagy követheted az AI API-árkalkulátorunkat és az AI-modell összehasonlító oldalunkat a legfrissebb technikai adatokért.
Hozzászólások 0
Még nincsenek hozzászólások. Írd meg te az elsőt!