Az Anthropic kiadta a Claude Fable 5.1-et, hozzáadva egy új, általánosan elérhető Claude-modellt, amelynek árstruktúrája a gyorsítótár viselkedését az API költségtervezés középpontjába helyezi. A cég modelldokumentációja a 2026. szeptember 1-jén kiadott Claude Fable 5.1 aktív és legújabb verzióját tartalmazza, a Claude API-modell azonosítója claude-fable-5-1.

A főárak egyértelműek: millió bemeneti tokenenként 10 dollár és millió kimeneti tokenenként 50 dollár. A működés szempontjából fontosabb szám a gyorsítótár-olvasási ár lehet, amely 0,25 dollár millió tokenenként. Az Anthropic emellett 50%-os Batch API-kedvezményt is dokumentál a bemeneti és kimeneti tokenekre.

Ez a kombináció megváltoztatja a nagy, ismétlődő kontextusokat kódoló ügynökökbe, támogató másodpilótákba, megfelelőség-ellenőrző rendszerekbe vagy belső tudássegédekbe küldő csapatok matematikáját. Ha egy alkalmazás képes megőrizni a gyorsítótár találatait a körök és a felhasználók között, a Fable 5.1 lényegesen kevesebbe kerülhet, mint azt egy egyszerű bemenet-kimenet ár-összehasonlítás javasolja. Ha ez nem sikerül, ugyanaz a munkateher papíron drágának tűnhet, gyártásban pedig drágának.

Mi változott

A Fable 5.1 nem csak új név az Anthropic katalógusában. Az Anthropic dokumentációja több terjesztési útvonalhoz sorolja fel az azonosítókat, beleértve a Claude API-t, az Amazon Bedrock-ot, a Google Cloud-ot, a Microsoft Foundry-t és a Claude Platformot az AWS-en. Ez azért fontos, mert sok vállalati vásárló nem közvetlenül egy szolgáltatói végpontról fogyaszt határmodelleket. Felhőbeli piactereken, belső átjárókon, beszerzési jóváhagyással rendelkező platformokon vagy fejlesztői eszközökön keresztül haladnak keresztül, amelyek saját szabályzati réteggel rendelkeznek.

A rendelkezésre állási kép is többszintű. Az Axios arról számolt be, hogy a Claude Fable 5.1 általánosan elérhető, míg a Claude Mythos 5.1 továbbra is csak ellenőrzött partnerekre korlátozódik olyan területeken, mint a kiberbiztonság és az élettudományok. Az adminisztrátorok számára ez azt jelenti, hogy az Anthropic szeptemberi megjelenését nem szabad egyetlen modellbevezetésként kezelni. Egy modell széles körben elérhető; úgy tűnik, hogy egy másik korlátozott hozzáférésű folyamat mögött áll.

Ez a megkülönböztetés egyre gyakoribb a határ menti MI-ben. A hozzáférés fel van osztva modell, képesség, telepítési csatorna, adatvezérlők és használati eset szerint. A csak egy megjelenített nevet és egy szolgáltató mezőt tároló modellkatalógus nem lesz elég azoknak a csapatoknak, akiknek meg kell magyarázniuk, hogy a felhasználó miért hívhat egy Claude SKU-t az egyik környezetből, de miért nem hívhat egy másikat.

Miért számít a gyorsítótár árazása

Régebben a token árakat könnyű volt összehasonlítani egy táblázatban: bemenet az egyik oldalon, kimenet a másikon. Az ügynöki munkaterhelés kevésbé hasznosította ezt. A kódoló ügynök számos körön keresztül kontextusban tarthatja a lerakat összefoglalását, a rendszerutasításokat, az eszközsémákat, a beszélgetési előzményeket és az előzetes elemzést. Egy támogatási munkafolyamat ismételten csatolhatja ugyanazt a házirend-dokumentumot vagy fiókállapotot. Ilyen esetekben a gyorsítótár olvasása uralhatja a tényleges költséggörbét.

A Fable 5.1 dokumentált 0,25 dollár/millió dolláros gyorsítótár-olvasási ára messze elmarad a 10 dollár/millió dolláros friss bemeneti ártól. Ez erős ösztönzést ad az ismétlődő kontextus stabilitásának, a munkamenetek következetes irányításának és az olyan alkalmazásminták elkerülésére, amelyek véletlenül érvénytelenítik a szolgáltatói gyorsítótárat. A kis megvalósítási lehetőségek nagy számlázási különbségekké válhatnak: a prompt előtagok megváltoztatása, az időbélyegek beszúrása az egyébként stabil utasításokba, vagy a felhasználói munkamenet szétosztása olyan útvonalakra, amelyek nem osztják meg a gyorsítótár állapotát, mind csökkenthetik az olcsó gyorsítótár-olvasások értékét.

A Batch API-kedvezmény egy második emelőt is tartalmaz. A háttér-elemzés, az értékelési futtatások, a dokumentum-ellenőrzés és az áttelepítési feladatok olcsóbbak lehetnek, ha kötegelt feladatokként ütemezhetők interaktív hívások helyett. A vállalkozások számára a gyakorlati kérdés nem egyszerűen az, hogy a Fable 5.1 „megéri-e”. Ez az, hogy mely munkaterheléseknek kell interaktívan futniuk, melyeket kötegelt formában, és amelyek újratervezhetők az újrafelhasználható kontextus megőrzése érdekében.

Kiket érint?

Az AI-átjárókat karbantartó fejlesztőknek hozzá kell adniuk az új Claude API modellazonosítót, és frissíteniük kell az ártáblázatokat, beleértve a gyorsítótár-olvasási elszámolást is. Az utolsó részt könnyű kihagyni. Egy átjáró, amely csak a friss bemeneti és kimeneti tokeneket számlázza ki, vagy hibásan jelzi a marzsokat, vagy elrejti a megtakarításokat az ügyfelek elől. A használati elemzésnek a gyorsítótárazott bemenetet a frisstől elkülönítve kell megjelenítenie, különösen az ügynöki munkaterhelést hangolni próbáló csapatok esetében.

A vállalati platform csapatainak más problémájuk van: a rendelkezésre állás és az irányítás. Mivel a Fable 5.1 számos felhő- és platformútvonalon dokumentálva van, előfordulhat, hogy a rendszergazdáknak el kell dönteniük, hogy ugyanaz a modell mindenhol engedélyezett-e, vagy csak a jóváhagyott csatornákon keresztül. A felhőútvonal kiválasztása befolyásolhatja a beszerzést, a naplózást, a regionális ellenőrzéseket és az incidensekre adott válaszokat.A Mythos 5.1 korlátozott hozzáférése egy újabb réteget ad, mert a jogosultság a partnerek átvilágításától függhet, nem pedig a normál modellváltási munkafolyamattól.

A Model Gate-stílusú platformok esetében a kiadás emlékeztet arra, hogy a többmodelles API ma már árképzési és irányelvi elvont, nem csak OpenAI-kompatibilis API-homlokzat. Az átjárónak ismernie kell a modellazonosítót, a szolgáltató útvonalát, a gyorsítótár házirendjét, a kötegelt engedményt, az ügyfél által látható árat és a hozzáférési állapotot. Olyan hibamódokra is szüksége van, amelyek egyértelműek, amikor az ügyfél olyan modellt vagy képességet kér, amelyet nem használhat.

Ami továbbra is homályos

A jelentéshez letöltött nyilvános dokumentáció megerősíti a modellazonosítót, a kiadás dátumát, az aktív állapotot, a listázott árakat és a támogatott terjesztési azonosítókat. Nem old meg teljesen minden indítási részletkérdést. Az Anthropic híradószoba-indexe nyilvános indító bejegyzést mutatott, de a részletes oldalt nem találták meg teljesen ebben a kutatási jegyben. Az Axios beszámolt az általánosan elérhető Fable 5.1 és a korlátozott Mythos 5.1 hozzáférés közötti rendelkezésre állási különbségekről is, de a Mythos használatára való pontos alkalmassági folyamatot nem határozták meg az ellenőrzött anyagban.

Vannak megvalósítási kérdések is, amelyeket minden platformnak magának kell megválaszolnia. A gyorsítótár gazdaságossága a valós találati arányon múlik, nem a listaárakon. A felhő-specifikus azonosítók útvonal-specifikus működési viselkedést mutathatnak. A kötegelt munkaterhelések olcsók lehetnek, de nem megfelelőek a késleltetésre érzékeny termékekhez. A vállalkozásoknak továbbra is el kell dönteniük, hogy az Anthropic legújabb árazása megfelel-e az irányítási, megőrzési és ellenőrzési követelményeiknek.

Az azonnali intézkedés konkrét: adott esetben adja hozzá a claude-fable-5-1-t, válassza le a Fable 5.1-et a korlátozott Mythos 5.1-től a katalógusokban, és tegye láthatóvá a gyorsítótár olvasatait a költségjelentésekben. A hosszabb távú lecke szélesebb. A Frontier modellek elindítása irányítási sík eseményekké válik. A nyertesek azok a csapatok lesznek, amelyek képességek, ár, irányelvek és munkaterhelés alapján tudnak útvonalat vezetni anélkül, hogy a fejlesztőknek meg kellene tanulniuk a szolgáltatókatalógust.