Anthropic ha llançat Claude Fable 5.1, afegint un nou model Claude disponible generalment amb una estructura de preus que situa el comportament de la memòria cau a prop del centre de la planificació de costos de l'API. La documentació del model de l'empresa inclou la Claude Fable 5.1 publicada l'1 de setembre de 2026, activa i més recent, amb l'identificador del model de l'API de Claude claude-fable-5-1.
Els preus dels titulars són senzills: 10 dòlars per milió de fitxes d'entrada i 50 dòlars per milió de fitxes de sortida. El nombre més important a nivell operatiu pot ser el preu de lectura de la memòria cau, que figura a 0,25 dòlars per milió de fitxes. Anthropic també documenta un descompte del 50% de l'API de lots en fitxes d'entrada i sortida.
Aquesta combinació canvia les matemàtiques dels equips que envien contextos grans i repetits a agents de codificació, copilots de suport, sistemes de revisió de compliment o assistents de coneixement intern. Si una aplicació pot conservar les visites de memòria cau a través de torns i usuaris, Fable 5.1 pot costar molt menys del que suggereix una simple comparació de preus d'entrada-sortida. Si no és possible, la mateixa càrrega de treball podria semblar cara en paper i cara en producció.
El que va canviar
Fable 5.1 no és només un nom nou al catàleg d'Anthropic. La documentació d'Anthropic enumera els identificadors per a diverses rutes de distribució, com ara l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry i Claude Platform a AWS. Això importa perquè molts compradors empresarials no consumeixen models de frontera directament des d'un punt final del proveïdor. S'envien a través de mercats al núvol, passarel·les internes, plataformes aprovades per a la compra o eines de desenvolupament que tenen la seva pròpia capa de política.
La imatge de disponibilitat també està escalonada. Axios va informar que Claude Fable 5.1 està disponible generalment, mentre que Claude Mythos 5.1 continua limitat a socis verificats en camps com la ciberseguretat i les ciències de la vida. Per als administradors, això significa que el llançament de setembre d'Anthropic no s'ha de tractar com un sol llançament de model. Un model està àmpliament disponible; un altre sembla estar darrere d'un procés d'accés restringit.
Aquesta distinció és cada cop més freqüent a la IA de frontera. L'accés s'està dividint per model, capacitat, canal de desplegament, controls de dades i cas d'ús. Un catàleg de models que només emmagatzema un nom de visualització i un camp de proveïdor no serà suficient per als equips que necessiten explicar per què un usuari pot trucar a un SKU de Claude des d'un entorn però no d'un altre.
Per què és important el preu de la memòria cau
Els preus dels testimonis solien ser fàcils de comparar en un full de càlcul: entrada d'una banda, sortida de l'altra. Les càrregues de treball d'agent ho van fer menys útil. Un agent de codificació pot mantenir un resum del dipòsit, les instruccions del sistema, els esquemes d'eines, l'historial de converses i l'anàlisi prèvia en context durant molts girs. Un flux de treball d'assistència pot adjuntar repetidament els mateixos documents de política o estat del compte. En aquests casos, les lectures de la memòria cau poden dominar la corba de cost efectiu.
El preu de lectura de memòria cau documentat de 0,25 dòlars per milió de dòlars de Fable 5.1 està molt per sota dels seus 10 dòlars per milió de dòlars d'entrada fresca. Això crea un fort incentiu per mantenir estable el context repetit, encaminar les sessions de manera coherent i evitar patrons d'aplicació que invalidin accidentalment la memòria cau del proveïdor. Les petites opcions d'implementació poden convertir-se en grans diferències de facturació: canviar els prefixos d'indicadors, injectar marques de temps en instruccions que d'altra manera siguin estables o distribuir una sessió d'usuari entre rutes que no comparteixen l'estat de la memòria cau poden reduir el valor de les lectures de la memòria cau barates.
El descompte de l'API de lots afegeix una segona palanca. Les tasques d'anàlisi de back-office, avaluació, revisió de documents i migració poden ser més barates quan es poden programar com a treballs per lots en lloc de trucades interactives. Per a les empreses, la qüestió pràctica no és simplement si Fable 5.1 "val la pena". Són quines càrregues de treball s'han d'executar de manera interactiva, que s'han d'executar per lots i que es poden redissenyar per preservar el context reutilitzable.
Qui està afectat
Els desenvolupadors que mantenen passarel·les d'IA han d'afegir el nou ID del model de l'API de Claude i actualitzar les taules de preus, inclosa la comptabilitat de lectura de memòria cau. Aquesta última part és fàcil de perdre's. Una passarel·la que factura només fitxes d'entrada i sortida noves indicarà erròniament els marges o amagarà els estalvis dels clients. L'anàlisi d'ús hauria de mostrar les entrades a la memòria cau per separat de les noves, especialment per als equips que intenten ajustar les càrregues de treball dels agents.
Els equips de la plataforma empresarial tenen un problema diferent: la disponibilitat i el govern. Com que Fable 5.1 està documentat en diverses rutes de núvol i plataformes, és possible que els administradors hagin de decidir si el mateix model es permet a tot arreu o només a través dels canals aprovats. La selecció de la ruta al núvol pot afectar l'adquisició, el registre, els controls regionals i la resposta a incidents.L'accés restringit a Mythos 5.1 afegeix una altra capa, perquè l'elegibilitat pot dependre de la verificació dels socis en lloc d'un flux de treball normal de canvi de model.
Per a les plataformes d'estil Model Gate, el llançament recorda que una API multimodel és ara una abstracció de preus i polítiques, no només una façana d'API compatible amb OpenAI. La passarel·la ha de conèixer l'identificador del model, la ruta del proveïdor, la política de memòria cau, el descompte per lots, el preu visible per al client i l'estat d'accés. També necessita modes d'error que siguin clars quan un client demana un model o una capacitat que no pot utilitzar.
El que encara no està clar
La documentació pública recuperada per a aquest informe confirma l'identificador del model, la data de llançament, l'estat actiu, els preus indicats i els identificadors de distribució compatibles. No resol completament totes les preguntes sobre els detalls del llançament. L'índex de la sala de redaccions d'Anthropic mostrava una entrada de llançament pública, però la pàgina detallada no es va recuperar completament en aquesta passada de recerca. Axios també va informar de la distinció de disponibilitat entre Fable 5.1 disponible generalment i accés limitat a Mythos 5.1, però el procés d'elegibilitat exacte per a Mythos no es va especificar al material verificat.
També hi ha preguntes d'implementació que cada plataforma haurà de respondre per si mateixa. L'economia de la memòria cau depèn de les taxes d'èxit reals, no dels preus de llista. Els identificadors específics del núvol poden tenir un comportament operatiu específic de la ruta. Les càrregues de treball per lots poden ser barates, però inadequades per a productes sensibles a la latència. I les empreses encara hauran de decidir si els preus més recents d'Anthropic s'ajusten als seus requisits de govern, retenció i auditoria.
L'acció immediata és concreta: afegiu claude-fable-5-1 quan escaigui, separeu Fable 5.1 de Mythos 5.1 restringit als catàlegs i feu visibles les lectures de la memòria cau als informes de costos. La lliçó a llarg termini és més àmplia. Els llançaments de models de frontera s'estan convertint en esdeveniments del pla de control. Els guanyadors seran equips que puguin dirigir-se per capacitat, preu, política i forma de càrrega de treball sense que els desenvolupadors memoritzin el catàleg de proveïdors.