Anthropic ha afegit dues funcions beta molt relacionades a l'API de Claude Messages: compactació de converses sota demanda i edició de context. Tots dos estan dirigits a un problema familiar per als desenvolupadors i els agents de creació: les converses útils solen durar més temps que el pressupost de context pràctic d'un model, sobretot quan s'acumulen trucades d'eines, documents recuperats i instruccions de diversos torns.
El canvi important és que Anthropic no només diu als desenvolupadors que resumeixin els missatges antics ells mateixos. Les seves notes de llançament de la plataforma del 14 de setembre descriuen una ruta de compactació a nivell d'API, habilitat mitjançant la capçalera beta compact-2026-09-04, que retorna un bloc de compactació signat. Aquest bloc pot substituir l'historial de converses anterior en una sol·licitud posterior mentre els torns recents romanguin intactes. Anthropic també va introduir l'edició de context en versió beta, centrada inicialment a esborrar automàticament els resultats d'eines anteriors i les trucades d'eines a mesura que una conversa s'acosta als límits de testimoni.
Per als equips d'aplicacions, aquesta és una característica d'usabilitat. Per als operadors de passarel·les, venedors d'observabilitat i empreses que normalitzen el trànsit entre proveïdors, es tracta d'un canvi de protocol. Una conversa compactada de Claude ja no és només una indicació més curta. Conté una representació signada i creada pel proveïdor del context anterior que s'hauria de conservar com a tal.
El que va canviar a l'API de Claude Messages
En una integració de xat de llarga durada, els desenvolupadors solen tenir tres opcions imperfectes quan la finestra de context s'omple. Poden deixar anar els torns antics, generar el seu propi resum o demanar a l'usuari que reiniciï. Cada opció pot danyar la continuïtat, ocultar instruccions importants o dificultar la depuració.
La nova versió beta de compactació d'Anthropic trasllada part d'aquest treball a l'API. L'API pot produir un bloc de compactació signat per al contingut de la conversa anterior. Aleshores, una sol·licitud posterior pot enviar aquest bloqueig en lloc dels missatges anteriors, mentre que la conversa més recent es conserva textualment. El disseny és important perquè distingeix l'historial compactat del text de resum normal escrit per l'assistent. Una passarel·la que aplani el bloc en una cadena, treu camps desconeguts o el tracti com un missatge normal d'usuari pot trencar la semàntica prevista.
L'edició de context ataca una font relacionada de creixement del testimoni: el trànsit d'eines. Les aplicacions agències poden acumular grans sortides d'eines, trucades intermèdies i observacions obsoletes. Anthropic diu que la versió beta inicialment admet l'eliminació automàtica dels resultats i les trucades d'eines anteriors a mesura que la conversa s'acosta als límits de testimoni. Això té sentit per a molts fluxos de treball, però també significa que una resposta posterior del model pot dependre d'un estat de conversa que s'hagi retallat deliberadament per les regles del proveïdor.
Això és especialment rellevant per als equips que creen una capa de govern de l'IA per sobre de diversos proveïdors de models. El sistema de govern ha de saber no només quina sol·licitud s'ha enviat, sinó també quines parts del context anterior es van retenir, compactar o eliminar.
Per què les passarel·les no poden tractar això com a resum genèric
El risc d'implementació immediat és la compatibilitat. Moltes passarel·les d'API i embolcalls SDK validen les càrregues útils de sol·licituds amb esquemes coneguts. Es poden eliminar els paràmetres de nivell superior desconeguts. Els blocs de contingut desconeguts poden ser coaccionats per convertir-los en text. Les canalitzacions de registre poden redactar o transformar camps que no reconeixen. Aquests són valors predeterminats raonables per a les metadades normals, però són perillosos quan l'objecte desconegut forma part del contracte de gestió del context del proveïdor de models.
Una passarel·la que conegui Claude hauria de conservar el nou paràmetre de compactació i els blocs signats sense tornar-los a escriure. També hauria de fer una clara distinció en les traces entre missatges originals, context compactat i girs recents sense modificar. Aquesta distinció no és acadèmica. Quan un client pregunta per què un agent va prendre una decisió, la pista d'auditoria hauria de mostrar si el model tenia accés al resultat de l'eina original, a una representació compactada o cap a cap.
Els productes de passarel·la compatibles amb OpenAI s'enfronten a un problema de disseny addicional. L'ecosistema de xat i respostes d'estil OpenAI té els seus propis patrons de gestió del context, inclòs l'estat de l'agent allotjat i la gestió de sessions específica del proveïdor. El bloc de compactació signat d'Anthropic és un objecte semàntic diferent. Un sol camp genèric anomenat "resum" o "memòria" no serà suficient si el sistema necessita preservar les garanties del proveïdor i el comportament de reproducció.
Per tant, les plataformes d'estil Model Gate que admeten tant l'encaminament compatible amb OpenAI com les API d'estil antròpic poden necessitar adaptadors de context específics del proveïdor. Això no vol dir que tots els clients vegin la complexitat.Significa que la passarel·la hauria d'exposar una experiència externa estable mentre manté intacta la semàntica de compactació d'Anthropic internament.
Les pistes d'anàlisi, facturació i auditoria es compliquen
Les notes de la versió no diuen si els blocs de compactació signats es facturen de manera diferent del text del missatge normal. Aquest punt no resolt importa. Si un bloc compactat es compta com qualsevol altra entrada, els sistemes de facturació poden tractar-lo com un altre component de sol·licitud que porta testimonis. Si Anthropic aplica una comptabilitat diferent, les passarel·les hauran de representar aquesta diferència clarament a les factures dels clients i a les exportacions d'ús.
Fins i tot sense preus especials, la compactació canvia com s'ha d'explicar l'anàlisi. Una conversa pot semblar més curta a nivell de missatge tot i que encara té l'efecte d'un intercanvi previ molt més llarg. Els gràfics bàsics de testimoni no respondran preguntes com ara: quant de context original es va compactar, quant de context recent es va mantenir textualment, amb quina freqüència s'ha invocat la compactació i si els errors es correlacionen amb les sortides de l'eina esborrades automàticament.
Aquestes preguntes pertanyen a un AI analytics dashboard/usageed"> troncs crus. Els clients empresarials esperen cada cop més veure els costos, el comportament del model i l'ús d'eines en la mateixa visió operativa. La compactació de la conversa afegeix una altra transició d'estat a aquesta vista.
També hi ha un angle de compliment. Si un client regulat pregunta quina informació estava disponible a un assistent en un moment concret, un operador no pot respondre únicament des de l'òrgan de sol·licitud final tret que entengui la cadena de compactació. Els blocs signats poden ajudar a preservar la integritat, però no eliminen la necessitat de regles de retenció acurades, rastres visibles per al client i eines de depuració internes.
Qui hauria d'actuar ara
Els desenvolupadors que utilitzin Claude directament haurien de revisar si el seu SDK, proxy o programari intermedi de registre passa les capçaleres beta, el paràmetre de compactació de nivell superior i el bloc de compactació retornat. També haurien de provar el comportament d'error quan es reprodueixen blocs de compactació en desplegaments, regions o sol·licituds de transformació.
Els equips de passarel·les haurien d'afegir cobertura d'esquema abans que els clients es trobin amb una degradació silenciosa. El treball pràctic mínim és deixar de deixar caure o reescriure els nous camps. La millor versió és etiquetar el context compactat per separat als registres, traces i registres d'ús. Per als equips que ja proporcionen facturació unificada de l'API d'AI, els esdeveniments de compactació haurien de ser prou visibles perquè els equips d'assistència puguin conciliar l'ús de testimonis i explicar el comportament de les sessions llargues.
Les empreses que executen agents de suport, assistents de codificació, eines de recerca o eines de recerca o fiabilitat de vendes haurien de tractar aquesta funció com a copilot. La compactació pot fer que les converses llargues siguin més duradores, però també introdueix una altra capa oculta entre la transcripció del xat visible i l'estat d'entrada real del model.
Les preguntes obertes encara són materials. Anthropic no ha dit si els blocs de compactació canvien la comptabilitat de fitxes facturades. L'estabilitat a llarg termini de la capçalera beta tampoc està garantida. I com que l'edició de context se centra inicialment en les trucades i els resultats d'eines més antigues, els desenvolupadors hauran de verificar si els valors predeterminats s'ajusten als fluxos de treball on les proves d'eines antigues segueixen sent importants des del punt de vista legal o operacional.
La direcció més àmplia és clara, però. La gestió de context llarg s'està passant del codi de l'aplicació adhesiva a les API del proveïdor. Les passarel·les que volen situar-se de manera fiable entre els clients i els proveïdors de models ara han de donar suport a aquest moviment a nivell de protocol, no només reenviant sol·licituds més breus.