Anthropic on lisanud Claude Messages API-le kaks tihedalt seotud beetafunktsiooni: vestluse tihendamine ja konteksti redigeerimine. Mõlemad on suunatud abimeeste ja agentide loomise arendajatele tuttavale probleemile: kasulikud vestlused kestavad sageli kauem kui mudeli praktilise konteksti eelarve, eriti kui kogunevad tööriistakutsed, hangitud dokumendid ja mitme pöörde juhised.
Oluline muudatus seisneb selles, et Anthropic ei käsi mitte ainult arendajatel vanadest sõnumitest ise kokku võtta. Selle 14. septembri platvormi väljalaskemärkmed kirjeldavad API-taseme tihendusteed, mis on lubatud beetapäise compact-2026-09-04 kaudu, mis tagastab allkirjastatud tihendusploki. See blokk võib hilisemas päringus asendada varasema vestlusajaloo, samas kui hiljutised pöörded jäävad puutumata. Anthropic tutvustas beetaversioonis ka konteksti redigeerimist, mis keskendus algselt vanemate tööriistade tulemuste ja tööriistakutsete automaatsele kustutamisele, kui vestlus läheneb lubade piirangutele.
Rakendusmeeskondade jaoks on see kasutatavuse funktsioon. Lüüsioperaatorite, jälgitavuse tarnijate ja pakkujate vahelist liiklust normaliseerivate ettevõtete jaoks on see protokolli muudatus. Tihendatud Claude'i vestlus pole enam lihtsalt lühem viip. See sisaldab pakkuja loodud, allkirjastatud esitust eelnevast kontekstist, mida tuleks sellisena säilitada.
Mis muutus Claude Messagesi API-s
Tavalise pikaajalise vestlusintegratsiooni korral on arendajatel tavaliselt kolm ebatäiuslikku valikut, kui kontekstiaken täitub. Nad võivad loobuda vanadest pöördetest, luua oma kokkuvõtte või paluda kasutajal taaskäivitada. Iga valik võib kahjustada järjepidevust, peita olulisi juhiseid või muuta silumise raskemaks.
Anthropicu uus tihendamise beetaversioon viib osa sellest tööst API-sse. API saab luua allkirjastatud tihendusploki varasema vestluse sisu jaoks. Hilisem päring võib seejärel saata selle ploki vanemate sõnumite asemele, samas kui uuema vestluse säilitamine muutub sõna-sõnalt. Kujundus on oluline, sest see eristab tihendatud ajalugu tavalisest assistendi autorite kokkuvõtlikust tekstist. Lüüs, mis tasandab ploki stringiks, eemaldab tundmatud väljad või käsitleb seda tavalise kasutajasõnumina, võib rikkuda kavandatud semantika.
Konteksti redigeerimine ründab seotud märgi kasvuallikat: tööriista liiklust. Agendirakendused võivad koguda suuri tööriistaväljundeid, vahepealseid kõnesid ja aegunud vaatlusi. Anthropic ütleb, et beetaversioon toetab algselt vanemate tööriistade tulemuste ja kõnede automaatset kustutamist, kui vestlus läheneb märgipiirangutele. See on paljude töövoogude puhul mõistlik, kuid see tähendab ka seda, et mudeli hilisem vastus võib sõltuda vestluse olekust, mida teenusepakkujapoolsed reeglid on tahtlikult kärbinud.
See on eriti oluline meeskondade puhul, kes loovad mitme mudelipakkuja kohale AI halduskihi. Juhtimissüsteem peab teadma mitte ainult seda, milline viip saadeti, vaid ka seda, millised varasema konteksti osad säilitati, tihendati või eemaldati.
Miks ei saa lüüsid seda käsitleda üldise kokkuvõttena
Kohe juurutamisrisk on ühilduvus. Paljud API-lüüsid ja SDK-mähised kontrollivad taotluste kasulikke koormusi tuntud skeemide alusel. Unknown top-level parameters may be dropped. Unknown content blocks may be coerced into text. Logikonveierid võivad redigeerida või muuta välju, mida nad ei tunne. Need on tavaliste metaandmete jaoks mõistlikud vaikeväärtused, kuid need on ohtlikud, kui tundmatu objekt on osa mudeli pakkuja kontekstihalduslepingust.
Claude-teadlik lüüs peaks säilitama uue tihendusparameetri ja allkirjastatud plokid neid ümber kirjutamata. Samuti peaks see selgelt eristama jälgedes originaalsõnumeid, tihendatud konteksti ja hiljutisi muutmata pöördeid. That distinction is not academic. Kui klient küsib, miks agent otsustas, peaks kontrolljälg näitama, kas mudelil oli juurdepääs tööriista algsele tulemusele, tihendatud esitusviisile või mitte.
OpenAI-ga ühilduvad lüüsitooted seisavad silmitsi täiendava disainiprobleemiga. OpenAI-stiilis vestluse ja vastuste ökosüsteemil on oma kontekstihaldusmustrid, sealhulgas hostitud agendi olek ja pakkujaspetsiifiline seansihaldus. Anthropici märgistatud tihendusplokk on erinev semantiline objekt. Ühest üldisest väljast nimega "kokkuvõte" või "mälu" ei piisa, kui süsteem peab säilitama pakkuja garantiid ja taasesituskäitumise.
Mudelvärava stiilis platvormid, mis toetavad nii OpenAI-ga ühilduvat marsruutimist kui ka Antroopse stiilis API-sid, võivad seetõttu vajada pakkujaspetsiifilisi kontekstiadaptereid. See ei tähenda, et iga klient näeks keerukust.It means the gateway should expose a stable external experience while keeping Anthropic's compaction semantics intact internally.
Analytics, billing and audit trails get more complicated
The release notes do not say whether signed compaction blocks are billed differently from ordinary message text. See lahendamata punkt on oluline. Kui tihendatud plokki loendatakse nagu mis tahes muud sisendit, saavad arveldussüsteemid käsitleda seda teise märki kandva päringukomponendina. If Anthropic applies different accounting, gateways will need to represent that difference clearly in customer invoices and usage exports.
Even without special pricing, compaction changes how analytics should be explained. Vestlus võib sõnumi tasemel tunduda lühem, kuid sellel on palju pikema eelneva vahetuse mõju. Basic token graphs will not answer questions such as: how much original context was compacted, how much recent context remained verbatim, how often compaction was invoked, and whether failures correlate with automatically cleared tool outputs.
Those questions belong in an AI API usage analytics dashboard rather than buried in raw logs. Ettevõtluskliendid loodavad üha enam näha kulusid, mudeli käitumist ja tööriistade kasutamist samas töövaates. Vestluse tihendamine lisab sellele vaatele veel ühe oleku ülemineku.
Seal on ka vastavusnurk. Kui reguleeritud klient küsib, milline teave oli assistendile teatud ajahetkel kättesaadav, ei saa operaator vastata ainult lõplikult päringuorganilt, kui ta ei mõista tihendusahelat. Signed blocks may help preserve integrity, but they do not remove the need for careful retention rules, customer-visible traces and internal debugging tools.
Who should act now
Developers using Claude directly should review whether their SDK, proxy or logging middleware passes beta headers, the top-level compaction parameter and returned compaction blocks unchanged. They should also test failure behavior when compaction blocks are replayed across deployments, regions or request transformations.
Gateway teams should add schema coverage before customers encounter silent degradation. Minimaalne praktiline töö on lõpetada uute väljade mahajätmine või ümberkirjutamine. Parem versioon on tihendatud konteksti eraldi sildistamine logides, jälgedes ja kasutuskirjetes. For teams that already provide unified AI API billing, compaction events should be visible enough that support teams can reconcile token usage and explain long-session behavior.
Businesses running support agents, coding assistants, research tools or sales copilots should treat this as a reliability feature with governance consequences. Compaction can make long conversations more durable, but it also introduces another hidden layer between the visible chat transcript and the model's actual input state.
The open questions are still material. Anthropic ei ole öelnud, kas tihendusplokid muudavad arveldatud märgi arvestust. Samuti ei ole garanteeritud beeta päise pikaajaline stabiilsus. Ja kuna konteksti redigeerimine keskendub algselt vanematele tööriistakutsungitele ja tulemustele, peavad arendajad kontrollima, kui hästi sobivad vaikeseaded töövoogudega, kus vanad tööriista tõendid on juriidiliselt või operatiivselt olulised.
Kuid laiem suund on selge. Pika konteksti haldamine liigub rakenduse liimikoodilt pakkuja API-dele. Gateways that want to sit reliably between customers and model providers now have to support that movement at the protocol level, not just by forwarding shorter prompts.