DeepSeek V4-Pro modelis ir pārvietots uz praktisko API plānošanas teritoriju. Uzņēmuma pašreizējā API cenu dokumentācijā ir norādīts DeepSeek-V4-Pro kopā ar DeepSeek-V4-Flash, kas tiek atklāts, izmantojot OpenAI formāta bāzes URL un atsevišķu antropiskā formāta bāzes URL. Kopienas ziņās, kurās ir minēts DeepSeek izmaiņu žurnāls, teikts, ka V4-Pro 0813 laidiens lietotņu, tīmekļa un API lietotājiem tika izlaists 13. augustā.

Modeļa saraksts ir ievērojams ne tikai ar pieejamību. DeepSeek-V4-Pro tiek reklamēts ar 1 miljona marķiera konteksta garumu un maksimālo izvadi 384 000 marķieru, kā arī JSON izvadi, rīku izsaukumus, tērzēšanas prefiksa pabeigšanas beta un FIM pabeigšanas beta versiju nedomāšanas režīmā. Izstrādātājiem, kas veido aģentus, koda rīkus, ilgstošas ​​​​dokumentu darbplūsmas vai izguves sistēmas, šie ierobežojumi ierindo V4-Pro to modeļu kategorijā, kas var pārveidot tūlītēju arhitektūru, nevis tikai aizstāt mazāku tērzēšanas modeli.

Tomēr cenu noteikšana ir patiesais darbības stāsts. DeepSeek lapā ir norādīts V4-Pro par USD 0,003625 par 1 miljonu kešatmiņas trāpījumu ievades marķieru, USD 0,435 par vienu miljonu kešatmiņas izlaiduma ievades marķieru un USD 0,87 par vienu miljonu izvades marķieru. Šī izkliede nozīmē, ka pieprasījuma izmaksas lielā mērā ir atkarīgas no tā, vai pakalpojumu sniedzēja kešatmiņu patiešām ietekmē atkārtots konteksts. Darba slodze, kas, ņemot vērā optimistiskus kešatmiņas pieņēmumus, šķiet lēta, var kļūt daudz dārgāka, ja uzvednes ir ļoti mainīgas, slikti segmentētas vai tiek maršrutētas, izmantojot rīkus, kas novērš kešatmiņas atkārtotu izmantošanu.

Kas mainījās API lietotājiem

DeepSeek dokumentācijā V4-Pro tagad tiek piedāvāts kā pirmās klases API bāzes modelis, kurā ir divi galvenie saderības punkti OpenAI-style. un antropiskā stila galapunkts zem atsevišķa ceļa. Tam ir nozīme, jo tas samazina integrācijas barjeru komandām, kas jau izmanto ar OpenAI saderīgus klientus, vienlaikus sniedzot Kloda stila klientiem tiešākas formāta opcijas.

Ar AI API vārteju tūlītējs darbs ir ikdienišķs, taču svarīgs: atsvaidziniet modeļu katalogu, atjauniniet konteksta logu un maksimālās izvades metadatus, atzīmējiet atbalstītās iespējas un izlemiet, kā attēlot formātus. OpenAI formāta un antropiskā formāta virsmu uzskatīšana par vienu un to pašu var būt ērta mārketinga lapām, taču tas var radīt neskaidrības SDK, žurnālos un politikas vadīklās. Izstrādātājiem ir jāzina, kura pieprasījuma shēma, rīku izsaukšanas darbība un straumēšanas pieņēmumi ir piemērojami.

Uzmanību ir pelnījis arī ļoti lielais reklamētās izvades ierobežojums. 384 000 marķiera maksimālā izvade nav tikai lielāks skaitlis tabulā. Tas maina atteices režīmus. Komandām var būt nepieciešami stingrāki atbilžu ierobežojumi, brīdinājumi par norēķiniem un lietojumprogrammu līmeņa aizsargmargas, lai nepieļautu, ka jaunas paaudzes vai nejaušas ilgstošas ​​​​izgāztuves nepārvērš vienu aģenta darbību materiālo izmaksu notikumā.

Kāpēc kešatmiņas trāpījuma cenām tagad ir lielāka nozīme

Daudzi izstrādātāji jau sen ir saistījuši DeepSeek ar agresīvām API cenām. V4-Pro sarežģī šo uztveri. Norādītā kešatmiņas trāpījuma ievades cena ir ārkārtīgi zema salīdzinājumā ar kešatmiņas nepareizas ievades cenu, taču šī atšķirība palīdz tikai tad, ja darba slodze ir paredzēta kešatmiņas atkārtotai izmantošanai.

Praksē kešatmiņas efektivitāte ir atkarīga no tūlītējas stabilitātes. Garas sistēmas uzvednes, politikas bloki, dokumentācijas komplekti un repozitorija konteksts var būt noderīgi, ja tie tiek pastāvīgi izmantoti atkārtoti. Taču aģentu sistēmas bieži maina uzvednes katrā solī: pievienojot žurnālus, rīku izvades, laikspiedolus, starpplānus un lietotājam raksturīgu stāvokli. Ja šīs izmaiņas maina kešatmiņas robežas vai liek izlaist lielus prefiksus, faktiskās izmaksas var tuvoties kešatmiņas izlaišanas rādītājam.

Tāpēc maršrutēšanas politikām nevajadzētu klasificēt V4-Pro pēc vienas jauktas ievades cenas. Izmaksu simulācijā ir jānodala kešatmiņas trāpījumu ievade, kešatmiņas nepareizas ievades un izvades marķieri, pēc tam jāpārbauda reprezentatīvās darba slodzes. Kodēšanas aģents, kas atkārtoti izmanto lielu repozitorija kopsavilkumu, var darboties ļoti atšķirīgi no klientu atbalsta palīga, kas katrā pieprasījumā ievada jaunu konta stāvokli.

Šajā gadījumā arī Model Gate un līdzīgiem vairāku modeļu maršrutēšanas slāņiem ir praktiska nozīme. Vārtejas, kas izseko marķiera lietojumu pēc modeļa, komandas un API atslēgas, var palīdzēt operatoriem noskaidrot, vai šķietami lēts maršruts patiešām ir lēts ražošanā. Attiecīgā metrika vairs nav tikai marķieri katram pieprasījumam; tas ir kešatmiņas trāpījumu ievades, nekešatmiņas ievades un ģenerētas izvades sajaukums reālajā datplūsmā.

Kas tiek ietekmēts

Izstrādātājiem, kas izmanto DeepSeek tieši, pirms produkcijas datplūsmas pārslēgšanas ir jāpārbauda modeļa identifikatori, galapunkta formāts un iespēju karodziņi. JSON izvades un rīku izsaukumi ir norādīti, taču lietojumprogrammu darbība joprojām ir jāpārbauda, ​​it īpaši, ja esošais kods ir atkarīgs no cita pakalpojumu sniedzēja malu gadījuma apstrādes.

Vārtejas operatoriem un platformu komandām ir plašāks kontrolsaraksts.Viņiem ir nepieciešamas atjauninātas cenu tabulas, konteksta ierobežojumi, maksimālās izlaides ierobežojumi, katra modeļa funkciju metadati, budžeta vadīklas un dokumentācija, lai piekļūtu gan ar OpenAI, gan ar antropu. Ja tie atklāj V4-Pro kā nolaižamo modeli, tiem joprojām ir jābrīdina klienti, ka līdzvērtīga pieprasījuma sintakse negarantē līdzvērtīgu darbību vai izmaksas.

Uzņēmumiem, kas izmanto liela apjoma automatizāciju, ir jāpārskata noklusējuma modeļa pieņēmumi. Modelis ar 1 miljona marķiera konteksta logu var būt pievilcīgs juridiskai pārskatīšanai, izpētes sintēzei, koda bāzes analīzei un ilgtermiņa aģentiem. Taču modeļi ar garu kontekstu mēdz mudināt izmantot lielākas uzvednes, un lielākas uzvednes palielina katru kļūdu kešatmiņas dizainā un izvades kontrolē.

Kas paliek neskaidrs

Cenu lapā ir norādītas pašreizējās cenas un iespējas, taču joprojām pastāv neskaidrības par paziņotajām cenu izmaiņām nākotnē. Kopienas ziņojumos teikts, ka DeepSeek ir brīdinājis par ievērojamu API cenu pieaugumu un ka jaunas maksimālās un ārpus maksimuma cenas var stāties spēkā 16. augustā. Šie apgalvojumi attiecas uz budžeta plānošanu, taču nākotnes tarifu tabula pētījuma laikā netika pārbaudīta no tieši pieejama oficiāla paziņojuma.

Šai nenoteiktībai vajadzētu padarīt komandas piesardzīgākas, nevis iesaldētas. Saprātīga reakcija ir pievienot V4-Pro novērtēšanas pūliem, pārbaudīt reālas darba slodzes, izmērīt kešatmiņas darbību un izvairīties no tā kodēšanas kā pastāvīga zemāko izmaksu noklusējuma, līdz tiek apstiprināta cena. Dažām darba slodzēm V4-Pro var būt lieliska ilgtermiņa konteksta opcija. Attiecībā uz citiem, īpaši aģentiem, kuriem ir liela izvade, vai uzvednēm ar vāju kešatmiņas atkārtotu izmantošanu, ekonomija var būt mazāk labvēlīga, nekā liecina virsraksta kešatmiņas trāpījumu līmenis.

Plašāka mācība ir tāda, ka modeļa pieejamība tagad ir tikai pirmais maršrutēšanas jautājums. Grūtākie jautājumi ir par formātu saderību, līdzekļu uzticamību, kešatmiņas mehāniku, izvades ierobežojumiem un izmaksu novērojamību. DeepSeek V4-Pro sniedz izstrādātājiem vēl vienu jaudīgu API opciju, taču tas arī skaidri parāda, ka “lēts” ir kļuvis par slodzes specifisku secinājumu, nevis pakalpojumu sniedzēja etiķeti.