Google ir ieviesis Gemini 3.7 Flash kā jaunu kodēšanas un aģentu darba slodzes modeli, saskaņā ar 13. augustā publicēto ar Google saistīto paziņojumu. Modelis tiek izplatīts izstrādātājiem, izmantojot Gemini API, Google AI Studio, Google Antigravity un Android Studio, ar uzņēmuma piekļuvi, izmantojot Gemini Enterprise Agent Platform un Gemini Enterprise lietotni.

Izlaišanai ir nozīme praktisku iemeslu dēļ, kas nav saistīti ar apgalvojumiem par modeļa kvalitāti: Google izmanto laika ierobežotu API ievada cenu noteikšanu. Līdz 2026. gada 31. decembrim Gemini 3.7 Flash cena ir 0,75 ASV dolāri par 1 miljonu ievades marķieru un 3,75 ASV dolāri par 1 miljonu izvades marķieru. Plānots, ka 2027. gada 1. janvārī šīs cenas dubultosies līdz 1,50 ASV dolāriem par 1 miljonu ievades marķieru un 7,50 ASV dolāru par 1 miljonu izvades marķieru.

Tādējādi Gemini 3.7 Flash ir tuvākā laika kandidāts izmaksu ziņā jutīgām aģentu cilpām, kodēšanas palīgiem un darbplūsmas automatizācijas sistēmām, kurām ir nepieciešams katrs spējīgs uzdevums, lai modelis būtu atzīmēts. Tas arī nosaka termiņu ikvienam, kas var izveidot izmaksu modeļus, kas atbilst izlaišanas cenai.

Kas mainījās

Gemini 3.7 Flash paplašina Google Gemini klāstu ar modeli, kas paredzēts kodēšanai un aģentiem, nevis tikai vispārīgai tērzēšanai. Izziņotie izplatīšanas ceļi ir plaši: tieša API piekļuve izstrādātājiem, IDE blakus esoša ekspozīcija, izmantojot Android Studio, eksperimentēšana, izmantojot Google AI Studio, un izvietošana uzņēmumā, izmantojot Gemini Enterprise virsmas.

API lietotājiem viskonkrētākās izmaiņas ir pieejamība, izmantojot Gemini API ar publicētiem marķiera tarifiem. Ievadcenas nosaka, ka ievades marķieri līdz 2026. gada beigām ir USD 0,75 par miljonu un izvades marķieri — USD 3,75 par miljonu. Plānotais 2027. gada janvāra cenu paaugstinājums ir neparasti svarīgs, jo daudzas aģentu sistēmas ģenerē lielu daudzumu starpposma uzvedņu, rīku rezultātu, atkārtotu mēģinājumu un plānošanas pēdas. Cena, kas septembrī izskatās pievilcīga, var radīt ļoti atšķirīgu gada likmi, ja netiek ņemtas vērā janvāra cenas.

Paziņojuma ziņās ir arī saite uz Google emuāra URL izlaišanai, taču oficiālo emuāra rakstu nevarēja tieši pārbaudīt pabeigtajā izpētes sesijā. Tas nozīmē, ka pret detalizētiem etalonu paziņojumiem, kas tiek izplatīti sekundārajās diskusijās, jāizturas piesardzīgi, līdz komandas pašas izskata Google oficiālo modeļa karti un dokumentāciju.

Kāpēc tas ir svarīgi izstrādātājiem un aģentu veidotājiem

Kodēšanas aģenti ir viena no dārgākajām praktiskajām mākslīgā intelekta darba slodzēm, jo ​​tās mēdz būt iteratīvas. Viens lietotāja pieprasījums var aktivizēt repozitorija meklēšanu, failu nolasīšanu, koda ģenerēšanu, testa izpildi, kļūdu analīzi un papildu ielāpus. Pat tad, ja katrs solis atsevišķi ir lēts, cilpa var kļūt ļoti smaga.

Tāpēc Flash klases modelis ar agresīvu iepazīšanās cenu ir pelnījis novērtējumu. Ja Gemini 3.7 Flash var uzticami apstrādāt parastās koda rediģēšanas, kļūdu šķirošanas, testa ģenerēšanas vai rīku izsaukšanas darbības, komandas var rezervēt dārgākus modeļus plānošanai, sarežģītai argumentācijai vai galīgai pārskatīšanai. Vērtība ne vienmēr ir katra modeļa aizstāšana; tas ir pareizā uzdevuma maršrutēšana uz lētāko modeli, kas darbojas pietiekami labi.

Palaišana ietekmē arī IDE un platformas stratēģiju. Pieejamība, izmantojot Android Studio un Google aģentu orientētus produktus, nozīmē, ka vairāk izstrādātāju var saskarties ar Gemini 3.7 Flash esošajās darbplūsmās, nevis kā atsevišķu API izvēli. Uzņēmumiem, kas izmanto Gemini Enterprise, būs jānovērtē ne tikai neapstrādāta modeļa kvalitāte, bet arī pārvaldība, auditējamība un tas, vai modeļa darbība ir pietiekami konsekventa, lai nodrošinātu ražošanas izstrādātāju rīkus.

Norēķini ir daļa no produkta stāsta

Plānotais cenu pieaugums nav zemsvītras piezīme. Tā ir izmaksu kontroles problēma.

Organizācijām, kuras iepazīšanās periodā veic Gemini 3.7 Flash etalonu, savos iekšējos kalkulatoros ir jāreģistrē gan pašreizējās, gan turpmākās cenas. Kodēšanas aģenta darba slodze, kas ir nedaudz lētāka nekā alternatīvas 2026. gada beigās, 2027. gadā, iespējams, nepaliks lētāka. Iepirkuma komandām, platformu inženieriem un finanšu īpašniekiem ir jāizvairās no ievada likmes kodēšanas informācijas paneļos, klientu cenās vai produktu rezervēs.

Šajā gadījumā AI API vārtejai vai vienotajam AI API slānim ir konkrēta darbības nozīme. Vārtiem, kas pārvalda modeļu katalogus, lietojuma analīzi un norēķinu loģiku, ir skaidri jāatklāj 1. janvāra cenu izmaiņas. Ja komanda izmanto Model Gate vai līdzīgu maršrutēšanas slāni, modelis ir jāpievieno novērtēšanas rindām ar cenu metadatiem, kas atšķir ievada logu no līdzsvara stāvokļa tarifa.

Partneriem, kuri veido pakalpojumus papildus vairāku modeļu API, šī problēma ir vēl asāka. Tālākpārdevējs vai aģentūra var absorbēt nelielas cenu noteikšanas kļūdas izmēģinājuma perioda laikā, taču novecojuši pieņēmumi var sabojāt peļņu, tiklīdz automatizācijas produkts sasniedz apjomu.Partnera API pakalpojumam, kas piedāvā kodēšanas automatizāciju, AI pārskatīšanu, biļešu šķirošanu vai iekšējos aģentus, ir nepieciešama ilgstoša izmaksu kontrole, nevis tikai zema palaišanas cena.

Kam tas jāpārbauda pirmajam

Visredzamākie kandidāti ir komandas, kuras jau izmanto Gemini 3.6 Flash vai citus vidēju izmaksu modeļus kodēšanai, aģentu orķestrēšanai un augstas caurlaidības automatizācijai. Viņiem ir jāpārbauda Gemini 3.7 Flash pret reālu darba slodzi, nevis jāpaļaujas uz publiskiem etalonu kopsavilkumiem.

Noderīgi testa gadījumi ietver rīku izsaukšanas precizitāti, repozitoriju atpazīstamu rediģēšanu, strukturētas izvades uzticamību, latentumu daudzpakāpju aģentu plūsmās, esošo uzvedņu regresiju un darbību ilgstošās sarunās. Komandām jāpārbauda arī kešatmiņas darbība, kļūdu līmenis un tas, kā modelis apstrādā neskaidras rīka instrukcijas. Lētāks modelis, kas rada vairāk atkārtotu mēģinājumu vai vairāk cilvēku veiktu pārskatīšanu, var netieši kļūt dārgs.

Uzņēmumiem ar regulētām vai klientiem paredzētajām darbplūsmām pirms ražošanas datplūsmas maršrutēšanas ir jānovērtē politikas vadīklas. Kodēšanas palīgi uzņēmumā atšķiras no autonomajiem aģentiem, kas var modificēt ražošanas sistēmas, izsaukt ārējās API vai rīkoties ar klientu datiem. Darbības jautājums ir ne tikai "vai šis modelis ir labs?" bet “kur to var droši, izmērāmi un atgriezeniski izmantot?”

Kas paliek neskaidrs

Lielākā neskaidrība ir Google visu tehnisko apgalvojumu neatkarīga pārbaude. Galvenie palaišanas fakti, API pieejamība un cenas tiek atbalstītas ar Google saistītajā paziņojumā un atspoguļotās diskusijās, kurās ir saites uz to pašu Google emuāra URL. Tomēr detalizētas etalona pretenzijas no sekundārajām ziņām izpētes sesijā netika neatkarīgi pārbaudītas.

Pagaidām nav arī skaidrs, cik ātri izstrādātāji redzēs stabilu piekļuvi produkcijai visās uzskaitītajās virsmās, vai uzņēmuma vadīklas atšķiras atkarībā no produkta vai kā Gemini 3.7 Flash praksē ir salīdzināms ar nesen izlaistajiem konkurējošiem kodēšanas aģentu darba modeļiem. Šīs atbildes tiks sniegtas no dokumentācijas, modeļu kartēm un ražošanas testēšanas, nevis no palaišanas ziņām.

Pagaidām praktiskais risinājums ir vienkāršs: Gemini 3.7 Flash nekavējoties jānovērtē komandām, kas veic kodēšanas un aģenta darba slodzi, taču jebkurā ieviešanas plānā ir jāiekļauj regresijas pārbaude, maršruta līmeņa uzraudzība un norēķinu modelis, kas jau zina sākuma cenu

6. beigās.