Gemini 3.7 Flash fördubblas i pris den 1 januari 2027 – pilotens kalkyl kan redan vara fel

Gemini 3.7 Flash ser billig ut just nu. Men priset som gör modellen attraktiv i en pilot är tidsbegränsat: den 1 januari 2027 fördubblas Googles listpris för standardanvändning. En pilot som räknar med dagens pris kan därför ge rätt tekniskt svar och fel investeringsbeslut.
Det betyder inte att Gemini 3.7 Flash plötsligt blir dyrt. Det betyder att kalkylen måste byggas på det pris verksamheten faktiskt kommer att betala när piloten går i produktion.
Introduktionspriset är en tidsbegränsad rabatt
Google lanserade Gemini 3.7 Flash den 13 augusti som en stabil modell för bland annat kodning, komplexa dokument och agentiska arbetsflöden. För standardanvändning på betald nivå kostar modellen till och med den 31 december 2026:
- Input: 0,75 dollar per miljon tokens
- Output, inklusive tänkandetokens: 3,75 dollar per miljon tokens
Från den 1 januari 2027 blir priserna 1,50 respektive 7,50 dollar. Även priserna för batch, flex, prioriterad inferens och kontextcache har egna nivåer på prissidan. Kalkylen i den här artikeln använder standardpriset, inte ett påstående om att varje köpform kostar lika mycket.
Källa: Google – Gemini Developer API pricing
Google beskriver 3.7 Flash som ett steg upp från 3.6 Flash och redovisar bland annat 30,4 procent på AutomationBench mot 17,0 procent för föregångaren. Det är ett leverantörsrapporterat jämförelsetest, inte bevis för att din process får 30,4 procents träffsäkerhet eller avkastning. För en budget är den viktiga frågan hur många användbara resultat som klarar hela arbetsflödet.
Källa: Google – Introducing Gemini 3.7 Flash
Samma pilot kostar 150 dollar nu och 300 dollar i januari
Ta en illustrativ månad med 100 miljoner inputtokens och 20 miljoner outputtokens. Outputpriset omfattar även tänkandetokens.
Med introduktionspriset blir modellkostnaden:
- 100 miljoner inputtokens × 0,75 dollar = 75 dollar
- 20 miljoner outputtokens × 3,75 dollar = 75 dollar
- Totalt: 150 dollar per månad
Från januari blir samma trafik:
- 100 miljoner inputtokens × 1,50 dollar = 150 dollar
- 20 miljoner outputtokens × 7,50 dollar = 150 dollar
- Totalt: 300 dollar per månad
Om flödet producerar 10 000 godkända resultat blir den rena modellkostnaden 0,015 dollar per resultat under introduktionsperioden och 0,03 dollar från januari. Beloppet är fortfarande litet. Fördubblingen är ändå verklig, och den följer med varje volymökning.
Det här är ett räkneexempel, inte en prognos för din användning. Din tokenmängd beror på dokumentlängd, konversationshistorik, verktygsresultat, tänkandenivå och hur ofta ett misslyckat försök körs om.
Kostnad per godkänt resultat är talet som går att styra
En token är en enhet i modellens in- eller output. Ett godkänt resultat är däremot ett svar eller en åtgärd som uppfyller verksamhetens krav och kan användas utan ännu en omkörning. Det kan vara en korrekt klassificerad faktura, ett kundsvar som går att skicka efter granskning eller en rapport där obligatoriska källor finns med.
Därför är en bättre kalkyl att räkna ihop modellkostnad, cache, verktyg och grounding, omkörningar och mänsklig granskning. Dela summan med antalet godkända resultat.
Om samma modelltrafik bara ger 7 000 godkända resultat stiger den rena modellkostnaden till cirka 0,021 dollar per resultat nu och 0,043 dollar från januari. Modellen har inte blivit dyrare per token i det första scenariot; arbetsflödet har blivit dyrare eftersom fler resultat underkänns.
Det är här en billig demo ofta lurar budgeten. Den visar kostnaden för att generera något, inte kostnaden för att få fram något som verksamheten accepterar.
Den billigaste token kan ligga i det dyraste arbetsflödet
Gemini 3.7 Flash stöder bland annat funktionsanrop, filsökning, kodkörning, sök-grounding och låg, medelhög eller hög tänkandenivå. Det gör modellen användbar i flerledade flöden, men varje lager kan ändra ekonomin.
Källa: Google – Gemini 3.7 Flash model documentation
- Tänkande räknas på outputsidan. En högre nivå kan ge bättre resultat men också fler debiterade outputtokens.
- Omkörningar multiplicerar mer än tokenkostnaden. De förbrukar även väntetid, verktygsanrop och granskarens uppmärksamhet.
- Grounding har en egen prissättning. Googles kostnadsfria månadsnivå delas över Gemini 3.x, och därefter debiteras sökningar separat.
- Cache är inte gratis lagring. Både cachetokens och lagringstid har priser som ändras vid årsskiftet.
- Mänsklig granskning kan dominera. Om varje resultat kräver fem minuters kontroll spelar några extra cent i modellkostnad mindre roll än en hög avvisningsgrad.
Det kommersiella misstaget är alltså inte att välja en modell som kostar några cent mer. Det är att optimera listpriset samtidigt som omkörningar och granskning fortsätter vara osynliga.
Budgetera med januaripriset och köp på resultat
En seriös pilot bör visa två kostnadslägen från början: dagens introduktionspris och listpriset från januari. Då slipper ledningen upptäcka prishoppet efter att arbetsflödet har byggts in i budgeten.
Jämför sedan alternativen på samma uppgift och med samma definition av godkänt resultat. Mät hur vald tänkandenivå påverkar första godkända svar, om batch eller flex passar väntetiden, hur mycket historik som verkligen behöver skickas och vilka verktyg som skapar ett bättre utfall snarare än bara mer aktivitet.
Det kan mycket väl visa att Gemini 3.7 Flash fortfarande är det bästa köpet efter fördubblingen. Ett alternativ som kostar mindre per token men kräver fler omkörningar kan bli dyrare. Ett dyrare alternativ kan vinna om det sänker granskningstiden tillräckligt. Det går inte att avgöra från leverantörens prisrad.
Pilotens affärsfråga har ändrats
Frågan är inte längre: ”Hur billigt kan vi anropa modellen?” Frågan är: ”Vad kostar ett godkänt resultat i januari, vid vår verkliga volym?”
Börja med en enda återkommande process. Logga tokenmängd, tänkandenivå, verktygsanrop, omkörningar, granskningsminuter och godkända resultat under samma period. Kör kalkylen med både dagens pris och priset från januari. Då får ni ett budgetunderlag som överlever kampanjpriset.
Om ni vill göra den mätningen till en del av själva arbetsflödet är det ett konkret uppdrag för Verktygssmide: bygg kostnad och godkända resultat i samma vy, i stället för att jämföra två separata fakturor i efterhand.
Vanliga frågor
När ändras priset för Gemini 3.7 Flash?
Googles introduktionspris gäller till och med den 31 december 2026. Från den 1 januari 2027 anger Google 1,50 dollar per miljon inputtokens och 7,50 dollar per miljon outputtokens för standardanvändning på betald nivå. Kontrollera den aktuella prissidan före ett köpbeslut.
Vad menas med kostnad per godkänt resultat?
Det är den samlade kostnaden för modell, cache, verktyg, grounding, omkörningar och mänsklig granskning delad med antalet resultat som uppfyller verksamhetens krav.
Blir Gemini 3.7 Flash alltid dubbelt så dyrt i januari?
Googles officiella prissida visar tidsbegränsade priser för flera användningslägen. Exemplen i artikeln gäller standardanvändning på betald nivå. Batch, flex, prioriterad inferens, cache och verktyg har egna priser, så räkna på den köpform som arbetsflödet faktiskt använder.
Smedjans nyhetsbrev
Få nya artiklar i inkorgen
Välj de ämnen som intresserar dig. Inget brus, max ett mejl i veckan.
Vi följer GDPR. Avsluta när du vill.


