Naar de inhoud
Terug naar overzicht
AI NieuwsGoogleSpraakKosten

Gemini 3.8 Live: kosten en verschillen met GPT-Live-1

·Door
Gemini 3.8 Live: kosten en verschillen met GPT-Live-1

Gemini 3.8 Live kost volgens Googles prijslijst $0,005 per minuut audio-invoer en $0,018 per minuut audio-uitvoer. Die bedragen zeggen alleen nog niet wat een volledig klantgesprek kost. Google factureert tokens en rekent ook eerder verwerkte gesprekscontext opnieuw mee. Een vergelijking met GPT-Live-1 op alleen de minuutprijs geeft daardoor een onvolledig beeld.

Google kondigde Gemini 3.8 Live en Extended Thinking op 15 september 2026 aan. Voor bedrijven die een AI-spraakassistent onderzoeken, zijn vooral twee vragen relevant: wat kan zo'n model tijdens het gesprek afhandelen, en welke kosten lopen daarbij door?

Wat kost Gemini 3.8 Live?

De betaalde Gemini API-prijslijst vermeldt voor beide nieuwe Live-modellen dezelfde tarieven:

  • Audio-invoer: $3 per miljoen tokens, met $0,005 per minuut als vermelde omrekening.
  • Audio-uitvoer: $12 per miljoen tokens, omgerekend $0,018 per minuut.
  • Tekst: $0,75 per miljoen invoertokens en $4,50 per miljoen uitvoertokens, inclusief denktokens.
  • Beeld en video als invoer: $1 per miljoen tokens, omgerekend $0,002 per minuut.

Alle bedragen zijn in Amerikaanse dollars en gecontroleerd op 16 september 2026. Ze gaan over API-gebruik, niet over een Gemini-abonnement voor consumenten.

De belangrijkste nuance staat in Googles uitleg over facturatie. Bij iedere gespreksbeurt telt de actieve context mee: nieuwe invoer én bewaarde geschiedenis. Eerdere audio wordt daarbij tegen het audio-invoertarief opnieuw verwerkt. Meer beurten kunnen dus hogere kosten opleveren, ook als de totale spreektijd gelijk blijft.

Google biedt instellingen om oudere context uit het actieve venster te laten vallen. Dat beperkt de groei van de rekening. Ingeschakelde transcriptie levert daarnaast tekstkosten op. Zonder de gebruikte instellingen en het gemeten tokenverbruik is een betrouwbare uurprijs voor Gemini niet te geven.

Gemini 3.8 Live versus GPT-Live-1: wat telt mee?

De twee aanbieders gebruiken een andere rekeneenheid. Kort naast elkaar:

  • Gemini 3.8 Live: verwerkte invoer- en uitvoertokens, inclusief opnieuw meegenomen context. De verhouding tussen audio, tekst en andere invoer beïnvloedt de kosten.
  • GPT-Live-1: $0,05 per minuut actieve stemsessie, afgerekend per seconde. Het achterliggende model en de tools worden apart betaald, volgens OpenAI's prijslijst.

Bij OpenAI telt ook de tijd waarin beide kanten stil zijn of het achterliggende model werkt. Dat staat expliciet in de uitleg over sessiekosten. Zestig minuten actieve sessietijd kost daarmee $3 voor het stemgedeelte. De totale rekening ligt hoger zodra betaald model- of toolgebruik erbij komt.

Bij Gemini is dezelfde rekensom niet mogelijk op basis van alleen de klok. Een gesprek met veel korte vragen kan andere contextkosten hebben dan een even lang gesprek met enkele lange antwoorden. Dat volgt uit de facturatie per beurt; het is geen resultaat van een eigen praktijktest.

Een korte afspraakbevestiging en een lang klantenservicegesprek zijn daarom verschillende vergelijkingen. Bij de eerste taak kan weinig geschiedenis nodig zijn. Bij de tweede kunnen eerdere vragen, correcties en antwoorden langer relevant blijven. Welke aanbieder goedkoper uitvalt, hangt af van de uitvoering.

Wat voegt Extended Thinking toe?

Volgens Google is de gewone Gemini 3.8 Live gericht op snelle gesprekken. Extended Thinking krijgt meer ruimte voor taken met meerdere redeneerstappen. Het model kan volgens de aankondiging blijven praten terwijl het nadenkt en achtergrondtaken uitvoert. De modellen zijn beschikbaar via de Gemini API en Google AI Studio.

Google omschrijft de inzet als volgt:

"For developers and enterprises, these models deliver the building blocks for reliable, production-ready voice agents."

— Tom Ouyang en Malini Jaganathan, Gemini Audio Team (aankondiging)

Dat is een leveranciersclaim over geschiktheid voor productie. Het bewijst niet dat een specifieke Nederlandse klantenservicetaak al betrouwbaar wordt afgehandeld. Deze vergelijking is gebaseerd op documentatie; we hebben de modellen hiervoor niet zelf getest.

Ook GPT-Live-1 kan werk aan een achterliggend model overlaten. Het verschil zit dus mede in hoe gesprek en denkwerk zijn georganiseerd, en waar de kosten terechtkomen.

Welke kostenvergelijking helpt een bedrijf verder?

Voor een zakelijke keuze zegt de rekening per correct afgeronde taak meer dan een losse minuutprijs. Denk aan een afspraak die daadwerkelijk goed in de agenda staat. Een goedkoop gesprek dat daarna door een medewerker moet worden hersteld, vertelt maar de helft van het verhaal.

Een bruikbare vergelijking bevat daarom dezelfde gesprekstaken, de volledige API-kosten, wachttijd en het aantal gevallen dat menselijke hulp vraagt. Wat een spraakassistent in de praktijk moet kunnen voordat de prijs ertoe doet, staat in het stuk over voice AI in de ouderenzorg. Bij Gemini horen daar de contextinstellingen bij; bij GPT-Live-1 de sessieduur en het gekozen achterliggende model. Zonder die gegevens zou een besparingspercentage schijnprecisie zijn.

Correctie, 16 september 2026: de eerdere versie rekende $0,69 voor dertig minuten invoer en dertig minuten uitvoer. Dat bedrag liet opnieuw gefactureerde context buiten beschouwing en is verwijderd als schatting voor een volledig gesprek.

Volgende Stap

Wil je weten wat een AI-spraakassistent voor jouw klantgesprekken kan betekenen, inclusief de kosten en grenzen? Neem contact op.

Headerbeeld: Google.

Hoe AI-ready is jouw organisatie?

Doe de gratis AI-Readiness Scan: 9 vragen, 2 minuten, direct een persoonlijk advies.