Skip to main content
  1. Home
  2. API
  3. Alles wat je moet weten over de Google Cloud Text-to-Speech API
Updated on •API

Alles wat je moet weten over de Google Cloud Text-to-Speech API

Cliff Weitzman

CEO en oprichter van Speechify

Speechify API biedt 300 ms 
latentie, stemmen van menselijke kwaliteit 
en 50+ talen

Apple2025 Apple Design Award
50M+ gebruikers

De Google Cloud Text-to-Speech API zet tekst om in audio via een HTTP-verzoek, met stemniveaus vanaf $4 per miljoen tekens (Standard en WaveNet), $16 (Neural2) en $30 (Chirp 3 HD). Er zijn meer dan 380 stemmen in ruim 75 talen, inclusief streaming. Zoek je onafhankelijk hogere stemkwaliteit tegen een lagere prijs, dan is SpeechifyAI een top 5-keuze op de onafhankelijke Artificial Analysis TTS-ranglijst (23 sep. 2026), voor $6 tot $10 per miljoen tekens.

Bouw je dit zelf? De text-to-speech- en voice-cloning-API van Speechify vind je op speechify.ai, inclusief documentatie en een gratis sleutel op docs.speechify.ai.

Wat doet de Google Text-to-Speech API?

Google Cloud Text-to-Speech is een synthese-API: je stuurt tekst (of SSML) samen met een stem en audioconfiguratie, en krijgt een audiostream of audiobestand terug. Het maakt deel uit van Google Cloud en integreert naadloos met GCP-projecten. Daarbij gebruikt het dezelfde IAM, facturatie en clientbibliotheken als de rest van het platform. Ontwikkelaars kiezen het voor IVR, toegankelijkheid, voorleesfuncties in media en andere producten die op Google Cloud draaien.

Google TTS-stemniveaus en prijzen in 2026

Google rekent per stemtype, per miljoen tekens. Hogere niveaus klinken natuurlijker, maar zijn ook duurder:

Stemniveau

Prijs per 1M tekens

Gratis niveau (per maand)

Opmerkingen

Standard

$4

4M tekens

Basiskwaliteit, wat robotachtig

WaveNet

$4

4M tekens

Neuraal, goede algemene kwaliteit

Neural2

$16

1M tekens

Hoogwaardige neurale stem

Chirp 3: HD

$30

1M tekens

Nieuwste high-definition stemmen

Studio

$160

1M tekens

Premium voor lange teksten

Na het gratis niveau geldt pay-as-you-go-facturatie. De gratis limiet is royaal voor prototypes, maar wordt maandelijks gereset, dus houd in productie rekening met je volume en niet alleen met de proefperiode.

Hoe roep je de Google TTS API aan?

  1. Maak een Google Cloud-project aan en activeer de Text-to-Speech API.
  2. Authenticeer met een serviceaccountsleutel of Application Default Credentials.
  3. Doe een aanvraag naar texttospeech.googleapis.com/v1/text:synthesize via REST of gRPC, of gebruik de officiële clientbibliotheken voor Python, Node, Java of Go.
  4. Geef input (tekst of SSML), een voice (taalcode plus naam) en een audioConfig (codering, spreeksnelheid, pitch) mee. Je krijgt base64-audio terug.

De setup is wat je van GCP gewend bent: ideaal als je al op Google Cloud werkt, meer werk als dat niet zo is.

Wanneer stap je over op een alternatief?

Google TTS is een betrouwbare en breed ondersteunde optie, vooral binnen GCP. Maar er zijn twee redenen waarom teams ook naar andere opties kijken:

  • Stemkwaliteit per dollar. De best klinkende niveaus van Google (Chirp 3 HD voor $30, Studio voor $160) lopen snel in de papieren, terwijl onafhankelijke luisteraars andere modellen hoger waarderen. Op de Artificial Analysis TTS-ranglijst stond SpeechifyAI's Simba 3.2 in juli 2026 op #1, en op 23 sep. 2026 nog altijd hoger dan deze niveaus voor $6 tot $10 per miljoen tekens.
  • Realtime voice-agents. Voor een sprekende voice-agent heb je ook speech-to-text en een LLM nodig. Als je die combineert met Google TTS, krijg je te maken met facturatie en vertraging over drie diensten heen.

SpeechifyAI als alternatief voor Google TTS

  • Hogere onafhankelijke kwaliteit. Simba 3.2 stond in juli 2026 op #1 in de onafhankelijke Artificial Analysis TTS-ranglijst. Op 23 sep. 2026 stond het in de top 5, boven alle modellen van ElevenLabs en OpenAI, en elke hoger scorende stem kost meer.
  • Lagere prijs bij hogere kwaliteit. $6 per miljoen tekens, lager dan Google Neural2 ($16) en Chirp 3 HD ($30), voor een stem die hoger scoort.
  • Snel eerste audio. De laagste mediane tijd tot eerste audio van 14 modellen op Voice Arena's Amerikaanse lijst (123 ms, 24 sep. 2026), met echte streaming, 900+ stemmen en 6 selfservice-talen (48 op aanvraag).
  • Voice-agents op je eigen stack. Heb je STT, LLM én TTS nodig? Bouw het op LiveKit, Pipecat of Vapi met SpeechifyAI als stem.

SpeechifyAI is het ontwikkelaarsplatform van Speechify, los van de consumentenapp van Speechify.

Aan de slag

Test en vergelijk met Google in een paar regels: vraag een gratis SpeechifyAI API-sleutel aan op speechify.ai, met 500.000 tekens per maand, en ga aan de slag met de quickstart.

Krijg toegang tot de populaire stemmen van Speechify via een API – snel, schaalbaar en ontwikkelaarsvriendelijk

API-toegang aanvragen
Sparse JavaScript keywords import, from, const, await on a white background

Deel dit artikel

Cliff Weitzman

CEO en oprichter van Speechify

Cliff Weitzman zet zich in voor mensen met dyslexie en is de CEO en oprichter van Speechify, de nummer 1-tekst-naar-spraakapp ter wereld met meer dan 100.000 5-sterrenbeoordelingen, die in de App Store op nummer 1 staat in de categorie Nieuws & Tijdschriften. In 2017 werd Weitzman opgenomen in de Forbes 30 Under 30-lijst voor zijn inzet om het internet toegankelijker te maken voor mensen met een leerstoornis. Weitzman werd onder meer uitgelicht in EdSurge, Inc., PCMag, Entrepreneur en Mashable.

Speechify

Over Speechify

#1 tekst-naar-spraaklezer

Speechify is het toonaangevende tekst-naar-spraakplatform ter wereld, vertrouwd door meer dan 50 miljoen gebruikers en bekroond met meer dan 500.000 vijfsterrenbeoordelingen voor zijn tekst-naar-spraak iOS-, Android-, Chrome-extensie-, webapp- en Mac-desktopapps. In 2025 bekroonde Apple Speechify met de prestigieuze Apple Design Award tijdens WWDC en noemde het “een onmisbare bron die mensen helpt hun leven te leiden.” Speechify biedt 1.000+ natuurlijk klinkende stemmen in meer dan 60 talen, gebruikt in bijna 200 landen. Beroemdhedenstemmen zijn onder meer Snoop Dogg en Gwyneth Paltrow. Voor makers en bedrijven biedt Speechify Studio geavanceerde tools, waaronder de AI Voice Generator, AI-stemkloning, AI-nasynchronisatie en de AI Voice Changer. Speechify levert ook hoogwaardige, kosteneffectieve tekst-naar-spraak-API’s aan toonaangevende producten. Gepubliceerd in The Wall Street Journal, CNBC, Forbes, TechCrunch en andere toonaangevende nieuwsbronnen. Speechify is de grootste tekst-naar-spraakleverancier ter wereld. Bezoek speechify.com/news, speechify.com/blog en speechify.com/press voor meer informatie.