Audio · Actief in de API

Spraak en transcriptie: modellen en toepassingen

Modellen voor spraak-naar-tekst, diarization en tekst-naar-spraak.

5varianten in deze gids
Afhankelijk van model en endpointcontext of outputvorm
22 juli 2026specificaties gecontroleerd

Kort antwoord

Wat is Spraak en transcriptie?

OpenAI biedt aparte modellen voor spraakherkenning, diarization en spraaksynthese. GPT-Realtime-Whisper is gericht op streaming transcriptie, GPT-4o Transcribe op nauwkeurige spraak-naar-tekst en de diarize-variant op sprekerherkenning. TTS-1 en TTS-1 HD blijven beschikbare modellen voor tekst-naar-spraak wanneer een volledige realtime agent niet nodig is.

Model-ID's

Actieve varianten

Gebruik een model-ID of snapshot alleen nadat je beschikbaarheid en rate limits in je eigen OpenAI-project hebt gecontroleerd.

Varianten en technische grenzen van Spraak en transcriptie.
VariantModel-IDContextMax. outputKennisgrens
GPT-Realtime-Whisper
Streaming speech-to-text.
gpt-realtime-whisperZie modelkaartTranscriptn.v.t.
GPT-4o Transcribe
Algemene hoogwaardige transcriptie.
gpt-4o-transcribeZie modelkaartTranscriptn.v.t.
GPT-4o mini Transcribe
Kostenefficiënte transcriptie.
gpt-4o-mini-transcribeZie modelkaartTranscriptn.v.t.
GPT-4o Transcribe Diarize
Transcriptie met sprekersegmentatie.
gpt-4o-transcribe-diarizeZie modelkaartTranscriptn.v.t.
TTS-1 / TTS-1 HD
Tekst-naar-spraak voor snelheid of kwaliteit.
tts-1n.v.t.Audion.v.t.

Praktische keuze

Waarvoor gebruik je Spraak en transcriptie?

Geschikte toepassingen

  • Vergaderingen transcriberen
  • Ondertiteling
  • Sprekers onderscheiden
  • Voice-over en voorleesfuncties

Belangrijke beperkingen

  • Namen, accenten en vaktermen vereisen kwaliteitscontrole.
  • Diarization is geen identiteitsverificatie.
  • Toestemming en privacybeleid zijn nodig bij het opnemen van gesprekken.

Beschikbare tools

  • Transcriptions
  • Realtime transcription
  • Speech generation

Beslisregel

Wanneer kies je deze family?

Gebruik Transcribe voor audio-naar-tekst, Diarize als sprekerwissels belangrijk zijn en TTS voor tekst-naar-audio. Kies Realtime alleen wanneer de gebruiker tijdens het spreken direct antwoord of interactie nodig heeft.

API-prijzen

Prijsindicatie voor Spraak en transcriptie

Alle bedragen zijn USD. Toolcalls, opslag en andere endpoints kunnen extra kosten hebben.

Prijsinformatie gecontroleerd op 22 juli 2026.
VariantInputCached inputOutput / prijsEenheid
Transcriptie en spraaksyntheseVerschilt per model, minuut of audiotokenper minuut of per 1M audiotokens
Controleer de officiële OpenAI-bron

Veelgestelde vragen

Vragen over Spraak en transcriptie

Welk model gebruik ik voor vergadernotulen?

Gebruik een transcriptiemodel; kies de diarize-variant wanneer je afzonderlijke sprekers wilt onderscheiden. Laat namen en beslissingen altijd controleren.

Is Whisper nog beschikbaar?

Het modelcatalogus vermeldt Whisper nog als algemeen spraakherkenningsmodel, naast nieuwere GPT-gebaseerde transcriptievarianten.

Bron

Productspecificaties zijn afgeleid van de officiële OpenAI-documentatie.

Open officiële documentatie

Gecontroleerd

22 juli 2026. De build vereist een nieuwe verificatie zodra deze informatie ouder is dan 45 dagen.

Redactie

chatnederlands.org, onafhankelijke Nederlandstalige AI-gids. Niet verbonden aan OpenAI.

Verder lezen

Artikelen over modellen en gebruik

Praktisch gebruiken

Stel een vraag in de Nederlandse chat

Gebruik de chat voor schrijven, uitleg en ideeën. De modelselector vermeldt welke backend actief is; deze gids verandert je keuze niet automatisch in Spraak en transcriptie.