Alle artikelen
Spraak-AI 2 min lezen

Snel, Gebalanceerd, Beste: welk kwaliteitsniveau kies je

Drie niveaus, drie verschillende modellen. Wat er echt tussen zit, en wanneer het traagste het wachten waard is.

Wat de drie niveaus zijn

Elke upload loopt via een van drie niveaus, en elk is een ander model:

  • Snel — Whisper large-v3-turbo. Een gedestilleerde versie van het grote model: minder decoderlagen, het grootste deel van de nauwkeurigheid, een fractie van de tijd.
  • Gebalanceerd — Whisper large-v3. Het volledige model, en de standaard.
  • Beste — GPT-4o Transcribe. Een nieuwere architectuur die beter overweg kan met accenten, door elkaar praten en ruis dan Whisper.

Alle drie geven timing op woordniveau terug: de speler leest overal mee en de ondertitelexport werkt op elk niveau hetzelfde.

Wat er echt verandert

Bij schone audio: weinig. Eén spreker met een fatsoenlijke microfoon in een stille ruimte komt op alle drie de niveaus vrijwel op hetzelfde uit — en juist daarom is wachten op Beste bij dat bestand weggegooid.

Het gat gaat open zodra de audio lastig wordt: overlappende spraak, zware accenten, achtergrondgeluid, vakjargon, eigennamen. Snel laat dan korte tussenwerpsels vallen en gokt naar namen. Beste houdt ze vast.

Kiezen zonder er lang over te doen

Laat het op Gebalanceerd. Het is de standaard omdat het meestal klopt.

Ga naar Snel als je snel de kern van een lange opname wilt, of als de audio schoon is en er weinig op het spel staat: een spraakmemo, een solo-opname, iets wat je gaat doorbladeren.

Ga naar Beste als een fout je iets kost: interviews die je gaat citeren, juridische of medische opnames, zware accenten, meerdere mensen die door elkaar praten, of alles wat je als ondertiteling publiceert.

Je kunt een bestand altijd opnieuw op een hoger niveau draaien. De originele audio blijft beschikbaar zolang je abonnement die bewaart.

Blog

Zet je eigen opname om in tekst

Upload een bestand en lees het transcript binnen enkele minuten — zonder account.

Een bestand transcriberen