Transcriptie vergeleken
Hoe nauwkeurig is scryp voor Nederlandse transcriptie – en hoe veilig is je data vergeleken met de grote clouddiensten? Hier zijn de resultaten van onze benchmark.
Transcriptienauwkeurigheid voor het Nederlands
Word Error Rate (WER) – lager is beter. Nauwkeurigheid = 100 % − WER.
← Tabel zijwaarts scrollen →
| Aanbieder | Algemeen (nauwkeurigheid) | Vakdomein (nauwkeurigheid) | WER algemeen |
|---|---|---|---|
| scrypSX-3 | 96.2 % | 96.1 % | 3.8 % |
| OpenAIWhisper Large v3 | 95.2 % | 83.5 % | 4.8 % |
| Google STTCloud Speech-to-Text | 88.5 % | 80.2 % | 11.5 % |
| Azure SpeechMicrosoft Cognitive | 87.9 % | 78.7 % | 12.1 % |
| AWS TranscribeAmazon Standard | 85.7 % | 75.9 % | 14.3 % |
Testdataset & methodologie
- De basis is onze eigen testdataset met openbaar beschikbare Nederlandstalige audio-opnames in de domeinen Algemeen, Gezondheid en Recht.
- Alle aanbieders zijn getest met identieke audiobestanden en een uniforme evaluatiemethode (Word Error Rate na standaardnormalisatie).
- De kolom Vakdomein toont het gemiddelde over gezondheids- en rechtsopnames. Bij vakjargon stijgt de foutmarge bij alle aanbieders – maar veel sterker bij modellen zonder domeinspecifieke training.
- Resultaten kunnen variëren afhankelijk van audiokwaliteit, aantal sprekers, dialect en het concrete gebruiksscenario.
Waarom scryp anders is opgebouwd voor gevoelige inhoud
Deze punten beschrijven de architectuur van scryp zelf. Ze zijn bewust concreet geformuleerd en niet bedoeld als algemene uitspraak over elke andere aanbieder.
Versleuteling op je apparaat
Bestanden worden vóór upload in de browser versleuteld. Opgeslagen inhoud blijft permanent uitsluitend versleuteld.
Heldere EU-architectuur
Transcriptie in Oostenrijk, versleutelde opslag in Duitsland – beide binnen de EU. Zo is duidelijk waar welke verwerkingsstap plaatsvindt.
Eigen verwerkingsinfrastructuur
Voor de transcriptie worden geen externe AI-derden ingezet. Dat beperkt extra datastromen en afhankelijkheden.
Volledige browserworkflow
Bewerken, exporteren, delen en audiosynchronisatie zitten direct in het product, niet alleen als losse API-componenten.
Bronnen & documentatie
Aanbiederfuncties zijn geverifieerd aan de hand van officiële documentatie. Nauwkeurigheidscijfers zijn gebaseerd op de hierboven beschreven testdataset.
Modellen & nauwkeurigheid
- Radford et al. (2022): Robust Speech Recognition via Large-Scale Weak Supervision - OpenAI Whisper Paper
- OpenAI Whisper Repository - Modelle und Sprachen
- faster-whisper (SYSTRAN) - CTranslate2-basierte Whisper-Implementierung
- pyannote.audio 3.x - Speaker Diarization Pipeline
- Mozilla Common Voice - Offener Sprachdatensatz
Aanbiederdocumentatie
- Google Cloud Speech-to-Text - Overview and speech recognition
- Google Cloud Speech-to-Text - Speaker Diarization
- Microsoft Azure Speech Service - Overview and documentation
- Azure Speech - Real-time diarization quickstart
- Amazon Transcribe - Developer Guide
- Amazon Transcribe - Speaker partitioning (Diarization)
Klaar voor veilige transcriptie?
Probeer scryp gratis – versleuteld vanaf de eerste seconde.