Haal tekst uit spraak, schermafbeeldingen en bestanden. Ondersteunt spraakherkenning in real-time, OCR voor schermopnames en batchverwerking van audio, video, afbeeldingen en PDF-bestanden.
Aan de slag
Kies een van de drie modi op het hoofdscherm:
- Live Transcription — spraak-naar-tekst in real-time vanaf je microfoon
- Capture Transcription — OCR vanaf schermafbeeldingen of camera
- File Transcription — verwerk audio-, video-, afbeeldings- of PDF-bestanden in batch
Live Transcription
Spraakherkenning in real-time vanaf je microfoon of audio-invoerapparaat.
Spraakengines
| Engine | Type | Geschikt voor |
|---|---|---|
| Google Speech | Online API | Hoge nauwkeurigheid, vele talen (standaard) |
| Whisper | Lokaal model | Offline gebruik, privacy (modellen van tiny tot large) |
| Vosk | Offline | Lichtgewicht, snel, vele talen |
Opname-opties
- Selectie van audio-invoerapparaat
- Audio Format: MP3 of WAV
- Audio Quality: laag / midden / hoog
- Optionele video-opname met cameravoorbeeld
- Optionele Speaker Classification (identificeert verschillende sprekers)
Capture Transcription
Haal tekst uit schermafbeeldingen of camera-opnames met behulp van OCR.
- Camera capture — selecteer een camera-apparaat en maak een enkele foto
- Full screen capture — legt het hele scherm vast
- Region selection — teken een rechthoek om een specifiek gebied vast te leggen
- Window capture — legt een specifiek venster vast
OCR-engine: Tesseract (standaard Japans). Resultaten verschijnen naast de vastgelegde afbeelding.
File Transcription
Verwerk bestanden in batch door ze te slepen en neer te zetten of via de bestandsbrowser.
Ondersteunde formaten
| Type | Formaten | Methode |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Spraakengine |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Audio-extractie → spraakengine |
| Afbeelding | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Document | Pagina → afbeelding → OCR |
Workset-geschiedenis
- Elke transcriptiesessie wordt opgeslagen als een workset
- Filter op trefwoord, type (Live/Capture/File) en status
- Dubbelklik om een eerdere sessie opnieuw te openen
- Sorteerbare kolommen: naam, type, methode, datum, status
Instellingen
| Instelling | Beschrijving | Standaard |
|---|---|---|
| Recognition Model | Standaard spraakengine | |
| Audio Format | Opnameformaat | WAV |
| Audio Quality | Compressieniveau | Medium |
| Video Capture | Camera-opname inschakelen | Off |
| Speaker Classification | Verschillende sprekers identificeren | Off |
Tips
- Offline transcriptie — Gebruik Whisper of Vosk voor volledig offline spraakherkenning
- Vergadernotities — Schakel Speaker Classification in om te onderscheiden wie wat heeft gezegd
- Batch-OCR — Sleep een hele map met gescande documenten voor batchverwerking
- PDF-extractie — Elke PDF-pagina wordt omgezet in een afbeelding en afzonderlijk via OCR verwerkt
Privacy
- De Whisper- en Vosk-engines draaien volledig op je apparaat
- Google Speech stuurt audio naar Google-servers voor herkenning
- Alle transcriptieresultaten en opnames worden uitsluitend op je lokale schijf opgeslagen
- Geen analytics of tracking