Udtrækker tekst fra tale, skærmbilleder og filer. Understøtter stemmegenkendelse i realtid, OCR fra skærmbilleder og batchbehandling af lyd, video, billeder og PDF'er.
Kom godt i gang
Vælg en af tre tilstande fra hovedskærmen:
- Live Transcription — tale-til-tekst i realtid fra din mikrofon
- Capture Transcription — OCR fra skærmbilleder eller kamera
- File Transcription — batchbehandling af lyd-, video-, billed- eller PDF-filer
Live Transcription
Talegenkendelse i realtid fra din mikrofon eller lydinputenhed.
Talemotorer
| Motor | Type | Bedst til |
|---|---|---|
| Google Speech | Online API | Høj nøjagtighed, mange sprog (default) |
| Whisper | Lokal model | Offline-brug, privatliv (modeller fra tiny til large) |
| Vosk | Offline | Letvægt, hurtig, mange sprog |
Optagelsesmuligheder
- Valg af lydinputenhed
- Audio Format: MP3 eller WAV
- Audio Quality: low / medium / high
- Valgfri Video Capture med kameraforhåndsvisning
- Valgfri Speaker Classification (identificerer forskellige talere)
Capture Transcription
Udtræk tekst fra skærmbilleder eller kameraoptagelser ved hjælp af OCR.
- Kameraoptagelse — vælg en kameraenhed, tag et enkelt billede
- Fuldskærmsoptagelse — optag hele skærmen
- Områdevalg — tegn et rektangel for at optage et bestemt område
- Vinduesoptagelse — optag et bestemt vindue
OCR-motor: Tesseract (japansk som standard). Resultaterne vises ved siden af det optagne billede.
File Transcription
Behandl filer i batch ved at trække og slippe eller bruge filbrowseren.
Understøttede formater
| Type | Formater | Metode |
|---|---|---|
| Lyd | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Talemotor |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Lydudtrækning → talemotor |
| Billede | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokument | Side → billede → OCR |
Workset-historik
- Hver transskriptionssession gemmes som et workset
- Filtrer efter nøgleord, type (Live/Capture/File) og status
- Dobbeltklik for at genåbne en tidligere session
- Sorterbare kolonner: navn, type, metode, dato, status
Indstillinger
| Indstilling | Beskrivelse | Standard |
|---|---|---|
| Recognition Model | Standard talemotor | |
| Audio Format | Optageformat | WAV |
| Audio Quality | Komprimeringsniveau | Medium |
| Video Capture | Aktivér kameraoptagelse | Off |
| Speaker Classification | Identificér forskellige talere | Off |
Tips
- Offline transskription — Brug Whisper eller Vosk til helt offline talegenkendelse
- Mødenoter — Aktivér Speaker Classification for at skelne hvem der sagde hvad
- Batch-OCR — Slip en hel mappe med scannede dokumenter for batchbehandling
- PDF-udtrækning — Hver PDF-side konverteres til et billede og OCR-behandles individuelt
Privatliv
- Whisper- og Vosk-motorer kører udelukkende på din enhed
- Google Speech sender lyd til Googles servere til genkendelse
- Alle transskriptionsresultater og optagelser gemmes kun på din lokale disk
- Ingen analyse eller sporing