Trekk ut tekst fra tale, skjermbilder og filer. Støtter sanntids stemmegjenkjenning, OCR fra skjermopptak og batchbehandling av lyd, video, bilder og PDF-er.
Kom i gang
Velg én av tre moduser fra hovedskjermen:
- Live Transcription — sanntids tale-til-tekst fra mikrofonen din
- Capture Transcription — OCR fra skjermbilder eller kamera
- File Transcription — batchbehandling av lyd-, video-, bilde- eller PDF-filer
Live Transcription
Sanntids talegjenkjenning fra mikrofonen eller lydinngangsenheten din.
Talemotorer
| Motor | Type | Best for |
|---|---|---|
| Google Speech | Online API | Høy nøyaktighet, mange språk (default) |
| Whisper | Lokal modell | Offline-bruk, personvern (tiny til large modeller) |
| Vosk | Offline | Lett, rask, mange språk |
Opptaksalternativer
- Valg av lydinngangsenhet
- Audio Format: MP3 eller WAV
- Audio Quality: low / medium / high
- Valgfri Video Capture med kameraforhåndsvisning
- Valgfri Speaker Classification (identifiserer forskjellige talere)
Capture Transcription
Trekk ut tekst fra skjermbilder eller kameraopptak ved hjelp av OCR.
- Kameraopptak — velg en kameraenhet, ta et enkelt bilde
- Fullskjermopptak — ta opp hele skjermen
- Områdevalg — tegn et rektangel for å fange et spesifikt område
- Vindusopptak — fang et spesifikt vindu
OCR-motor: Tesseract (japansk som standard). Resultatene vises ved siden av det fangede bildet.
File Transcription
Batchbehandle filer ved å dra og slippe eller bruke filutforskeren.
Støttede formater
| Type | Formater | Metode |
|---|---|---|
| Lyd | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Talemotor |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Lyduttrekking → talemotor |
| Bilde | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokument | Side → bilde → OCR |
Workset-historikk
- Hver transkripsjonsøkt lagres som et workset
- Filtrer etter nøkkelord, type (Live/Capture/File) og status
- Dobbeltklikk for å åpne en tidligere økt på nytt
- Sorterbare kolonner: navn, type, metode, dato, status
Innstillinger
| Innstilling | Beskrivelse | Standard |
|---|---|---|
| Recognition Model | Standard talemotor | |
| Audio Format | Opptaksformat | WAV |
| Audio Quality | Komprimeringsnivå | Medium |
| Video Capture | Aktiver kameraopptak | Off |
| Speaker Classification | Identifiser forskjellige talere | Off |
Tips
- Offline transkripsjon — Bruk Whisper eller Vosk for helt offline talegjenkjenning
- Møtenotater — Aktiver Speaker Classification for å skille hvem som sa hva
- Batch-OCR — Slipp en hel mappe med skannede dokumenter for batchbehandling
- PDF-uttrekking — Hver PDF-side konverteres til et bilde og OCR-behandles individuelt
Personvern
- Whisper- og Vosk-motorer kjører helt på enheten din
- Google Speech sender lyd til Googles servere for gjenkjenning
- Alle transkripsjonsresultater og opptak lagres kun på din lokale disk
- Ingen analyse eller sporing