Extrahera text från tal, skärmdumpar och filer. Stöder röstigenkänning i realtid, OCR av skärmdumpar och batchbearbetning av ljud-, video-, bild- och PDF-filer.
Kom igång
Välj ett av tre lägen från huvudskärmen:
- Live Transcription — tal till text i realtid från din mikrofon
- Capture Transcription — OCR från skärmdumpar eller kamera
- File Transcription — batchbearbetning av ljud-, video-, bild- eller PDF-filer
Live Transcription
Röstigenkänning i realtid från din mikrofon eller ljudingångsenhet.
Talmotorer
| Motor | Typ | Bäst för |
|---|---|---|
| Google Speech | Online-API | Hög precision, många språk (standard) |
| Whisper | Lokal modell | Offline-användning, integritet (modeller från tiny till large) |
| Vosk | Offline | Lättviktig, snabb, många språk |
Inspelningsalternativ
- Val av ljudingångsenhet
- Audio Format: MP3 eller WAV
- Audio Quality: low / medium / high
- Valfri videoinspelning med kameraförhandsvisning
- Valfri Speaker Classification (identifierar olika talare)
Capture Transcription
Extrahera text från skärmdumpar eller kameran med hjälp av OCR.
- Camera capture — välj kameraenhet, ta en enskild bild
- Full screen capture — fånga hela skärmen
- Region selection — rita en rektangel för att fånga ett specifikt område
- Window capture — fånga ett specifikt fönster
OCR-motor: Tesseract (japanska som standard). Resultaten visas bredvid den fångade bilden.
File Transcription
Bearbeta filer i batch genom dra och släpp eller via filbläddraren.
Format som stöds
| Typ | Format | Metod |
|---|---|---|
| Ljud | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Talmotor |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Ljudextraktion → talmotor |
| Bild | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokument | Sida → bild → OCR |
Workset History
- Varje transkriptionssession sparas som ett workset
- Filtrera efter nyckelord, typ (Live/Capture/File) och status
- Dubbelklicka för att öppna en tidigare session igen
- Sorterbara kolumner: namn, typ, metod, datum, status
Inställningar
| Inställning | Beskrivning | Standard |
|---|---|---|
| Recognition Model | Standardtalmotor | |
| Audio Format | Inspelningsformat | WAV |
| Audio Quality | Komprimeringsnivå | Medium |
| Video Capture | Aktivera kamerainspelning | Off |
| Speaker Classification | Identifiera olika talare | Off |
Tips
- Offline-transkription — Använd Whisper eller Vosk för helt offline röstigenkänning
- Mötesanteckningar — Aktivera Speaker Classification för att urskilja vem som sa vad
- Batch-OCR — Släpp en hel mapp med skannade dokument för batchbearbetning
- PDF-extraktion — Varje PDF-sida konverteras till en bild och OCR-bearbetas individuellt
Integritet
- Whisper- och Vosk-motorerna körs helt på din enhet
- Google Speech skickar ljud till Googles servrar för igenkänning
- Alla transkriptionsresultat och inspelningar lagras endast på din lokala disk
- Ingen analys eller spårning