Extrahujte text z řeči, snímků obrazovky a souborů. Podporuje rozpoznávání řeči v reálném čase, OCR snímků obrazovky a dávkové zpracování zvuku, videa, obrázků a PDF.
Začínáme
Vyberte jeden ze tří režimů na hlavní obrazovce:
- Live Transcription — převod řeči na text v reálném čase z mikrofonu
- Capture Transcription — OCR ze snímků obrazovky nebo kamery
- File Transcription — dávkové zpracování zvukových, video, obrázkových nebo PDF souborů
Live Transcription
Rozpoznávání řeči v reálném čase z mikrofonu nebo audio vstupního zařízení.
Hlasové moduly
| Modul | Typ | Nejlepší pro |
|---|---|---|
| Google Speech | Online API | Vysoká přesnost, mnoho jazyků (výchozí) |
| Whisper | Lokální model | Offline použití, soukromí (modely tiny až large) |
| Vosk | Offline | Lehký, rychlý, mnoho jazyků |
Možnosti nahrávání
- Výběr audio vstupního zařízení
- Audio Format: MP3 nebo WAV
- Audio Quality: low / medium / high
- Volitelné nahrávání videa s náhledem kamery
- Volitelná Speaker Classification (rozlišuje různé mluvčí)
Capture Transcription
Extrahujte text ze snímků obrazovky nebo z kamery pomocí OCR.
- Camera capture — vyberte zařízení kamery, pořiďte jednotlivý snímek
- Full screen capture — zachyťte celou obrazovku
- Region selection — nakreslete obdélník pro zachycení konkrétní oblasti
- Window capture — zachyťte konkrétní okno
OCR modul: Tesseract (výchozí japonština). Výsledky se zobrazují vedle zachyceného obrázku.
File Transcription
Zpracovávejte soubory dávkově přetažením nebo pomocí prohlížeče souborů.
Podporované formáty
| Typ | Formáty | Metoda |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Hlasový modul |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Extrakce zvuku → hlasový modul |
| Obrázek | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokument | Stránka → obrázek → OCR |
Workset History
- Každá relace přepisu se ukládá jako workset
- Filtrujte podle klíčového slova, typu (Live/Capture/File) a stavu
- Dvojklikem znovu otevřete předchozí relaci
- Tříditelné sloupce: název, typ, metoda, datum, stav
Nastavení
| Nastavení | Popis | Výchozí |
|---|---|---|
| Recognition Model | Výchozí hlasový modul | |
| Audio Format | Formát nahrávání | WAV |
| Audio Quality | Úroveň komprese | Medium |
| Video Capture | Povolit nahrávání z kamery | Off |
| Speaker Classification | Identifikace různých mluvčích | Off |
Tipy
- Offline přepis — Použijte Whisper nebo Vosk pro plně offline rozpoznávání řeči
- Poznámky ze schůzek — Zapněte Speaker Classification pro rozlišení, kdo co řekl
- Dávkové OCR — Přetáhněte celou složku skenovaných dokumentů pro dávkové zpracování
- Extrakce PDF — Každá stránka PDF je převedena na obrázek a OCR zpracována samostatně
Soukromí
- Moduly Whisper a Vosk běží zcela na vašem zařízení
- Google Speech odesílá zvuk na servery Google k rozpoznání
- Všechny výsledky přepisu a nahrávky jsou uloženy pouze na vašem lokálním disku
- Žádná analytika ani sledování