Extrahujte text z reči, snímok obrazovky a súborov. Podporuje rozpoznávanie reči v reálnom čase, OCR snímok obrazovky a dávkové spracovanie zvuku, videa, obrázkov a PDF.
Začíname
Vyberte jeden z troch režimov na hlavnej obrazovke:
- Live Transcription — prevod reči na text v reálnom čase z mikrofónu
- Capture Transcription — OCR zo snímok obrazovky alebo kamery
- File Transcription — dávkové spracovanie zvukových, video, obrázkových alebo PDF súborov
Live Transcription
Rozpoznávanie reči v reálnom čase z mikrofónu alebo zvukového vstupného zariadenia.
Hlasové moduly
| Modul | Typ | Najlepší pre |
|---|---|---|
| Google Speech | Online API | Vysoká presnosť, mnoho jazykov (predvolený) |
| Whisper | Lokálny model | Offline použitie, súkromie (modely tiny až large) |
| Vosk | Offline | Ľahký, rýchly, mnoho jazykov |
Možnosti nahrávania
- Výber zvukového vstupného zariadenia
- Audio Format: MP3 alebo WAV
- Audio Quality: low / medium / high
- Voliteľné nahrávanie videa s náhľadom kamery
- Voliteľná Speaker Classification (rozlišuje rôznych rečníkov)
Capture Transcription
Extrahujte text zo snímok obrazovky alebo z kamery pomocou OCR.
- Camera capture — vyberte zariadenie kamery, urobte jednotlivú snímku
- Full screen capture — zachyťte celú obrazovku
- Region selection — nakreslite obdĺžnik na zachytenie konkrétnej oblasti
- Window capture — zachyťte konkrétne okno
OCR modul: Tesseract (predvolená japončina). Výsledky sa zobrazujú vedľa zachyteného obrázka.
File Transcription
Spracujte súbory dávkovo presunutím alebo pomocou prehliadača súborov.
Podporované formáty
| Typ | Formáty | Metóda |
|---|---|---|
| Zvuk | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Hlasový modul |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Extrakcia zvuku → hlasový modul |
| Obrázok | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokument | Strana → obrázok → OCR |
Workset History
- Každá relácia prepisu sa ukladá ako workset
- Filtrujte podľa kľúčového slova, typu (Live/Capture/File) a stavu
- Dvojklikom znova otvoríte predchádzajúcu reláciu
- Triediteľné stĺpce: názov, typ, metóda, dátum, stav
Nastavenia
| Nastavenie | Popis | Predvolené |
|---|---|---|
| Recognition Model | Predvolený hlasový modul | |
| Audio Format | Formát nahrávania | WAV |
| Audio Quality | Úroveň kompresie | Medium |
| Video Capture | Povoliť nahrávanie z kamery | Off |
| Speaker Classification | Identifikácia rôznych rečníkov | Off |
Tipy
- Offline prepis — Použite Whisper alebo Vosk pre úplne offline rozpoznávanie reči
- Poznámky zo stretnutí — Zapnite Speaker Classification na rozlíšenie, kto čo povedal
- Dávkové OCR — Presuňte celý priečinok skenovaných dokumentov na dávkové spracovanie
- Extrakcia PDF — Každá strana PDF sa prevedie na obrázok a OCR sa spracuje samostatne
Súkromie
- Moduly Whisper a Vosk bežia úplne na vašom zariadení
- Google Speech odosiela zvuk na servery Google na rozpoznanie
- Všetky výsledky prepisu a nahrávky sú uložené iba na vašom lokálnom disku
- Žiadna analytika ani sledovanie