Extrageți text din vorbire, capturi de ecran și fișiere. Acceptă recunoașterea vocii în timp real, OCR pentru capturi de ecran și procesare în lot a fișierelor audio, video, imagine și PDF.
Primii pași
Alegeți unul dintre cele trei moduri de pe ecranul principal:
- Live Transcription — conversie vorbire-text în timp real de la microfon
- Capture Transcription — OCR din capturi de ecran sau cameră
- File Transcription — procesare în lot a fișierelor audio, video, imagine sau PDF
Live Transcription
Recunoaștere a vorbirii în timp real de la microfon sau dispozitiv de intrare audio.
Motoare vocale
| Motor | Tip | Cel mai potrivit pentru |
|---|---|---|
| Google Speech | API online | Precizie ridicată, multe limbi (implicit) |
| Whisper | Model local | Utilizare offline, confidențialitate (modele tiny–large) |
| Vosk | Offline | Ușor, rapid, multe limbi |
Opțiuni de înregistrare
- Selectarea dispozitivului de intrare audio
- Audio Format: MP3 sau WAV
- Audio Quality: low / medium / high
- Înregistrare video opțională cu previzualizare a camerei
- Speaker Classification opțional (identifică diferiți vorbitori)
Capture Transcription
Extrageți text din capturi de ecran sau capturi de cameră folosind OCR.
- Camera capture — selectați un dispozitiv cameră, faceți o singură captură
- Full screen capture — capturați întregul ecran
- Region selection — desenați un dreptunghi pentru a captura o zonă specifică
- Window capture — capturați o anumită fereastră
Motor OCR: Tesseract (japoneză implicit). Rezultatele apar lângă imaginea capturată.
File Transcription
Procesați fișiere în lot prin glisare și plasare sau folosind exploratorul de fișiere.
Formate acceptate
| Tip | Formate | Metodă |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Motor vocal |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Extragere audio → motor vocal |
| Imagine | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Document | Pagină → imagine → OCR |
Workset History
- Fiecare sesiune de transcriere se salvează ca workset
- Filtrați după cuvânt-cheie, tip (Live/Capture/File) și stare
- Faceți dublu clic pentru a redeschide o sesiune anterioară
- Coloane sortabile: nume, tip, metodă, dată, stare
Setări
| Setare | Descriere | Implicit |
|---|---|---|
| Recognition Model | Motor vocal implicit | |
| Audio Format | Format de înregistrare | WAV |
| Audio Quality | Nivel de compresie | Medium |
| Video Capture | Activează înregistrarea camerei | Off |
| Speaker Classification | Identifică diferiți vorbitori | Off |
Sfaturi
- Transcriere offline — Folosiți Whisper sau Vosk pentru recunoaștere a vorbirii complet offline
- Notițe de ședință — Activați Speaker Classification pentru a distinge cine ce a spus
- OCR în lot — Plasați un întreg folder cu documente scanate pentru procesare în lot
- Extragere PDF — Fiecare pagină PDF este convertită în imagine și OCR-ată individual
Confidențialitate
- Motoarele Whisper și Vosk rulează în întregime pe dispozitivul dvs.
- Google Speech trimite audio către serverele Google pentru recunoaștere
- Toate rezultatele transcrierii și înregistrările sunt stocate doar pe discul local
- Fără analize sau urmărire