Estrai testo da voce, screenshot e file. Supporta riconoscimento vocale in tempo reale, OCR da cattura schermo ed elaborazione batch di audio, video, immagini e PDF.
Per iniziare
Scegli una delle tre modalità dalla schermata principale:
- Live Transcription — trascrizione vocale in tempo reale dal microfono
- Capture Transcription — OCR da screenshot o fotocamera
- File Transcription — elaborazione batch di file audio, video, immagine o PDF
Live Transcription
Riconoscimento vocale in tempo reale dal microfono o dal dispositivo di ingresso audio.
Motori di riconoscimento vocale
| Motore | Tipo | Ideale per |
|---|---|---|
| Google Speech | API online | Alta precisione, molte lingue (predefinito) |
| Whisper | Modello locale | Uso offline, privacy (modelli da tiny a large) |
| Vosk | Offline | Leggero, veloce, molte lingue |
Opzioni di registrazione
- Selezione del dispositivo di ingresso audio
- Formato audio: MP3 o WAV
- Qualità audio: bassa / media / alta
- Cattura video opzionale con anteprima della fotocamera
- Classificazione opzionale dei parlanti (identifica i diversi interlocutori)
Capture Transcription
Estrai testo da screenshot o catture della fotocamera tramite OCR.
- Cattura da fotocamera — seleziona un dispositivo fotocamera, scatta una singola immagine
- Cattura schermo intero — cattura l’intero schermo
- Selezione di una regione — disegna un rettangolo per catturare un’area specifica
- Cattura finestra — cattura una finestra specifica
Motore OCR: Tesseract (giapponese predefinito). I risultati appaiono accanto all’immagine catturata.
File Transcription
Elabora file in batch tramite trascinamento o utilizzando il selettore di file.
Formati supportati
| Tipo | Formati | Metodo |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Motore vocale |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Estrazione audio → motore vocale |
| Immagine | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Documento | Pagina → immagine → OCR |
Cronologia dei workset
- Ogni sessione di trascrizione viene salvata come workset
- Filtra per parola chiave, tipo (Live/Capture/File) e stato
- Doppio clic per riaprire una sessione precedente
- Colonne ordinabili: nome, tipo, metodo, data, stato
Impostazioni
| Impostazione | Descrizione | Predefinito |
|---|---|---|
| Recognition Model | Motore vocale predefinito | |
| Audio Format | Formato di registrazione | WAV |
| Audio Quality | Livello di compressione | Medium |
| Video Capture | Abilita la registrazione dalla fotocamera | Off |
| Speaker Classification | Identifica i diversi parlanti | Off |
Suggerimenti
- Trascrizione offline — Usa Whisper o Vosk per un riconoscimento vocale completamente offline
- Note di riunione — Abilita la classificazione dei parlanti per distinguere chi ha detto cosa
- OCR in batch — Trascina un’intera cartella di documenti scansionati per l’elaborazione in batch
- Estrazione da PDF — Ogni pagina del PDF viene convertita in immagine e sottoposta a OCR singolarmente
Privacy
- I motori Whisper e Vosk vengono eseguiti interamente sul tuo dispositivo
- Google Speech invia l’audio ai server Google per il riconoscimento
- Tutti i risultati di trascrizione e le registrazioni sono memorizzati esclusivamente sul tuo disco locale
- Nessuna analisi né tracciamento