Textnizer - Guida

Estrai testo da voce, screenshot e file. Supporta riconoscimento vocale in tempo reale, OCR da cattura schermo ed elaborazione batch di audio, video, immagini e PDF.


Per iniziare

Scegli una delle tre modalità dalla schermata principale:

  1. Live Transcription — trascrizione vocale in tempo reale dal microfono
  2. Capture Transcription — OCR da screenshot o fotocamera
  3. File Transcription — elaborazione batch di file audio, video, immagine o PDF

Live Transcription

Riconoscimento vocale in tempo reale dal microfono o dal dispositivo di ingresso audio.

Motori di riconoscimento vocale

MotoreTipoIdeale per
Google SpeechAPI onlineAlta precisione, molte lingue (predefinito)
WhisperModello localeUso offline, privacy (modelli da tiny a large)
VoskOfflineLeggero, veloce, molte lingue

Opzioni di registrazione

  • Selezione del dispositivo di ingresso audio
  • Formato audio: MP3 o WAV
  • Qualità audio: bassa / media / alta
  • Cattura video opzionale con anteprima della fotocamera
  • Classificazione opzionale dei parlanti (identifica i diversi interlocutori)

Capture Transcription

Estrai testo da screenshot o catture della fotocamera tramite OCR.

  • Cattura da fotocamera — seleziona un dispositivo fotocamera, scatta una singola immagine
  • Cattura schermo intero — cattura l’intero schermo
  • Selezione di una regione — disegna un rettangolo per catturare un’area specifica
  • Cattura finestra — cattura una finestra specifica

Motore OCR: Tesseract (giapponese predefinito). I risultati appaiono accanto all’immagine catturata.


File Transcription

Elabora file in batch tramite trascinamento o utilizzando il selettore di file.

Formati supportati

TipoFormatiMetodo
AudioMP3, WAV, M4A, FLAC, AAC, OGG, WMAMotore vocale
VideoMP4, AVI, MOV, MKV, WMV, FLVEstrazione audio → motore vocale
ImmagineJPG, PNG, BMP, TIFF, GIFTesseract OCR
DocumentoPDFPagina → immagine → OCR

Cronologia dei workset

  • Ogni sessione di trascrizione viene salvata come workset
  • Filtra per parola chiave, tipo (Live/Capture/File) e stato
  • Doppio clic per riaprire una sessione precedente
  • Colonne ordinabili: nome, tipo, metodo, data, stato

Impostazioni

ImpostazioneDescrizionePredefinito
Recognition ModelMotore vocale predefinitoGoogle
Audio FormatFormato di registrazioneWAV
Audio QualityLivello di compressioneMedium
Video CaptureAbilita la registrazione dalla fotocameraOff
Speaker ClassificationIdentifica i diversi parlantiOff

Suggerimenti

  • Trascrizione offline — Usa Whisper o Vosk per un riconoscimento vocale completamente offline
  • Note di riunione — Abilita la classificazione dei parlanti per distinguere chi ha detto cosa
  • OCR in batch — Trascina un’intera cartella di documenti scansionati per l’elaborazione in batch
  • Estrazione da PDF — Ogni pagina del PDF viene convertita in immagine e sottoposta a OCR singolarmente

Privacy

  • I motori Whisper e Vosk vengono eseguiti interamente sul tuo dispositivo
  • Google Speech invia l’audio ai server Google per il riconoscimento
  • Tutti i risultati di trascrizione e le registrazioni sono memorizzati esclusivamente sul tuo disco locale
  • Nessuna analisi né tracciamento