Textnizer - Guide

Extrayez du texte à partir de la parole, de captures d’écran et de fichiers. Prend en charge la reconnaissance vocale en temps réel, l’OCR de capture d’écran et le traitement par lots de fichiers audio, vidéo, images et PDF.


Démarrage

Choisissez l’un des trois modes depuis l’écran principal :

  1. Live Transcription — conversion de la parole en texte en temps réel depuis votre microphone
  2. Capture Transcription — OCR à partir de captures d’écran ou de la caméra
  3. File Transcription — traite par lots des fichiers audio, vidéo, image ou PDF

Live Transcription

Reconnaissance vocale en temps réel depuis votre microphone ou périphérique d’entrée audio.

Moteurs vocaux

MoteurTypeIdéal pour
Google SpeechAPI en ligneGrande précision, nombreuses langues (par défaut)
WhisperModèle localUtilisation hors ligne, confidentialité (modèles de tiny à large)
VoskHors ligneLéger, rapide, nombreuses langues

Options d’enregistrement

  • Sélection du périphérique d’entrée audio
  • Audio Format : MP3 ou WAV
  • Audio Quality : faible / moyenne / élevée
  • Capture vidéo facultative avec aperçu de la caméra
  • Speaker Classification facultative (identifie les différents locuteurs)

Capture Transcription

Extrayez du texte à partir de captures d’écran ou de la caméra grâce à l’OCR.

  • Camera capture — sélectionnez un appareil photo et prenez une seule photo
  • Full screen capture — capture l’écran entier
  • Region selection — dessinez un rectangle pour capturer une zone précise
  • Window capture — capture une fenêtre spécifique

Moteur OCR : Tesseract (japonais par défaut). Les résultats apparaissent à côté de l’image capturée.


File Transcription

Traitez les fichiers par lots en les glissant-déposant ou via le navigateur de fichiers.

Formats pris en charge

TypeFormatsMéthode
AudioMP3, WAV, M4A, FLAC, AAC, OGG, WMAMoteur vocal
VidéoMP4, AVI, MOV, MKV, WMV, FLVExtraction audio → moteur vocal
ImageJPG, PNG, BMP, TIFF, GIFTesseract OCR
DocumentPDFPage → image → OCR

Historique des worksets

  • Chaque session de transcription est enregistrée comme un workset
  • Filtrez par mot-clé, type (Live/Capture/File) et statut
  • Double-cliquez pour rouvrir une session précédente
  • Colonnes triables : nom, type, méthode, date, statut

Paramètres

ParamètreDescriptionPar défaut
Recognition ModelMoteur vocal par défautGoogle
Audio FormatFormat d’enregistrementWAV
Audio QualityNiveau de compressionMedium
Video CaptureActiver l’enregistrement par caméraOff
Speaker ClassificationIdentifier les différents locuteursOff

Astuces

  • Transcription hors ligne — Utilisez Whisper ou Vosk pour une reconnaissance vocale entièrement hors ligne
  • Notes de réunion — Activez Speaker Classification pour distinguer qui a dit quoi
  • OCR par lots — Déposez un dossier entier de documents numérisés pour un traitement par lots
  • Extraction PDF — Chaque page PDF est convertie en image et traitée individuellement par OCR

Confidentialité

  • Les moteurs Whisper et Vosk s’exécutent entièrement sur votre appareil
  • Google Speech envoie l’audio aux serveurs de Google pour la reconnaissance
  • Tous les résultats de transcription et enregistrements sont stockés uniquement sur votre disque local
  • Aucun suivi ni analyse