Extrayez du texte à partir de la parole, de captures d’écran et de fichiers. Prend en charge la reconnaissance vocale en temps réel, l’OCR de capture d’écran et le traitement par lots de fichiers audio, vidéo, images et PDF.
Démarrage
Choisissez l’un des trois modes depuis l’écran principal :
- Live Transcription — conversion de la parole en texte en temps réel depuis votre microphone
- Capture Transcription — OCR à partir de captures d’écran ou de la caméra
- File Transcription — traite par lots des fichiers audio, vidéo, image ou PDF
Live Transcription
Reconnaissance vocale en temps réel depuis votre microphone ou périphérique d’entrée audio.
Moteurs vocaux
| Moteur | Type | Idéal pour |
|---|---|---|
| Google Speech | API en ligne | Grande précision, nombreuses langues (par défaut) |
| Whisper | Modèle local | Utilisation hors ligne, confidentialité (modèles de tiny à large) |
| Vosk | Hors ligne | Léger, rapide, nombreuses langues |
Options d’enregistrement
- Sélection du périphérique d’entrée audio
- Audio Format : MP3 ou WAV
- Audio Quality : faible / moyenne / élevée
- Capture vidéo facultative avec aperçu de la caméra
- Speaker Classification facultative (identifie les différents locuteurs)
Capture Transcription
Extrayez du texte à partir de captures d’écran ou de la caméra grâce à l’OCR.
- Camera capture — sélectionnez un appareil photo et prenez une seule photo
- Full screen capture — capture l’écran entier
- Region selection — dessinez un rectangle pour capturer une zone précise
- Window capture — capture une fenêtre spécifique
Moteur OCR : Tesseract (japonais par défaut). Les résultats apparaissent à côté de l’image capturée.
File Transcription
Traitez les fichiers par lots en les glissant-déposant ou via le navigateur de fichiers.
Formats pris en charge
| Type | Formats | Méthode |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Moteur vocal |
| Vidéo | MP4, AVI, MOV, MKV, WMV, FLV | Extraction audio → moteur vocal |
| Image | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Document | Page → image → OCR |
Historique des worksets
- Chaque session de transcription est enregistrée comme un workset
- Filtrez par mot-clé, type (Live/Capture/File) et statut
- Double-cliquez pour rouvrir une session précédente
- Colonnes triables : nom, type, méthode, date, statut
Paramètres
| Paramètre | Description | Par défaut |
|---|---|---|
| Recognition Model | Moteur vocal par défaut | |
| Audio Format | Format d’enregistrement | WAV |
| Audio Quality | Niveau de compression | Medium |
| Video Capture | Activer l’enregistrement par caméra | Off |
| Speaker Classification | Identifier les différents locuteurs | Off |
Astuces
- Transcription hors ligne — Utilisez Whisper ou Vosk pour une reconnaissance vocale entièrement hors ligne
- Notes de réunion — Activez Speaker Classification pour distinguer qui a dit quoi
- OCR par lots — Déposez un dossier entier de documents numérisés pour un traitement par lots
- Extraction PDF — Chaque page PDF est convertie en image et traitée individuellement par OCR
Confidentialité
- Les moteurs Whisper et Vosk s’exécutent entièrement sur votre appareil
- Google Speech envoie l’audio aux serveurs de Google pour la reconnaissance
- Tous les résultats de transcription et enregistrements sont stockés uniquement sur votre disque local
- Aucun suivi ni analyse