Εξάγετε κείμενο από ομιλία, στιγμιότυπα οθόνης και αρχεία. Υποστηρίζει αναγνώριση φωνής σε πραγματικό χρόνο, OCR από λήψεις οθόνης και ομαδική επεξεργασία ήχου, βίντεο, εικόνων και PDF.
Ξεκινώντας
Επιλέξτε μία από τις τρεις λειτουργίες από την κύρια οθόνη:
- Live Transcription — ομιλία σε κείμενο σε πραγματικό χρόνο από το μικρόφωνό σας
- Capture Transcription — OCR από στιγμιότυπα οθόνης ή κάμερα
- File Transcription — ομαδική επεξεργασία αρχείων ήχου, βίντεο, εικόνας ή PDF
Live Transcription
Αναγνώριση ομιλίας σε πραγματικό χρόνο από το μικρόφωνό σας ή τη συσκευή εισόδου ήχου.
Μηχανές ομιλίας
| Μηχανή | Τύπος | Ιδανική για |
|---|---|---|
| Google Speech | Διαδικτυακό API | Υψηλή ακρίβεια, πολλές γλώσσες (default) |
| Whisper | Τοπικό μοντέλο | Χρήση εκτός σύνδεσης, απόρρητο (μοντέλα από tiny έως large) |
| Vosk | Εκτός σύνδεσης | Ελαφρύ, γρήγορο, πολλές γλώσσες |
Επιλογές εγγραφής
- Επιλογή συσκευής εισόδου ήχου
- Audio Format: MP3 ή WAV
- Audio Quality: low / medium / high
- Προαιρετικό Video Capture με προεπισκόπηση κάμερας
- Προαιρετικό Speaker Classification (αναγνωρίζει διαφορετικούς ομιλητές)
Capture Transcription
Εξάγετε κείμενο από στιγμιότυπα οθόνης ή λήψεις κάμερας χρησιμοποιώντας OCR.
- Λήψη με κάμερα — επιλέξτε μια συσκευή κάμερας, τραβήξτε μία λήψη
- Λήψη πλήρους οθόνης — καταγράψτε ολόκληρη την οθόνη
- Επιλογή περιοχής — σχεδιάστε ένα ορθογώνιο για να καταγράψετε μια συγκεκριμένη περιοχή
- Λήψη παραθύρου — καταγράψτε ένα συγκεκριμένο παράθυρο
Μηχανή OCR: Tesseract (Ιαπωνικά από προεπιλογή). Τα αποτελέσματα εμφανίζονται δίπλα στην καταγεγραμμένη εικόνα.
File Transcription
Επεξεργαστείτε αρχεία ομαδικά μέσω μεταφοράς και απόθεσης ή χρησιμοποιώντας τον περιηγητή αρχείων.
Υποστηριζόμενες μορφές
| Τύπος | Μορφές | Μέθοδος |
|---|---|---|
| Ήχος | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Μηχανή ομιλίας |
| Βίντεο | MP4, AVI, MOV, MKV, WMV, FLV | Εξαγωγή ήχου → μηχανή ομιλίας |
| Εικόνα | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Έγγραφο | Σελίδα → εικόνα → OCR |
Ιστορικό worksets
- Κάθε συνεδρία μεταγραφής αποθηκεύεται ως workset
- Φιλτράρισμα κατά λέξη-κλειδί, τύπο (Live/Capture/File) και κατάσταση
- Διπλό κλικ για να ανοίξετε ξανά μια προηγούμενη συνεδρία
- Στήλες με δυνατότητα ταξινόμησης: όνομα, τύπος, μέθοδος, ημερομηνία, κατάσταση
Ρυθμίσεις
| Ρύθμιση | Περιγραφή | Προεπιλογή |
|---|---|---|
| Recognition Model | Προεπιλεγμένη μηχανή ομιλίας | |
| Audio Format | Μορφή εγγραφής | WAV |
| Audio Quality | Επίπεδο συμπίεσης | Medium |
| Video Capture | Ενεργοποίηση εγγραφής κάμερας | Off |
| Speaker Classification | Αναγνώριση διαφορετικών ομιλητών | Off |
Συμβουλές
- Μεταγραφή εκτός σύνδεσης — Χρησιμοποιήστε Whisper ή Vosk για πλήρως εκτός σύνδεσης αναγνώριση ομιλίας
- Σημειώσεις συσκέψεων — Ενεργοποιήστε το Speaker Classification για να διακρίνετε ποιος είπε τι
- Ομαδικό OCR — Ρίξτε έναν ολόκληρο φάκελο σαρωμένων εγγράφων για ομαδική επεξεργασία
- Εξαγωγή PDF — Κάθε σελίδα PDF μετατρέπεται σε εικόνα και υποβάλλεται σε OCR ξεχωριστά
Απόρρητο
- Οι μηχανές Whisper και Vosk εκτελούνται εξ ολοκλήρου στη συσκευή σας
- Το Google Speech στέλνει ήχο στους διακομιστές της Google για αναγνώριση
- Όλα τα αποτελέσματα μεταγραφής και οι ηχογραφήσεις αποθηκεύονται μόνο στον τοπικό σας δίσκο
- Χωρίς αναλυτικά στοιχεία ή παρακολούθηση