Textnizer - Οδηγός

Εξάγετε κείμενο από ομιλία, στιγμιότυπα οθόνης και αρχεία. Υποστηρίζει αναγνώριση φωνής σε πραγματικό χρόνο, OCR από λήψεις οθόνης και ομαδική επεξεργασία ήχου, βίντεο, εικόνων και PDF.


Ξεκινώντας

Επιλέξτε μία από τις τρεις λειτουργίες από την κύρια οθόνη:

  1. Live Transcription — ομιλία σε κείμενο σε πραγματικό χρόνο από το μικρόφωνό σας
  2. Capture Transcription — OCR από στιγμιότυπα οθόνης ή κάμερα
  3. File Transcription — ομαδική επεξεργασία αρχείων ήχου, βίντεο, εικόνας ή PDF

Live Transcription

Αναγνώριση ομιλίας σε πραγματικό χρόνο από το μικρόφωνό σας ή τη συσκευή εισόδου ήχου.

Μηχανές ομιλίας

ΜηχανήΤύποςΙδανική για
Google SpeechΔιαδικτυακό APIΥψηλή ακρίβεια, πολλές γλώσσες (default)
WhisperΤοπικό μοντέλοΧρήση εκτός σύνδεσης, απόρρητο (μοντέλα από tiny έως large)
VoskΕκτός σύνδεσηςΕλαφρύ, γρήγορο, πολλές γλώσσες

Επιλογές εγγραφής

  • Επιλογή συσκευής εισόδου ήχου
  • Audio Format: MP3 ή WAV
  • Audio Quality: low / medium / high
  • Προαιρετικό Video Capture με προεπισκόπηση κάμερας
  • Προαιρετικό Speaker Classification (αναγνωρίζει διαφορετικούς ομιλητές)

Capture Transcription

Εξάγετε κείμενο από στιγμιότυπα οθόνης ή λήψεις κάμερας χρησιμοποιώντας OCR.

  • Λήψη με κάμερα — επιλέξτε μια συσκευή κάμερας, τραβήξτε μία λήψη
  • Λήψη πλήρους οθόνης — καταγράψτε ολόκληρη την οθόνη
  • Επιλογή περιοχής — σχεδιάστε ένα ορθογώνιο για να καταγράψετε μια συγκεκριμένη περιοχή
  • Λήψη παραθύρου — καταγράψτε ένα συγκεκριμένο παράθυρο

Μηχανή OCR: Tesseract (Ιαπωνικά από προεπιλογή). Τα αποτελέσματα εμφανίζονται δίπλα στην καταγεγραμμένη εικόνα.


File Transcription

Επεξεργαστείτε αρχεία ομαδικά μέσω μεταφοράς και απόθεσης ή χρησιμοποιώντας τον περιηγητή αρχείων.

Υποστηριζόμενες μορφές

ΤύποςΜορφέςΜέθοδος
ΉχοςMP3, WAV, M4A, FLAC, AAC, OGG, WMAΜηχανή ομιλίας
ΒίντεοMP4, AVI, MOV, MKV, WMV, FLVΕξαγωγή ήχου → μηχανή ομιλίας
ΕικόναJPG, PNG, BMP, TIFF, GIFTesseract OCR
ΈγγραφοPDFΣελίδα → εικόνα → OCR

Ιστορικό worksets

  • Κάθε συνεδρία μεταγραφής αποθηκεύεται ως workset
  • Φιλτράρισμα κατά λέξη-κλειδί, τύπο (Live/Capture/File) και κατάσταση
  • Διπλό κλικ για να ανοίξετε ξανά μια προηγούμενη συνεδρία
  • Στήλες με δυνατότητα ταξινόμησης: όνομα, τύπος, μέθοδος, ημερομηνία, κατάσταση

Ρυθμίσεις

ΡύθμισηΠεριγραφήΠροεπιλογή
Recognition ModelΠροεπιλεγμένη μηχανή ομιλίαςGoogle
Audio FormatΜορφή εγγραφήςWAV
Audio QualityΕπίπεδο συμπίεσηςMedium
Video CaptureΕνεργοποίηση εγγραφής κάμεραςOff
Speaker ClassificationΑναγνώριση διαφορετικών ομιλητώνOff

Συμβουλές

  • Μεταγραφή εκτός σύνδεσης — Χρησιμοποιήστε Whisper ή Vosk για πλήρως εκτός σύνδεσης αναγνώριση ομιλίας
  • Σημειώσεις συσκέψεων — Ενεργοποιήστε το Speaker Classification για να διακρίνετε ποιος είπε τι
  • Ομαδικό OCR — Ρίξτε έναν ολόκληρο φάκελο σαρωμένων εγγράφων για ομαδική επεξεργασία
  • Εξαγωγή PDF — Κάθε σελίδα PDF μετατρέπεται σε εικόνα και υποβάλλεται σε OCR ξεχωριστά

Απόρρητο

  • Οι μηχανές Whisper και Vosk εκτελούνται εξ ολοκλήρου στη συσκευή σας
  • Το Google Speech στέλνει ήχο στους διακομιστές της Google για αναγνώριση
  • Όλα τα αποτελέσματα μεταγραφής και οι ηχογραφήσεις αποθηκεύονται μόνο στον τοπικό σας δίσκο
  • Χωρίς αναλυτικά στοιχεία ή παρακολούθηση