Textnizer - מדריך

חלצו טקסט מדיבור, מצילומי מסך ומקבצים. תומך בזיהוי קולי בזמן אמת, ב-OCR של צילומי מסך ובעיבוד אצווה של קבצי שמע, וידאו, תמונות ו-PDF.


תחילת עבודה

בחרו אחד משלושה מצבים מהמסך הראשי:

  1. Live Transcription — המרת דיבור לטקסט בזמן אמת מהמיקרופון
  2. Capture Transcription — OCR מצילומי מסך או מצלמה
  3. File Transcription — עיבוד אצווה של קבצי שמע, וידאו, תמונה או PDF

Live Transcription

זיהוי קולי בזמן אמת מהמיקרופון או ממכשיר קלט שמע.

מנועי דיבור

מנועסוגמתאים ל
Google SpeechAPI מקווןדיוק גבוה, שפות רבות (ברירת מחדל)
Whisperמודל מקומישימוש לא מקוון, פרטיות (מודלים מ-tiny ועד large)
Voskלא מקווןקל ומהיר, תומך בשפות רבות

אפשרויות הקלטה

  • בחירת מכשיר קלט שמע
  • Audio Format: MP3 או WAV
  • Audio Quality: low / medium / high
  • Video Capture אופציונלי עם תצוגה מקדימה של המצלמה
  • Speaker Classification אופציונלי (מזהה דוברים שונים)

Capture Transcription

חלצו טקסט מצילומי מסך או מצילומי מצלמה באמצעות OCR.

  • Camera capture — בחרו מכשיר מצלמה וצלמו תמונה אחת
  • Full screen capture — צלמו את המסך כולו
  • Region selection — ציירו מלבן ללכידת אזור מסוים
  • Window capture — לכדו חלון מסוים

מנוע OCR: Tesseract (יפנית כברירת מחדל). התוצאות מופיעות לצד התמונה שצולמה.


File Transcription

עיבוד אצווה של קבצים על-ידי גרירה ושחרור או באמצעות דפדפן הקבצים.

תבניות נתמכות

סוגתבניותשיטה
שמעMP3, WAV, M4A, FLAC, AAC, OGG, WMAמנוע דיבור
וידאוMP4, AVI, MOV, MKV, WMV, FLVחילוץ שמע → מנוע דיבור
תמונהJPG, PNG, BMP, TIFF, GIFTesseract OCR
מסמךPDFעמוד → תמונה → OCR

היסטוריית ערכות עבודה

  • כל פעולת תמלול נשמרת כערכת עבודה
  • סינון לפי מילת מפתח, סוג (Live/Capture/File) וסטטוס
  • לחיצה כפולה לפתיחה מחדש של פעולה קודמת
  • עמודות הניתנות למיון: שם, סוג, שיטה, תאריך, סטטוס

הגדרות

הגדרהתיאורברירת מחדל
Recognition Modelמנוע דיבור ברירת מחדלGoogle
Audio Formatתבנית הקלטהWAV
Audio Qualityרמת דחיסהMedium
Video Captureהפעלת הקלטה במצלמהOff
Speaker Classificationזיהוי דוברים שוניםOff

טיפים

  • תמלול לא מקוון — השתמשו ב-Whisper או ב-Vosk לזיהוי קולי לא מקוון לחלוטין
  • סיכומי פגישות — הפעילו Speaker Classification כדי להבחין מי אמר מה
  • OCR אצווה — שחררו תיקייה שלמה של מסמכים סרוקים לעיבוד אצווה
  • חילוץ PDF — כל עמוד ב-PDF מומר לתמונה ועובר OCR בנפרד

פרטיות

  • מנועי Whisper ו-Vosk רצים כולם על המכשיר שלכם
  • Google Speech שולח שמע לשרתי Google לצורך זיהוי
  • כל תוצאות התמלול וההקלטות נשמרות אך ורק בדיסק המקומי
  • אין אנליטיקה או מעקב