Textnizer - الدليل

استخرج النصوص من الكلام ولقطات الشاشة والملفات. يدعم التعرف الصوتي في الوقت الفعلي، وOCR لالتقاط الشاشة، والمعالجة الجماعية للصوت والفيديو والصور وملفات PDF.


البدء

اختر أحد الأوضاع الثلاثة من الشاشة الرئيسية:

  1. Live Transcription — تحويل الكلام إلى نص في الوقت الفعلي من الميكروفون
  2. Capture Transcription — OCR من لقطات الشاشة أو الكاميرا
  3. File Transcription — معالجة جماعية لملفات الصوت أو الفيديو أو الصور أو PDF

Live Transcription

تعرف صوتي في الوقت الفعلي من الميكروفون أو جهاز إدخال الصوت.

محركات الكلام

المحركالنوعالأنسب لـ
Google SpeechAPI عبر الإنترنتدقة عالية، لغات متعددة (افتراضي)
Whisperنموذج محليالاستخدام دون اتصال، الخصوصية (نماذج من tiny إلى large)
Voskدون اتصالخفيف وسريع ويدعم لغات متعددة

خيارات التسجيل

  • اختيار جهاز إدخال الصوت
  • Audio Format: MP3 أو WAV
  • Audio Quality: low / medium / high
  • Video Capture اختياري مع معاينة الكاميرا
  • Speaker Classification اختياري (يحدد المتحدثين المختلفين)

Capture Transcription

استخرج النصوص من لقطات الشاشة أو التقاطات الكاميرا باستخدام OCR.

  • Camera capture — اختر جهاز كاميرا والتقط صورة واحدة
  • Full screen capture — التقط الشاشة بأكملها
  • Region selection — ارسم مستطيلاً لالتقاط منطقة محددة
  • Window capture — التقط نافذة معينة

محرك OCR: Tesseract (يابانية افتراضيًا). تظهر النتائج بجانب الصورة الملتقطة.


File Transcription

عالج الملفات دفعة واحدة عبر السحب والإفلات أو متصفح الملفات.

الصيغ المدعومة

النوعالصيغالطريقة
صوتMP3, WAV, M4A, FLAC, AAC, OGG, WMAمحرك الكلام
فيديوMP4, AVI, MOV, MKV, WMV, FLVاستخراج الصوت → محرك الكلام
صورةJPG, PNG, BMP, TIFF, GIFTesseract OCR
مستندPDFصفحة → صورة → OCR

سجل مجموعات العمل

  • تُحفظ كل جلسة تفريغ كمجموعة عمل
  • التصفية حسب الكلمة المفتاحية والنوع (Live/Capture/File) والحالة
  • انقر مرتين لإعادة فتح جلسة سابقة
  • أعمدة قابلة للفرز: الاسم والنوع والطريقة والتاريخ والحالة

الإعدادات

الإعدادالوصفالافتراضي
Recognition Modelمحرك الكلام الافتراضيGoogle
Audio Formatصيغة التسجيلWAV
Audio Qualityمستوى الضغطMedium
Video Captureتفعيل تسجيل الكاميراOff
Speaker Classificationتحديد المتحدثين المختلفينOff

نصائح

  • التفريغ دون اتصال — استخدم Whisper أو Vosk للتعرف الصوتي بشكل كامل دون اتصال بالإنترنت
  • محاضر الاجتماعات — فعّل Speaker Classification لتمييز من قال ماذا
  • OCR جماعي — أفلت مجلدًا كاملاً من الوثائق الممسوحة للمعالجة الجماعية
  • استخراج PDF — تُحوَّل كل صفحة من PDF إلى صورة ويتم تطبيق OCR عليها على حدة

الخصوصية

  • يعمل محركا Whisper وVosk بالكامل على جهازك
  • يرسل Google Speech الصوت إلى خوادم Google للتعرف عليه
  • تُخزَّن جميع نتائج التفريغ والتسجيلات على القرص المحلي فقط
  • لا توجد تحليلات أو تتبع