استخرج النصوص من الكلام ولقطات الشاشة والملفات. يدعم التعرف الصوتي في الوقت الفعلي، وOCR لالتقاط الشاشة، والمعالجة الجماعية للصوت والفيديو والصور وملفات PDF.
البدء
اختر أحد الأوضاع الثلاثة من الشاشة الرئيسية:
- Live Transcription — تحويل الكلام إلى نص في الوقت الفعلي من الميكروفون
- Capture Transcription — OCR من لقطات الشاشة أو الكاميرا
- File Transcription — معالجة جماعية لملفات الصوت أو الفيديو أو الصور أو PDF
Live Transcription
تعرف صوتي في الوقت الفعلي من الميكروفون أو جهاز إدخال الصوت.
محركات الكلام
| المحرك | النوع | الأنسب لـ |
|---|---|---|
| Google Speech | API عبر الإنترنت | دقة عالية، لغات متعددة (افتراضي) |
| Whisper | نموذج محلي | الاستخدام دون اتصال، الخصوصية (نماذج من tiny إلى large) |
| Vosk | دون اتصال | خفيف وسريع ويدعم لغات متعددة |
خيارات التسجيل
- اختيار جهاز إدخال الصوت
- Audio Format: MP3 أو WAV
- Audio Quality: low / medium / high
- Video Capture اختياري مع معاينة الكاميرا
- Speaker Classification اختياري (يحدد المتحدثين المختلفين)
Capture Transcription
استخرج النصوص من لقطات الشاشة أو التقاطات الكاميرا باستخدام OCR.
- Camera capture — اختر جهاز كاميرا والتقط صورة واحدة
- Full screen capture — التقط الشاشة بأكملها
- Region selection — ارسم مستطيلاً لالتقاط منطقة محددة
- Window capture — التقط نافذة معينة
محرك OCR: Tesseract (يابانية افتراضيًا). تظهر النتائج بجانب الصورة الملتقطة.
File Transcription
عالج الملفات دفعة واحدة عبر السحب والإفلات أو متصفح الملفات.
الصيغ المدعومة
| النوع | الصيغ | الطريقة |
|---|---|---|
| صوت | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | محرك الكلام |
| فيديو | MP4, AVI, MOV, MKV, WMV, FLV | استخراج الصوت → محرك الكلام |
| صورة | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| مستند | صفحة → صورة → OCR |
سجل مجموعات العمل
- تُحفظ كل جلسة تفريغ كمجموعة عمل
- التصفية حسب الكلمة المفتاحية والنوع (Live/Capture/File) والحالة
- انقر مرتين لإعادة فتح جلسة سابقة
- أعمدة قابلة للفرز: الاسم والنوع والطريقة والتاريخ والحالة
الإعدادات
| الإعداد | الوصف | الافتراضي |
|---|---|---|
| Recognition Model | محرك الكلام الافتراضي | |
| Audio Format | صيغة التسجيل | WAV |
| Audio Quality | مستوى الضغط | Medium |
| Video Capture | تفعيل تسجيل الكاميرا | Off |
| Speaker Classification | تحديد المتحدثين المختلفين | Off |
نصائح
- التفريغ دون اتصال — استخدم Whisper أو Vosk للتعرف الصوتي بشكل كامل دون اتصال بالإنترنت
- محاضر الاجتماعات — فعّل Speaker Classification لتمييز من قال ماذا
- OCR جماعي — أفلت مجلدًا كاملاً من الوثائق الممسوحة للمعالجة الجماعية
- استخراج PDF — تُحوَّل كل صفحة من PDF إلى صورة ويتم تطبيق OCR عليها على حدة
الخصوصية
- يعمل محركا Whisper وVosk بالكامل على جهازك
- يرسل Google Speech الصوت إلى خوادم Google للتعرف عليه
- تُخزَّن جميع نتائج التفريغ والتسجيلات على القرص المحلي فقط
- لا توجد تحليلات أو تتبع