Textnizer - Посібник

Видобувайте текст із мовлення, знімків екрана та файлів. Підтримує розпізнавання голосу в реальному часі, OCR знімків екрана та пакетну обробку аудіо-, відео-, графічних і PDF-файлів.


Перші кроки

Оберіть один із трьох режимів на головному екрані:

  1. Live Transcription — перетворення мовлення на текст у реальному часі з мікрофона
  2. Capture Transcription — OCR зі знімків екрана або камери
  3. File Transcription — пакетна обробка аудіо-, відео-, графічних або PDF-файлів

Live Transcription

Розпізнавання мовлення в реальному часі з мікрофона або пристрою аудіовходу.

Мовні рушії

РушійТипНайкраще для
Google SpeechOnline APIВисока точність, багато мов (за замовчуванням)
WhisperЛокальна модельАвтономна робота, конфіденційність (моделі від tiny до large)
VoskOfflineЛегкий, швидкий, багато мов

Параметри запису

  • Вибір пристрою аудіовходу
  • Audio Format: MP3 або WAV
  • Audio Quality: low / medium / high
  • Опційний відеозапис із попереднім переглядом камери
  • Опційна Speaker Classification (розпізнає різних мовців)

Capture Transcription

Видобувайте текст зі знімків екрана або знімків з камери за допомогою OCR.

  • Camera capture — оберіть пристрій камери, зробіть один знімок
  • Full screen capture — захопіть увесь екран
  • Region selection — намалюйте прямокутник, щоб захопити певну область
  • Window capture — захопіть конкретне вікно

OCR-рушій: Tesseract (за замовчуванням японська). Результати з’являються поряд із захопленим зображенням.


File Transcription

Обробляйте файли пакетно, перетягуючи їх або через провідник файлів.

Підтримувані формати

ТипФорматиМетод
АудіоMP3, WAV, M4A, FLAC, AAC, OGG, WMAМовний рушій
ВідеоMP4, AVI, MOV, MKV, WMV, FLVВидобуття звуку → мовний рушій
ЗображенняJPG, PNG, BMP, TIFF, GIFTesseract OCR
ДокументPDFСторінка → зображення → OCR

Workset History

  • Кожен сеанс транскрипції зберігається як workset
  • Фільтруйте за ключовим словом, типом (Live/Capture/File) та статусом
  • Двічі клацніть, щоб знову відкрити попередній сеанс
  • Сортовані стовпці: назва, тип, метод, дата, статус

Налаштування

НалаштуванняОписЗа замовчуванням
Recognition ModelМовний рушій за замовчуваннямGoogle
Audio FormatФормат записуWAV
Audio QualityРівень стисненняMedium
Video CaptureУвімкнути запис із камериOff
Speaker ClassificationІдентифікація різних мовцівOff

Поради

  • Автономна транскрипція — Використовуйте Whisper або Vosk для повністю автономного розпізнавання мовлення
  • Нотатки нарад — Увімкніть Speaker Classification, щоб розрізнити, хто що сказав
  • Пакетний OCR — Перетягніть цілу теку зі сканованими документами для пакетної обробки
  • Видобуття PDF — Кожна сторінка PDF перетворюється на зображення й обробляється OCR окремо

Конфіденційність

  • Рушії Whisper і Vosk працюють повністю на вашому пристрої
  • Google Speech надсилає аудіо на сервери Google для розпізнавання
  • Усі результати транскрипції та записи зберігаються лише на вашому локальному диску
  • Без аналітики чи відстеження