Textnizer - Panduan

Ekstrak teks dari ucapan, tangkapan layar, dan file. Mendukung pengenalan suara waktu nyata, OCR tangkapan layar, dan pemrosesan batch audio, video, gambar, dan PDF.


Memulai

Pilih salah satu dari tiga mode dari layar utama:

  1. Live Transcription — ucapan-ke-teks waktu nyata dari mikrofon Anda
  2. Capture Transcription — OCR dari tangkapan layar atau kamera
  3. File Transcription — memproses file audio, video, gambar, atau PDF secara batch

Live Transcription

Pengenalan ucapan waktu nyata dari mikrofon atau perangkat input audio Anda.

Mesin Ucapan

MesinTipePaling cocok untuk
Google SpeechAPI OnlineAkurasi tinggi, banyak bahasa (default)
WhisperModel lokalPenggunaan offline, privasi (model dari tiny hingga large)
VoskOfflineRingan, cepat, banyak bahasa

Opsi Perekaman

  • Pemilihan perangkat input audio
  • Audio Format: MP3 atau WAV
  • Audio Quality: low / medium / high
  • Video Capture opsional dengan pratinjau kamera
  • Speaker Classification opsional (mengidentifikasi pembicara yang berbeda)

Capture Transcription

Ekstrak teks dari tangkapan layar atau pengambilan kamera menggunakan OCR.

  • Pengambilan kamera — pilih perangkat kamera, ambil satu jepretan
  • Pengambilan layar penuh — tangkap seluruh layar
  • Pemilihan area — gambar persegi panjang untuk menangkap area tertentu
  • Pengambilan jendela — tangkap jendela tertentu

Mesin OCR: Tesseract (Jepang secara default). Hasil muncul di samping gambar yang ditangkap.


File Transcription

Proses file secara batch dengan menyeret dan menjatuhkan atau menggunakan penjelajah file.

Format yang Didukung

TipeFormatMetode
AudioMP3, WAV, M4A, FLAC, AAC, OGG, WMAMesin ucapan
VideoMP4, AVI, MOV, MKV, WMV, FLVEkstraksi audio → mesin ucapan
GambarJPG, PNG, BMP, TIFF, GIFTesseract OCR
DokumenPDFHalaman → gambar → OCR

Riwayat Workset

  • Setiap sesi transkripsi disimpan sebagai workset
  • Filter berdasarkan kata kunci, tipe (Live/Capture/File), dan status
  • Klik dua kali untuk membuka kembali sesi sebelumnya
  • Kolom yang dapat diurutkan: nama, tipe, metode, tanggal, status

Pengaturan

PengaturanDeskripsiDefault
Recognition ModelMesin ucapan defaultGoogle
Audio FormatFormat perekamanWAV
Audio QualityTingkat kompresiMedium
Video CaptureAktifkan perekaman kameraOff
Speaker ClassificationIdentifikasi pembicara yang berbedaOff

Tips

  • Transkripsi offline — Gunakan Whisper atau Vosk untuk pengenalan ucapan sepenuhnya offline
  • Catatan rapat — Aktifkan Speaker Classification untuk membedakan siapa berkata apa
  • OCR Batch — Lepaskan seluruh folder dokumen yang dipindai untuk pemrosesan batch
  • Ekstraksi PDF — Setiap halaman PDF dikonversi menjadi gambar dan di-OCR secara individu

Privasi

  • Mesin Whisper dan Vosk berjalan sepenuhnya di perangkat Anda
  • Google Speech mengirimkan audio ke server Google untuk pengenalan
  • Semua hasil transkripsi dan rekaman disimpan hanya di disk lokal Anda
  • Tidak ada analitik atau pelacakan