Ekstrak teks dari ucapan, tangkapan layar, dan file. Mendukung pengenalan suara waktu nyata, OCR tangkapan layar, dan pemrosesan batch audio, video, gambar, dan PDF.
Memulai
Pilih salah satu dari tiga mode dari layar utama:
- Live Transcription — ucapan-ke-teks waktu nyata dari mikrofon Anda
- Capture Transcription — OCR dari tangkapan layar atau kamera
- File Transcription — memproses file audio, video, gambar, atau PDF secara batch
Live Transcription
Pengenalan ucapan waktu nyata dari mikrofon atau perangkat input audio Anda.
Mesin Ucapan
| Mesin | Tipe | Paling cocok untuk |
|---|---|---|
| Google Speech | API Online | Akurasi tinggi, banyak bahasa (default) |
| Whisper | Model lokal | Penggunaan offline, privasi (model dari tiny hingga large) |
| Vosk | Offline | Ringan, cepat, banyak bahasa |
Opsi Perekaman
- Pemilihan perangkat input audio
- Audio Format: MP3 atau WAV
- Audio Quality: low / medium / high
- Video Capture opsional dengan pratinjau kamera
- Speaker Classification opsional (mengidentifikasi pembicara yang berbeda)
Capture Transcription
Ekstrak teks dari tangkapan layar atau pengambilan kamera menggunakan OCR.
- Pengambilan kamera — pilih perangkat kamera, ambil satu jepretan
- Pengambilan layar penuh — tangkap seluruh layar
- Pemilihan area — gambar persegi panjang untuk menangkap area tertentu
- Pengambilan jendela — tangkap jendela tertentu
Mesin OCR: Tesseract (Jepang secara default). Hasil muncul di samping gambar yang ditangkap.
File Transcription
Proses file secara batch dengan menyeret dan menjatuhkan atau menggunakan penjelajah file.
Format yang Didukung
| Tipe | Format | Metode |
|---|---|---|
| Audio | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Mesin ucapan |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Ekstraksi audio → mesin ucapan |
| Gambar | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Dokumen | Halaman → gambar → OCR |
Riwayat Workset
- Setiap sesi transkripsi disimpan sebagai workset
- Filter berdasarkan kata kunci, tipe (Live/Capture/File), dan status
- Klik dua kali untuk membuka kembali sesi sebelumnya
- Kolom yang dapat diurutkan: nama, tipe, metode, tanggal, status
Pengaturan
| Pengaturan | Deskripsi | Default |
|---|---|---|
| Recognition Model | Mesin ucapan default | |
| Audio Format | Format perekaman | WAV |
| Audio Quality | Tingkat kompresi | Medium |
| Video Capture | Aktifkan perekaman kamera | Off |
| Speaker Classification | Identifikasi pembicara yang berbeda | Off |
Tips
- Transkripsi offline — Gunakan Whisper atau Vosk untuk pengenalan ucapan sepenuhnya offline
- Catatan rapat — Aktifkan Speaker Classification untuk membedakan siapa berkata apa
- OCR Batch — Lepaskan seluruh folder dokumen yang dipindai untuk pemrosesan batch
- Ekstraksi PDF — Setiap halaman PDF dikonversi menjadi gambar dan di-OCR secara individu
Privasi
- Mesin Whisper dan Vosk berjalan sepenuhnya di perangkat Anda
- Google Speech mengirimkan audio ke server Google untuk pengenalan
- Semua hasil transkripsi dan rekaman disimpan hanya di disk lokal Anda
- Tidak ada analitik atau pelacakan