Textnizer 是一款多功能的文字擷取工具,可將語音、螢幕截圖和檔案轉換為可編輯的文字。可從三種強大模式中選擇:用於即時語音擷取的 Live Transcription、用於螢幕文字辨識的 Capture OCR,以及用於音訊、影片、圖片和 PDF 批次轉換的 File Processing。
為什麼選擇 Textnizer
- 單一應用程式整合三種擷取模式,無需另外準備轉錄、OCR 和轉換工具
- 多種語音辨識引擎(Google、Whisper、Vosk)可在速度、準確度和離線能力之間靈活選擇
- 說話人分類功能可辨識會議與訪談中誰說了什麼
- 工作集歷史管理讓專案井然有序、隨時取用
主要功能
- 具備即時語音辨識的 Live Transcription
- 語音引擎:Google Speech Recognition、OpenAI Whisper 與 Vosk
- 面向相機與螢幕擷取、基於 Tesseract 的 Capture OCR
- 辨識不同聲音的說話人分類
- 支援 MP3、WAV、MP4、AVI、JPG、PNG 與 PDF 格式的檔案處理
- 一次轉換多個檔案的批次處理
- 用於整理擷取專案的工作集歷史管理
- 用於檢視音訊與影片來源的內建媒體播放器
適用對象
- 轉錄訪談與演講的記者及研究人員
- 將手寫筆記與課堂錄音轉為文字的學生
- 從掃描文件與 PDF 擷取文字的辦公人員
- 需要從影片檔案產生字幕或逐字稿的內容創作者
快速上手
- 選擇模式:Live Transcription、Capture OCR 或 File Processing
- 使用 Live Transcription 時,選擇語音引擎並開始錄音
- 使用 Capture OCR 時,截取螢幕或以相機擷取文字
- 使用 File Processing 時,拖放音訊、影片、圖片或 PDF 檔案
- 檢閱並編輯擷取的文字,然後匯出或複製到剪貼簿
隱私
- 使用 Whisper 或 Vosk 引擎時,Textnizer 會在您的 Mac 上本地處理所有資料
- 選擇 Google Speech Recognition 時,音訊資料會被傳送到 Google 伺服器進行處理
- 應用程式本身不會收集或共享任何個人資料
- 所有工作集和擷取的文字皆儲存在您的裝置本地