Textnizer - 首頁

Textnizer 是一款多功能的文字擷取工具,可將語音、螢幕截圖和檔案轉換為可編輯的文字。可從三種強大模式中選擇:用於即時語音擷取的 Live Transcription、用於螢幕文字辨識的 Capture OCR,以及用於音訊、影片、圖片和 PDF 批次轉換的 File Processing。

Textnizer

Textnizer

Textnizer - Main Screen

Textnizer - Main Screen

為什麼選擇 Textnizer

  • 單一應用程式整合三種擷取模式,無需另外準備轉錄、OCR 和轉換工具
  • 多種語音辨識引擎(Google、Whisper、Vosk)可在速度、準確度和離線能力之間靈活選擇
  • 說話人分類功能可辨識會議與訪談中誰說了什麼
  • 工作集歷史管理讓專案井然有序、隨時取用

主要功能

  • 具備即時語音辨識的 Live Transcription
  • 語音引擎:Google Speech Recognition、OpenAI Whisper 與 Vosk
  • 面向相機與螢幕擷取、基於 Tesseract 的 Capture OCR
  • 辨識不同聲音的說話人分類
  • 支援 MP3、WAV、MP4、AVI、JPG、PNG 與 PDF 格式的檔案處理
  • 一次轉換多個檔案的批次處理
  • 用於整理擷取專案的工作集歷史管理
  • 用於檢視音訊與影片來源的內建媒體播放器

適用對象

  • 轉錄訪談與演講的記者及研究人員
  • 將手寫筆記與課堂錄音轉為文字的學生
  • 從掃描文件與 PDF 擷取文字的辦公人員
  • 需要從影片檔案產生字幕或逐字稿的內容創作者

快速上手

  • 選擇模式:Live Transcription、Capture OCR 或 File Processing
  • 使用 Live Transcription 時,選擇語音引擎並開始錄音
  • 使用 Capture OCR 時,截取螢幕或以相機擷取文字
  • 使用 File Processing 時,拖放音訊、影片、圖片或 PDF 檔案
  • 檢閱並編輯擷取的文字,然後匯出或複製到剪貼簿

隱私

  • 使用 Whisper 或 Vosk 引擎時,Textnizer 會在您的 Mac 上本地處理所有資料
  • 選擇 Google Speech Recognition 時,音訊資料會被傳送到 Google 伺服器進行處理
  • 應用程式本身不會收集或共享任何個人資料
  • 所有工作集和擷取的文字皆儲存在您的裝置本地