Textnizer は、音声・スクリーンショット・ファイルを編集可能なテキストに変換する多機能テキスト抽出ツールです。リアルタイム音声入力用の Live Transcription、画面上のテキスト認識用の Capture OCR、音声・動画・画像・PDF の一括変換用の File Processing という 3 つの強力なモードから選択できます。
Textnizer を選ぶ理由
- 3 つの抽出モードを 1 つのアプリに統合し、文字起こし・OCR・変換ツールを別々に用意する必要がありません
- 複数の音声認識エンジン(Google、Whisper、Vosk)を備え、速度・精度・オフライン対応を選択可能
- 話者分類により、会議やインタビューで誰が何を話したかを識別できます
- ワークセット履歴管理でプロジェクトを整理し、すぐに参照できます
主な機能
- リアルタイム音声認識による Live Transcription
- 音声エンジン: Google Speech Recognition、OpenAI Whisper、Vosk
- カメラと画面キャプチャ用に Tesseract を使用した Capture OCR
- 異なる声を識別する話者分類
- MP3、WAV、MP4、AVI、JPG、PNG、PDF 形式のファイル処理
- 複数ファイルを一括変換するバッチ処理
- 抽出プロジェクトを整理するワークセット履歴管理
- 音声・動画ソースを確認するための内蔵メディアプレーヤー
こんな方におすすめ
- インタビューや講演を文字起こしするジャーナリスト・研究者
- 手書きノートや講義録音をテキスト化する学生
- スキャン文書や PDF からテキストを抽出するオフィスワーカー
- 動画ファイルから字幕やトランスクリプトを必要とするコンテンツ制作者
はじめ方
- モードを選択: Live Transcription、Capture OCR、または File Processing
- Live Transcription では、音声エンジンを選んで録音を開始します
- Capture OCR では、スクリーンショットやカメラでテキストを取り込みます
- File Processing では、音声・動画・画像・PDF ファイルをドラッグ&ドロップします
- 抽出されたテキストを確認・編集し、エクスポートまたはクリップボードへコピーします
プライバシー
- Whisper または Vosk エンジン使用時、Textnizer はすべてのデータを Mac 上でローカル処理します
- Google Speech Recognition を選択した場合、音声データは処理のため Google のサーバーへ送信されます
- アプリ自体は個人情報を収集または共有しません
- ワークセットおよび抽出されたテキストはすべてお使いのデバイスにローカル保存されます