Textnizer 是一款多功能的文本提取工具,可将语音、屏幕截图和文件转换为可编辑的文本。可从三种强大模式中选择:用于实时语音捕获的 Live Transcription、用于屏幕文本识别的 Capture OCR,以及用于音频、视频、图像和 PDF 批量转换的 File Processing。
为什么选择 Textnizer
- 单个应用集成三种提取模式,无需另外准备转录、OCR 和转换工具
- 多种语音识别引擎(Google、Whisper、Vosk)可在速度、准确度和离线能力之间灵活选择
- 说话人分类功能可识别会议和访谈中谁说了什么
- 工作集历史管理让项目井然有序、随时调用
主要功能
- 具备实时语音识别的 Live Transcription
- 语音引擎:Google Speech Recognition、OpenAI Whisper 和 Vosk
- 面向相机和屏幕捕获、基于 Tesseract 的 Capture OCR
- 识别不同声音的说话人分类
- 支持 MP3、WAV、MP4、AVI、JPG、PNG 和 PDF 格式的文件处理
- 一次转换多个文件的批量处理
- 用于整理提取项目的工作集历史管理
- 用于查看音视频源的内置媒体播放器
适用人群
- 转录访谈和讲座的记者与研究人员
- 将手写笔记和讲座录音转为文字的学生
- 从扫描文档和 PDF 提取文本的办公人员
- 需要从视频文件生成字幕或文字稿的内容创作者
快速上手
- 选择模式:Live Transcription、Capture OCR 或 File Processing
- 使用 Live Transcription 时,选择语音引擎并开始录音
- 使用 Capture OCR 时,截取屏幕或用相机捕获文本
- 使用 File Processing 时,拖放音频、视频、图像或 PDF 文件
- 查看并编辑提取的文本,然后导出或复制到剪贴板
隐私
- 使用 Whisper 或 Vosk 引擎时,Textnizer 会在您的 Mac 上本地处理所有数据
- 选择 Google Speech Recognition 时,音频数据会被发送到 Google 服务器进行处理
- 应用本身不会收集或共享任何个人数据
- 所有工作集和提取的文本均保存在您的设备本地