Textnizer - Trang chủ

Textnizer là một công cụ trích xuất văn bản đa năng chuyển đổi giọng nói, ảnh chụp màn hình và tệp thành văn bản có thể chỉnh sửa. Chọn từ ba chế độ mạnh mẽ: Live Transcription để ghi âm giọng nói thời gian thực, Capture OCR để nhận dạng văn bản trên màn hình và File Processing để chuyển đổi hàng loạt âm thanh, video, hình ảnh và PDF.

Textnizer

Textnizer

Textnizer - Main Screen

Textnizer - Main Screen

Tại sao chọn Textnizer

  • Ba chế độ trích xuất trong một ứng dụng loại bỏ nhu cầu sử dụng các công cụ phiên âm, OCR và chuyển đổi riêng biệt
  • Nhiều công cụ nhận dạng giọng nói (Google, Whisper, Vosk) cho phép bạn lựa chọn giữa tốc độ, độ chính xác và khả năng ngoại tuyến
  • Speaker Classification giúp xác định ai đã nói gì trong các cuộc họp và phỏng vấn
  • Quản lý lịch sử workset giúp các dự án của bạn được tổ chức và dễ truy cập

Tính năng chính

  • Live Transcription với nhận dạng giọng nói thời gian thực
  • Công cụ giọng nói: Google Speech Recognition, OpenAI Whisper và Vosk
  • Capture OCR sử dụng Tesseract cho ảnh chụp từ camera và màn hình
  • Speaker Classification để xác định các giọng nói khác nhau
  • File Processing cho các định dạng MP3, WAV, MP4, AVI, JPG, PNG và PDF
  • Xử lý hàng loạt để chuyển đổi nhiều tệp cùng một lúc
  • Quản lý lịch sử workset để tổ chức các dự án trích xuất
  • Trình phát đa phương tiện tích hợp để xem lại các nguồn âm thanh và video

Phù hợp cho

  • Nhà báo và nhà nghiên cứu phiên âm các cuộc phỏng vấn và bài giảng
  • Sinh viên chuyển đổi ghi chú viết tay và bản ghi bài giảng thành văn bản
  • Nhân viên văn phòng trích xuất văn bản từ tài liệu được quét và PDF
  • Người sáng tạo nội dung cần phụ đề hoặc bản phiên âm từ tệp video

Bắt đầu

  • Chọn chế độ của bạn: Live Transcription, Capture OCR hoặc File Processing
  • Đối với Live Transcription, chọn công cụ giọng nói và bắt đầu ghi âm
  • Đối với Capture OCR, chụp ảnh màn hình hoặc sử dụng camera để chụp văn bản
  • Đối với File Processing, kéo và thả các tệp âm thanh, video, hình ảnh hoặc PDF của bạn
  • Xem lại và chỉnh sửa văn bản đã trích xuất, sau đó xuất hoặc sao chép vào clipboard

Quyền riêng tư

  • Textnizer xử lý tất cả dữ liệu cục bộ trên máy Mac của bạn khi sử dụng công cụ Whisper hoặc Vosk
  • Google Speech Recognition gửi dữ liệu âm thanh đến máy chủ của Google để xử lý khi được chọn
  • Không có dữ liệu cá nhân nào được thu thập hoặc chia sẻ bởi chính ứng dụng
  • Tất cả workset và văn bản đã trích xuất được lưu trữ cục bộ trên thiết bị của bạn