Textnizer - Handleiding

Haal tekst uit spraak, schermafbeeldingen en bestanden. Ondersteunt spraakherkenning in real-time, OCR voor schermopnames en batchverwerking van audio, video, afbeeldingen en PDF-bestanden.


Aan de slag

Kies een van de drie modi op het hoofdscherm:

  1. Live Transcription — spraak-naar-tekst in real-time vanaf je microfoon
  2. Capture Transcription — OCR vanaf schermafbeeldingen of camera
  3. File Transcription — verwerk audio-, video-, afbeeldings- of PDF-bestanden in batch

Live Transcription

Spraakherkenning in real-time vanaf je microfoon of audio-invoerapparaat.

Spraakengines

EngineTypeGeschikt voor
Google SpeechOnline APIHoge nauwkeurigheid, vele talen (standaard)
WhisperLokaal modelOffline gebruik, privacy (modellen van tiny tot large)
VoskOfflineLichtgewicht, snel, vele talen

Opname-opties

  • Selectie van audio-invoerapparaat
  • Audio Format: MP3 of WAV
  • Audio Quality: laag / midden / hoog
  • Optionele video-opname met cameravoorbeeld
  • Optionele Speaker Classification (identificeert verschillende sprekers)

Capture Transcription

Haal tekst uit schermafbeeldingen of camera-opnames met behulp van OCR.

  • Camera capture — selecteer een camera-apparaat en maak een enkele foto
  • Full screen capture — legt het hele scherm vast
  • Region selection — teken een rechthoek om een specifiek gebied vast te leggen
  • Window capture — legt een specifiek venster vast

OCR-engine: Tesseract (standaard Japans). Resultaten verschijnen naast de vastgelegde afbeelding.


File Transcription

Verwerk bestanden in batch door ze te slepen en neer te zetten of via de bestandsbrowser.

Ondersteunde formaten

TypeFormatenMethode
AudioMP3, WAV, M4A, FLAC, AAC, OGG, WMASpraakengine
VideoMP4, AVI, MOV, MKV, WMV, FLVAudio-extractie → spraakengine
AfbeeldingJPG, PNG, BMP, TIFF, GIFTesseract OCR
DocumentPDFPagina → afbeelding → OCR

Workset-geschiedenis

  • Elke transcriptiesessie wordt opgeslagen als een workset
  • Filter op trefwoord, type (Live/Capture/File) en status
  • Dubbelklik om een eerdere sessie opnieuw te openen
  • Sorteerbare kolommen: naam, type, methode, datum, status

Instellingen

InstellingBeschrijvingStandaard
Recognition ModelStandaard spraakengineGoogle
Audio FormatOpnameformaatWAV
Audio QualityCompressieniveauMedium
Video CaptureCamera-opname inschakelenOff
Speaker ClassificationVerschillende sprekers identificerenOff

Tips

  • Offline transcriptie — Gebruik Whisper of Vosk voor volledig offline spraakherkenning
  • Vergadernotities — Schakel Speaker Classification in om te onderscheiden wie wat heeft gezegd
  • Batch-OCR — Sleep een hele map met gescande documenten voor batchverwerking
  • PDF-extractie — Elke PDF-pagina wordt omgezet in een afbeelding en afzonderlijk via OCR verwerkt

Privacy

  • De Whisper- en Vosk-engines draaien volledig op je apparaat
  • Google Speech stuurt audio naar Google-servers voor herkenning
  • Alle transcriptieresultaten en opnames worden uitsluitend op je lokale schijf opgeslagen
  • Geen analytics of tracking