Textnizer - Vejledning

Udtrækker tekst fra tale, skærmbilleder og filer. Understøtter stemmegenkendelse i realtid, OCR fra skærmbilleder og batchbehandling af lyd, video, billeder og PDF'er.


Kom godt i gang

Vælg en af tre tilstande fra hovedskærmen:

  1. Live Transcription — tale-til-tekst i realtid fra din mikrofon
  2. Capture Transcription — OCR fra skærmbilleder eller kamera
  3. File Transcription — batchbehandling af lyd-, video-, billed- eller PDF-filer

Live Transcription

Talegenkendelse i realtid fra din mikrofon eller lydinputenhed.

Talemotorer

MotorTypeBedst til
Google SpeechOnline APIHøj nøjagtighed, mange sprog (default)
WhisperLokal modelOffline-brug, privatliv (modeller fra tiny til large)
VoskOfflineLetvægt, hurtig, mange sprog

Optagelsesmuligheder

  • Valg af lydinputenhed
  • Audio Format: MP3 eller WAV
  • Audio Quality: low / medium / high
  • Valgfri Video Capture med kameraforhåndsvisning
  • Valgfri Speaker Classification (identificerer forskellige talere)

Capture Transcription

Udtræk tekst fra skærmbilleder eller kameraoptagelser ved hjælp af OCR.

  • Kameraoptagelse — vælg en kameraenhed, tag et enkelt billede
  • Fuldskærmsoptagelse — optag hele skærmen
  • Områdevalg — tegn et rektangel for at optage et bestemt område
  • Vinduesoptagelse — optag et bestemt vindue

OCR-motor: Tesseract (japansk som standard). Resultaterne vises ved siden af det optagne billede.


File Transcription

Behandl filer i batch ved at trække og slippe eller bruge filbrowseren.

Understøttede formater

TypeFormaterMetode
LydMP3, WAV, M4A, FLAC, AAC, OGG, WMATalemotor
VideoMP4, AVI, MOV, MKV, WMV, FLVLydudtrækning → talemotor
BilledeJPG, PNG, BMP, TIFF, GIFTesseract OCR
DokumentPDFSide → billede → OCR

Workset-historik

  • Hver transskriptionssession gemmes som et workset
  • Filtrer efter nøgleord, type (Live/Capture/File) og status
  • Dobbeltklik for at genåbne en tidligere session
  • Sorterbare kolonner: navn, type, metode, dato, status

Indstillinger

IndstillingBeskrivelseStandard
Recognition ModelStandard talemotorGoogle
Audio FormatOptageformatWAV
Audio QualityKomprimeringsniveauMedium
Video CaptureAktivér kameraoptagelseOff
Speaker ClassificationIdentificér forskellige talereOff

Tips

  • Offline transskription — Brug Whisper eller Vosk til helt offline talegenkendelse
  • Mødenoter — Aktivér Speaker Classification for at skelne hvem der sagde hvad
  • Batch-OCR — Slip en hel mappe med scannede dokumenter for batchbehandling
  • PDF-udtrækning — Hver PDF-side konverteres til et billede og OCR-behandles individuelt

Privatliv

  • Whisper- og Vosk-motorer kører udelukkende på din enhed
  • Google Speech sender lyd til Googles servere til genkendelse
  • Alle transskriptionsresultater og optagelser gemmes kun på din lokale disk
  • Ingen analyse eller sporing