Textnizer - Veiledning

Trekk ut tekst fra tale, skjermbilder og filer. Støtter sanntids stemmegjenkjenning, OCR fra skjermopptak og batchbehandling av lyd, video, bilder og PDF-er.


Kom i gang

Velg én av tre moduser fra hovedskjermen:

  1. Live Transcription — sanntids tale-til-tekst fra mikrofonen din
  2. Capture Transcription — OCR fra skjermbilder eller kamera
  3. File Transcription — batchbehandling av lyd-, video-, bilde- eller PDF-filer

Live Transcription

Sanntids talegjenkjenning fra mikrofonen eller lydinngangsenheten din.

Talemotorer

MotorTypeBest for
Google SpeechOnline APIHøy nøyaktighet, mange språk (default)
WhisperLokal modellOffline-bruk, personvern (tiny til large modeller)
VoskOfflineLett, rask, mange språk

Opptaksalternativer

  • Valg av lydinngangsenhet
  • Audio Format: MP3 eller WAV
  • Audio Quality: low / medium / high
  • Valgfri Video Capture med kameraforhåndsvisning
  • Valgfri Speaker Classification (identifiserer forskjellige talere)

Capture Transcription

Trekk ut tekst fra skjermbilder eller kameraopptak ved hjelp av OCR.

  • Kameraopptak — velg en kameraenhet, ta et enkelt bilde
  • Fullskjermopptak — ta opp hele skjermen
  • Områdevalg — tegn et rektangel for å fange et spesifikt område
  • Vindusopptak — fang et spesifikt vindu

OCR-motor: Tesseract (japansk som standard). Resultatene vises ved siden av det fangede bildet.


File Transcription

Batchbehandle filer ved å dra og slippe eller bruke filutforskeren.

Støttede formater

TypeFormaterMetode
LydMP3, WAV, M4A, FLAC, AAC, OGG, WMATalemotor
VideoMP4, AVI, MOV, MKV, WMV, FLVLyduttrekking → talemotor
BildeJPG, PNG, BMP, TIFF, GIFTesseract OCR
DokumentPDFSide → bilde → OCR

Workset-historikk

  • Hver transkripsjonsøkt lagres som et workset
  • Filtrer etter nøkkelord, type (Live/Capture/File) og status
  • Dobbeltklikk for å åpne en tidligere økt på nytt
  • Sorterbare kolonner: navn, type, metode, dato, status

Innstillinger

InnstillingBeskrivelseStandard
Recognition ModelStandard talemotorGoogle
Audio FormatOpptaksformatWAV
Audio QualityKomprimeringsnivåMedium
Video CaptureAktiver kameraopptakOff
Speaker ClassificationIdentifiser forskjellige talereOff

Tips

  • Offline transkripsjon — Bruk Whisper eller Vosk for helt offline talegjenkjenning
  • Møtenotater — Aktiver Speaker Classification for å skille hvem som sa hva
  • Batch-OCR — Slipp en hel mappe med skannede dokumenter for batchbehandling
  • PDF-uttrekking — Hver PDF-side konverteres til et bilde og OCR-behandles individuelt

Personvern

  • Whisper- og Vosk-motorer kjører helt på enheten din
  • Google Speech sender lyd til Googles servere for gjenkjenning
  • Alle transkripsjonsresultater og opptak lagres kun på din lokale disk
  • Ingen analyse eller sporing