Textnizer - Guide

Extrahera text från tal, skärmdumpar och filer. Stöder röstigenkänning i realtid, OCR av skärmdumpar och batchbearbetning av ljud-, video-, bild- och PDF-filer.


Kom igång

Välj ett av tre lägen från huvudskärmen:

  1. Live Transcription — tal till text i realtid från din mikrofon
  2. Capture Transcription — OCR från skärmdumpar eller kamera
  3. File Transcription — batchbearbetning av ljud-, video-, bild- eller PDF-filer

Live Transcription

Röstigenkänning i realtid från din mikrofon eller ljudingångsenhet.

Talmotorer

MotorTypBäst för
Google SpeechOnline-APIHög precision, många språk (standard)
WhisperLokal modellOffline-användning, integritet (modeller från tiny till large)
VoskOfflineLättviktig, snabb, många språk

Inspelningsalternativ

  • Val av ljudingångsenhet
  • Audio Format: MP3 eller WAV
  • Audio Quality: low / medium / high
  • Valfri videoinspelning med kameraförhandsvisning
  • Valfri Speaker Classification (identifierar olika talare)

Capture Transcription

Extrahera text från skärmdumpar eller kameran med hjälp av OCR.

  • Camera capture — välj kameraenhet, ta en enskild bild
  • Full screen capture — fånga hela skärmen
  • Region selection — rita en rektangel för att fånga ett specifikt område
  • Window capture — fånga ett specifikt fönster

OCR-motor: Tesseract (japanska som standard). Resultaten visas bredvid den fångade bilden.


File Transcription

Bearbeta filer i batch genom dra och släpp eller via filbläddraren.

Format som stöds

TypFormatMetod
LjudMP3, WAV, M4A, FLAC, AAC, OGG, WMATalmotor
VideoMP4, AVI, MOV, MKV, WMV, FLVLjudextraktion → talmotor
BildJPG, PNG, BMP, TIFF, GIFTesseract OCR
DokumentPDFSida → bild → OCR

Workset History

  • Varje transkriptionssession sparas som ett workset
  • Filtrera efter nyckelord, typ (Live/Capture/File) och status
  • Dubbelklicka för att öppna en tidigare session igen
  • Sorterbara kolumner: namn, typ, metod, datum, status

Inställningar

InställningBeskrivningStandard
Recognition ModelStandardtalmotorGoogle
Audio FormatInspelningsformatWAV
Audio QualityKomprimeringsnivåMedium
Video CaptureAktivera kamerainspelningOff
Speaker ClassificationIdentifiera olika talareOff

Tips

  • Offline-transkription — Använd Whisper eller Vosk för helt offline röstigenkänning
  • Mötesanteckningar — Aktivera Speaker Classification för att urskilja vem som sa vad
  • Batch-OCR — Släpp en hel mapp med skannade dokument för batchbearbetning
  • PDF-extraktion — Varje PDF-sida konverteras till en bild och OCR-bearbetas individuellt

Integritet

  • Whisper- och Vosk-motorerna körs helt på din enhet
  • Google Speech skickar ljud till Googles servrar för igenkänning
  • Alla transkriptionsresultat och inspelningar lagras endast på din lokala disk
  • Ingen analys eller spårning