Poimi tekstiä puheesta, kuvakaappauksista ja tiedostoista. Tukee reaaliaikaista puheentunnistusta, näyttökaappausten OCR-tunnistusta ja äänen, videon, kuvien ja PDF-tiedostojen eräkäsittelyä.
Aloittaminen
Valitse päänäytöltä yksi kolmesta tilasta:
- Live Transcription — reaaliaikainen puheen muunto tekstiksi mikrofonista
- Capture Transcription — OCR kuvakaappauksista tai kamerasta
- File Transcription — ääni-, video-, kuva- tai PDF-tiedostojen eräkäsittely
Live Transcription
Reaaliaikainen puheentunnistus mikrofonistasi tai äänen syöttölaitteesta.
Puhemoottorit
| Moottori | Tyyppi | Sopii erityisesti |
|---|---|---|
| Google Speech | Online-API | Korkea tarkkuus, monia kieliä (default) |
| Whisper | Paikallinen malli | Offline-käyttö, yksityisyys (mallit pienestä suureen) |
| Vosk | Offline | Kevyt, nopea, monia kieliä |
Tallennusasetukset
- Äänen syöttölaitteen valinta
- Audio Format: MP3 tai WAV
- Audio Quality: low / medium / high
- Valinnainen Video Capture kameran esikatselulla
- Valinnainen Speaker Classification (tunnistaa eri puhujat)
Capture Transcription
Poimi tekstiä kuvakaappauksista tai kamerakuvista OCR:n avulla.
- Kamerakaappaus — valitse kameralaite, ota yksittäinen kuva
- Koko näytön kaappaus — kaappaa koko näyttö
- Alueen valinta — piirrä suorakulmio kaapataksesi tietyn alueen
- Ikkunan kaappaus — kaappaa tietty ikkuna
OCR-moottori: Tesseract (oletuksena japani). Tulokset näkyvät kaapatun kuvan vieressä.
File Transcription
Käsittele tiedostoja eränä vetämällä ja pudottamalla tai tiedostoselaimen avulla.
Tuetut muodot
| Tyyppi | Muodot | Menetelmä |
|---|---|---|
| Ääni | MP3, WAV, M4A, FLAC, AAC, OGG, WMA | Puhemoottori |
| Video | MP4, AVI, MOV, MKV, WMV, FLV | Äänen erotus → puhemoottori |
| Kuva | JPG, PNG, BMP, TIFF, GIF | Tesseract OCR |
| Asiakirja | Sivu → kuva → OCR |
Worksetien historia
- Jokainen litterointi-istunto tallennetaan worksetinä
- Suodata avainsanan, tyypin (Live/Capture/File) ja tilan mukaan
- Kaksoisnapsauta avataksesi aiemman istunnon uudelleen
- Lajiteltavat sarakkeet: nimi, tyyppi, menetelmä, päivämäärä, tila
Asetukset
| Asetus | Kuvaus | Oletus |
|---|---|---|
| Recognition Model | Oletuspuhemoottori | |
| Audio Format | Tallennusmuoto | WAV |
| Audio Quality | Pakkaustaso | Medium |
| Video Capture | Ota kameran tallennus käyttöön | Off |
| Speaker Classification | Tunnista eri puhujat | Off |
Vinkkejä
- Offline-litterointi — Käytä Whisperiä tai Voskia täysin offline-puheentunnistukseen
- Kokousmuistiinpanot — Ota Speaker Classification käyttöön erottaaksesi kuka sanoi mitä
- Erä-OCR — Pudota kokonainen kansio skannattuja asiakirjoja eräkäsittelyä varten
- PDF-poiminta — Jokainen PDF-sivu muunnetaan kuvaksi ja käsitellään OCR:llä erikseen
Yksityisyys
- Whisper- ja Vosk-moottorit toimivat täysin laitteellasi
- Google Speech lähettää äänen Googlen palvelimille tunnistusta varten
- Kaikki litterointitulokset ja tallenteet säilyvät vain paikallisella levylläsi
- Ei analytiikkaa eikä seurantaa