Ordliste
Begreberne, kort forklaret
Feltet er fuldt af engelske forkortelser og ord, der betyder noget andet i daglig tale. Her er 30 af dem, forklaret på dansk, korte nok til at blive læst færdige.
Talegenkendelse og modeller
- ASR
- Automatic speech recognition, det engelske fagbegreb for automatisk talegenkendelse.
- Diarisering
- At dele en optagelse i segmenter efter, hvem der taler, uden nødvendigvis at vide, hvem personerne er.
- Finjustering
- At videretræne en færdig model på et smallere materiale, for eksempel tale på ét enkelt sprog.
- Hallucination
- Tekst, som modellen producerer, uden at der er dækning for den i lyden.
- Kodeskift
- At skifte mellem to eller flere sprog i samme samtale, ofte inden for én sætning.
- NB-Whisper
- Det norske Nationalbibliotekets videretrænede version af Whisper, tilpasset norsk tale og dialekt.
- Ordfejlrate (WER)
- Andelen af ord, der er forkerte, mangler eller er tilføjet, divideret med antal ord i facit.
- Sprogmodel
- En model, der forudsiger sandsynlige ordrækker, og som bruges både i transskription og til at lave resuméer.
- Taleaktivitetsdetektion (VAD)
- Teknikken, der afgør, hvor i en lydoptagelse der faktisk tales, og hvor der er stille.
- Talegenkendelse
- Teknologien, der gør talelyd til skreven tekst.
- Taleridentifikation
- At knytte en stemme til en kendt person, ikke blot skelne den fra andre stemmer.
- Whisper
- En åben talegenkendelsesmodel fra OpenAI, som kan køres på egen maskine.
Metoder og arbejdsgang
- Batchtransskription
- At transskribere en færdig optagelse bagefter, i stedet for mens der tales.
- Efterredigering
- At gennemgå og rette et maskingenereret transskript mod lyden.
- Lokal transskription
- Transskription, der køres på din egen maskine, uden at lyden sendes til en server.
- Realtidstransskription
- Transskription, der sker, mens der tales, med et til tre sekunders forsinkelse.
- Skytransskription
- Transskription, hvor lyden uploades og behandles på leverandørens servere.
Filformater og lyd
- Lydformat
- Filformatet, lyden er gemt i, for eksempel m4a, mp3 eller wav.
- Samplingsfrekvens
- Hvor mange gange i sekundet lydsignalet måles, angivet i hertz.
- SRT
- Det mest almindelige undertekstformat: nummererede tekstblokke med start- og sluttid.
- Tidsstempel
- En tidsangivelse, der knytter en bid af teksten til et bestemt punkt i lydoptagelsen.
- Undertekstning
- At vise tale som læsbar tekst på skærm, tidsstyret og begrænset i linjer og tegn.
- VTT
- Webstandarden for undertekster, med understøttelse af styling, positionering og metadata.
Transskriptionsformer
- Renskrevet transskription
- Transskription, hvor indholdet er bevaret, men formuleret i hele, læsbare sætninger.
- Verbatim
- Ordret transskription, der tager tøven, gentagelser, afbrydelser og ofte pauser med.
Møde og referat
- Beslutningslog
- En løbende liste over beslutninger på tværs af møder, med dato, ejer og begrundelse.
- Dissens
- At et medlem stemmer imod eller markerer uenighed i en beslutning.
- Eventuelt
- Fast sidste punkt på dagsordenen, til korte sager, der ikke er anmeldt på forhånd.
- Handlingspunkt
- En konkret opgave, der følger af et møde, med én ansvarlig og én frist.
- Protokoltilførsel
- En udtalelse, et medlem kræver optaget i protokollen, uanset hvad flertallet mener.
Hvorfor engelsk dominerer feltet
Forskningen i talegenkendelse er lavet på engelsk, og begreberne fulgte med. Nogle har fået gode nordiske ord, som ordfejlrate for word error rate. Andre har ikke, og så er det bedre at bruge det engelske end at opfinde noget, ingen genkender. Hvor begge dele bruges, står begge opført her.
Tale, skrevet ud
Sayable transskriberer tale med dialekt, skelner talerne og laver et udkast til referat. Gratis at komme i gang.