Ordliste

Begreberne, kort forklaret

Feltet er fuldt af engelske forkortelser og ord, der betyder noget andet i daglig tale. Her er 30 af dem, forklaret på dansk, korte nok til at blive læst færdige.

Talegenkendelse og modeller

ASR
Automatic speech recognition, det engelske fagbegreb for automatisk talegenkendelse.
Diarisering
At dele en optagelse i segmenter efter, hvem der taler, uden nødvendigvis at vide, hvem personerne er.
Finjustering
At videretræne en færdig model på et smallere materiale, for eksempel tale på ét enkelt sprog.
Hallucination
Tekst, som modellen producerer, uden at der er dækning for den i lyden.
Kodeskift
At skifte mellem to eller flere sprog i samme samtale, ofte inden for én sætning.
NB-Whisper
Det norske Nationalbibliotekets videretrænede version af Whisper, tilpasset norsk tale og dialekt.
Ordfejlrate (WER)
Andelen af ord, der er forkerte, mangler eller er tilføjet, divideret med antal ord i facit.
Sprogmodel
En model, der forudsiger sandsynlige ordrækker, og som bruges både i transskription og til at lave resuméer.
Taleaktivitetsdetektion (VAD)
Teknikken, der afgør, hvor i en lydoptagelse der faktisk tales, og hvor der er stille.
Talegenkendelse
Teknologien, der gør talelyd til skreven tekst.
Taleridentifikation
At knytte en stemme til en kendt person, ikke blot skelne den fra andre stemmer.
Whisper
En åben talegenkendelsesmodel fra OpenAI, som kan køres på egen maskine.

Metoder og arbejdsgang

Batchtransskription
At transskribere en færdig optagelse bagefter, i stedet for mens der tales.
Efterredigering
At gennemgå og rette et maskingenereret transskript mod lyden.
Lokal transskription
Transskription, der køres på din egen maskine, uden at lyden sendes til en server.
Realtidstransskription
Transskription, der sker, mens der tales, med et til tre sekunders forsinkelse.
Skytransskription
Transskription, hvor lyden uploades og behandles på leverandørens servere.

Filformater og lyd

Lydformat
Filformatet, lyden er gemt i, for eksempel m4a, mp3 eller wav.
Samplingsfrekvens
Hvor mange gange i sekundet lydsignalet måles, angivet i hertz.
SRT
Det mest almindelige undertekstformat: nummererede tekstblokke med start- og sluttid.
Tidsstempel
En tidsangivelse, der knytter en bid af teksten til et bestemt punkt i lydoptagelsen.
Undertekstning
At vise tale som læsbar tekst på skærm, tidsstyret og begrænset i linjer og tegn.
VTT
Webstandarden for undertekster, med understøttelse af styling, positionering og metadata.

Transskriptionsformer

Renskrevet transskription
Transskription, hvor indholdet er bevaret, men formuleret i hele, læsbare sætninger.
Verbatim
Ordret transskription, der tager tøven, gentagelser, afbrydelser og ofte pauser med.

Møde og referat

Beslutningslog
En løbende liste over beslutninger på tværs af møder, med dato, ejer og begrundelse.
Dissens
At et medlem stemmer imod eller markerer uenighed i en beslutning.
Eventuelt
Fast sidste punkt på dagsordenen, til korte sager, der ikke er anmeldt på forhånd.
Handlingspunkt
En konkret opgave, der følger af et møde, med én ansvarlig og én frist.
Protokoltilførsel
En udtalelse, et medlem kræver optaget i protokollen, uanset hvad flertallet mener.

Hvorfor engelsk dominerer feltet

Forskningen i talegenkendelse er lavet på engelsk, og begreberne fulgte med. Nogle har fået gode nordiske ord, som ordfejlrate for word error rate. Andre har ikke, og så er det bedre at bruge det engelske end at opfinde noget, ingen genkender. Hvor begge dele bruges, står begge opført her.

Tale, skrevet ud

Sayable transskriberer tale med dialekt, skelner talerne og laver et udkast til referat. Gratis at komme i gang.