Puhujatunnisteet ja aikaleimat tekevät litteraatista haettavan, puhujiin yhdistettävän ja helpommin tarkistettavan, mutta vain silloin, kun muoto vastaa toimitettavaa aineistoa. Käytä tunnettujen osallistujien kohdalla vahvistettuja nimiä, roolitunnisteita silloin, kun henkilöllisyys ei ole tarpeen, vakaita anonyymejä tunnisteita silloin, kun vain äänet erotellaan, ja tunnistetta Tuntematon puhuja, kun henkilöllisyyttä ei voida vahvistaa. Luettavissa litteraateissa lisää aikaleima jokaisen puhujan vaihtumisen kohdalle; käytä alku- ja loppuaikojen muodostamia aikavälejä editointiin tai todisteeksi ja tekstityksiin cue-aikavälejä. Tämä opas määrittelee termit, vertailee muotoja, käsittelee päällekkäistä puhetta ja esittelee toistettavan ihmisen tekemän laadunvarmistuksen työnkulun.
Suora vastaus: Puhujatunnisteet yksilöivät jokaisen puheenvuoron, kun taas aikaleimat yhdistävät puheenvuoron lähteen tiettyyn hetkeen. Nopein luotettava oletusratkaisu on vahvistettu nimi tai vakaa roolitunniste sekä puheenvuoron alkua osoittava aikaleima, kuten [00:09] Maya Chen:. Käytä editointiin aikavälejä, tekstityksiin cue-aikoja ja arvaamisen sijaan tunnistetta Tuntematon puhuja.
Määritelmä: Puhujatunnisteet ja aikaleimat ovat litteraatin metatietoja, jotka yhdistävät puheen johdonmukaisesti tiettyyn henkilöön tai rooliin ja yhdistävät sanat, puheenvuorot tai tekstityscuet lähdeäänen täsmällisiin kohtiin.

Mitä ovat puhujatunnisteet ja aikaleimat?
Puhujatunnisteet ja aikaleimat vastaavat kahteen eri kysymykseen: kuka vastaa tekstikohdasta ja missä kyseinen kohta esiintyy lähteessä. Hyvä litteraatti pitää nämä kysymykset erillään, koska järjestelmä voi paikantaa ja erotella äänet tarkasti mutta silti liittää niihin väärän tosielämän nimen.
| Termi | Lyhyt määritelmä | Mitä se voi osoittaa | Mitä se ei voi yksin osoittaa |
|---|---|---|---|
| Puhujan diarisaatio | Jakaa äänen puheen perusteella ja määrittää puhujan vuoroille johdonmukaiset järjestelmän luomat tunnisteet. | Kuka puhui ja milloin suhteessa muihin havaittuihin ääniin. | Henkilön vahvistettua nimeä, roolia, toimivaltaa tai tarkoitusta. |
| Puhujan tunnistaminen | Yhdistää havaitun äänen vahvistettuun oikeaan henkilöön tai projektin rooliin. | Ihmisen helposti ymmärrettävän tunnisteen, jota tukevat osallistujaluettelo, esittely tai tunnettu tallenne. | Täydellistä kohdistusta silloin, kun äänet menevät päällekkäin tai näyttö on epäselvä. |
| Aikaleima-aikaväli | Sanan, puheenvuoron, jakson tai tekstityscuen alku- ja loppuaika. | Tekstiin liittyvän lähdeäänen aikavälin. | Ovatko sanat tai puhujatunniste oikein. |
| Tapahtumamerkintä | Johdonmukainen merkintätapa merkitykselliselle äänelle tai lähteen tilalle, kuten [naurua], [ovi sulkeutuu], [päällekkäistä puhetta] tai [epäselvää 00:24]. | Kontekstin, jota pelkät puhutut sanat eivät tavoita. | Kuulemattomia sanoja tai vahvistamatonta henkilöllisyyttä. |
Google Cloud kuvaa diarisaation puhujan vaihtumisen havaitsemiseksi ja eri äänille tunnisteiden määrittämiseksi. IBM:n dokumentaatio menee pidemmälle: järjestelmän luomat tunnukset eivät välttämättä ole peräkkäisiä, väliaikaiset tunnukset voivat muuttua, eikä samaa tunnistetta pidä tulkita vahvistetuksi nimeksi ilman toista näyttölähdettä.
Lähteet: Google Cloud: Eri puhujien tunnistaminen ja IBM Cloud: Puhujatunnisteet, tarkistettu 2026-08-05.

Mikä on oikea puhujatunniste litteroinnissa?
Oikea puhujatunniste on täsmällisin näytön tukema kohdistus, jota käytetään johdonmukaisesti alusta loppuun. Visuaalinen tyyli on toissijainen. Tunnisteen on autettava aiottua lukijaa erottamaan puheenvuorot ilman, että varmuutta liioitellaan.
| Saatavilla oleva näyttö | Suositeltu tunniste | Esimerkki | Vahvistussääntö |
|---|---|---|---|
| Henkilöllisyys on vahvistettu ja olennainen | Vahvistettu koko nimi | Maya Chen: | Vertaa esittelyyn, hyväksyttyyn luetteloon tai tunnettuun vertailuääneen. |
| Rooli on nimeä tärkeämpi | Vakiintunut rooli | Haastattelija: | Vahvista rooli ja käytä samaa kirjoitusasua kaikkialla. |
| Äänet on eroteltu, mutta henkilöllisyydet ovat tuntemattomia | Anonyymi tunniste | Puhuja 2: | Pidä vastaavuus samana; älä oleta numeron olevan kronologinen. |
| Henkilöllisyyttä ei voida vahvistaa | Selkeä epävarmuus | Tuntematon puhuja: | Jätä henkilöllisyys tuntemattomaksi, kunnes ääni tai projektin tiedot tukevat korjausta. |
Voi: nimetä anonyymin tunnisteen uudelleen, kun ääni on vahvistettu. Ei voi: käsitellä diarisaationumeroa, näyttöjärjestystä, aksenttia, jonkun muun mainitsemaa tehtävänimikettä tai oletettua ääntä henkilöllisyyden todisteena.
Kuvateksteissä visuaalinen sijoittelu voi joskus tunnistaa ruudulla olevan puhujan ilman nimen toistamista. DCMP suosittelee selkeää puhujan tunnistamista ja yhdenmukaista esitystapaa; se huomauttaa myös, että puhujatunnisteina käytetyt erisnimet kirjoitetaan isolla alkukirjaimella, kun taas yleiset tunnisteet kirjoitetaan yleensä pienellä. Tavallisessa litteraatissa voidaan käyttää nimen normaalia isojen ja pienten kirjainten mukaista kirjoitusasua, jota seuraa kaksoispiste.
Lähde: DCMP Captioning Key, tarkistettu 2026-08-05.

Mikä puhujatunnisteen muoto on oikea?
Yhtä yleispätevää puhujatunnisteen muotoa ei ole. Oikea muoto on se, jota kohde edellyttää ja jota käytetään yhdenmukaisesti. Käytä asiakirjoissa luettavaa puheenvuorotunnistetta, WebVTT:ssä koneellisesti luettavaa äänimerkintää ja asiakkaan täsmällistä tyyliä, kun tuomioistuin, lähetystoiminnan harjoittaja, tutkimusprojekti, saavutettavuuspalvelun tarjoaja tai arkisto määrittelee sellaisen.
| Toimitus | Suositeltu malli | Esimerkki | Keskeinen rajoitus |
|---|---|---|---|
| Luettava litteraatti | Aikaleima + vahvistettu tunniste + kaksoispiste | [00:09] Maya Chen: Pilotti alkaa 22. syyskuuta. | Ei tekstitystiedosto eikä sanatason kohdistus. |
| Roolipohjainen haastattelu | Vakiintunut rooli + kaksoispiste | Haastattelija: Mikä muuttui? | Voi peittää henkilöllisyyden, kun tutkimusasetelma edellyttää nimellä ilmoitettua tekijyyttä. |
| Anonyymi tutkimuslitteraatti | Osallistujakoodi | P03: Luovutus oli epäselvä. | Koodi on hallinnoitava erillään henkilötiedoista. |
| WebVTT-tekstitykset | Kuvakkeen aikaväli + äänialue | <v Maya Chen>Pilotti alkaa 22. syyskuuta. | Soittimen tuki ja tekstityksen sijoittelua koskevat säännöt ovat edelleen tärkeitä. |
Vältä vaihtelua tunnisteiden Maya, M. Chen, Puhuja 1 ja Esihenkilö välillä saman äänen kohdalla. Jos henkilöllisyys korjataan tarkistuksen puolivälissä, päivitä kaikki aiemmat puheenvuorot ja tarkista uudelleen kaikki vanhan tunnisteen perusteella laaditut yhteenvedot, tehtävät, lainaukset tai vastaukset.
Mihin litteraatin aikaviite tulisi sijoittaa?
Usean puhujan luettavassa litteraatissa nopein hyödyllinen oletus on puheenvuoron alkuun sijoitettava aikaleima juuri ennen puhujatunnistetta. Se antaa tarkistajalle yhden napsautus- tai kelauspisteen jokaista puhujanvaihdosta kohti täyttämättä jokaista lausetta aikatiedoilla. Valitse toinen tarkkuustaso vain, kun seuraava tehtävä sitä edellyttää.
| Aikaviittauksen tyyppi | Esimerkki | Sopii parhaiten | Kompromissi |
|---|---|---|---|
| Osio tai luku | 00:15:00 Procurement risks | Podcastien, luentojen tai pitkien kokousten navigointiin | Liian karkea lainausten tarkistamiseen. |
| Puheenvuoron alku | [00:02:14] Maya Chen: | Helppolukuisille haastattelu- ja kokoustranskripteille | Ei näytä tarkkaa loppua. |
| Puheenvuoron aikaväli | [00:02:14-00:02:19] | Muokkaukseen, todisteiden tarkasteluun ja päällekkäisiin puheenvuoroihin | Enemmän visuaalista hälyä. |
| Tekstityksen ajoitusväli | 00:02:14.000 --> 00:02:19.000 | WebVTT:n näyttöajoitukseen | Edellyttää kelvollista cue-syntaksia ja selkeästi segmentoituja osia. |
| Sanatason siirtymä | "pilot" 134.2s-134.7s | Kohdistukseen, hakuun ja automatisoituun laadunvarmistukseen | Yleensä sopimaton näkyväksi leipätekstiksi. |
Google Cloud tarjoaa tunnistettujen sanojen alku- ja loppusiirtymät. W3C:n WebVTT määrittelee cuet ääneen tai videoon kohdistettuina aikaväleinä ja käyttää pistettä millisekuntien merkitsemiseen, kuten tässä: 00:11.000 --> 00:13.000. Transkription hakasulkeet ovat toimituksellinen käytäntö, eivät WebVTT:n vaatimus.
Voi: tallentaa sanatason ajoituksen ja näyttää vain puheenvuorotason aikaleimat. Ei voi: olettaa, että tarkempi ajoitus osoittaa tunnistuksen tai puhujan määrityksen olevan oikein.
Lähteet: Google Cloud: Word time offsets ja W3C WebVTT, tarkistettu 2026-08-05.

Miten sanatarkka, älykkäästi sanatarkka ja tekstitysmuotoinen transkriptio eroavat toisistaan?
Sama lähdeääni voi tuottaa kolme kelvollista lopputulosta, koska kullakin muodolla on eri tehtävä. Sanatarkka transkriptio säilyttää puheen ominaispiirteet, älykkäästi sanatarkka transkriptio parantaa luettavuutta säilyttäen merkityksen ja puhujan, ja tekstitys jakaa tekstin synkronoitua näyttöä varten.
Kontrolloitu toimituksellinen lähdenäyte: Kohdassa 00:09.100 Maya sanoo: "Um, so I, I think the pilot starts September 22." Kohdassa 00:11.500 Luis puhuu päälle ja sanoo: "Pending procurement approval." Kohdassa 00:13.300 Maya sanoo: "Right." Tämä on laadunvarmistusta varten rakennettu näyte, ei kirjautuneessa tuotteessa tehty testi.
Sanatarkka transkriptio
[00:09.100-00:12.700] Maya: Um, so I, I think the pilot starts September 22.
[00:11.500-00:13.200] Luis: [overlapping speech] Pending procurement approval.
[00:13.300-00:13.800] Maya: Right.
Käytä tätä tasoa, kun toistot, täytesanat, tauot, keskeytykset ja puheenvuorojen kilpailu ovat osa analyysiä tai projektin määrittelyä. Määrittele jokainen merkintätapa tyylioppaassa.
Älykkäästi sanatarkka transkriptio
[00:09] Maya: I think the pilot starts September 22.
[00:11] Luis: [overlapping speech] Pending procurement approval.
[00:13] Maya: Right.
Tämä versio poistaa epäröinnit, mutta ei yhdistä Luisin ehtoa Mayan lauseeseen. Kielen siistiminen ei saa siirtää lausuman omistajuutta toiselle puhujalle.
WebVTT-tekstitysesimerkki
WEBVTT
00:09.100 --> 00:12.700
<v Maya>I think the pilot starts September 22.
00:11.500 --> 00:13.200
<v Luis>Pending procurement approval.
00:13.300 --> 00:13.800
<v Maya>Right.
WebVTT käyttää cue-kohtien alku- ja loppuajoitusta ja tukee äänialuetta. Tekstityksen tuotannossa on lisäksi huomioitava lukunopeus, rivinvaihdot, sijoittelu ja samanaikaiset cuet. DCMP suosittelee synkronointia, sisällöllistä vastaavuutta, puhujan tunnistamista ja merkityksellisiä äänitietoja; FCC:n televisiotekstityksiä koskevissa säännöissä käytetään tarkasteluperiaatteina täsmällisyyttä, synkronisuutta, täydellisyyttä ja asianmukaista sijoittelua.
Lähteet: W3C WebVTT, DCMP Captioning Key ja 47 CFR 79.1, tarkistettu 2026-08-05. CFR:n tekstityksen laatua koskevat säännöt koskevat niissä määriteltyä televisioympäristöä; tässä artikkelissa neljää laatutermiä käytetään tarkastelukriteereinä, ei yleispätevänä oikeudellisena väitteenä.

Miten päällekkäiset puheenvuorot, tuntemattomat puhujat ja tapahtumamerkinnät tulisi käsitellä?
Päällekkäisyys on sekä transkriptio- että puhujanmääritysongelma. Jos molemmat äänet ovat ymmärrettäviä, säilytä molemmat puheenvuorot leikkaavine aikaväleineen. Jos vain yksi ääni on ymmärrettävä, transkriboi kyseinen ääni ja merkitse tilanne vain, jos se auttaa lukijaa. Jos kumpikaan ei ole luotettava, merkitse lähde kuulumattomaksi ja palaa siihen laadunvarmistuksen aikana.
- Toistuvat ymmärrettävät puheenvuorot: pidä puhujatunnisteet ja aikavälit erillään; älä yhdistä kahta puhujaa yhdeksi lauseeksi.
- Lyhyet myötäilyilmaukset: tarkista "yes," "right," ja "mm-hmm" huolellisesti, koska diarisaatio määrittää lyhyet ilmaukset usein väärälle puhujalle.
- Tuntematon henkilöllisyys: käytä
Unknown speaker:-merkintää tai pysyvää anonyymiä tunnistetta todennäköisen nimen sijaan. - Epäselvät sanat: käytä projektissa määriteltyä merkintää, kuten
[inaudible 00:24]; älä koskaan kirjoita sanaa, jonka tarkistaja odotti kuulevansa. - Merkitykselliset äänet: käytä ytimekkäitä pienaakkosilla kirjoitettuja kuvauksia, kuten
[laughter],[door closes]tai[phone rings], kun ne vaikuttavat ymmärtämiseen. - Hiljaisuus ja tauot: merkitse ne vain, kun niiden kesto tai vaikutus keskusteluun on toimituksen kannalta merkityksellinen.
IBM varoittaa, että päällekkäinen puhe tai puheenvuorojen limittyminen voi olla yhdistetyssä äänitiedostossa vaikeaa tai mahdotonta tunnistaa tarkasti. Myös lyhyet ilmaukset, melu, hallitseva puhuja ja osallistujien suuri määrä voivat heikentää puhujatunnisteiden suorituskykyä. Erilliset tallennetut kanavat voivat vähentää tarvetta päätellä, kuka puhui, mutta kanavat on silti kohdistettava ja laadunvarmistettava.
Mitkä ovat automaattisen puhujantunnistuksen rajoitukset?
Automaattiset järjestelmät voivat nopeuttaa segmentointia ja lähteen selaamista, mutta diarisaation tuottama tulos on alustavaa metadataa. Käsittele sitä tarkistusjonona, älä lopullisena henkilöllisyystietueena.
| Virhe | Miksi se tapahtuu | Näkyvä oire | Tarkistajan toimenpide |
|---|---|---|---|
| Puhujan vaihtuminen | Samankaltaiset äänet tai epäselvä puheenvuoron vaihto | Yhden henkilön lause näkyy toisen tunnisteen alla | Kuuntele vaihdosta edeltävä ja sitä seuraava kohta uudelleen ja korjaa koko vaikutuksen alainen jakso. |
| Haamupuhuja | Melu tai äänen vaihtelu | Uusi tunniste ilmestyy, vaikka uutta henkilöä ei liittynyt mukaan | Yhdistä vasta, kun olet vahvistanut äänen lähimpien puheenvuorojen perusteella. |
| Puhuja jää huomaamatta | Lyhyt puheenvuoro tai hallitseva pääpuhuja | Lyhyt puheenvuoro merkitään pääpuhujan puheeksi | Tarkista keskeytykset ja myötäilyilmaukset manuaalisesti. |
| Päällekkäisyyden sulautuminen | Yksi yhdistetty kanava | Kaksi ääntä muuttuu yhdeksi katkonaiseksi lauseeksi | Käytä aikavälitoistoa tai erillisiä raitoja, jos ne ovat saatavilla. |
| Väliaikaisten tunnisteiden ajautuminen | Malli tarkistaa arviotaan, kun lisää ääntä saapuu | Puhujanumerot muuttuvat osittaisen ja lopullisen tuloksen välillä | Tee henkilöllisyyksien vastaavuusmääritys lopulliseen litteraattiin ja normalisoi se sen jälkeen. |
Voi: käyttää diarisaatiota puhujanvaihtojen tarkistamisen priorisointiin. Ei voi: luvata, että jokainen ääni, keskeytys tai nimi on oikein ilman lähteen kuuntelemista.
Miten puhujatunnisteille ja aikaleimoille tehdään ihmisen suorittama laadunvarmistus?
Aloita riskialttiista aineistosta sen sijaan, että toistaisit tiedoston lineaarisesti: päätökset, velvoitteet, nimet, päivämäärät, numerot, sitaatit, ulkopuoliset lupaukset ja kohdat, joissa äänet menevät päällekkäin. Normalisoi sitten koko asiakirja.
- Valmistele osallistujaluettelo ja tyyli. Luettele odotetut puhujat, hyväksytyt nimet tai roolit, tulostusmuoto, aikaleimojen tarkkuus, tapahtumamerkintöjen käytäntö ja yksityisyysrajoitukset.
- Ankkuroi tunnetut äänet. Yhdistä ääni oikeaan nimeen esittelyjen tai muun varmennetun lähdekohdan avulla; älä päättele henkilöllisyyttä diarisaation numerosta.
- Tarkista puhujanvaihdot. Toista ensimmäinen puheenvuoron vaihto sekä jokainen riskialtis päätös, sitaatti, vastuuhenkilö, määräaika, lyhyt kuittaus ja keskeytys.
- Ratkaise päällekkäisyydet ja epävarmuus. Säilytä ymmärrettävät samanaikaiset puheenvuorot, merkitse hyödylliset päällekkäisyydet tai äänitapahtumat johdonmukaisesti ja säilytä Unknown speaker- tai inaudible-merkinnät, kun näyttöä ei ole riittävästi.
- Tarkista aikaleimojen kohdistus. Varmista, että puheenvuoron alun tai aikavälin aikaleimat avaavat oikean lähdekohdan ja että tekstityksen vihjeiden alut, loput ja lukujärjestys vastaavat ääntä.
- Normalisoi asiakirja. Käytä koko toimituksessa yhtä tunnisteiden kirjoitusasua, kirjainkokoa, välimerkitystä, aikaleimakuviota ja tapahtumamerkintöjen tyyliä.
- Tarkista johdetut tulosteet uudelleen. Kun olet korjannut tunnisteen tai ajan, tarkista yhteenvedot, tehtävät, sitaatit, viennit ja lähteistetyt vastaukset, jotta virhe ei säily myöhemmissä vaiheissa.
Nopein perusteltavissa oleva työnkulku: käytä pysyviä luotuja tunnisteita ja puheenvuoron alun aikaleimoja, varmista kunkin äänen esittely tai ensimmäinen selkeä näyte, tarkista jokainen vaikutukseltaan merkittävä puheenvuoron vaihto ja nimeä tunnisteet sitten maailmanlaajuisesti uudelleen. Jos toimitus on riskialtis, käytä toista tarkistajaa tai dokumentoitua otantasääntöä sen sijaan, että olettaisit ensimmäisen kierroksen olevan valmis.
Mitatut: Google- ja Bing-hakutulossivut sekä Google Cloudin, IBM Cloudin, W3C:n, DCMP:n ja FCC:n sivut tarkistettiin 2026-08-05. Ei sovellu: äänen lataus, diarisaation tulos, tuotteen tarkkuus, tarkistajien yhdenmukaisuus, käsittelynopeus ja kirjautumista edellyttävien ominaisuuksien saatavuus.

Miten puhujatunnisteet, aikaleimat ja lähdeviittaukset varmistavat toisensa?
Litteraatti perustuu lähteeseen, kun tunniste, lähdeaika ja johdettu vastaus voidaan tarkistaa yhtenä ketjuna. Litteraatin korjaaminen ei riitä, jos tehtävä tai tekoälyn vastaus sisältää edelleen vanhan vastuuhenkilön.
Kontrolloitu toimituksellinen esimerkki; tuotteen mittaus ei sovellu.
00:09 Maya Chen: "The pilot starts September 22."
00:24 Speaker 2: "I will send the access list by September 15."
00:41 Maya Chen: "Procurement approval is still open."
Tarkistuspolku: Avaa kohta 00:24, vertaa ääntä Luis Ortizin varmennettuun esittelyyn, vaihda Speaker 2 nimeksi Luis Ortiz ja suorita kaikki johdetut tulosteet uudelleen tai tarkista ne uudelleen.
Korjattu tehtävä: Luis Ortiz – lähetä käyttöoikeusluettelo – määräaika 15. syyskuuta – lähde 00:24.
Lainattu vastaus: "Kuka vastaa käyttöoikeusluettelosta?" Luis Ortiz [00:24].
Korjaus on valmis vasta, kun litteraatissa, yhteenvedossa, tehtävässä, viennissä ja lainatussa vastauksessa kaikissa käytetään nimeä Luis. Jos henkilöllisyyttä ei voida vahvistaa, rehellinen vastaus on, että puhuja 2 vastaa tehtävästä lähteen 00:24 perusteella tunnistamista odotettaessa.
Mihin HiNoter sopii tässä työnkulussa?
HiNoter on tekoälypohjainen kokous- ja monilähdemuistiinpanotyökalu, joka muuttaa valtuutetut kokoukset, YouTube-videot, PDF-tiedostot sekä video- ja äänitiedostot jäsennellyiksi muistiinpanoiksi ja lähteisiin viittaaviksi vastauksiksi.
Kun kokous tai tiedosto on valtuutettu käsiteltäväksi, HiNoteria voidaan arvioida puhujilla merkittyjen litteraattien navigointiin, aikaleimojen toistoon, merkintöjen korjaamiseen, jäsenneltyihin yhteenvetoihin, tehtäviin ja tekoälychatin vastauksiin, jotka linkittävät takaisin lähteen kohtiin. Lähdelinkki tekee korjauksesta tarkistettavan; se ei tee alkuperäisestä automaattisesta merkinnästä erehtymätöntä.
Käyttäjän toimittama / tarkistettava ennen julkaisua: Puhujamerkintöjen muokkausta, aikaleimanavigointia, automaattista läsnäolon seurantaa, litterointia, käsittelynopeutta, kielitukea, jäsenneltyjä muistiinpanoja, integraatioita ja lähteisiin linkittävää tekoälychattia ei testattu kirjautuneella HiNoter-tilillä tätä sivua varten. Tarkista ennen julkaisua nykyinen toiminta, tilauksen ominaisuudet, vientimuoto, yksityisyydensuojan hallinta, lähteiden käyttöoikeus, korjausten välittyminen ja poistovaihtoehdot.
Vieraile HiNoterissa, testaa puheesta tekstiksi -työnkulku, vertaile tekoälypohjaisia kokousmuistiinpanoja, tarkastele tekoälychatin lähdeviittauksia, tutustu tietosuojakäytäntöön ja katso Google Docs -integraatio. Aiheeseen liittyvä monikielinen litterointityönkulku selittää, miksi puhujan määrittäminen ja monikielisen merkityksen säilyminen ovat erillisiä laatutarkistuksia.

Mitä yksityisyyttä ja käyttöoikeuksia koskevia tarkistuksia tarvitaan?
Puhujamerkinnät voivat muuttaa yleisen litteraatin henkilötiedoiksi yhdistämällä äänen, nimen, roolin, lausuman ja ajankohdan. Käsittele vain omistamaasi tai käyttöösi valtuutettua ääntä, ilmoita osallistujille tarvittaessa ja rajoita litteraatin ja lähdetallenteen käyttö henkilöille, jotka tarvitsevat niitä.
- Dokumentoi tallentamisen, litteroinnin, puhujan tunnistamisen ja myöhemmän tekoälykäsittelyn tarkoitus.
- Käytä osallistujakoodeja nimien sijaan, kun tutkimus tai tietosuojan suunnittelu edellyttää tunnistetietojen poistamista.
- Älä päättele äänestä arkaluonteisia henkilöllisyyteen liittyviä ominaisuuksia.
- Rajoita pääsyä luetteloon, joka yhdistää anonyymit osallistujakoodit oikeisiin nimiin.
- Sovella säilytys- ja poistamissääntöjä sekä litteraattiin että alkuperäiseen äänitiedostoon.
- Ota lakiasioista, henkilöstöhallinnosta, terveydenhuollosta, asiakkaista tai säännellystä materiaalista vastaava tietosuoja- tai vaatimustenmukaisuusasiantuntija mukaan.
Tämä on työnkulkuopas, ei oikeudellista neuvontaa. Tuotteen tietosuojausehdot sekä paikalliset tallentamista ja biometrisiä tietoja koskevat säännöt on tarkistettava todellisten osallistujien, lainkäyttöalueen ja käyttötarkoituksen osalta.
Usein kysytyt kysymykset
Mikä on puhujamerkintä litteraatissa?
Litteraatin puhujamerkintä kertoo puheenvuoron käyttäneen henkilön, roolin tai anonyymin äänen. Esimerkkejä ovat Maya Chen, Haastattelija, Puhuja 2 ja Tuntematon puhuja. Merkinnän tulee pysyä yhdenmukaisena, eikä sen pidä väittää kyseessä olevan tietty henkilö, ellei henkilöllisyyttä ole vahvistettu lähteen tai projektitietueen perusteella.
Mikä puhujamerkintä on oikea?
Oikea puhujamerkintä on täsmällisin merkintä, jonka todisteet tukevat: vahvistettu nimi, kun henkilöllisyydellä on merkitystä, rooli, kun rooli riittää, pysyvä anonyymi numero, kun puhujantunnistus on vain erottanut äänet toisistaan, tai Tuntematon puhuja, kun henkilöllisyyttä ei voida vahvistaa. Yhdenmukaisuus ja todennettavuus ovat tärkeämpiä kuin koristeellinen muotoilu.
Mikä on puhujamerkinnän oikea muoto?
Helppolukuisessa litteraatissa käytä yhtä merkintää, jota seuraa kaksoispiste jokaisen puheenvuoron alussa, esimerkiksi [00:09] Maya Chen: Pilotti alkaa 22. syyskuuta. Tekstityksissä noudata kohdetiedoston määrityksiä; WebVTT tukee puhejaksoa, joka yksilöi vihjeen puhujan. Asiakas, tuomioistuin, yleisradioyhtiö tai tutkimusprojekti voi edellyttää erilaista tyyliä.
Mihin aikaviite sijoitetaan litteraatissa?
Yleisessä litteraatissa sijoita puheenvuoron alun aikaleima välittömästi ennen puhujamerkintää. Käytä alku- ja loppuaikaa, kun editoija tarvitsee täsmälliset rajat, säännöllisiä aikaleimoja vain, kun projekti niitä pyytää, ja vihjeiden aikavälejä tekstityksissä. Sanakohtaiset ajat on parasta säilyttää koneellisesti luettavana kohdistustietona sen sijaan, että ne tulostetaan jokaisen sanan eteen.
Miten päällekkäiset tai tuntemattomat puhujat merkitään?
Säilytä molemmat puheenvuorot, kun sanat ovat ymmärrettäviä, ja anna kummallekin aikaväli. Lisää johdonmukainen tilamerkintä, kuten [päällekkäistä puhetta], kun se auttaa tarkistajaa. Jos ääntä tai sanoja ei voida vahvistaa, käytä merkintää Tuntematon puhuja tai [epäselvää 00:24] sen sijaan, että määrittäisit todennäköisen nimen tai keksisit tekstiä.
Mitä HiNoter tekee puhujamerkinnöille ja aikaleimoille?
Valtuutuksen jälkeen HiNoteria voidaan arvioida litteraatin navigointiin, puhujamerkintöjen muokkaukseen, jäsenneltyihin muistiinpanoihin, tehtäviin ja tekoälychatin vastauksiin, jotka palaavat lähteen aikaleimoihin. Nämä tuotteen toiminnot on toimitettu käyttäjän toimesta tätä artikkelia varten, ja ne on tarkistettava nykyisessä tuotteessa, tilauksessa, yksityisyydensuojan hallinnassa ja lähdelinkkien työnkulussa ennen julkaisua.
Tarkista valtuutettu litteraatti lähteeseen verraten
Tarkista ensin yllä oleva valvottu esimerkki. Käsittele sitten yhtä valtuutettua kokousta tai tiedostoa HiNoterissa, korjaa puhujamerkinnät, avaa lähteen aikaleimat ja varmista, että yhteenvedossa, tehtävissä ja tekoälychatin vastauksissa on korjattu puhujanmääritys.
Käsittele valtuutettu kokous tai tiedosto | Näytä lähteisiin linkitetty tekoälychat