Skip to main content
HiNoter
/AI Translator/전사에서 화자 레이블과 타임스탬프: 모범 사례
AI TranslatorAug 5, 202628 min read

전사에서 화자 레이블과 타임스탬프: 모범 사례

화자 레이블과 타임스탬프는 전사문을 검색 가능하고, 출처를 명확히 하며, 검증하기 쉽게 만들어 주지만, 형식이 산출물에 맞을 때만 그렇습니다. 알려진 참여자에게는 검증된 이름을 사용하고, 신원이 중요하지 않을 때는 역할 레이블을 사용하며, 음성만 구분하면 될 때는 일관된 익명 레이블을 사용하고, 신원을 확인할 수 없을 때는 Unknown speaker를 사용하세요. 읽기 쉬운 전사문에는 화자 전환마다 타임스탬프를 추가하고, 편집이나 증거 목적에는 시작-끝 구간을, 자막에는 큐 구간을 사용하세요. 이 가이드는 용어를 정의하고, 형식을 비교하고, 겹치는 발화를 처리하는 방법을 설명하며, 반복 가능한 사람 검수 워크플로를 제공합니다.

직접 답변: 화자 레이블은 각 발화 턴이 누구의 것인지 식별하고, 타임스탬프는 그 발화 턴을 원본의 특정 시점과 연결합니다. 가장 빠르고 신뢰할 수 있는 기본값은 검증된 이름 또는 일관된 역할 레이블에 턴 시작 타임스탬프를 붙이는 것입니다. 예: [00:09] Maya Chen:. 편집용에는 구간을, 자막에는 큐 타임을 사용하고, 신원을 추측하는 대신 Unknown speaker를 사용하세요.

정의: 화자 레이블과 타임스탬프는 발화에 일관된 사람 또는 역할을 부여하고, 단어, 발화 턴 또는 자막 큐를 원본 오디오의 정확한 위치와 연결하는 전사 메타데이터입니다.

검증된 이름과 시간 참조가 포함된 전사에서의 화자 레이블과 타임스탬프
레이블, 시간 참조, 원본 검증을 보여주는 원본 편집용 다이어그램이며, 제품 스크린샷은 아닙니다.

화자 레이블과 타임스탬프란 무엇인가요?

화자 레이블과 타임스탬프는 서로 다른 두 가지 질문을 해결합니다: 어떤 사람이 한 발화인지, 그리고 그 발화가 원본의 어디에 있는지입니다. 유용한 전사문은 이 두 질문을 분리해 둡니다. 시스템이 음성을 정확히 찾아 분리하더라도 실제 사람 이름을 잘못 붙일 수 있기 때문입니다.

전사의 핵심 정의, 2026-08-05 검토
용어짧은 정의무엇을 입증할 수 있는가단독으로는 무엇을 입증할 수 없는가
화자 분리(diarization)오디오를 음성별로 구분하고 화자 턴에 일관된 생성 레이블을 부여합니다.감지된 다른 음성들 사이에서 누가 언제 말했는지.사람의 검증된 이름, 역할, 권한 또는 의도.
화자 식별감지된 음성을 검증된 실제 인물 또는 프로젝트 역할에 매핑합니다.명단, 소개, 또는 알려진 녹음을 근거로 한 사람이 읽을 수 있는 레이블.음성이 겹치거나 근거가 불분명할 때의 완벽한 귀속.
타임스탬프 구간단어, 턴, 세그먼트 또는 자막 큐의 시작과 끝 시간입니다.텍스트와 연결된 원본 구간.단어나 화자 레이블이 올바른지 여부.
이벤트 마커[laughter], [door closes], [overlapping speech], [inaudible 00:24]와 같이 의미 있는 소리나 원본 상태를 일관되게 표기하는 방식입니다.말로 된 단어만으로는 포착되지 않는 맥락.들을 수 없는 단어나 검증되지 않은 신원.

Google Cloud는 화자 분리를 화자 변경을 감지하고 서로 다른 음성에 레이블을 부여하는 것으로 설명합니다. IBM의 문서는 더 나아가 생성된 ID는 연속적이지 않을 수 있고, 임시 ID는 변경될 수 있으며, 추가 증거 출처가 없으면 같은 레이블을 검증된 이름으로 해석해서는 안 된다고 설명합니다.

출처: Google Cloud: 서로 다른 화자 감지 및 IBM Cloud: 화자 레이블, 2026-08-05 검토.

화자 분리, 식별, 시간 정렬, 이벤트 표기에 대한 화자 레이블과 타임스탬프 정의
화자 분리, 식별, 시간 정렬, 이벤트 표기는 서로 다른 계층입니다.

전사에서 올바른 화자 레이블은 무엇인가요?

올바른 화자 레이블은 근거가 뒷받침하는 가장 구체적인 귀속이며, 처음부터 끝까지 일관되게 사용됩니다. 시각적 형식은 부차적입니다. 레이블은 의도한 독자가 과도한 확신 없이 발화 턴을 구분하는 데 도움을 주어야 합니다.

화자 레이블 결정표
확인 가능한 증거권장 레이블예시검증 규칙
신원이 확인되었고 관련성이 있음검증된 전체 이름Maya Chen:자기소개, 승인된 명단, 또는 알려진 참조 음성에 일치하는지 확인한다.
이름보다 역할이 더 중요함고정된 역할Interviewer:역할을 확인하고 전체에서 동일한 표기를 사용한다.
목소리는 구분되지만 신원은 알려지지 않음익명 식별자Speaker 2:매핑을 일관되게 유지하고, 숫자를 시간순으로 가정하지 않는다.
신원을 확인할 수 없음명시적 불확실성Unknown speaker:오디오나 프로젝트 기록이 정정을 뒷받침할 때까지는 미확인 상태로 둔다.

할 수 있음: 음성이 검증된 뒤 익명 레이블의 이름을 바꿀 수 있다. 할 수 없음: 화자 분리 번호, 표시 순서, 억양, 다른 사람이 언급한 직함, 또는 그럴듯한 목소리를 신원 증거로 취급할 수 없다.

자막에서는 화면상의 화자를 이름을 반복하지 않고도 시각적 배치로 식별할 수 있다. DCMP는 명확한 화자 식별과 일관된 표시를 권장하며, 화자 ID로 사용된 고유명사는 대문자로 표기하고 일반적인 식별은 보통 소문자로 표기한다고도 설명한다. 일반 전사문에서는 이름을 정상적으로 대문자 표기한 뒤 콜론을 붙일 수 있다.

출처: DCMP Captioning Key, 2026-08-05 검토.

검증된 이름, 역할, Speaker 2 또는 Unknown speaker를 사용한 올바른 화자 레이블 형식
증거가 약할수록 구체성 사다리 아래로 내려가라; 추측으로 절대 위로 올라가지 말라.

어떤 화자 레이블 형식이 올바른가?

보편적인 화자 레이블 형식은 없다. 올바른 형식은 대상이 요구하고 일관되게 적용된 형식이다. 문서에는 읽기 쉬운 발화 표시를 사용하고, WebVTT에는 기계 판독 가능한 음성 주석을 사용하며, 법원·방송사·연구 프로젝트·접근성 벤더·아카이브가 지정한 경우에는 해당 고객의 정확한 스타일을 사용한다.

산출물별 화자 레이블 형식
산출물권장 패턴예시주요 제한 사항
읽기 쉬운 전사문타임스탬프 + 검증된 레이블 + 콜론[00:09] Maya Chen: The pilot starts September 22.자막 파일이 아니며 단어 수준 정렬도 아니다.
역할 기반 인터뷰고정된 역할 + 콜론Interviewer: What changed?연구 설계가 이름 귀속을 요구할 때는 신원을 숨길 수 있다.
익명 연구 전사문참가자 코드P03: The handoff was unclear.코드는 개인 신원과 별도로 관리해야 한다.
WebVTT 자막큐 구간 + 음성 범위<v Maya Chen>The pilot starts September 22.플레이어 지원과 자막 배치 규칙도 여전히 중요하다.

같은 화자에 대해 MayaM. ChenSpeaker 1Manager 를 번갈아 사용하지 말아야 한다. 검토 도중 신원이 중간에 정정되면 이전의 모든 발화를 업데이트하고, 이전 레이블에서 파생된 요약·할 일·인용문·답변도 다시 확인하라.

전사문에서 시간 참조는 어디에 있어야 하는가?

여러 화자가 있는 읽기 쉬운 전사문에서 가장 빠르고 유용한 기본값은 화자 레이블 바로 앞에 발화 시작 타임스탬프를 두는 것이다. 이렇게 하면 리뷰어가 문장마다 시간을 가득 채우지 않고도 화자 전환마다 한 번의 클릭 또는 스크럽 지점을 얻을 수 있다. 다음 작업이 다른 수준을 요구할 때만 다른 방식을 선택하라.

작업별 타임스탬프 세분화
시간 기준 유형예시적합한 용도장단점
섹션 또는 챕터00:15:00 Procurement risks팟캐스트, 강의, 장시간 회의 탐색인용 검증용으로는 너무 거칩니다.
턴 시작[00:02:14] Maya Chen:읽기 쉬운 인터뷰 및 회의 녹취록정확한 끝 시점을 보여주지 않습니다.
턴 구간[00:02:14-00:02:19]편집, 근거 검토, 겹치는 턴시각적 잡음이 더 많습니다.
자막 큐 구간00:02:14.000 --> 00:02:19.000WebVTT 표시 타이밍유효한 큐 구문과 읽기 쉬운 분할이 필요합니다.
단어 수준 오프셋"pilot" 134.2s-134.7s정렬, 검색, 자동 QA보이는 문장으로는 보통 부적합합니다.

Google Cloud는 인식된 단어에 대해 시작 및 종료 오프셋을 제공합니다. W3C WebVTT는 큐를 오디오 또는 비디오에 맞춘 시간 구간으로 정의하며, 밀리초에는 점을 사용합니다. 예: 00:11.000 --> 00:13.000. 녹취록의 대괄호는 편집 관례일 뿐, WebVTT의 요구사항은 아닙니다.

가능: 단어 수준 타이밍을 저장하면서 표시에는 턴 수준 타임스탬프만 사용하기. 불가능: 더 세분화된 타이밍이 인식이나 화자 귀속의 정확성을 증명한다고 가정하기.

출처: Google Cloud: Word time offsets 및 W3C WebVTT, 2026-08-05 검토.

전사에서 턴 시작, 턴 구간, 자막 큐, 단어 타임스탬프를 보여주는 시간 기준
타임스탬프의 세분화는 탐색, 검토, 자막 표시, 기계 정렬 중 다음 작업에 맞춰야 합니다.

전체 축어록, 지능형 축어록, 자막은 어떻게 다른가요?

같은 원본 오디오라도 형식마다 역할이 다르기 때문에 세 가지 유효한 출력이 나올 수 있습니다. 전체 축어록은 발화의 특성을 보존하고, 지능형 축어록은 의미와 화자 귀속을 유지하면서 읽기 쉽게 다듬으며, 자막은 동기화된 표시를 위해 텍스트를 분할합니다.

통제된 편집용 원본 샘플: 00:09.100에 Maya가 "음, 그래서 저는, 저는 그 파일럿이 9월 22일에 시작한다고 생각해요."라고 말합니다. 00:11.500에 Luis가 "조달 승인 보류 중입니다."라고 겹쳐 말합니다. 00:13.300에 Maya가 "맞아요."라고 말합니다. 이는 생성된 QA 샘플이며, 서명된 제품 테스트가 아닙니다.

전체 축어록

[00:09.100-00:12.700] Maya: 음, 그래서 저는, 저는 그 파일럿이 9월 22일에 시작한다고 생각해요.
[00:11.500-00:13.200] Luis: [겹치는 발화] 조달 승인 보류 중입니다.
[00:13.300-00:13.800] Maya: 맞아요.

반복, 군더더기, 멈춤, 끼어들기, 발화 경쟁이 분석 또는 프로젝트 사양의 일부일 때 이 수준을 사용합니다. 모든 표기법은 스타일 시트에 정의해야 합니다.

지능형 축어록

[00:09] Maya: 파일럿이 9월 22일에 시작한다고 생각해요.
[00:11] Luis: [겹치는 발화] 조달 승인 보류 중입니다.
[00:13] Maya: 맞아요.

이 버전은 비유창성을 제거하지만, Luis의 조건을 Maya의 문장에 합치지는 않습니다. 언어를 정제할 때 발화의 소유권을 옮기면 안 됩니다.

WebVTT 자막 발췌

WEBVTT

00:09.100 --> 00:12.700
<v Maya>파일럿이 9월 22일에 시작한다고 생각해요.

00:11.500 --> 00:13.200
<v Luis>조달 승인 보류 중입니다.

00:13.300 --> 00:13.800
<v Maya>맞아요.

WebVTT는 시작-종료 큐 타이밍을 사용하며 음성 범위를 지원합니다. 자막 제작에서는 읽기 속도, 줄바꿈, 배치, 동시 큐도 고려해야 합니다. DCMP는 동기화, 내용 일치, 화자 식별, 의미 있는 소리 정보를 권장하며, FCC의 텔레비전 자막 규칙은 정확성, 동기성, 완전성, 적절한 배치를 검토 원칙으로 사용합니다.

출처: W3C WebVTT, DCMP Captioning Key, 47 CFR 79.1, 2026-08-05 검토. CFR 자막 품질 규칙은 정의된 텔레비전 맥락에 적용되며, 이 글에서는 네 가지 품질 용어를 보편적 법적 주장 대신 검토 기준으로 사용합니다.

전체 축어록, 지능형 축어록, WebVTT 자막 예시를 보여주는 화자 라벨과 타임스탬프
출력의 목적에 맞게 같은 원본을 형식화해야 하며, 하나의 보편적 템플릿을 적용해서는 안 됩니다.

겹침, 알 수 없는 화자, 이벤트 표시는 어떻게 처리해야 하나요?

겹침은 전사 문제이자 귀속 문제입니다. 두 목소리 모두 알아들을 수 있다면, 서로 겹치는 구간으로 두 턴을 모두 보존합니다. 한 목소리만 알아들을 수 있다면, 그 목소리만 전사하고, 독자에게 도움이 될 때만 그 상태를 표시합니다. 어느 것도 신뢰할 수 없다면, 원본을 들리지 않음으로 표시하고 QA에서 다시 확인합니다.

  • 겹치는 이해 가능한 발화: 별도의 레이블과 시간 구간을 유지하고, 두 화자를 하나의 문장으로 합치지 마세요.
  • 짧은 맞장구: "yes," "right," "mm-hmm"는 특히 주의해서 확인하세요. 화자 분리(diarization)가 짧은 발화를 잘못 할당하는 경우가 많습니다.
  • 알 수 없는 신원: 가능성 있는 이름 대신 Unknown speaker: 또는 일관된 익명 ID를 사용하세요.
  • 불명확한 단어: 프로젝트에서 정한 표식, 예를 들어 [inaudible 00:24]를 사용하세요. 검토자가 들을 것으로 예상한 단어를 적어서는 안 됩니다.
  • 의미 있는 소리: 이해에 영향을 줄 때는 [laughter][door closes][phone rings] 처럼 간결한 소문자 설명을 사용하세요.
  • 침묵과 멈춤: 지속 시간이나 대화상 영향이 결과물에 중요할 때만 표시하세요.

IBM은 교차 발화나 중첩 발화가 혼합 오디오에서 정확하게 인식되기 어렵거나 불가능할 수 있다고 경고합니다. 또한 짧은 발화, 잡음, 지배적인 화자, 많은 참여자도 화자 레이블 성능을 저하시킬 수 있습니다. 녹음 채널이 분리되어 있으면 누가 말했는지 추론할 필요를 줄일 수 있지만, 그래도 채널 정렬과 QA는 필요합니다.

자동 화자 식별의 한계는 무엇인가요?

자동 시스템은 세분화와 원본 탐색을 빠르게 할 수 있지만, 화자 분리 결과는 잠정적인 메타데이터입니다. 최종 신원 기록이 아니라 검토 대기열로 취급하세요.

자동 화자 레이블 실패 모드
실패발생 이유겉으로 드러나는 증상검토자 조치
화자 전환 오류비슷한 목소리 또는 전환이 부드럽지 않음한 사람의 문장이 다른 레이블 아래 나타남전환 전후를 다시 재생하고 영향을 받은 전체 구간을 수정합니다.
가짜 화자잡음 또는 목소리 변화새 사람이 들어오지 않았는데도 새 레이블이 나타남가까운 발화와 목소리를 대조해 확인한 뒤에만 병합합니다.
누락된 화자짧은 발언 또는 지배적인 주 화자짧은 참여자가 주된 목소리로 할당됨끼어들기와 맞장구를 수동으로 검토합니다.
중첩 붕괴단일 혼합 채널두 목소리가 하나의 끊어진 문장이 됨가능한 경우 구간 재생이나 분리 트랙을 사용합니다.
임시 레이블 드리프트더 많은 오디오가 들어오면서 모델이 추정치를 수정함부분 출력과 최종 출력 사이에서 화자 번호가 바뀜최종 원고에서 신원 매핑을 수행한 뒤 표준화합니다.

할 수 있는 것: 화자 전환 검토의 우선순위를 정하기 위해 화자 분리를 사용합니다. 할 수 없는 것: 소스를 듣지 않고도 모든 목소리, 끼어듦, 이름이 정확하다고 약속하는 것입니다.

화자 레이블과 타임스탬프에 대한 사람 검수 QA는 어떻게 진행하나요?

파일을 선형으로 처음부터 끝까지 다시 재생하기보다, 고위험 자료부터 시작하세요: 결정, 의무, 이름, 날짜, 숫자, 인용문, 외부 약속, 그리고 목소리가 겹치는 지점입니다. 그런 다음 전체 문서를 표준화합니다.

  1. 명단과 스타일을 준비합니다. 예상 화자, 승인된 이름 또는 역할, 출력 형식, 타임스탬프 세분성, 이벤트 표식 규칙, 개인정보 제한 사항을 나열합니다.
  2. 알려진 목소리를 기준점에 연결합니다. 자기소개나 검증된 다른 원본 순간을 사용해 목소리를 실제 이름과 연결합니다. 화자 분리 번호만 보고 신원을 추론해서는 안 됩니다.
  3. 화자 변경을 검토합니다. 첫 전환과 모든 고위험 결정, 인용, 담당자, 마감일, 짧은 확인 발화, 끼어들기를 다시 재생합니다.
  4. 중첩과 불확실성을 해결합니다. 이해 가능한 동시 발화를 보존하고, 유용한 중첩이나 소리 이벤트는 일관되게 표시하며, 증거가 부족할 때는 Unknown speaker 또는 inaudible 표식을 유지합니다.
  5. 타임스탬프 정렬을 확인합니다. 발화 시작 또는 구간 타임스탬프가 올바른 원본 순간을 여는지, 그리고 자막 큐의 시작·끝·읽기 순서가 오디오와 일치하는지 확인합니다.
  6. 문서를 표준화합니다. 레이블 철자, 대문자 표기, 구두점, 타임스탬프 패턴, 이벤트 표식 스타일을 결과물 전체에 하나로 통일합니다.
  7. 파생 출력을 다시 확인합니다. 레이블이나 시간을 수정한 뒤에는 요약, 작업 항목, 인용문, 내보내기, 인용된 답변까지 확인해 오류가 하위 단계로 남지 않게 합니다.

가장 빠른 방어 가능한 워크플로: 안정적인 생성 레이블과 발화 시작 타임스탬프를 사용하고, 각 목소리의 소개나 첫 번째 명확한 샘플을 확인한 뒤, 모든 고영향 전환을 검토한 다음, 레이블을 전역적으로 이름 변경하세요. 결과물이 고위험이라면 첫 번째 패스가 완전하다고 가정하기보다 두 번째 검토자나 문서화된 샘플링 규칙을 사용하세요.

측정: Google 및 Bing SERP와 Google Cloud, IBM Cloud, W3C, DCMP, FCC 페이지를 2026-08-05에 검토했습니다. N/A: 오디오 업로드, 화자 분리 출력, 제품 정확도, 검토자 합의, 처리 속도, 로그인한 기능 사용 가능 여부.

올바른 화자 레이블과 타임스탬프, 중첩, 알 수 없는 화자를 위한 사람 검수 워크플로
모든 줄을 다듬기 전에 신원과 고위험 원본 순간을 확인하세요.

화자 레이블, 타임스탬프, 인용은 어떻게 서로를 검증하나요?

레이블, 원본 시간, 파생 답변을 하나의 연결고리로 검토할 수 있을 때 전사본은 출처에 기반한 문서가 됩니다. 작업 항목이나 AI 답변이 여전히 이전 담당자를 담고 있다면, 전사본만 고쳐서는 충분하지 않습니다.

통제된 편집 시연; 제품 측정 N/A.

00:09 Maya Chen: "The pilot starts September 22."
00:24 Speaker 2: "I will send the access list by September 15."
00:41 Maya Chen: "Procurement approval is still open."

검토 경로: 00:24를 열고, 목소리를 Luis Ortiz의 검증된 소개와 비교한 뒤, Speaker 2를 Luis Ortiz로 변경하고, 파생 출력을 모두 다시 실행하거나 재검토하세요.

수정된 작업 항목: Luis Ortiz - 액세스 목록을 보내기 - 기한 9월 15일 - 출처 00:24.

인용된 답변: "액세스 목록의 소유자는 누구인가요?" Luis Ortiz [00:24].

수정은 대본, 요약, 작업 항목, 내보내기, 인용된 답변이 모두 Luis를 사용할 때에만 완료됩니다. 신원을 확인할 수 없다면, 정직한 답변은 Speaker 2가 작업을 담당하며, 출처는 00:24이고 신원 확인 대기 중이라는 것입니다.

HiNoter는 이 워크플로에서 어디에 해당하나요?

HiNoter는 승인된 회의, YouTube 동영상, PDF, 비디오 및 오디오를 구조화된 노트와 인용된 답변으로 바꾸는 AI 회의 및 다중 소스 노트 도구입니다.

회의나 파일이 처리 승인되면, HiNoter는 화자 라벨이 포함된 대본 탐색, 타임스탬프 재생, 라벨 수정, 구조화된 요약, 작업 항목, 그리고 출처 시점으로 되돌아가는 AI Chat 답변에 대해 평가될 수 있습니다. 출처 링크는 수정을 검토 가능하게 만들 뿐, 원래의 자동 라벨을 완벽하게 보장하지는 않습니다.

사용자 제공 / 게시 전 확인 필요: 화자 라벨 편집, 타임스탬프 탐색, 자동 출석 확인, 대본 생성, 처리 속도, 언어 지원, 구조화된 노트, 통합 기능, 출처 연결 AI Chat은 이 페이지를 위해 로그인된 HiNoter 계정에서 테스트되지 않았습니다. 현재 동작, 계정 플랜, 내보내기 형식, 개인정보 보호 제어, 출처 접근, 수정 전파, 삭제 옵션을 게시 전에 확인하세요.

HiNoter를 방문해 HiNoter오디오-텍스트 워크플로를 테스트하고, AI 회의 노트를 비교하며, AI Chat 출처 참조를 검토하고, 개인정보 보호 정책을 확인하고, Google Docs 통합을 살펴보세요. 관련 다국어 대본 워크플로는 화자 귀속과 언어 간 의미가 별개의 품질 검토 항목임을 설명합니다.

HiNoter 화자 라벨 타임스탬프 수정 및 출처 인용 AI Chat 워크플로
출처 기반 워크플로를 사용하면 검토자가 라벨 수정을 최종 답변까지 추적할 수 있습니다.

어떤 개인정보 보호 및 권한 확인이 필요한가요?

화자 라벨은 음성, 이름, 역할, 발언, 시간 정보를 연결함으로써 일반 대본을 개인 데이터로 바꿀 수 있습니다. 본인이 소유했거나 사용할 권한이 있는 오디오만 처리하고, 필요할 때 참가자에게 알리며, 대본과 원본 녹음은 필요한 사람에게만 제한하세요.

  • 녹음, 전사, 화자 식별, 이후 AI 처리의 목적을 문서화하세요.
  • 연구 또는 개인정보 보호 설계에서 비식별화가 필요할 때는 이름 대신 참가자 코드를 사용하세요.
  • 음성으로 민감한 신원 특성을 추론하지 마세요.
  • 익명 참가자 코드와 실제 이름을 매핑하는 명단에 대한 접근을 제한하세요.
  • 대본과 원본 오디오 모두에 보존 및 삭제 규칙을 적용하세요.
  • 법률, 인사, 의료, 고객, 또는 규제 대상 자료의 경우 책임 있는 개인정보 보호 또는 컴플라이언스 담당자와 상의하세요.

이것은 워크플로 가이드이며 법률 자문이 아닙니다. 실제 참가자, 관할권, 사용 사례에 대해 제품 개인정보 보호 약관과 현지 녹음 또는 생체 정보 규칙을 검토해야 합니다.

자주 묻는 질문

전사에서 화자 라벨이란 무엇인가요?

전사에서 화자 라벨은 발화 턴을 담당한 사람, 역할, 또는 익명 음성을 식별합니다. 예로는 Maya Chen, Interviewer, Speaker 2, Unknown speaker가 있습니다. 라벨은 일관되게 유지되어야 하며, 출처나 프로젝트 기록으로 해당 신원이 검증되지 않는 한 실제 신원을 주장해서는 안 됩니다.

어떤 화자 라벨이 올바른가요?

올바른 화자 라벨은 근거가 뒷받침하는 가장 구체적인 라벨입니다: 신원이 중요할 때는 검증된 이름, 역할만으로 충분할 때는 역할, 화자 분리만 이루어진 경우에는 안정적인 익명 번호, 신원을 확인할 수 없을 때는 Unknown speaker입니다. 일관성과 검증 가능성이 장식적인 형식보다 더 중요합니다.

올바른 화자 라벨 형식은 무엇인가요?

가독성 있는 대본에서는 각 발화의 시작 부분에 콜론이 뒤따르는 하나의 라벨을 사용하세요. 예: [00:09] Maya Chen: 시범은 9월 22일에 시작됩니다. 자막의 경우 대상 파일 사양을 따르세요. WebVTT는 큐의 화자를 식별하는 voice span을 지원합니다. 의뢰인, 법원, 방송사, 또는 연구 프로젝트는 다른 내부 스타일을 요구할 수 있습니다.

전사에서 시간 참조는 어디에 표시해야 하나요?

일반 대본에서는 발화 시작 타임스탬프를 화자 라벨 바로 앞에 두세요. 편집자가 정확한 경계를 필요로 할 때는 시작-끝 구간을 사용하고, 프로젝트에서 요청한 경우에만 주기적 타임스탬프를 사용하며, 자막에는 큐 구간을 사용하세요. 단어 단위 시간은 각 단어 앞에 인쇄하기보다 기계가 읽을 수 있는 정렬 데이터로 보관하는 것이 가장 좋습니다.

겹치는 발화나 알 수 없는 화자는 어떻게 라벨링해야 하나요?

말이 알아들을 수 있을 때는 두 발화를 모두 보존하고 각각에 시간 구간을 부여하세요. 검토자가 도움이 된다고 판단할 때는 [overlapping speech] 같은 일관된 상태 표시를 추가하세요. 음성이나 단어를 확인할 수 없으면 유력한 이름을 지정하거나 텍스트를 만들어내지 말고 Unknown speaker 또는 [inaudible 00:24]를 사용하세요.

HiNoter는 화자 라벨과 타임스탬프를 어떻게 처리하나요?

승인 후 HiNoter는 대본 탐색, 화자 라벨 편집, 구조화된 노트, 작업 항목, 그리고 출처 타임스탬프로 돌아가는 AI Chat 답변에 대해 평가될 수 있습니다. 이러한 제품 동작은 이 글을 위한 사용자 제공 정보이며, 게시 전에 현재 제품, 플랜, 개인정보 보호 제어, 출처 링크 워크플로에서 확인해야 합니다.

승인된 대본을 원본과 대조해 확인하기

먼저 위의 통제된 예시를 검토하세요. 그런 다음 HiNoter에서 승인된 회의 또는 파일 하나를 처리하고, 화자 라벨을 수정한 뒤, 출처 타임스탬프를 열고, 요약, 작업 항목, AI Chat 답변에 수정된 귀속이 반영되었는지 확인하세요.

승인된 회의 또는 파일 처리하기 | 출처 연결 AI Chat 보기