화자 레이블과 타임스탬프는 대본을 검색 가능하고, 발언자를 식별할 수 있으며, 검증하기 쉽게 만들지만, 형식이 결과물에 맞을 때만 그렇습니다. 알려진 참가자에게는 확인된 이름을 사용하고, 신원 확인이 불필요할 때는 역할 레이블을 사용하며, 목소리만 구분하면 될 때는 일관된 익명 레이블을 사용하고, 신원을 확인할 수 없을 때는 알 수 없는 화자를 사용하세요. 읽기 쉬운 대본에서는 화자가 바뀔 때마다 타임스탬프를 추가하고, 편집이나 증거에는 시작-종료 구간을, 자막에는 큐 구간을 사용하세요. 이 가이드는 용어를 정의하고, 형식을 비교하며, 겹치는 발화를 처리하고, 반복 가능한 사람 중심 QA 워크플로를 제시합니다.
직접적인 답변: 화자 레이블은 각 발화 차례를 식별하고, 타임스탬프는 해당 발화 차례를 출처의 특정 시점과 연결합니다. 가장 빠르고 신뢰할 수 있는 기본값은 확인된 이름 또는 일관된 역할 레이블에 발화 시작 타임스탬프를 더하는 것으로, 예를 들면 [00:09] Maya Chen:과 같습니다. 편집에는 구간을, 자막에는 큐 시간을 사용하고, 신원을 추측하는 대신 알 수 없는 화자를 사용하세요.
정의: 화자 레이블과 타임스탬프는 발화를 일관된 사람이나 역할에 귀속시키고, 단어·발화 차례 또는 자막 큐를 원본 오디오의 정확한 위치와 연결하는 대본 메타데이터입니다.

화자 레이블과 타임스탬프란 무엇인가요?
화자 레이블과 타임스탬프는 서로 다른 두 가지 질문에 답합니다: 누가 한 구절에 책임이 있는지와 해당 구절이 출처의 어디에 있는지입니다. 시스템이 목소리를 정확하게 찾아내고 분리하면서도 실제 인물의 이름을 잘못 지정할 수 있으므로, 유용한 대본은 이 두 질문을 구분합니다.
| 용어 | 간단한 정의 | 확인할 수 있는 내용 | 단독으로 확인할 수 없는 내용 |
|---|---|---|---|
| 화자 분할 | 목소리별로 오디오를 분할하고 화자 차례에 일관된 생성 레이블을 할당합니다. | 감지된 다른 목소리와 관련하여 언제 누가 말했는지. | 그 사람의 확인된 이름, 역할, 권한 또는 의도. |
| 화자 식별 | 감지된 목소리를 확인된 실제 인물 또는 프로젝트 역할에 연결합니다. | 명단, 소개 또는 알려진 녹음으로 뒷받침되는 사람이 읽을 수 있는 레이블. | 목소리가 겹치거나 증거가 불명확할 때의 완벽한 귀속. |
| 타임스탬프 구간 | 단어, 발화 차례, 구간 또는 자막 큐의 시작 및 종료 시간. | 텍스트와 연결된 출처의 시간 창. | 단어나 화자 레이블이 정확한지 여부. |
| 이벤트 표기 | [웃음], [문 닫힘], [겹치는 발화] 또는 [들리지 않음 00:24]와 같이 의미 있는 소리나 출처 상태를 나타내는 일관된 표기입니다. | 말로 한 단어만으로는 포착할 수 없는 맥락. | 들리지 않은 단어나 확인되지 않은 신원. |
Google Cloud는 분할을 화자 변화를 감지하고 서로 다른 목소리에 레이블을 할당하는 것으로 설명합니다. IBM의 문서는 한 단계 더 나아가 생성된 ID가 순차적이지 않을 수 있고, 중간 ID가 변경될 수 있으며, 다른 증거 출처가 없을 때 동일한 레이블을 확인된 이름으로 해석해서는 안 된다고 설명합니다.
출처: Google Cloud: 서로 다른 화자 감지 및 IBM Cloud: 화자 레이블, 2026-08-05 검토.

전사에서 올바른 화자 레이블은 무엇인가요?
올바른 화자 레이블은 증거가 뒷받침하는 가장 구체적인 귀속으로, 처음부터 끝까지 일관되게 사용됩니다. 시각적 스타일은 부차적입니다. 레이블은 의도한 독자가 확실성을 과장하지 않고 발화 차례를 구분하는 데 도움이 되어야 합니다.
| 사용 가능한 근거 | 권장 레이블 | 예시 | 확인 규칙 |
|---|---|---|---|
| 신원이 확인되었고 관련성이 있음 | 확인된 전체 이름 | Maya Chen: | 자기소개, 승인된 명단 또는 알려진 기준 음성과 대조합니다. |
| 이름보다 역할이 중요함 | 일관된 역할 | 면접관: | 역할을 확인하고 전체 문서에서 하나의 표기를 사용합니다. |
| 음성은 분리되었지만 신원을 알 수 없음 | 익명 식별자 | 화자 2: | 매핑을 일관되게 유지하고, 숫자가 시간순이라는 가정을 하지 않습니다. |
| 신원을 확인할 수 없음 | 명시적 불확실성 | 알 수 없는 화자: | 오디오 또는 프로젝트 기록이 수정을 뒷받침할 때까지 알 수 없는 상태로 둡니다. |
가능: 음성이 확인된 후 익명 레이블의 이름을 변경할 수 있습니다. 불가능: 화자 분리 번호, 표시 순서, 억양, 다른 사람이 언급한 직함 또는 추정되는 음성을 신원 확인의 증거로 간주할 수 없습니다.
자막에서는 화면상의 배치만으로도 이름을 반복하지 않고 화면에 나오는 화자를 식별할 수 있습니다. DCMP는 명확한 화자 식별과 일관된 표시를 권장하며, 화자 ID로 사용되는 고유명사는 대문자로 시작하고 일반적인 식별 정보는 보통 소문자로 표기한다고 설명합니다. 일반 트랜스크립트에서는 이름을 일반적인 방식으로 대문자 표기한 다음 콜론을 사용할 수 있습니다.
출처: DCMP 자막 작성 지침, 2026-08-05 검토.

어떤 화자 레이블 형식이 올바른가요?
보편적인 화자 레이블 형식은 없습니다. 올바른 형식은 목적지가 요구하는 형식이며 일관되게 적용되는 형식입니다. 문서에는 읽기 쉬운 발화 레이블을, WebVTT에는 기계가 읽을 수 있는 음성 주석을 사용하고, 법원, 방송사, 연구 프로젝트, 접근성 제공업체 또는 아카이브에서 형식을 정한 경우에는 고객의 정확한 스타일을 사용합니다.
| 제출물 | 권장 패턴 | 예시 | 주요 제한 사항 |
|---|---|---|---|
| 읽기 쉬운 트랜스크립트 | 타임스탬프 + 확인된 레이블 + 콜론 | [00:09] Maya Chen: 파일럿은 9월 22일에 시작합니다. | 자막 파일이 아니며 단어 단위 정렬도 아닙니다. |
| 역할 기반 인터뷰 | 일관된 역할 + 콜론 | 면접관: 무엇이 바뀌었나요? | 연구 설계상 이름을 사용한 귀속이 필요한 경우 신원을 숨길 수 있습니다. |
| 익명 연구 트랜스크립트 | 참여자 코드 | P03: 인계가 불명확했습니다. | 코드는 개인 신원 정보와 별도로 관리해야 합니다. |
| WebVTT 자막 | 큐 구간 + 음성 범위 | <v Maya Chen>파일럿은 9월 22일에 시작합니다. | 플레이어 지원 및 자막 배치 규칙도 여전히 중요합니다. |
같은 음성에 대해 Maya, M. Chen, 화자 1, 관리자를 번갈아 사용하지 마세요. 검토 중간에 신원이 수정되었다면 이전의 모든 발화를 업데이트하고, 이전 레이블에서 파생된 요약, 작업 항목, 인용문 또는 답변을 다시 확인하세요.
트랜스크립션에서 시간 참조는 어디에 표시해야 하나요?
여러 화자가 등장하는 읽기 쉬운 트랜스크립트에 가장 빠르고 유용한 기본값은 화자 레이블 바로 앞에 발화 시작 타임스탬프를 표시하는 것입니다. 발화가 넘어갈 때마다 검토자에게 한 번의 클릭 또는 스크럽 지점을 제공하면서 모든 문장에 시간 데이터를 넣는 일은 피할 수 있습니다. 다음 작업에 필요한 경우에만 다른 수준을 선택하세요.
| 시간 참조 유형 | 예시 | 적합한 용도 | 절충점 |
|---|---|---|---|
| 섹션 또는 장 | 00:15:00 조달 위험 | 팟캐스트, 강의 또는 긴 회의 탐색 | 인용문 확인에는 너무 거칠다. |
| 발화 시작 | [00:02:14] Maya Chen: | 읽기 쉬운 인터뷰 및 회의 녹취록 | 정확한 종료 시점을 보여 주지 않는다. |
| 발화 구간 | [00:02:14-00:02:19] | 편집, 증거 검토 및 겹치는 발화 | 시각적 잡음이 더 많다. |
| 자막 큐 구간 | 00:02:14.000 --> 00:02:19.000 | WebVTT 표시 타이밍 | 유효한 큐 문법과 읽기 쉬운 분할이 필요하다. |
| 단어 수준 오프셋 | "pilot" 134.2s-134.7s | 정렬, 검색 및 자동 QA | 일반적으로 표시되는 문장에는 부적합하다. |
Google Cloud는 인식된 단어의 시작 및 종료 오프셋을 제공합니다. W3C WebVTT는 큐를 오디오 또는 비디오에 맞춰 정렬된 시간 구간으로 정의하며, 00:11.000 --> 00:13.000과 같이 밀리초에 마침표를 사용합니다. 녹취록의 대괄호는 편집상의 관례일 뿐 WebVTT의 요구 사항은 아닙니다.
할 수 있는 것: 표시할 때는 발화 수준 타임스탬프만 사용하면서 단어 수준 타이밍을 저장할 수 있습니다. 할 수 없는 것: 더 세분화된 타이밍만으로 인식이나 발화자 귀속이 정확하다고 단정할 수는 없습니다.
출처: Google Cloud: Word time offsets 및 W3C WebVTT, 2026-08-05 검토.

완전 축어록, 지능형 축어록 및 자막은 어떻게 다른가?
같은 원본 오디오에서도 각 형식의 목적이 다르기 때문에 세 가지 유효한 결과물을 만들 수 있습니다. 완전 축어록은 말하기의 특성을 보존하고, 지능형 축어록은 의미와 발화자 귀속을 유지하면서 읽기 쉽게 만들며, 자막은 동기화된 표시를 위해 텍스트를 분할합니다.
통제된 편집용 원본 샘플: 00:09.100에 Maya가 "음, 그러니까, 내 생각에는 파일럿이 9월 22일에 시작해."라고 말합니다. 00:11.500에 Luis가 "조달 승인 대기 중이야."라고 겹쳐 말합니다. 00:13.300에 Maya가 "맞아."라고 말합니다. 이는 구성된 QA 샘플이며, 실제 제품 테스트에 로그인한 것이 아닙니다.
완전 축어록
[00:09.100-00:12.700] Maya: 음, 그러니까, 내 생각에는 파일럿이 9월 22일에 시작해.
[00:11.500-00:13.200] Luis: [겹치는 발화] 조달 승인 대기 중이야.
[00:13.300-00:13.800] Maya: 맞아.
반복, 추임새, 멈춤, 끼어들기 및 발화 경쟁이 분석 또는 프로젝트 사양의 일부일 때 이 수준을 사용하세요. 스타일 시트에서 모든 표기법을 정의하세요.
지능형 축어록
[00:09] Maya: 내 생각에는 파일럿이 9월 22일에 시작해.
[00:11] Luis: [겹치는 발화] 조달 승인 대기 중이야.
[00:13] Maya: 맞아.
이 버전은 비유창한 표현을 제거하지만 Luis의 조건을 Maya의 문장에 합치지는 않습니다. 언어를 다듬더라도 발언의 주체를 바꿔서는 안 됩니다.
WebVTT 자막 발췌
WEBVTT
00:09.100 --> 00:12.700
<v Maya>내 생각에는 파일럿이 9월 22일에 시작해.
00:11.500 --> 00:13.200
<v Luis>조달 승인 대기 중이야.
00:13.300 --> 00:13.800
<v Maya>맞아.
WebVTT는 시작-종료 큐 타이밍을 사용하며 음성 스팬을 지원합니다. 자막 제작에서는 읽기 속도, 줄바꿈, 배치 및 동시 큐도 고려해야 합니다. DCMP는 동기화, 내용 동등성, 발화자 식별 및 의미 있는 소리 정보를 권장하며, FCC의 텔레비전 자막 규칙은 정확성, 동기성, 완전성 및 적절한 배치라는 검토 원칙을 사용합니다.
출처: W3C WebVTT, DCMP Captioning Key 및 47 CFR 79.1, 2026-08-05 검토. CFR 자막 품질 규칙은 해당 규정에서 정의한 텔레비전 맥락에 적용됩니다. 이 글에서는 네 가지 품질 용어를 보편적인 법적 주장으로서가 아니라 검토 기준으로 사용합니다.

겹치는 발화, 알 수 없는 발화자 및 이벤트 표시는 어떻게 처리해야 하는가?
겹치는 발화는 녹취 문제인 동시에 귀속 문제이기도 합니다. 두 목소리를 모두 명확하게 알아들을 수 있다면 교차하는 구간으로 두 발화를 모두 보존하세요. 한 목소리만 명확하게 알아들을 수 있다면 해당 목소리만 전사하고, 독자에게 도움이 될 때만 그 상태를 표시하세요. 어느 쪽도 신뢰할 수 없다면 원본을 들을 수 없음으로 표시하고 QA 중에 다시 확인하세요.
- 겹치는 식별 가능한 발화: 레이블과 시간 구간을 별도로 유지하고, 두 화자를 하나의 문장으로 결합하지 마세요.
- 짧은 맞장구: "yes," "right," 및 "mm-hmm"을 주의 깊게 확인하세요. 화자 분할은 짧은 발화를 잘못 할당하는 경우가 많기 때문입니다.
- 신원을 알 수 없는 경우: 가능성이 높은 이름 대신
Unknown speaker:또는 일관된 익명 ID를 사용하세요. - 불명확한 단어:
[inaudible 00:24]과 같이 프로젝트에서 정의한 표식을 사용하세요. 검토자가 들었을 것으로 예상한 단어를 절대 적지 마세요. - 의미 있는 소리: 이해에 영향을 미치는 경우
[laughter],[door closes], 또는[phone rings]과 같이 간결한 소문자 설명을 사용하세요. - 침묵과 멈춤: 지속 시간이나 대화에 미치는 영향이 결과물에 중요할 때만 표시하세요.
IBM은 혼합 오디오에서 겹쳐 말하는 발화나 중첩을 정확하게 인식하기 어렵거나 불가능할 수 있다고 경고합니다. 짧은 발화, 소음, 지배적인 화자, 많은 참여자 역시 화자 레이블 성능을 저하시킬 수 있습니다. 별도로 녹음된 채널을 사용하면 누가 말했는지 추론해야 할 필요를 줄일 수 있지만, 채널은 여전히 정렬과 QA가 필요합니다.
자동 화자 식별의 한계는 무엇인가요?
자동 시스템은 구간 분할과 소스 탐색을 가속할 수 있지만, 화자 분할 결과는 잠정적인 메타데이터입니다. 이를 최종 신원 기록이 아니라 검토 대기열로 취급하세요.
| 오류 | 발생 이유 | 눈에 보이는 증상 | 검토자 조치 |
|---|---|---|---|
| 화자 뒤바뀜 | 비슷한 목소리 또는 불명확한 교대 | 한 사람의 문장이 다른 레이블 아래에 표시됨 | 뒤바뀐 지점 전후를 다시 재생하고 영향을 받은 전체 구간을 수정하세요. |
| 유령 화자 | 소음 또는 목소리 변화 | 새로운 사람이 참여하지 않았는데 새 레이블이 나타남 | 주변 발화와 목소리를 확인한 후에만 병합하세요. |
| 화자 누락 | 짧은 발언 또는 지배적인 주 화자 | 짧게 발언한 참여자가 주된 목소리로 할당됨 | 끼어들기와 맞장구를 수동으로 검토하세요. |
| 중첩 발화 병합 | 단일 혼합 채널 | 두 목소리가 하나의 끊긴 문장이 됨 | 가능한 경우 구간 재생 또는 별도 트랙을 사용하세요. |
| 임시 레이블 변동 | 더 많은 오디오가 들어오면서 모델이 추정치를 수정함 | 부분 결과와 최종 결과 사이에서 화자 번호가 바뀜 | 최종 전사본에서 신원 매핑을 수행한 다음 정규화하세요. |
할 수 있는 일: 화자 변경 검토의 우선순위를 정하기 위해 화자 분할을 사용하세요. 할 수 없는 일: 소스를 직접 듣지 않고 모든 목소리, 끼어들기 또는 이름이 정확하다고 보장할 수는 없습니다.
화자 레이블과 타임스탬프에 대한 사람의 QA는 어떻게 수행하나요?
파일을 처음부터 순서대로 재생하기보다 결정, 의무, 이름, 날짜, 숫자, 인용문, 외부에 한 약속, 목소리가 겹치는 지점 등 위험도가 높은 자료부터 시작하세요. 그런 다음 전체 문서를 정규화하세요.
- 명단과 스타일을 준비하세요. 예상 화자, 승인된 이름 또는 역할, 출력 형식, 타임스탬프 세분성, 이벤트 표식 규칙, 개인정보 보호 제한을 나열하세요.
- 알려진 목소리를 기준점으로 삼으세요. 자기소개나 검증된 다른 소스의 순간을 사용하여 목소리와 실제 이름을 연결하세요. 화자 분할 번호로 신원을 추론하지 마세요.
- 화자 변경을 검토하세요. 첫 번째 교대와 모든 고위험 결정, 인용문, 담당자, 기한, 짧은 확인 발언 및 끼어들기를 다시 재생하세요.
- 중첩과 불확실성을 해결하세요. 식별 가능한 동시 발화를 보존하고, 유용한 중첩이나 소리 이벤트를 일관되게 표시하며, 근거가 부족할 때는 Unknown speaker 또는 inaudible 표식을 유지하세요.
- 타임스탬프 정렬을 확인하세요. 발화 시작 또는 구간 타임스탬프가 올바른 소스 순간을 열고, 캡션 큐의 시작과 끝 및 읽기 순서가 오디오와 일치하는지 확인하세요.
- 문서를 정규화하세요. 결과물 전체에 하나의 레이블 철자, 대소문자, 구두점, 타임스탬프 패턴 및 이벤트 표식 스타일을 적용하세요.
- 파생 결과물을 다시 확인하세요. 레이블이나 시간을 수정한 후 요약, 실행 항목, 인용문, 내보내기 파일 및 인용된 답변을 확인하여 오류가 후속 결과에 남지 않도록 하세요.
가장 빠르고 방어 가능한 워크플로: 안정적으로 생성된 레이블과 발화 시작 타임스탬프를 사용하고, 각 목소리의 소개 또는 첫 번째 명확한 샘플을 확인하며, 영향이 큰 모든 교대를 검토한 다음 레이블을 전체적으로 변경하세요. 결과물의 위험도가 높다면 첫 번째 검토가 완전하다고 가정하지 말고 두 번째 검토자나 문서화된 샘플링 규칙을 사용하세요.
측정 범위: Google 및 Bing SERP와 Google Cloud, IBM Cloud, W3C, DCMP 및 FCC 페이지를 2026-08-05에 검토했습니다. 해당 없음: 오디오 업로드, 화자 분할 결과, 제품 정확도, 검토자 간 일치도, 처리 속도 및 로그인 상태에 따른 기능 이용 가능 여부.

화자 레이블, 타임스탬프 및 인용은 서로를 어떻게 검증하나요?
레이블, 소스 시간 및 파생된 답변을 하나의 연결 고리로 확인할 수 있을 때 전사본은 소스에 근거하게 됩니다. 실행 항목이나 AI 답변에 이전 담당자가 여전히 남아 있다면 전사본을 수정하는 것만으로는 충분하지 않습니다.
통제된 편집 시연; 제품 측정 해당 없음.
00:09 Maya Chen: "The pilot starts September 22."
00:24 Speaker 2: "I will send the access list by September 15."
00:41 Maya Chen: "Procurement approval is still open."
검토 경로: 00:24를 열고 Luis Ortiz의 검증된 소개와 목소리를 비교한 다음 Speaker 2를 Luis Ortiz로 변경하고 모든 파생 결과물을 다시 실행하거나 재확인하세요.
수정된 실행 항목: Luis Ortiz - 액세스 목록 보내기 - 마감일 9월 15일 - 출처 00:24.
인용된 답변: "액세스 목록을 담당하는 사람은 누구인가요?" Luis Ortiz [00:24].
트랜스크립트, 요약, 실행 항목, 내보내기, 인용된 답변이 모두 Luis를 사용할 때만 수정이 완료됩니다. 신원을 확인할 수 없다면, 정직한 답변은 Speaker 2가 해당 작업을 담당하며 출처는 00:24이고 신원 확인이 보류 중이라는 것입니다.
이 워크플로에서 HiNoter는 어떤 역할을 하나요?
HiNoter는 승인된 회의, YouTube 동영상, PDF, 동영상 및 오디오를 구조화된 노트와 인용된 답변으로 변환하는 AI 회의 및 다중 소스 노트 도구입니다.
회의 또는 파일의 처리가 승인되면 HiNoter를 화자 레이블이 지정된 트랜스크립트 탐색, 타임스탬프 재생, 레이블 수정, 구조화된 요약, 실행 항목, 그리고 소스의 특정 시점으로 연결되는 AI Chat 답변에 대해 평가할 수 있습니다. 소스 링크는 수정을 검토할 수 있게 하지만, 원래의 자동 레이블이 틀림없다는 의미는 아닙니다.
사용자 제공 정보 / 게시 전 확인: 화자 레이블 편집, 타임스탬프 탐색, 자동 참석자 기록, 트랜스크립트 생성, 처리 속도, 언어 지원, 구조화된 노트, 통합 기능, 소스에 연결된 AI Chat은 이 페이지를 위해 로그인된 HiNoter 계정에서 테스트되지 않았습니다. 게시 전에 현재 동작, 계정 요금제, 내보내기 형식, 개인정보 보호 제어, 소스 액세스, 수정 사항의 전파 및 삭제 옵션을 확인하세요.
HiNoter를 방문하고 오디오-텍스트 워크플로를 테스트하며, AI 회의 노트를 비교하고, AI Chat 소스 참조를 검사하고, 개인정보 처리방침을 검토한 다음 Google Docs 통합을 확인하세요. 관련 다국어 트랜스크립트 워크플로에서는 화자 귀속과 언어 간 의미가 서로 별도의 품질 확인 항목인 이유를 설명합니다.

어떤 개인정보 보호 및 권한 확인이 필요한가요?
화자 레이블은 음성, 이름, 역할, 발언 및 시간을 연결하여 일반적인 트랜스크립트를 개인정보로 바꿀 수 있습니다. 소유하고 있거나 사용 권한이 있는 오디오만 처리하고, 필요한 경우 참가자에게 알리며, 트랜스크립트와 소스 녹음에 대한 접근을 필요한 사람으로 제한하세요.
- 녹음, 트랜스크립션, 화자 식별 및 후속 AI 처리의 목적을 문서화하세요.
- 연구 또는 개인정보 보호 설계에서 비식별화가 필요한 경우 이름 대신 참가자 코드를 사용하세요.
- 음성으로부터 민감한 신원 특성을 추론하지 마세요.
- 익명 참가자 코드를 실제 이름에 매핑하는 명단에 대한 접근을 제한하세요.
- 트랜스크립트와 원본 오디오 모두에 보존 및 삭제 규칙을 적용하세요.
- 법률, 인사, 의료, 고객 또는 규제 대상 자료의 경우 담당 개인정보 보호 또는 컴플라이언스 책임자를 참여시키세요.
이는 워크플로 안내이며 법률 자문이 아닙니다. 실제 참가자, 관할권 및 사용 사례에 맞춰 제품 개인정보 보호 약관과 현지 녹음 또는 생체정보 관련 규정을 검토해야 합니다.
자주 묻는 질문
트랜스크립션에서 화자 레이블이란 무엇인가요?
트랜스크립션의 화자 레이블은 발화 차례를 담당한 사람, 역할 또는 익명의 음성을 식별합니다. 예로는 Maya Chen, Interviewer, Speaker 2 및 Unknown speaker가 있습니다. 레이블은 일관되게 유지해야 하며, 소스 또는 프로젝트 기록을 통해 신원이 확인되지 않은 경우 실제 신원을 주장해서는 안 됩니다.
어떤 화자 레이블이 올바른가요?
올바른 화자 레이블은 증거가 뒷받침하는 가장 구체적인 레이블입니다. 신원이 중요한 경우 확인된 이름을, 역할로 충분한 경우 역할을, 화자 분리로 음성만 구분된 경우 안정적인 익명 번호를, 신원을 확인할 수 없는 경우 Unknown speaker를 사용합니다. 장식적인 형식보다 일관성과 검증 가능성이 더 중요합니다.
올바른 화자 레이블 형식은 무엇인가요?
읽기 쉬운 트랜스크립트에서는 각 발화 시작 부분에 콜론이 뒤따르는 하나의 레이블을 사용하세요. 예: [00:09] Maya Chen: The pilot starts September 22. 자막의 경우 대상 파일 사양을 따르세요. WebVTT는 해당 큐의 화자를 식별하는 음성 범위를 지원합니다. 고객, 법원, 방송사 또는 연구 프로젝트에 따라 다른 하우스 스타일이 필요할 수 있습니다.
트랜스크립션에서 시간 참조는 어디에 표시해야 하나요?
일반적인 트랜스크립트에서는 화자 레이블 바로 앞에 발화 시작 타임스탬프를 표시하세요. 편집자에게 정확한 경계가 필요한 경우 시작-종료 구간을 사용하고, 프로젝트에서 요청한 경우에만 주기적인 타임스탬프를 사용하며, 자막에는 큐 구간을 사용하세요. 단어 단위 시간은 모든 단어 앞에 표시하기보다 기계 판독이 가능한 정렬 데이터로 보관하는 것이 좋습니다.
겹치는 화자 또는 알 수 없는 화자는 어떻게 레이블을 지정해야 하나요?
말을 알아들을 수 있다면 두 발화를 모두 보존하고 각각에 시간 구간을 부여하세요. 검토자에게 도움이 되는 경우 [overlapping speech]와 같은 일관된 상태 표시를 추가하세요. 음성이나 단어를 확인할 수 없다면 추정되는 이름을 지정하거나 텍스트를 만들어 내지 말고 Unknown speaker 또는 [inaudible 00:24]를 사용하세요.
HiNoter는 화자 레이블과 타임스탬프를 어떻게 처리하나요?
승인 후 HiNoter를 트랜스크립트 탐색, 화자 레이블 편집, 구조화된 노트, 실행 항목 및 소스 타임스탬프로 돌아가는 AI Chat 답변에 대해 평가할 수 있습니다. 이러한 제품 동작은 이 글을 위해 사용자가 제공한 정보이며, 게시 전에 현재 제품, 요금제, 개인정보 보호 제어 및 소스 링크 워크플로에서 확인해야 합니다.
승인된 트랜스크립트를 소스와 대조하여 확인하세요
먼저 위의 통제된 예시를 검토하세요. 그런 다음 HiNoter에서 승인된 회의 또는 파일 하나를 처리하고, 화자 레이블을 수정하고, 소스 타임스탬프를 연 다음, 요약, 실행 항목 및 AI Chat 답변에 수정된 귀속이 반영되는지 확인하세요.