発言者ごとに整理
一続きの文字起こしを話者ラベルで分け、会話の流れを読みやすくします。
話者分離
複数人の録音を話者ごとに整理。話者名を確認し、重要な発言は元音声に戻って確かめられます。
話者ラベルは完成品ではありません。録音環境や同時発話で誤りが生じることを前提に、名前と重要な発言を確認できる流れが必要です。
一続きの文字起こしを話者ラベルで分け、会話の流れを読みやすくします。
固有名詞、数字、引用など、間違えられない箇所を音声で確かめます。
話者名を確認し、読み手が発言の背景を追える記録にします。
DEFINITION
話者分離とは、複数人の会話が録音された音声を「誰がいつ話したか」の区間に分ける処理です。文字起こしと組み合わせると、一続きの文章が「話者A」「話者B」のように発言者ごとに区切られます。
似た言葉に話者識別があります。話者分離が「話者が切り替わった場所」を見つける処理だとすると、話者識別は「その区間を話したのは誰か」を名前と結びつけることです。Klangは録音を自動で話者ごとに区切り、そのうえで話者名を確認・修正できます。
BETTER RESULTS
話者分離の結果は、録音の仕方で大きく変わります。特別な機材は必要ありません。次の4点を録音前と文字起こし後に押さえておくと、確認の手間が減ります。
同時発話は話者分離が苦手とする場面です。会議の冒頭で「発言は一人ずつ」と決めておくと、文字起こしの区切りも読みやすくなります。
端末や録音機器を参加者の中央に置き、話者との距離を近づけます。特定の人だけ遠い配置は、その人の区間が曖昧になりやすいです。
録音の最初に参加者が名前を言うと、あとで話者ラベルと名前を照合する手がかりになります。オンライン会議でも同じです。
文字起こし後に話者ラベルへ名前をつけ、区切りが誤っている箇所は直します。名前をつけた記録は、読み手が誰の発言か迷わずに済みます。
01
端末を話者から遠ざけすぎず、空調音や机の振動、同時発話をできるだけ避けます。
02
音声または動画ファイルをアップロードし、話者ラベル付きの結果を作成します。
03
冒頭の自己紹介や会話の文脈を手がかりに、話者ラベルと名前を照合します。
04
決定事項、引用、固有名詞、数字は元音声で最終確認します。
複数人が含まれる音声を、話者ごとの区間に分けて文字起こしを整理する処理です。「話者A・話者B」のように区切るところまでが話者分離で、その区間に実際の名前を結びつけるのが話者識別です。
話者分離は「いつ話者が切り替わったか」を分ける処理、話者識別は「その区間を話したのは誰か」を決めることです。Klangは自動で区切ったうえで、話者名を確認・修正できます。
話者ラベルと実際の名前は、会話の文脈や自己紹介をもとに確認してください。重要な記録では人による確認が必要です。
同時発話、雑音、話者間の距離などにより結果は変わります。実際の録音で試し、重要箇所は元音声と照合してください。
無料プランはクレジットカード不要です。
無料で始める