同意と明確な開示を得てAI留守番電話音声を作成する方法
AI留守番電話音声を作成するには、想定される用途で許可されている合成音声を選択するか、話者の明示的な許可を得て音声を複製します。メールボックスを特定し、音声がAIによって生成されたものであることを明確に伝え、発信者にメッセージの残し方や別の連絡方法を案内する応答メッセージを作成します。発音を確認した上で、実際の通話を通じて応答メッセージをテストします。本ガイドは、日常的な個人用または小規模チーム用の留守番電話応答メッセージを設定する成人を対象としています。目的は、発信者がボイスメールを残す前に再生される固定の音声メッセージを作成することです。以下のワークフローは、情報源に裏付けられた同意と開示の原則に、実践的な録音のアドバイスを組み合わせたものです。
音声を選択し、メールボックスが応答メッセージをどのように受け付けるか確認する
まずは2つの決定から始めます。発信者に誰の声を聞かせたいか、そして録音をどのように設定(インストール)するかです。音声生成の料金を支払う前に、この両方を解決しておきましょう。
特定の人物の声に似せることにあまり価値がない場合は、既製のストック音声が現実的な出発点となります。クローン音声を使用する場合は、プロバイダーの実際の登録要件を確認してください。例えば、Microsoftのパーソナル音声に関するドキュメント(https://learn.microsoft.com/en-us/azure/ai-services/speech-service/personal-voice-overview)では、ユーザーの明示的な同意と、音声の作成および使用を承認する発言の録音が義務付けられています。また、同社のAPIアクセスは対象となる顧客および承認されたユースケースに限定されており、制限のない一般消費者向けの留守番電話ツールではありません。
次に、お使いの電話サービスの応答メッセージ設定を開きます。音声ファイルのアップロードに対応しているか、サービス独自のテキスト読み上げ機能を提供しているか、あるいはマイクによる録音が必要かを確認してください。アップロードがサポートされている場合は、書き出す前に対応フォーマット、ファイルサイズ、時間制限を確認しておきましょう。
すべてのサービスにアップロードボタンがあると思い込まないでください。Google Voiceの公式応答メッセージ設定手順(https://support.google.com/voice/answer/115069?hl=en)では、応答メッセージの録音、プレビュー、保存、およびアクティブなメッセージの選択について説明されています。サービスがマイクによる録音のみに対応している場合、生成された音声をそのマイクに向かって再生しても、満足のいく結果が得られない可能性があります。本番設定の前にテストしてください。明瞭な通常録音が有用な代替手段(フォールバック)となります。
話者の音声を複製する前に具体的な許可を得る
このワークフローでは、合成音声の作成と意図された用途の両方について話者から承認を得てください。別の目的で送信された録音音声を、再利用可能な音声モデルを構築するための許可と見なしてはなりません。
以下の質問に答える簡潔な書面記録を残しておきましょう:
範囲の例としては、「共有スタジオのメールボックス用に私が承認した応答メッセージを生成するために私の声を使用すること。文言を修正して生成したり、他の場所で声を使用したりする場合は、事前に私に確認すること」などが挙げられます。これは期待値を明確にするための実践的な方法であり、プロバイダーの登録プロセスの代わりになるものではありません。
他人の録音をアップロードする前に、サービスの規約を確認してください。一部のサービスでは、話者本人が直接自分の声を登録することを義務付けています。例えば、Microsoftの合成音声開示ガイダンス(https://learn.microsoft.com/en-us/azure/foundry/responsible-ai/speech-service/text-to-speech/concepts-disclosure-guidelines)では、外部ユーザーの音声機能に対して特定の要件を定めており、ユーザー自身の音声からのみモデルを作成することや、提示された承認文言を録音することなどが含まれます。
小規模チームの場合は、話者が許可を取り消したりチームを離れたりした際に応答メッセージを差し替える責任者を1名指名しておきます。代替の応答メッセージを事前に用意しておきましょう。また、アップロードされた録音や音声モデルの削除をプロバイダーがどのように処理するかについても別途確認してください。メールボックスから応答メッセージを削除しても、それらのステップが完了するわけではありません。
発信者がすぐに聞き取れる開示文を作成する
メールボックスの宛先情報と並べて、冒頭近くに開示を入れます。「この応答メッセージにはAI生成音声を使用しています」と伝えるのが簡潔でわかりやすいでしょう。承認済みのクローン音声を使用している場合は、「この応答メッセージには私の声をAIで生成した音声を使用しています」とすると、より具体的になります。
開示と話者の同意は、それぞれ異なる問題に対処するものです。同意は、その使用に対する話者の合意を確立します。開示は、発信者に対して何を聞いているかを伝えます。Microsoftの合成音声開示ガイダンス(https://learn.microsoft.com/en-us/azure/foundry/responsible-ai/speech-service/text-to-speech/concepts-disclosure-guidelines)では、ユーザーが実在の人物と対話しているかどうかで誤認されないよう、合成音声の開示を明示的に義務付けています。これはプロバイダーの要件ですが、ここでの文言は一般的な応答メッセージに向けた実践的な推奨事項です。
ウェブサイト上の注記だけに頼ることは避けてください。発信者がそれを目にしない可能性があります。音声による開示は、メッセージの他の部分と同じ聞き取りやすい音量とペースを維持してください。
原稿を作成する際は、以下の順序に従ってください:
固定の録音音声を、双方向の対話型アシスタントのように聞こえさせないでください。電話システムが実際にその動作を行わない限り、「ご用件をお話しいただければおつなぎします」といったフレーズは不適切です。同様に、ストック音声が実在の特定の従業員として名乗るべきではありません。
実用的な見通しを設定し、予備の連絡手段を提供する
発信者が応答メッセージを聞き終えたときに、次に何をすべきかが明確になっている必要があります。通常は、名前、折り返し先の電話番号、および簡単な用件を尋ねるだけで十分です。折り返しの電話に不要な詳細まで求めるのは避けましょう。
対応可能な時間枠を維持できる場合にのみ、返信までの目安を伝えてください。チームが平日のみメッセージを確認している場合は、その旨を伝えます。翌日の折り返しを確実に約束できない場合は、その約束を含めないでください。異なる地域の着信者を想定する場合は、営業時間にタイムゾーンを含めてください。
日常的に確認されている予備の連絡手段を1つ選択します。個人の電話番号の場合、SMSを受信できるのであれば、同じ番号へのテキスト送信が考えられます。小規模チームの場合は、共有のメールアドレスなどが適しています。誰かがアクセスできること、また通常留守番電話を確認する担当者が不在の場合でも機能することを確認してください。
メールアドレスや電話番号は、メモを取れるよう十分にゆっくりと読み上げます。アドレスが長かったり口頭で聞き取りにくかったりする場合は、既存のよりシンプルな連絡方法を選んでください。スクリプトを埋めるためだけに連絡先アドレスをでっち上げてはなりません。
2つの応答メッセージのスクリプト例です。以下の名前は架空のものです。実際の身元、利用可能な連絡方法、実際のメッセージ確認体制に合わせて文言を調整してください。
個人用メールボックス:
アレックス・モーガンの留守番電話です。この応答メッセージには、私の声をAIで生成した音声を使用しています。発信音の後に、お名前、折り返し先のお電話番号、簡単なご用件をお残しください。この番号宛てにテキストメッセージをお送りいただくことも可能です。確認次第、折り返しご連絡いたします。ありがとうございました。
その音声が承認済みのクローンであり、その番号でテキストを受信できる場合にのみ、このバージョンを使用してください。ストック音声を使用する場合は、開示部分を「この応答メッセージにはAI生成音声を使用しています」に変更してください。
小規模チーム用メールボックス:
シダー・ワークショップ・チームの留守番電話です。この応答メッセージにはAI生成音声を使用しています。メッセージの確認は月曜日から金曜日まで行っております。発信音の後に、お名前、折り返し先のお電話番号、簡単なご用件をお残しください。この番号へのテキストメッセージも受け付けており、該当の曜日にチームが確認いたします。ありがとうございました。
チームの例は、チームが実際に監視しているメッセージを同じ番号で受信できることを前提としています。そうでない場合は、音声を生成する前に、その文を実際に確認可能な連絡方法に置き換えてください。
音声を生成し、発音を確認する
原稿と音声の利用許可が確定したら、まずは最も発音が難しい単語を含めた短いテスト音声を作成します。人名、チーム名、連絡先の詳細などを含めてください。これにより、完全な応答メッセージを生成する前に発音の問題を解決できます。
クローン音声の場合は、選択したプロバイダーの録音手順と検証ステップに従ってください。静かな場所を使用し、同意した話者のみが含まれる録音を使用します。他のサービスのサンプル長や録音フォーマットがそのまま通用すると思い込まないでください。
ストック音声でもクローン音声でも、明瞭で落ち着いた話し方を選択します。読み上げられたメッセージを正しく判断できるよう、最初はBGMなしで始めてください。以下の各項目に注意して耳を傾けてください:
単語の発音がおかしい場合は、サービスに発音調整機能があればそれを使用するか、生成テキスト内で音声表記(当て字やひらがななど)を試してください。確認用として、正しい綴りの原稿は別途保管しておきます。変更を加えるたびに文全体を再生成して聴き直してください。エディター上のテキストだけでなく、出力された音声そのもので判断します。
別の大人に原稿を読ませずに一度聞いてもらいます。メールボックスの宛先、予備の連絡先、次のステップを復唱してもらってください。少しでも聞き取りの食い違いがあれば、修正の理由として受け止めます。クローン音声の場合は、話者本人にも実際に使用される音声そのものを承認してもらいます。
応答メッセージを設定し、発信者側の聞こえ方をテストする
電話サービスが対応している設定で書き出すか、指定の録音プロセスに従います。承認された原稿と音声を、判別しやすいバージョン名をつけて保存してください。差し替えたメッセージがテスト通話を通過するまでは、以前使用していた応答メッセージを利用可能な状態で残しておきます。
新しい応答メッセージがアクティブ(有効)になっていることを確認します。保存と有効化は別々のステップである場合があります。例えばGoogle Voiceの手順(https://support.google.com/voice/answer/115069?hl=en)では、保存した応答メッセージに対して明示的に「アクティブとして設定」を選択するよう説明されています。
別の電話から発信し、留守番電話に接続させます。発信音まで聞き届け、テストメッセージを残し、それが想定通りの場所に届くことを確認します。冒頭が途切れていないか、音量は適切か、開示が明瞭に保たれているか、原稿がなくても予備の連絡先が聞き取れるかを確認してください。
聞き取りにくい場合は、言葉遣いを簡潔にするか、話す速度を落としてから再試行してください。再生品質が改善しない場合は、設定の問題を解決する間、サービスのデフォルトの応答メッセージや通常録音した応答メッセージを使用してください。
録音チェックリスト
応答メッセージを有効にする前に、以下を確認してください:
連絡先、対応時間、チームの担当範囲、または話者の許可に変更があった場合は、応答メッセージを見直してください。改訂後は、特に名前、番号、発信者が取るべき行動に変更があった場合、再度聞き取り確認とテスト通話を行ってください。
