如何在获得同意并明确告知的情况下创建 AI 语音信箱声音
要创建 AI 语音信箱声音,请选择符合您预期用途的合成声音,或在获得发音人明确许可的情况下克隆声音。编写一段问候语,标明信箱归属,明确说明声音由 AI 生成,并告知来电者如何留言或使用其他联系方式。检查发音,然后通过实际通话测试问候语。本指南适用于设置普通个人或小团队语音信箱问候语的成年人。任务目标是生成一段固定音频消息,在来电者留言之前播放。以下工作流程将权威来源支撑的同意与告知原则与实用的录音建议相结合。
选择声音并检查信箱接收问候语的方式
首先做好两个决定:您希望来电者听到谁的声音,以及您将如何安装该录音。在为声音生成付费之前,请先解决这两个问题。
当听起来像某个特定的人没有太大价值时,预设声音(现成声音)是一个实用的起点。对于克隆声音,请查看服务提供商的实际注册要求。例如,微软的个人声音文档(https://learn.microsoft.com/en-us/azure/ai-services/speech-service/personal-voice-overview)要求获得用户的明确同意,并提供确认创建和使用该声音的录音声明。其 API 访问权限也仅限于符合条件的客户和获批的使用场景;它并不是一个不受限制的消费级语音信箱工具。
接下来,打开电话服务的问候语设置。检查它是否支持上传音频、是否提供自带的文字转语音功能,还是要求通过麦克风录制。如果支持上传,请在导出前注意允许的格式、文件大小和时长限制。
不要以为每项服务都有上传按钮。Google Voice 的官方问候语说明(https://support.google.com/voice/answer/115069?hl=en)描述了录制、试听、保存和选择已启用问候语的过程。如果您的服务只能通过麦克风录制,将生成的音频对着麦克风播放可能会导致效果不佳。在正式采用前请先测试;清晰的常规录音是一个实用的备选方案。
在克隆发音人声音前获取明确许可
在此工作流程中,应要求发音人同时批准合成声音的创建及其预期用途。为其他目的发送的录音不应被视为构建可重复使用的声音模型的许可。
保留一份简短的书面记录,回答以下问题:
一个示范性的授权范围可以是:“允许使用我的声音生成我批准的、用于我们共享工作室信箱的问候语。在生成修改后的措辞或在其他地方使用该声音之前,请先征得我的同意。”这是明确预期的一种实用方式,并不能替代提供商的注册流程。
在上传任何人的录音之前,请查看该服务的规则。某些服务要求发音人直接注册自己的声音。例如,微软的合成声音告知指南(https://learn.microsoft.com/en-us/azure/foundry/responsible-ai/speech-service/text-to-speech/concepts-disclosure-guidelines)对外部用户声音功能提出了具体要求,包括仅根据用户自己的声音创建模型,以及录制所提供的确认声明。
对于小团队,如果发音人撤回许可或离开合作,请指定一人负责更换问候语。随时备好替代问候语。另外检查提供商如何处理已上传录音和声音模型的删除;仅从信箱中移除问候语并不会完成这些后续步骤。
编写来电者能立即听到的告知声明
将告知声明放在开头部分,与信箱身份说明并列。“此问候语使用 AI 生成的声音”这种表述直接明了、通俗易懂。如果使用的是获批的克隆声音,说“此问候语使用我声音的 AI 生成版本”则更为具体。
告知和发音人同意解决的是不同的问题。同意确立的是发音人对该用途的认可。告知则是告诉来电者他们听到的是什么。微软的合成声音告知指南(https://learn.microsoft.com/en-us/azure/foundry/responsible-ai/speech-service/text-to-speech/concepts-disclosure-guidelines)明确要求对合成声音进行披露,以免用户在是否与真人互动的问题上受到误导。这是提供商的要求;此处的措辞则是针对普通问候语的实用建议。
避免仅依赖网站上的说明:来电者可能根本看不到。语音告知声明应保持与留言其余部分同样清晰的音量和语速。
起草时请遵循以下顺序:
不要让固定的录音听起来像交互式语音助手。诸如“告诉我您的需求,我来为您转接”之类的语句是不合适的,除非电话系统确实具备该功能。同样,预设声音也不应自称为某位指名道姓的员工。
建立切合实际的预期并提供备用联系方式
来电者听完问候语后应当清楚下一步该怎么做。通常,询问姓名、回电号码和简要来电事由就足够了。避免索取回电并不需要的信息。
只有在能够确保履行的前提下,才说明回复期限。如果团队只在工作日查收留言,请如实说明。如果您无法稳妥地保证次日回电,就不要作出承诺。对于身处不同时区的来电者,在说明工作时间时请注明时区。
选择一种有人积极跟进的备用联系方式。对于个人号码,如果可以接收短信,直接发送短信至该号码可能是一个选择。对于小团队,则可以是一个共享电子邮件地址。请确保有人可以访问它,并且在通常负责查收语音信箱的人员不在时它仍然有效。
朗读电子邮件地址和号码的语速要慢,以便对方记录。如果某个地址太长或口头难以听清,请选择一个更简单的现有联系途径。切勿为了凑满文稿而生造一个联系地址。
两份示范问候语文稿。以下姓名均为虚构。请根据您的真实身份、可用的联系方式以及实际查收留言的习惯调整措辞。
个人信箱:
您好,您拨打的是 Alex Morgan 的语音信箱。此问候语使用的是我声音的 AI 生成版本。请在提示音后留下您的姓名、回电号码和简短留言。您也可以发送短信至该号码。我有空时会给您回电。谢谢。
仅当该声音为您经过授权的克隆声音且该号码可接收短信时,才使用该版本。如果使用预设声音,请将告知声明更改为“此问候语使用 AI 生成的声音”。
小团队信箱:
您好,您拨打的是 Cedar Workshop 团队的语音信箱。此问候语使用 AI 生成的声音。我们在周一至周五查收留言。请在提示音后留下您的姓名、回电号码和简短留言。您也可以发送短信至该号码,我们的团队会在工作日期间查看您的留言。谢谢。
团队示例的前提是该号码确实支持短信且有团队人员跟进。如果不支持,请在生成音频前将该句替换为经过核实的联系方式。
生成音频并检查发音
在确定文稿和声音权限后,先创建一个包含最难读字词的简短测试音频。包含个人姓名、团队名称以及所有联系方式详情。这样可以让您在生成完整问候语之前解决发音问题。
对于克隆声音,请遵循所选提供商的录音说明和验证步骤。使用安静的环境,并确保录音中仅包含同意授权的发音人。不要认为来自其他服务的样本时长或录音格式可以直接套用。
无论是预设声音还是克隆声音,都要选择清晰、沉稳的语调。一开始不要添加背景音乐,以便您可以准确评估语音留言的效果。仔细倾听以下每一个要点:
如果某个词听起来不自然,且服务支持该功能,请使用发音控制设置,或者在生成文本中尝试使用拼音/注音拼写。将拼写正确的原始文稿另行保存以便审核。每次修改后重新生成并试听整句话;要以最终生成的音频为准,而不能仅仅看编辑器中的文字。
请另一位成年人在不看文稿的情况下听一遍。让他们复述信箱身份、备用联系方式和后续步骤。凡有偏差,均应作为修改的理由。对于克隆声音,还应让发音人确认批准将要使用的确切音频。
安装问候语并测试来电体验
根据电话服务支持的设置进行导出,或遵循其录音流程。使用易于识别的版本名称保存已获批的文稿和音频。在替代音频通过测试通话之前,请保留此前可用的问候语。
确认新问候语已处于启用状态。保存和启用可能是两个独立的步骤:Google Voice 的说明(https://support.google.com/voice/answer/115069?hl=en)明确描述了需要对已保存的问候语选择“设为当前”(Set as active)。
用另一部电话呼叫该号码并进入语音信箱。听完提示音,留下一条测试留言,并确认其能否正常送达预期位置。检查开头是否被截断、音量是否舒适、告知声明是否清晰,以及在没有文稿的情况下备用联系方式是否能听懂。
如果效果难以听清,请在再次尝试前简化措辞或放慢语速。如果播放效果依然较差,在解决安装问题的同时,可使用服务的默认设置或常规录制的问候语。
录音核对清单
在启用问候语之前,请确认:
当联系方式、营业时间、团队职责或发音人许可发生变更时,请重新审核问候语。在进行修改后,重新执行收听检查和测试通话,尤其是在变更涉及姓名、号码或来电者下一步行动时。
