AI 智能体
模型与 服务商
支撑每一次对话的语音识别、语言模型和语音合成服务商,如何为您的部署选择这些服务商,以及这一选择如何与您的区域保持一致。
本页内容
AI 智能体进行的每一次对话,都依赖来自专业服务商的 AI 模型:一个将语音转换为文字,一个理解对话并决定如何回复,还有一个将回复说出来。Telonic 会根据您的客户使用的语言和方言、适合您品牌的音色,以及您的数据必须留存的区域,为每一次部署与您共同选择这些服务商。本页说明每类服务商的作用、如何做出选择,以及这一选择如何遵循适用于您的部署的区域规则。
每类服务商在对话中的作用
| 服务商类型 | 作用 | 适用于 |
|---|---|---|
| 语音识别 | 在来电者说话的同时,以其使用的语言和方言将语音转换为文字 | 语音通话、浏览器语音和 WhatsApp 语音消息 |
| 语言模型 | 在智能体的限制范围内,利用从您的系统和文档中检索到的事实,理解对话并决定如何回复 | 所有渠道 |
| 语音合成 | 用为您的品牌选定的音色说出智能体的回复 | 语音通话和浏览器语音 |
在 WhatsApp、短信、电子邮件和网页聊天中,每条回复只涉及语言模型,因为对话本身已经是文字形式。例外情况是 WhatsApp 语音消息,它会先被转录为文字。客户发送的图片和文件,由运行在您所选区域内的模型读取。
语言模型并非单独工作。Telonic 自己的软件围绕在它的外围:针对您所在行业的行业模型(您的业务赖以运转的各项要素,以及与每项要素相关的规则)、您的限制、客户档案,以及与您的系统之间的连接。
语言模型决定如何表达一个答复。答复中的事实来自您的系统和经审批的文档,可供它执行的操作,就是您的团队已经允许的那些操作。参见智能体的工作方式。
技术细节
语音识别在来电者说话期间持续运行,因此转录文本在通话过程中逐步生成,而不是在通话结束后才生成。智能体在来电者快说完一句话时就开始组织回复,这让对话保持自然,不会显得迟缓。
Telonic 通过模型路由层(将每个请求发送给为该职能选定的服务商的软件)使用模型,因此可以更换每项职能背后的服务商,而无需重建智能体。更换服务商时,您的行业模型、限制、记忆和集成都保持不变。
如何为您的部署选择服务商
服务商在实施阶段与您共同选定,每次部署单独选择。决定这一选择的因素有三个。
| 决定因素 | 为何重要 | 示例 |
|---|---|---|
| 语言和方言覆盖范围 | 语音识别和音色的质量因语言和方言而异。适合海湾阿拉伯语的服务商,可能与适合埃及阿拉伯语或英语的服务商不同 | 利雅得的一家酒店集团,其来电者大多讲海湾阿拉伯语,谈及预订条款时会切换为英语 |
| 音色 | 音色是您品牌的一部分。不同服务商的音色,在特质、性别以及在每种语言中听起来的自然程度上各不相同 | 一家高端开发商选择一种沉稳、正式的阿拉伯语音色,以及一种与之相配的英语音色 |
| 区域 | 服务商必须部署在您的数据留存的区域 | 一家数据必须保留在沙特阿拉伯境内的保险公司 |
上线(智能体开始服务真实客户的时间点)之后,仍可更改这一选择。对模型或服务商的任何更改,在用于您的客户之前,都要使用取自您所在行业的一组对话进行测试。参见每次发布前的测试。
这一选择如何与您的区域保持一致
一次部署的所有处理,包括语音识别、语言模型和语音合成,都在您选择的区域内进行,使用的是部署在该区域内的模型和服务商。
在您所选区域之外进行处理的服务商,只有在您明确选择时才会使用,而且只有语言模型可以通过这种方式选择。如果您做出这一选择,在任何数据到达该服务商之前,个人信息都会先经过脱敏处理(删除或遮蔽)。脱敏范围包括以阿拉伯文和拉丁文书写的姓名、电话号码、电子邮件地址、国民身份证号码(包括阿联酋 Emirates ID 号码和沙特 Iqama 号码)、护照号码、支付卡号码、银行账号和 IBAN、出生日期以及街道地址。
语音识别和语音合成始终在您所选的区域内运行,不提供任何区域外的语音识别或语音合成服务商。音频在转录之前无法进行脱敏,而且合成语音所朗读的文字往往包含客户的姓名。当文字发送到区域外的语言模型时,每一项经过脱敏的内容都会被替换为占位符,真实值则在您的部署环境内还原到回复中。
| 您的选择 | 各服务商在哪里运行 | 哪些内容会离开您的区域 |
|---|---|---|
| 仅限区域内 | 语音识别、语言模型和语音合成全部在您所选的区域内运行 | 无 |
| 由您明确选择的区域外语言模型 | 语音识别和语音合成在您的区域内运行。语言模型在区域外运行 | 对话文字、为回复检索的事实以及智能体的指令,其中的个人信息会先经过脱敏处理 |
您的部署所选择的服务商,包括您的区域以外的任何服务商,都会记录在您的协议中,以及您的部署的次级处理者(代表 Telonic 处理个人数据的公司)名单中。参见次级处理者。
Telonic 所使用的服务商
Telonic 使用以下服务商。并非每家服务商都部署在每个区域,这也是需要按部署选择服务商的原因之一。您所在区域可用哪些服务商和模型,会在实施阶段确认,并在您的协议中列明。
| 服务商类型 | 服务商 |
|---|---|
| 语言模型 | OpenAI、Anthropic、Google Gemini、Mistral AI、Meta(Llama 模型)、TII(Falcon 模型) |
| 语音识别与语音合成 | Deepgram、ElevenLabs、Fish Audio、Rime、Cartesia、Speechmatics、AssemblyAI、Soniox |
名单中的每家语音服务商都提供语音识别、语音合成,或两者兼有。
服务商如何处理您的数据
服务商处理对话数据,仅限于履行其在您的部署中的职能:转录、决定回复或说出回复。Telonic 与每家服务商签订的合同,都禁止使用您的数据来训练或改进其模型。凡服务商提供零数据保留安排(即服务商在处理完成后不保留任何内容)的,均予以采用。
Telonic 从一次部署延续到下一次部署的是行业知识:工作流、边缘情况以及用于检查质量的测试集。Telonic 绝不会将您的客户数据带入其他部署。
Telonic 构建什么,使用什么
基础模型(由服务商构建的大型通用 AI 模型)要在您的业务中发挥作用,所需的一切都由 Telonic 构建:针对您所在行业的行业模型、工作流、限制、客户档案、与您的系统之间的连接,以及检查每一项变更的测试。基础模型本身来自成熟的服务商。Telonic 不训练这些模型。
这意味着底层模型的改进无需重建即可惠及您的部署。任何新模型在用于您的部署之前,都要使用取自您所在行业的对话进行测试,只有在表现至少与被替换的模型相当时才会采用。
如果某家服务商发生故障,您的部署可以切换到您已审批通过的另一家服务商。这在实施阶段配置,备用服务商也会像其他任何变更一样提前经过测试。故障切换只会切换到位于您所选区域内、且已审批通过的服务商。
实际应用
一家在利雅得和吉达经营酒店的集团,与 Telonic 一起搭建语音预订服务。
- 该集团的来电客人大多讲海湾阿拉伯语,说到日期和房型时常常切换为英语。也有一些客人讲埃及阿拉伯语或英语。
- Telonic 与该集团的 IT 团队共同选定了一家语音识别服务商,它能够很好地处理海湾阿拉伯语、埃及阿拉伯语以及阿拉伯语与英语混用的情况,并且部署在沙特阿拉伯区域。
- 市场团队试听了入围的音色,选定了一种温和而正式的阿拉伯语音色,以及一种与之相配的英语音色。
- 该集团将所有服务商都保留在区域内。没有任何内容离开沙特阿拉伯区域。
- 几个月后,该区域推出了一款更新的语言模型。Telonic 使用该集团的预订对话对其进行测试,确认其表现至少与原模型相当,并在该集团审批通过后将这项变更上线。
您的团队掌控的内容
- 是否可以使用您的区域以外的任何服务商,以及用于哪项职能。
- 您的客户在每种语言中听到的声音。
- 在上线前审批对模型或服务商的任何更改。每一项此类更改都要在发布前经您审批。
相关内容
产品名称和标识均为其各自所有者的商标。提及这些名称和标识,表示 Telonic 与相应系统连接,并不意味着存在合作或背书关系。