Integraciones
ElevenLabs
Cómo pueden usarse los modelos de voz de ElevenLabs en su despliegue, siempre en la región que usted elija, y qué reciben.
En esta página
ElevenLabs es uno de los proveedores de voz con los que trabaja Telonic. Los proveedores de voz suministran los modelos que hay detrás de cada conversación hablada: el reconocimiento del habla (convertir en texto lo que dice la persona que llama, a medida que habla) y la síntesis de voz (pronunciar la respuesta del agente de IA con la voz elegida para su marca). ElevenLabs proporciona reconocimiento del habla, síntesis de voz o ambos. Qué modelos suyos usa su despliegue, y para qué función, se decide con usted durante la implementación.
Lo que hace un proveedor de voz en su despliegue
| Función | Lo que significa para usted | Ejemplo |
|---|---|---|
| Reconocimiento del habla | Se entiende a las personas que llaman a medida que hablan, y la transcripción se va generando durante la llamada, no después | Las palabras de quien llama se transcriben a medida que habla en una llamada de voz o en la voz en el navegador, y una nota de voz de WhatsApp se transcribe cuando llega |
| Síntesis de voz | La respuesta del agente se pronuncia con la voz elegida para su marca, en cada idioma | Una voz árabe serena y formal, y una voz inglesa a juego |
| Voz personalizada | Una voz exclusiva de su marca, creada a partir de una breve grabación de un locutor que usted elija. Se configura durante la implementación | Una voz grabada por un presentador que selecciona su equipo de marketing |
Cómo se conecta
El reconocimiento del habla y la síntesis de voz siempre se ejecutan en la región que usted elija. No se ofrece ningún proveedor de reconocimiento ni de síntesis de voz fuera de su región, sea cual sea su elección de modelo de lenguaje. Los proveedores de voz se eligen para su despliegue en función de dos aspectos: su cobertura de los idiomas y dialectos que usan sus clientes, y las voces que se ajustan a su marca.
El contrato de Telonic con cada proveedor prohíbe usar sus datos para entrenar o mejorar sus modelos, y se aplican acuerdos de conservación cero de datos (el proveedor no guarda ninguna copia de lo que procesa) siempre que el proveedor los ofrezca. Cualquier cambio de proveedor o de modelo de voz se prueba con conversaciones procedentes de su sector y requiere su aprobación antes de publicarse. Si un proveedor sufre una interrupción, la conmutación por error solo cambia a otro proveedor aprobado en la región que usted eligió, probado de antemano y configurado durante la implementación.
Lo que recibe el proveedor
| Datos | Necesarios para | Por defecto |
|---|---|---|
| El audio de la llamada, a medida que habla quien llama | Reconocimiento del habla | Solo si el proveedor se elige para el reconocimiento. Se procesa en su región |
| El texto de cada respuesta hablada | Síntesis de voz | Solo si el proveedor se elige para la síntesis. Se procesa en su región |
| Una grabación del locutor que usted elija | Crear una voz personalizada | Solo si encarga una voz personalizada, con el consentimiento por escrito del locutor |
| Acceso a sus sistemas o al registro del cliente | No es necesario | No se concede |
| Sus datos, para entrenar los modelos del proveedor | No está permitido | Prohibido por contrato |
Las llamadas solo se graban una vez que la persona que llama ha dado su consentimiento, y no se almacena nada sin que usted lo autorice. Consulte Modelos y proveedores.
En la práctica
Sahel Crest Properties, una promotora de Dubái, quiere que su agente de IA suene como su marca y como ninguna otra.
- Su equipo de marketing elige a un presentador cuya voz ya utiliza en su centro de ventas.
- Con el consentimiento por escrito del presentador, se realiza una breve grabación y se crea una voz personalizada con un proveedor elegido durante la implementación. ElevenLabs figura entre los proveedores considerados.
- La voz se prueba con las llamadas de ventas y de entrega de la promotora, en árabe y en inglés, antes de que el agente empiece a atender a clientes reales.
- Los compradores que llaman a la promotora oyen la misma voz en cada llamada, desde la región que eligió la promotora.
Relacionado
- Reconocimiento del habla y vozIntegraciones
- Modelos y proveedoresAgentes
- VocesIdiomas
- Idiomas admitidos y dialectos árabesIdiomas
- Alojamiento y residencia de los datosSeguridad y protección de datos
Los nombres y logotipos de productos son marcas comerciales de sus respectivos titulares. Su mención indica sistemas con los que Telonic se conecta y no implica asociación ni respaldo.