Ajustes de voz, idioma y comportamiento
Última actualización: 8 de septiembre de 2026
La pestaña Voz, idioma y comportamiento del editor del agente es la superficie completa de ajuste de cómo suena y cómo se comporta tu agente en una llamada. Cambia lo que necesites, haz clic en Guardar ajustes y la configuración se sincroniza con el motor de voz.
Voz
La lista de voces es dinámica: se carga en vivo desde tu cuenta de Retell, así que muestra exactamente las voces que tu cuenta puede usar — incluidas las voces de ElevenLabs si usas tu propia clave de ElevenLabs en Retell. Filtra por nombre, proveedor o acento y usa Vista previa de voz para escuchar antes de decidir: reproduce una muestra de tres segundos — suficiente para juzgar tono y acento — y se detiene sola. Si la lista no se puede cargar (por ejemplo porque Retell todavía no está conectado), siempre puedes pegar un voice ID manualmente.
Debajo del selector puedes ajustar la voz en sí: Modelo de voz (TTS), Velocidad, Temperatura (expresividad), Volumen y Emoción.
Modelo LLM e idioma
La sección Modelo LLM e idioma define el cerebro y la lengua: elige el Modelo LLM con el que piensa el agente y el Idioma que habla y entiende (predeterminado: inglés US).
Vista previa de coste por minuto y latencia
Junto al selector de modelo cada modelo muestra el $/min de Retell, y debajo una línea de estimación se actualiza en vivo al cambiar voz, modelo, reducción de ruido o JSON avanzado: el coste por minuto (LLM + voz + infraestructura de voz de Retell, más los complementos de pago como base de conocimiento, reducción de ruido avanzada, eliminación de PII o guardarraíles) y la latencia esperada de extremo a extremo (voz + modelo + transcripción). Las mismas cifras aparecen en la cabecera del agente. No hace falta una llamada de prueba: la estimación sale de la lista de precios publicada por Retell, la misma tabla que usa el panel de Retell. La telefonía de Twilio no está incluida: la factura Twilio en tu troncal.
Dos cosas que conviene saber:
- Un
*junto al coste significa que un componente aún no tiene precio publicado: el total es un mínimo, no la cifra completa. - Cuando el agente tiene llamadas reales, una segunda línea muestra las cifras medidas: el gasto real por minuto de conversación (coste total ÷ minutos totales) y la latencia como p50 / p90, sobre las últimas llamadas reales — las llamadas de prueba quedan excluidas. Esa línea es la verdad; la estimación es la previsión.
Comportamiento
La sección Comportamiento es un conjunto de deslizadores e interruptores:
| Ajuste | Qué controla |
|---|---|
| Capacidad de respuesta | Con qué rapidez empieza a responder el agente. |
| Sensibilidad a la interrupción | Con qué facilidad puede el contacto hablar por encima del agente. |
| Backchannel | Confirmaciones verbales breves mientras habla el lead, con un deslizador de frecuencia. |
| Capacidad de respuesta dinámica / Velocidad de voz dinámica | Permiten que el agente adapte su ritmo a la conversación. |
| Permitir DTMF (teclado) | Si el agente acepta los tonos del teclado. |
Audio, tiempos, transcripción, privacidad
Otras cuatro secciones cubren el resto de la experiencia de llamada: Entorno de audio (sonido ambiental y su volumen, reducción de ruido), Tiempos y timeouts (retardo del primer mensaje, finalizar llamada tras silencio, recordatorios, duración máxima de llamada, duración del tono, timeout de detección de buzón de voz), Transcripción (modo STT, vocabulario especializado) y Privacidad y datos (retención de datos).
Avanzado (JSON)
Las configuraciones anidadas que no tienen un campo dedicado —diccionarios de pronunciación, configuración de transcripción personalizada, tratamiento de PII y similares— pasan por la vía de escape Config avanzada (JSON). Pega un objeto JSON; se combina con los campos de arriba al guardar. Debe ser un objeto JSON válido, y el formulario te avisa si no lo es.
La misma sección Avanzado incluye un campo Zona horaria (IANA): es la zona horaria del agente en el motor de voz y no tiene nada que ver con la franja horaria del marcador — esa vive en Reintentos y transferencia, consulta Define una franja horaria por agente.
Buzón de voz: la política predeterminada
La detección de buzón de voz siempre está activa — el agente nunca habla con un contestador. La política predeterminada es colgar en silencio cuando responde una máquina. Si prefieres dejar un mensaje fijo, eso se configura por agente en la pestaña Reintentos y transferencia — consulta Cadencia de reintentos, devoluciones de llamada y transferencia.
En un agente entrante esa pestaña solo muestra las tarjetas de transferencia y de citas: la franja horaria, las rellamadas y el buzón de voz pertenecen a los agentes salientes cuyas devoluciones de llamada atiende.
Cuándo se aplican los cambios
Haz clic en Guardar ajustes y la nueva configuración se aplica a partir de la siguiente llamada — las llamadas ya en curso no se tocan. La sincronización con el motor de voz es best-effort: un error puntual de sincronización queda registrado y nunca bloquea el guardado.
Los agentes creados antes de que se lanzara una función de la plataforma (por ejemplo nuevas herramientas en llamada) no incorporan esas novedades al guardar la voz o el LLM. Usa el botón Sincronizar herramientas GHL de la pestaña Datos y GHL, o guarda la política en la pestaña Reintentos y transferencia: esas dos son las que vuelven a registrar en el motor de voz las herramientas en llamada, el análisis posterior a la llamada y la política de buzón de voz.
Siguientes pasos
- Prueba tu agente desde el navegador — escucha la nueva voz y el nuevo comportamiento al instante.
- Versiones del prompt, métricas A/B y rollback — ajustar las palabras, no solo la voz.
