Audio de fondo
El silencio total suena artificial por teléfono. Puedes añadir capas de:- Ambient sound — oficina, ciudad, bosque, sala concurrida o tecleo, con volumen ajustable (o tu propio audio subido).
- Thinking sound — un sonido sutil mientras el asistente piensa — durante la espera del LLM y cualquier llamada a herramientas — para que el procesamiento nunca suene como una llamada caída.
Gestión de interrupciones
Quien llama interrumpe — los buenos asistentes lo manejan con naturalidad.- Allow interruptions — activado de forma predeterminada; el asistente deja de hablar en cuanto quien llama habla por encima.
- Minimum interruption duration — ignora ruidos muy breves para que una tos no corte al asistente.
- Adaptive interruptions — la retroalimentación de escucha como «mhm», «vale» o «claro» no se trata como una interrupción, así que el asistente sigue hablando pese a esa reacción natural, pero cede la palabra ante una interjección real. En los modos Realtime compatibles, selecciona Adaptive en Turn detection para activar este comportamiento.
Preajustes de entorno de ruido y VAD
En Conversation → Latency, Noise & echo cancellation es un simple interruptor de activar/desactivar — el modelo adecuado para el canal (teléfono o web) se elige automáticamente. Debajo, VAD sensitivity / noise threshold ofrece cuatro preajustes de entorno que deciden cuánto volumen hace falta para que algo cuente como habla:
Un latency waterfall en vivo (STT / LLM TTFT / TTS TTFB / E2E) solo aparece en el panel de prueba de llamada web del estudio — nunca en el widget público.
Las recomendaciones de telecomunicaciones (ITU-T G.114) fijan como objetivo una latencia unidireccional por debajo de 150 ms para que una llamada se sienta natural — una referencia útil a la hora de decidir con cuánta agresividad ajustar la interrupción y la sensibilidad de VAD para tu caso de uso.
Frases de relleno y herramientas asíncronas
Cuando una llamada a una herramienta (consulta de CRM, comprobación de disponibilidad) tarda varios segundos, el asistente puede cubrir ese hueco:- Speak-during text — un anuncio fijo al iniciar la herramienta («Un momento, estoy comprobándolo…»).
- Filler phrases — un conjunto rotativo de frases cortas que se dicen durante esperas más largas, con retraso inicial e intervalo configurables. Solo se dicen en las pausas — nunca hablan por encima de quien llama.
- Async tools — marca un nodo de herramienta como asíncrono y la conversación continúa mientras la herramienta se ejecuta; el resultado se incorpora en cuanto llega.
Gestión de inactividad
Nadie quiere una llamada que se queda colgada en silencio para siempre:- Idle timeout — pasados estos segundos de silencio, el asistente comprueba si quien llama sigue ahí («¿Sigues ahí?»).
- Idle messages — frases fijas opcionales para esas comprobaciones; déjalo vacío para que las genere el LLM de forma natural.
- Max rounds — tras N comprobaciones sin respuesta, el asistente se despide y cuelga. Esto también protege tu saldo de minutos.
Buzón de voz
Este ajuste solo decide qué ocurre una vez que la detección de contestador automático (AMD) señala un buzón en una llamada saliente — no qué ocurre cuando una llamada simplemente suena sin respuesta.- Leave a voicemail message — activado: el asistente dice un mensaje y luego cuelga. Desactivado: el asistente cuelga de inmediato, sin dejar nada.
- Voicemail message — el mensaje en texto libre que se dice mediante TTS cuando se detecta un buzón. Mantenlo corto e incluye un número de devolución de llamada. Déjalo vacío y se usará en su lugar el saludo o primer mensaje.
La respuesta a un buzón detectado siempre proviene de estos ajustes del asistente, no de la campaña que hizo la llamada — aunque una campaña puede, por separado, activar o desactivar su propia detección de contestador automático.
Tono de llamada
Dos tiempos de espera independientes controlan cuánto suena una llamada antes de que ocurra algo:Esto es independiente del tiempo de espera de timbre propio de la herramienta Call transfer, que cronometra un único intento de transferencia y no la llamada original.
Consentimiento
Para jurisdicciones que exigen el consentimiento de todas las partes (Alemania: §201 StGB):- Consent announcement — un mensaje configurable que se reproduce al inicio de la llamada (pregenerado, sin latencia añadida).
- Consent mode — quien llama da su consentimiento verbalmente o pulsando una tecla (DTMF).
- On decline — continuar la llamada, o terminarla con cortesía.
- El resultado del consentimiento se guarda junto con la llamada, a prueba de auditorías.
Qué cubre el consentimiento
Un solo anuncio puede cubrir dos finalidades distintas. Actívalas de forma independiente en el editor del asistente:- Recording the call — la grabación empieza solo después del consentimiento, nunca antes, y además requiere Record calls. Se pregunta en cada llamada, porque cada grabación necesita su propio permiso.
- Remember callers — un consentimiento concedido desbloquea la memoria duradera de quien llama, de modo que las personas que vuelven a llamar se reconocen sin que nadie tenga que aprobarlas a mano en Audience → Customer memory. Se pregunta una sola vez.
Privacidad de las grabaciones: redacción y retranscripción
Hay dos ajustes más junto a la grabación, en Settings → Privacy.Redactar datos personales en la transcripción
Las categorías seleccionadas de datos personales se sustituyen por[REDACTED:type] antes de guardar la transcripción — minimización de datos, no solo enmascarado en pantalla. Se aplica únicamente a las llamadas recién terminadas; las transcripciones ya guardadas conservan su texto original.
Al activarlo se seleccionan primero cuatro categorías — dirección de correo, número de teléfono, IBAN y número de tarjeta de crédito. La lista integrada completa es mucho más amplia y abarca identidad, contacto, identificación gubernamental, información financiera, credenciales de seguridad e información de salud, y puedes seleccionar cualquier combinación de ella. Más allá de las categorías integradas, añade hasta 20 patrones propios con nombre (expresiones regulares) para cualquier cosa específica de tu negocio.
Retranscripción automática
Independientemente de la acción manual Re-transcribe en Historial, Re-transcribe recording puede ejecutarse automáticamente para cada llamada grabada. Cuando está activado, la grabación de cada llamada terminada se transcribe de nuevo con un motor de mayor precisión en cuanto termina la llamada; la transcripción mejorada aparece en la vista de detalle de la llamada, junto a la transcripción en vivo. Requiere que Record calls esté activado.La retranscripción automática se factura por minuto grabado (redondeado al alza) al ritmo Re-transcribe del espacio de trabajo; las tarifas actuales están en la página de uso.
Barreras de protección
Barreras de seguridad deterministas por encima del prompt:- Manipulation → Prompt injection — bloquea los intentos de eludir o anular las instrucciones del sistema (detección de jailbreak en el habla de quien llama). Disponible en todos los planes, activado de forma predeterminada; desmárcalo para desactivarlo (
guardrails.input.jailbreak). - Blocked topics — temas que el asistente debe rechazar; la respuesta coincidente se sustituye por tu refusal text (Fallbacks & Guardrails).
- Escalation keywords — si quien llama menciona una (por ejemplo, «abogado», «emergencia»), la plataforma —no el LLM— dispara una transferencia inmediata a tu escalation number (Fallbacks & Guardrails).
Los filtros de temas y categorías se aplican en el flujo de salida, así que siguen vigentes incluso cuando quien llama, con habilidad, logra desviar al modelo de su prompt.
Pronunciación y limpieza de texto
Consulta Modelos y voces → Estilo de habla: diccionario de pronunciación, filtrado de markdown/emojis, velocidad de habla y volumen de salida.Solución de problemas
Cambia un solo ajuste cada vez y vuelve a probar con una llamada realista — los cambios pequeños y aislados son mucho más fáciles de evaluar que varios a la vez.