Skip to main content
Los modelos de un asistente determinan qué tan bien entiende a quien llama y cómo suena. El editor del asistente es donde los eliges, ajustas el estilo de habla, clonas tu propia voz y activas alternativas de respaldo que mantienen la llamada en marcha si un modelo falla a mitad de conversación.

Catálogo de modelos

El editor del asistente muestra un catálogo seleccionado de modelos disponibles para tu espacio de trabajo: La disponibilidad depende de tu espacio de trabajo y del modo de motor seleccionado. Los modelos marcados como Recommended son un buen punto de partida; Low latency destaca las opciones adecuadas para conversaciones telefónicas con buena capacidad de respuesta. Cuando Fallbacks & Guardrails está incluido, puedes elegir modelos por separado para asistentes pipeline, realtime y half-cascade. En caso contrario, el asistente usa la selección automática recomendada.

Temperature

En modo Pipeline, Temperature controla cuánto se ciñe el modelo de lenguaje a tu prompt frente a variar su redacción. El control deslizante va de 0 — determinista y ceñido al guion — hacia respuestas más creativas e improvisadas. 0,5–0,8 es un rango habitual para conversaciones telefónicas. Trátalo como un ajuste final, no como un sustituto de un prompt bien escrito:
  1. Termina primero el prompt: rol, objetivos, límites, tono.
  2. Empieza bajo.
  3. Súbelo en pasos pequeños, solo una vez que la base suene bien.
  4. Prueba y compara después de cada cambio.
Súbelo cuando las respuestas suenen rígidas o encasilladas y el caso de uso tolere algo de improvisación. Mantenlo bajo cuando la consistencia, el cumplimiento normativo o la redacción precisa importan más que la variación natural.

Biblioteca de voces

Usa el selector de voces para filtrar por idioma y características de voz, y luego reproduce una muestra antes de guardar.
  • Assistant voice — la voz predeterminada del asistente.
  • Voice per flow agent — asigna voces distintas a cada agente de un flow.
  • Voice per language — cambia la voz junto con el cambio automático de idioma.
  • Cloned voices — cuando está incluido en tu plan, añade una voz personalizada privada y úsala como cualquier voz de la biblioteca.
Al grabar una muestra para clonar, usa audio claro y de alta calidad, con una entonación estable y natural y sin ruido de fondo — y clona únicamente una voz que tengas permiso para usar (consulta Consentimiento para la clonación de voz). El clonado también está disponible como POST /api/v1/voices/clone (subida multipart, alcance voices:write) y la herramienta MCP clone_voice. Tanto el selector del panel como la llamada a la API pasan por el mismo circuito de clonado, sujeto al mismo complemento Clone your own voice y a la misma capacidad del plan — la API no puede crear una voz clonada que el panel no permitiría también.

Estilo de habla

Los controles disponibles se adaptan al modelo seleccionado. Según la voz, puedes ver:
  • velocidad de habla y volumen de salida;
  • estabilidad, similitud o expresividad;
  • instrucciones de estilo en texto libre;
  • un diccionario de pronunciación para nombres, abreviaturas y términos especializados;
  • filtros que evitan que se lean en voz alta el markdown y los emojis.
Solo se muestran y aplican los controles compatibles.
Elige primero la voz y luego ajusta un control cada vez — estabilidad, similitud o velocidad — y escucha una frase realista de tu flujo de llamada real antes de cambiar el siguiente.
Cuando el ajuste Dynamic emotions (Expressive Mode) está disponible para la voz seleccionada, el asistente puede adaptar a la conversación la emoción, el ritmo, el énfasis, las pausas y los sonidos no verbales admitidos. Se aplica a los asistentes pipeline y half-cascade; los modelos de voz realtime gestionan la expresión vocal de forma nativa. La disponibilidad depende de la voz seleccionada, y las indicaciones de interpretación no compatibles no se aplican. Las transcripciones se mantienen limpias y no incluyen marcado de interpretación.

Glosario de reconocimiento de voz

Abre Assistant settings → Voice → Speech recognition para añadir nombres de clientes, productos y nombres propios que deban transcribirse con precisión. El glosario afecta a la transcripción; usa el diccionario de pronunciación por separado cuando un término también necesite una forma hablada especial. Si Automatic term detection (Beta) está disponible y activado, el asistente puede reconocer términos adicionales para la llamada en curso. Esto puede añadir uso de IA. Los términos detectados no se añaden a tu glosario guardado.

Cadenas de respaldo

Fallback chains es un único interruptor, no un conjunto de opciones que configures. Actívalo, y si el servicio principal de reconocimiento de voz, modelo de lenguaje o voz se agota, falla o se cae a mitad de la llamada, el asistente pasa automáticamente a un respaldo compatible para que la conversación siga en lugar de cortarse. Famulor elige y mantiene a qué respaldo recurre cada cadena — no hay selector para los modelos de respaldo en sí.
Las cadenas de respaldo vienen incluidas en el complemento Fallbacks & Guardrails; consulta Settings → Plan para ver la disponibilidad. El propio cambio a un respaldo no añade ningún cargo aparte — una llamada que cambia a un respaldo se sigue facturando a la tarifa normal por minuto de llamada.
Prueba los asistentes importantes después de cambiar modelos, voces o idiomas. Normalmente basta una simulación corta para detectar diferencias de pronunciación y de tiempo.