> ## Documentation Index
> Fetch the complete documentation index at: https://docs.famulor.io/llms.txt
> Use this file to discover all available pages before exploring further.

# Modelos y voces

> Elige modelos, escucha voces, clona la tuya propia y activa alternativas de respaldo fiables

Los modelos de un asistente determinan qué tan bien entiende a quien llama y cómo suena. El editor del asistente es donde los eliges, ajustas el estilo de habla, clonas tu propia voz y activas alternativas de respaldo que mantienen la llamada en marcha si un modelo falla a mitad de conversación.

## Catálogo de modelos

El editor del asistente muestra un catálogo seleccionado de modelos disponibles para tu espacio de trabajo:

| Tipo                  | Función                                              |
| --------------------- | ---------------------------------------------------- |
| Modelo de lenguaje    | Comprende la conversación y decide qué decir o hacer |
| Reconocimiento de voz | Convierte el habla de quien llama en texto           |
| Texto a voz           | Produce la voz hablada del asistente                 |
| Realtime              | Escucha y habla en un único modelo de baja latencia  |

La disponibilidad depende de tu espacio de trabajo y del [modo de motor](/es/assistants/engine-modes) seleccionado. Los modelos marcados como **Recommended** son un buen punto de partida; **Low latency** destaca las opciones adecuadas para conversaciones telefónicas con buena capacidad de respuesta.

Cuando **Fallbacks & Guardrails** está incluido, puedes elegir modelos por separado para asistentes pipeline, realtime y half-cascade. En caso contrario, el asistente usa la selección automática recomendada.

## Temperature

En modo Pipeline, **Temperature** controla cuánto se ciñe el modelo de lenguaje a tu prompt frente a variar su redacción. El control deslizante va de 0 — determinista y ceñido al guion — hacia respuestas más creativas e improvisadas. **0,5–0,8** es un rango habitual para conversaciones telefónicas.

Trátalo como un ajuste final, no como un sustituto de un prompt bien escrito:

1. Termina primero el prompt: rol, objetivos, límites, tono.
2. Empieza bajo.
3. Súbelo en pasos pequeños, solo una vez que la base suene bien.
4. Prueba y compara después de cada cambio.

Súbelo cuando las respuestas suenen rígidas o encasilladas y el caso de uso tolere algo de improvisación. Mantenlo bajo cuando la consistencia, el cumplimiento normativo o la redacción precisa importan más que la variación natural.

## Biblioteca de voces

Usa el selector de voces para filtrar por idioma y características de voz, y luego reproduce una muestra antes de guardar.

* **Assistant voice** — la voz predeterminada del asistente.
* **Voice per flow agent** — asigna voces distintas a cada agente de un [flow](/es/flow-builder/nodes).
* **Voice per language** — cambia la voz junto con el [cambio automático de idioma](/es/assistants/languages).
* **Cloned voices** — cuando está incluido en tu plan, añade una voz personalizada privada y úsala como cualquier voz de la biblioteca.

Al grabar una muestra para clonar, usa audio claro y de alta calidad, con una entonación estable y natural y sin ruido de fondo — y clona únicamente una voz que tengas permiso para usar (consulta [Consentimiento para la clonación de voz](/es/assistants/voice-cloning-consent)).

El clonado también está disponible como `POST /api/v1/voices/clone` (subida multipart, alcance `voices:write`) y la herramienta MCP `clone_voice`. Tanto el selector del panel como la llamada a la API pasan por el mismo circuito de clonado, sujeto al mismo complemento **Clone your own voice** y a la misma capacidad del plan — la API no puede crear una voz clonada que el panel no permitiría también.

## Estilo de habla

Los controles disponibles se adaptan al modelo seleccionado. Según la voz, puedes ver:

* velocidad de habla y volumen de salida;
* estabilidad, similitud o expresividad;
* instrucciones de estilo en texto libre;
* un diccionario de pronunciación para nombres, abreviaturas y términos especializados;
* filtros que evitan que se lean en voz alta el markdown y los emojis.

Solo se muestran y aplican los controles compatibles.

<Tip>
  Elige primero la voz y luego ajusta un control cada vez — estabilidad, similitud o velocidad — y escucha una frase realista de tu flujo de llamada real antes de cambiar el siguiente.
</Tip>

Cuando el ajuste **Dynamic emotions** (Expressive Mode) está disponible para la voz seleccionada, el asistente puede adaptar a la conversación la emoción, el ritmo, el énfasis, las pausas y los sonidos no verbales admitidos. Se aplica a los asistentes pipeline y half-cascade; los modelos de voz realtime gestionan la expresión vocal de forma nativa. La disponibilidad depende de la voz seleccionada, y las indicaciones de interpretación no compatibles no se aplican. Las transcripciones se mantienen limpias y no incluyen marcado de interpretación.

## Glosario de reconocimiento de voz

Abre **Assistant settings → Voice → Speech recognition** para añadir nombres de clientes, productos y nombres propios que deban transcribirse con precisión. El glosario afecta a la transcripción; usa el diccionario de pronunciación por separado cuando un término también necesite una forma hablada especial.

Si **Automatic term detection (Beta)** está disponible y activado, el asistente puede reconocer términos adicionales para la llamada en curso. Esto puede añadir uso de IA. Los términos detectados no se añaden a tu glosario guardado.

## Cadenas de respaldo

**Fallback chains** es un único interruptor, no un conjunto de opciones que configures. Actívalo, y si el servicio principal de reconocimiento de voz, modelo de lenguaje o voz se agota, falla o se cae a mitad de la llamada, el asistente pasa automáticamente a un respaldo compatible para que la conversación siga en lugar de cortarse. Famulor elige y mantiene a qué respaldo recurre cada cadena — no hay selector para los modelos de respaldo en sí.

<Note>
  Las cadenas de respaldo vienen incluidas en el complemento **Fallbacks & Guardrails**; consulta **Settings → Plan** para ver la disponibilidad. El propio cambio a un respaldo no añade ningún cargo aparte — una llamada que cambia a un respaldo se sigue facturando a la tarifa normal por minuto de llamada.
</Note>

<Note>
  Prueba los asistentes importantes después de cambiar modelos, voces o idiomas. Normalmente basta una simulación corta para detectar diferencias de pronunciación y de tiempo.
</Note>
