Skip to main content
Les modèles d’un assistant déterminent la qualité de sa compréhension de l’appelant et le son de sa voix. C’est dans l’éditeur d’assistant que vous les choisissez, ajustez le style de parole, clonez votre propre voix et activez des solutions de secours qui maintiennent l’appel actif si un modèle tombe en panne en cours d’appel.

Catalogue de modèles

L’éditeur d’assistant affiche un catalogue sélectionné de modèles disponibles pour votre espace de travail : La disponibilité dépend de votre espace de travail et du mode moteur choisi. Les modèles marqués Recommended sont de bons points de départ ; Low latency signale les options adaptées aux conversations téléphoniques réactives. Lorsque Fallbacks & Guardrails est inclus, vous pouvez choisir les modèles séparément pour les assistants pipeline, realtime et half-cascade. Sinon, l’assistant utilise la sélection automatique recommandée.

Temperature

En mode Pipeline, Temperature détermine dans quelle mesure le modèle de langage s’en tient à votre prompt plutôt que de varier sa formulation. Le curseur va de 0 — déterministe et fidèle au script — jusqu’à des réponses plus créatives et improvisées. 0,5–0,8 est une plage typique pour les conversations téléphoniques. Traitez-le comme un réglage fin final, pas comme un substitut à un prompt bien écrit :
  1. Terminez d’abord le prompt — rôle, objectifs, limites, ton.
  2. Commencez bas.
  3. Augmentez par petits paliers, seulement une fois que la base sonne bien.
  4. Testez et comparez après chaque changement.
Augmentez-le quand les réponses sonnent rigides ou stéréotypées et que le cas d’usage tolère un peu d’improvisation. Gardez-le bas quand la cohérence, la conformité ou la formulation précise comptent plus que la variation naturelle.

Bibliothèque de voix

Utilisez le sélecteur de voix pour filtrer par langue et par caractéristiques, puis écoutez un extrait avant d’enregistrer.
  • Assistant voice — la voix par défaut de l’assistant.
  • Voice per flow agent — attribuez des voix distinctes à chaque agent d’un flux.
  • Voice per language — changez de voix en même temps que le changement automatique de langue.
  • Cloned voices — si votre forfait le permet, ajoutez une voix personnalisée privée et utilisez-la comme une voix de la bibliothèque.
Pour enregistrer un échantillon à cloner, utilisez un audio clair et de haute qualité, avec un débit stable et naturel et sans bruit de fond — et ne clonez qu’une voix que vous avez le droit d’utiliser (voir Consentement au clonage vocal). Le clonage est aussi disponible via POST /api/v1/voices/clone (import multipart, portée voices:write) et l’outil MCP clone_voice. Le sélecteur du tableau de bord et l’appel API passent tous deux par le même circuit de clonage, soumis au même add-on Clone your own voice et à la même capacité de forfait — l’API ne peut pas créer de voix clonée que le tableau de bord n’autoriserait pas déjà.

Style de parole

Les réglages disponibles s’adaptent au modèle sélectionné. Selon la voix, vous pouvez disposer de :
  • débit de parole et volume de sortie ;
  • stabilité, similarité ou expressivité ;
  • instructions de style en texte libre ;
  • un dictionnaire de prononciation pour les noms, abréviations et termes spécialisés ;
  • filtres empêchant la lecture du markdown et des emoji.
Seuls les réglages compatibles sont affichés et appliqués.
Choisissez d’abord la voix, puis ajustez un réglage à la fois — stabilité, similarité ou débit — en écoutant une phrase réaliste tirée de votre flux d’appel réel avant de passer au réglage suivant.
Lorsque le réglage Dynamic emotions (Expressive Mode) est disponible pour la voix sélectionnée, l’assistant peut adapter l’émotion, le rythme, l’accentuation, les pauses et les sons non verbaux pris en charge à la conversation. Cela s’applique aux assistants pipeline et half-cascade ; les modèles vocaux realtime gèrent l’expression vocale nativement. La disponibilité dépend de la voix sélectionnée, et les indications d’interprétation non prises en charge ne sont pas appliquées. Les transcriptions restent propres et ne contiennent aucun balisage d’interprétation.

Glossaire de reconnaissance vocale

Ouvrez Assistant settings → Voice → Speech recognition pour ajouter les noms de clients, produits et noms propres qui doivent être transcrits avec précision. Le glossaire agit sur la transcription ; utilisez séparément le dictionnaire de prononciation lorsqu’un terme a aussi besoin d’une forme orale particulière. Si Automatic term detection (Beta) est disponible et activée, l’assistant peut reconnaître des termes supplémentaires pour l’appel en cours. Cela peut ajouter de l’usage IA. Les termes détectés ne sont pas ajoutés à votre glossaire enregistré.

Chaînes de secours

Fallback chains est un simple interrupteur, pas un ensemble de choix à configurer. Activez-le, et si le service principal de reconnaissance vocale, de modèle de langage ou de voix expire, renvoie une erreur ou décroche en cours d’appel, l’assistant bascule automatiquement vers un service de secours compatible pour que la conversation continue au lieu de s’interrompre. C’est Famulor qui choisit et maintient vers quel service de secours chaque chaîne bascule — il n’y a pas de sélecteur pour les modèles de secours eux-mêmes.
Les chaînes de secours sont incluses dans l’add-on Fallbacks & Guardrails ; consultez Settings → Plan pour vérifier leur disponibilité. Le basculement lui-même n’ajoute aucun coût séparé — un appel qui bascule est toujours facturé au tarif normal à la minute d’appel.
Testez les assistants importants après avoir changé de modèles, de voix ou de langues. Une courte simulation suffit généralement à repérer les différences de prononciation et de timing.