Skip to main content
Ce sont ces réglages qui font la différence entre « on dirait clairement un robot » et une conversation où l’on a envie de rester en ligne. Ils se configurent tous par assistant.

Audio d’ambiance

Un silence complet sonne artificiel au téléphone. Vous pouvez y superposer :
  • Ambient sound — bureau, ville, forêt, pièce animée ou bruit de clavier, avec un volume réglable (ou votre propre audio importé).
  • Thinking sound — un son discret pendant que l’assistant réfléchit — durant l’attente du LLM et lors des appels d’outils — afin que le traitement ne ressemble jamais à un appel coupé.
La musique d’attente ne fait pas partie de cette section : elle se configure directement sur l’outil de transfert à chaud (piste intégrée ou votre propre import), puisqu’elle ne joue que pendant qu’un superviseur est briefé.

Gestion des interruptions

Les appelants coupent la parole — les bons assistants gèrent cela avec naturel.
  • Allow interruptions — activé par défaut ; l’assistant arrête de parler dès que l’appelant prend la parole.
  • Minimum interruption duration — ignore les bruits très brefs, pour qu’une toux ne coupe pas l’assistant.
  • Adaptive interruptions — les marques d’écoute comme « mhm », « d’accord » ou « oui » ne sont pas traitées comme des interruptions, si bien que l’assistant continue de parler malgré ces réactions naturelles de l’auditeur, mais cède la parole face à une véritable interjection. Dans les modes Realtime compatibles, sélectionnez Adaptive sous Turn detection pour activer ce comportement.
Pour commencer, les assistants sortants fonctionnent en général mieux lorsqu’ils sont plus faciles à interrompre — un appelant qui veut intervenir ne devrait pas avoir à parler par-dessus une offre commerciale. Les assistants d’accueil et de réception bénéficient souvent d’un peu plus de stabilité, afin qu’une toux isolée ou une voix en arrière-plan ne coupe pas l’assistant en plein milieu d’une phrase.

Préréglages d’environnement bruit et VAD

Sous Conversation → Latency, Noise & echo cancellation est un simple interrupteur marche/arrêt — le modèle adapté au canal (téléphone ou web) est choisi pour vous. En dessous, VAD sensitivity / noise threshold propose quatre préréglages d’environnement qui déterminent le niveau sonore à partir duquel quelque chose compte comme de la parole : Un latency waterfall en direct (STT / LLM TTFT / TTS TTFB / E2E) n’apparaît que dans le panneau de test d’appel web du studio — jamais dans le widget public.
Les recommandations télécom (ITU-T G.114) visent une latence aller simple inférieure à 150 ms pour qu’un appel paraisse naturel — un repère utile pour décider avec quelle agressivité régler l’interruption et la sensibilité VAD selon votre cas d’usage.

Phrases de remplissage et outils asynchrones

Quand un appel d’outil (recherche CRM, vérification de disponibilité) prend quelques secondes, l’assistant peut combler ce temps mort :
  • Speak-during text — une annonce fixe au démarrage de l’outil (« Un instant, je vérifie ça… »).
  • Filler phrases — un ensemble de phrases courtes prononcées à tour de rôle pendant les attentes plus longues, avec un délai initial et un intervalle configurables. Elles ne sont dites que pendant les pauses — elles ne parlent jamais par-dessus l’appelant.
  • Async tools — marquez un nœud outil comme asynchrone, et la conversation continue pendant que l’outil s’exécute ; le résultat est intégré dès qu’il arrive.

Gestion de l’inactivité

Personne ne veut d’un appel qui reste indéfiniment silencieux :
  • Idle timeout — passé ce nombre de secondes de silence, l’assistant relance l’appelant (« Vous êtes toujours là ? »).
  • Idle messages — phrases fixes facultatives pour ces relances ; laissez le champ vide pour des relances générées naturellement par le LLM.
  • Max rounds — après N relances sans réponse, l’assistant prend congé et raccroche. Cela protège également votre solde de minutes.
Indépendamment de cela, la max call duration plafonne chaque appel : une fois atteinte, l’assistant conclut poliment et met fin à l’appel.

Messagerie vocale

Ce réglage détermine uniquement ce qui se passe une fois que la détection de répondeur (AMD) signale une boîte vocale sur un appel sortant — pas ce qui se passe quand un appel sonne simplement dans le vide sans réponse.
  • Leave a voicemail message — activé : l’assistant énonce un message, puis raccroche. Désactivé : l’assistant raccroche immédiatement, sans rien laisser.
  • Voicemail message — le message en texte libre prononcé par synthèse vocale lorsqu’une boîte vocale est détectée. Gardez-le court et incluez un numéro de rappel. Laissez-le vide pour utiliser à la place l’accueil / le premier message.
L’AMD s’exécute automatiquement sur les appels sortants directs. Sur les appels de campagne, elle s’exécute lorsque la campagne a l’AMD activée ou que cette bascule est activée.
La réponse à une boîte vocale détectée provient toujours de ce réglage de l’assistant, jamais de la campagne qui a passé l’appel — même si une campagne peut, séparément, activer ou désactiver sa propre détection de répondeur.

Sonnerie

Deux délais indépendants déterminent combien de temps un appel sonne avant que quelque chose ne se passe :
Ceci est distinct du délai de sonnerie propre à l’outil Call transfer, qui chronomètre une seule tentative de transfert plutôt que l’appel d’origine.

Consentement

Pour les juridictions exigeant le consentement de toutes les parties (Allemagne : §201 StGB) :
  • Consent announcement — un message configurable diffusé au début de l’appel (pré-généré, sans latence ajoutée).
  • Consent mode — l’appelant donne son accord à l’oral ou en appuyant sur une touche (DTMF).
  • On decline — soit poursuivre l’appel, soit y mettre fin poliment.
  • Le résultat du consentement est stocké avec l’appel, à l’épreuve des audits.

Ce que couvre le consentement

Une seule annonce peut couvrir deux finalités distinctes. Cochez-les indépendamment dans l’éditeur d’assistant :
  • Recording the call — l’enregistrement démarre seulement après le consentement, jamais avant, et nécessite en plus Record calls. Demandé à chaque appel, car chaque enregistrement requiert sa propre autorisation.
  • Remember callers — un consentement accordé débloque la mémoire durable de cet appelant, de sorte que les appelants récurrents soient reconnus sans que personne n’ait à les approuver manuellement sous Audience → Customer memory. Demandé une seule fois.
Un consentement refusé n’est jamais enregistré comme un refus permanent : l’appelant est simplement redemandé lors d’un appel ultérieur. Le consentement mémoire n’est redemandé qu’après l’expiration, sans appel entretemps, de la période de rétention définie sous Settings → Memory — la mémoire expirée est supprimée, si bien que l’appel suivant repart de zéro.
Chaque finalité doit être nommée dans l’annonce. Le consentement à être enregistré n’équivaut pas au consentement à la conservation d’un profil client — ce sont des finalités distinctes au regard du RGPD. Lorsque vous cochez une finalité, l’éditeur propose une formulation adaptée dans la langue de l’assistant ; si le texte reste vide, une formulation par défaut tenant compte de la finalité et de la langue est utilisée.Si Record calls est activé alors que l’annonce ne couvre pas l’enregistrement, l’assistant refuse d’enregistrer et journalise recording_skipped_no_consent — il n’enregistrera jamais sans avoir prévenu.

Confidentialité des enregistrements : caviardage et retranscription

Deux réglages supplémentaires se trouvent à côté de l’enregistrement, sous Settings → Privacy.

Caviarder les données personnelles dans la transcription

Les catégories sélectionnées de données personnelles sont remplacées par [REDACTED:type] avant que la transcription ne soit stockée — une minimisation des données, pas un simple masquage à l’affichage. Cela ne s’applique qu’aux appels nouvellement terminés ; les transcriptions déjà stockées conservent leur texte d’origine. L’activer sélectionne d’abord quatre catégories — adresse e-mail, numéro de téléphone, IBAN et numéro de carte bancaire. La liste intégrée complète est bien plus large : elle couvre l’identité, les coordonnées, les identifiants gouvernementaux, les données financières, les identifiants de sécurité et les informations de santé, et vous pouvez en sélectionner n’importe quelle combinaison. Au-delà des catégories intégrées, ajoutez jusqu’à 20 motifs personnalisés (expressions régulières) pour tout ce qui est spécifique à votre activité.

Retranscription automatique

Indépendamment de l’action manuelle Re-transcribe dans l’historique, Re-transcribe recording peut s’exécuter automatiquement pour chaque appel enregistré. Une fois activée, l’enregistrement de chaque appel terminé est retranscrit avec un moteur plus précis dès la fin de l’appel ; la transcription améliorée apparaît dans la vue détaillée de l’appel, à côté de la transcription en direct. Cela nécessite que Record calls soit activé.
La retranscription automatique est facturée par minute enregistrée (arrondie au supérieur), au tarif Re-transcribe de l’espace de travail ; les tarifs actuels figurent sur la page Usage.

Garde-fous

Des filets de sécurité déterministes, en complément du prompt :
  • Manipulation → Prompt injection — bloque les tentatives de contournement ou de remplacement des instructions système (détection de jailbreak dans les propos de l’appelant). Disponible sur tous les forfaits, activé par défaut ; décochez pour désactiver (guardrails.input.jailbreak).
  • Blocked topics — sujets que l’assistant doit refuser d’aborder ; toute réponse correspondante est remplacée par votre refusal text (Fallbacks & Guardrails).
  • Escalation keywords — si l’appelant en mentionne un (par exemple « avocat », « urgence »), c’est la plateforme — et non le LLM — qui déclenche un transfert immédiat vers votre escalation number (Fallbacks & Guardrails).
Les filtres de sujets et de catégories sont appliqués sur le chemin de sortie : ils restent donc valables même si un appelant habile parvient à faire dévier le modèle de son prompt.

Prononciation et nettoyage du texte

Voir Modèles et voix → Style de parole : dictionnaire de prononciation, filtrage markdown/emoji, débit de parole et volume de sortie.

Dépannage

Modifiez un seul réglage à la fois et retestez avec un appel réaliste — des changements petits et isolés sont bien plus faciles à évaluer que plusieurs à la fois.