Skip to main content
POST
Assistenten erstellen
Einen neuen KI-Assistenten mit spezifizierter Konfiguration erstellen
Dieser Endpunkt ermöglicht es dir, einen neuen KI-Assistenten mit umfassenden Konfigurationsoptionen zu erstellen.

Engine-Modi

Die API unterstützt drei Engine-Modi mit unterschiedlichen Fähigkeiten:

Request Body

Erforderliche Kernfelder

string
erforderlich
Der Name des Assistenten (max. 255 Zeichen)
integer
erforderlich
Die Voice-ID für den Assistenten. Verwende den Endpunkt Stimmen abrufen mit dem Query-Parameter mode, um kompatible Stimmen für deinen Engine-Modus zu erhalten.
integer
erforderlich
Die Language-ID für den Assistenten. Verwende den Endpunkt Sprachen abrufen, um verfügbare Sprachen zu erhalten.
string
erforderlich
Der Assistenten-Typ. Optionen: inbound, outbound
string
erforderlich
Der Engine-Modus. Optionen: pipeline, multimodal, dualplex
string
erforderlich
Die Zeitzone des Assistenten (z.B. “Europe/Berlin”, “America/New_York”)
string
erforderlich
Die erste Nachricht, die der Assistent beim Start des Anrufs spricht (max. 200 Zeichen)
string
erforderlich
Der System-Prompt, der Verhalten und Persönlichkeit des Assistenten definiert

Modus-spezifische Felder

integer
Die LLM-Model-ID. Erforderlich für den Modus pipeline.Verwende den Endpunkt Modelle abrufen, um verfügbare Modelle zu erhalten.
integer
Die Multimodal-Model-ID. Erforderlich für die Modi multimodal und dualplex.Verwende den Endpunkt Modelle abrufen, um verfügbare Multimodal-Modelle zu erhalten.
integer
Fallback-LLM-Model-ID für Tool-Calls in multimodal/dualplex. Optional.
number
Empfindlichkeit der Turn-Detection in multimodal/dualplex (0-1). Standard: auto

Sekundäre Sprachen

integer[]
Array zusätzlicher Language-IDs, die der Assistent sprechen kann. Der Assistent erkennt die Sprache automatisch und wechselt entsprechend.

Knowledgebase-Einstellungen

integer
Die Knowledgebase-ID, die an diesen Assistenten angehängt werden soll
string
Wie die Knowledgebase verwendet wird. Optionen:
  • function_call - Die KI ruft eine Funktion zur Suche auf (erforderlich für multimodal/dualplex)
  • prompt - Wissen wird in den Prompt injiziert (nur pipeline)

Organisation

integer
ID eines Ordners, in den dieser Assistent eingeordnet werden soll. Muss zu deinem Konto gehören. Sende null, um den Assistenten unkategorisiert zu lassen.
integer[]
Array von Label-IDs, die diesem Assistenten zugewiesen werden sollen. Jedes Label muss zu deinem Konto gehören.

Telefonnummer

integer
Die ID einer Telefonnummer, die dem Assistenten zugewiesen werden soll. Muss zu deinem Konto gehören.
Für inbound Assistenten darf die Telefonnummer kein Caller-ID Typ sein und darf nicht bereits einem anderen inbound Assistenten zugewiesen sein.

Custom Mid-Call Tools

integer[]
Array von IDs für Custom Mid-Call Tools, die angehängt werden sollen. Jedes Tool muss zu deinem Konto gehören.

Built-in Tools

array
Array integrierter Tools. Jedes Tool hat ein type-Feld und tool-spezifische Felder. Bei Assistent aktualisieren ersetzt dies alle bestehenden integrierten Tools — übergib ein leeres Array [], um alle Tools zu entfernen.
In der Assistenten-Liste wird jedes konfigurierte Tool als { "type": "...", "data": { ... } } zurückgegeben — dieselben Feldnamen wie im Request, aber unter data verschachtelt (nicht top-level).

Voice- und TTS-Einstellungen

boolean
Standard:"true"
Ob emotionale Text-to-Speech Synthese aktiviert ist
number
Standard:"0.70"
Voice-Stability (0-1). Höher = konsistenter
number
Standard:"0.50"
Voice-Similarity (0-1). Höher = näher am Original
number
Standard:"1.00"
Sprechgeschwindigkeit-Multiplikator (0.7-1.2)
number
Standard:"0.10"
LLM-Temperatur (0-1). Niedriger = deterministischer
integer
Custom TTS Provider-ID. Wenn nicht gesetzt, wird anhand der Sprache automatisch ausgewählt. Siehe Synthesizer-Provider abrufen.
integer
Custom STT Provider-ID. Wenn nicht gesetzt, wird anhand der Sprache automatisch ausgewählt. Nur pipeline. Siehe Transcriber-Provider abrufen.

Call-Behavior-Einstellungen

boolean
Standard:"true"
Ob Unterbrechungen durch den Anrufer erlaubt sind.
Kann für multimodal und dualplex nicht deaktiviert werden.
boolean
Standard:"false"
Ob Filler-Audio während der Verarbeitung verwendet werden soll (z.B. “äh”, “einen Moment”).
Nur verfügbar im Modus pipeline.
object
Benutzerdefinierte Füller-Profile pro Kategorie. Wenn nicht angegeben, werden sprachabhängige Standardwerte verwendet. Jede Kategorie ist ein Array kurzer Phrasen.
  • positive: Füller für zustimmende Antworten (z.B. “Super!”, “Perfekt!”)
  • negative: Füller für ablehnende/neutrale Antworten (z.B. “Hmm.”, “Mhm.”)
  • question: Füller beim Verarbeiten einer Frage (z.B. “Hmm.”, “Einen Moment.”)
  • neutral: Füller für neutrale Bestätigungen (z.B. “Ok.”, “Verstanden.”)
boolean
Standard:"false"
Ob der Anruf aufgezeichnet werden soll
boolean
Standard:"true"
Ob Noise-Cancellation aktiviert werden soll
boolean
Standard:"false"
Wenn true, wartet der Assistent, bis der Kunde zuerst spricht

Timing-Einstellungen

integer
Standard:"600"
Maximale Anrufdauer in Sekunden (20-1200)
integer
Standard:"40"
Maximale Stille-Dauer bis zur Re-Engagement in Sekunden (1-360)
integer
Maximale Stille direkt beim Anrufstart, bevor beendet wird (1-120 Sekunden). Optional.
integer
Standard:"30"
Maximale Klingelzeit, bevor abgebrochen wird (1-60 Sekunden)

Re-Engagement-Einstellungen

integer
Standard:"30"
Re-Engagement Intervall in Sekunden (7-600)
string
Custom Prompt für Re-Engagement-Nachrichten (max. 1000 Zeichen)Beispiel: "Sind Sie noch dran? Haben Sie noch weitere Fragen?"

Voicemail-Einstellungen

boolean
Standard:"true"
Ob der Anruf beendet werden soll, wenn Voicemail erkannt wird
string
Nachricht, die auf der Voicemail hinterlassen wird (max. 1000 Zeichen)

Endpoint-Detection

string
Standard:"vad"
Voice-Activity-Detection-Typ. Optionen: vad, ai
number
Standard:"0.5"
Endpoint-Sensitivity (0-5)
number
Standard:"0.5"
Interrupt-Sensitivity (0-5)
integer
Mindestanzahl an Wörtern, bevor eine Unterbrechung erlaubt wird (0-10). Zum Aktivieren setzen.

Ambient Sound

string
Hintergrund-Ambient-Sound. Optionen: off, office, city, forest, crowded_room, cafe, nature
number
Standard:"0.5"
Ambient-Sound-Lautstärke (0-1)

Webhook-Konfiguration

boolean
Standard:"false"
Ob Webhook-Benachrichtigungen aktiviert sind
string
Die Webhook-URL für Post-Call Benachrichtigungen. Erforderlich, wenn is_webhook_active true ist.
boolean
Standard:"true"
Ob Webhooks nur bei abgeschlossenen Anrufen gesendet werden sollen (nicht bei failed/no-answer)
boolean
Standard:"true"
Ob Recording-URL in der Webhook-Payload enthalten sein soll

Post-Call Evaluation

boolean
Standard:"true"
Ob AI Post-Call Evaluation aktiviert ist
array
Schema-Definition für Post-Call Datenextraktion

Variablen

object
Key-Value Paare von Custom Variablen, die in Prompts via {{variable_name}} genutzt werden können

Conversation-Ended-Einstellungen

integer
Standard:"30"
Minuten Chat-Inaktivität, bis die Konversation als beendet gilt (1–1440)
boolean
Standard:"false"
Ob die Konversation nach Inaktivitäts-Ende erneut gestartet werden kann
string
Webhook-URL, die beim Ende einer Chat-Konversation wegen Inaktivität aufgerufen wird. Getrennt vom Anruf-Webhook.

Beispiel-Requests

pipeline Modus Assistent

multimodal Modus Assistent

dualplex Modus Assistent


Response

string
Erfolgsmeldung, die die Erstellung des Assistenten bestätigt
object

Hinweise

  • Alle erforderlichen Felder müssen für eine erfolgreiche Erstellung angegeben werden
  • Verwende den Endpunkt Stimmen abrufen mit dem Query-Parameter mode, um kompatible Stimmen zu erhalten
  • Für multimodal/dualplex muss knowledgebase_mode auf function_call gesetzt sein
  • Für multimodal/dualplex ist allow_interruptions immer aktiv
  • fillers ist nur im Modus pipeline verfügbar
  • Neue Assistenten werden standardmäßig mit Status inactive erstellt