> ## Documentation Index
> Fetch the complete documentation index at: https://docs.web-wb.de/llms.txt
> Use this file to discover all available pages before exploring further.

# Allgemeine Einstellungen

> Grundlegende Konfigurationseinstellungen für Ihren KI-Assistenten, einschließlich Anrufrichtung, Telefonnummern, Stimme und erweiterte Einstellungen.

Konfigurieren Sie die grundlegenden Einstellungen für Ihren KI-Assistenten, einschließlich Anrufrichtung, Telefonnummern, Stimmauswahl und technische Parameter.

## Schnellstart-Anleitung

Bereit, Ihren ersten KI-Assistenten einzurichten? Hier ist der wesentliche Ablauf:

1. **Anrufrichtung wählen:** Eingehend (beantwortet Anrufe) oder Ausgehend (tätigt Anrufe)
2. **Assistentenname festlegen:** Interne Bezeichnung wie "Support-Bot" oder "Vertriebs-Bot"
3. **Telefonnummern konfigurieren:** Plattformnummern, SIP oder Anrufer-ID zuweisen
4. **Stimme & Sprache auswählen:** Aus integrierten Stimmen wählen oder benutzerdefinierte klonen
5. **Erweiterte Einstellungen anpassen:** Modelle, Timing und Audio-Parameter feinabstimmen

<Tip>
  **Testen Sie immer Ihre Änderungen**, indem Sie den Assistenten anrufen oder eine kleine Kampagne durchführen, um zu bestätigen, dass er sich wie erwartet verhält.
</Tip>

<Note>
  Folgen Sie dieser Seite Abschnitt für Abschnitt, um Ihren Assistenten zu konfigurieren. Jede Einstellung enthält detaillierte Erklärungen und Best Practices, um Ihnen bei der richtigen Wahl zu helfen.
</Note>

## Anrufrichtung & Grundeinrichtung

### Assistententyp

Wählen Sie, ob Ihr Assistent **eingehende** oder **ausgehende** Anrufe bearbeitet. Diese grundlegende Wahl beeinflusst, welche anderen Optionen verfügbar werden.

**Eingehend (Anrufe empfangen):** Bearbeitet eingehende Anrufe von Kunden. Siehe [Übersicht eingehende Anrufe](/inbound-calls/overview).

**Ausgehend (Anrufe tätigen):** Initiiert Anrufe an Leads oder Kunden. Siehe [Übersicht ausgehende Anrufe](/outbound-calls/overview).

### Assistentenname

Ein beschreibender Name zur Identifizierung Ihres Assistenten im Dashboard. Verwenden Sie etwas Einprägsames, das den Zweck des Assistenten beschreibt (z.B. "Vertriebs-Qualifizierer", "Support-Bot", "Termin-Planer").

## Telefonnummern-Konfiguration

Ihr Assistent benötigt eine Telefonnummer zum Betrieb. Die verfügbaren Optionen hängen von Ihrer Anrufrichtungswahl ab.

### Für ausgehende Assistenten

Sie können verwenden:

* **Plattformnummern:** Direkt von unserer Plattform gemietete Nummern
* **SIP-Nummern:** Verbinden Sie Ihr bestehendes VOIP/PBX-System
* **Nur Anrufer-ID:** Verifizieren Sie den Besitz einer bestehenden Nummer, um sie bei ausgehenden Anrufen anzuzeigen

### Für eingehende Assistenten

Sie können verwenden:

* **Plattformnummern:** Direkt von unserer Plattform gemietete Nummern
* **SIP-Nummern:** Verbinden Sie Ihr bestehendes VOIP/PBX-System

**Hinweis:** Nur-Anrufer-ID-Nummern können keine eingehenden Anrufe bearbeiten - sie werden nur bei ausgehenden Anrufen angezeigt.

### Preise & Kosten

* **Plattformnummern:** Monatliche Mietgebühren ab \$3,99/Monat. Siehe [Dedizierte Nummer mieten](/pricing/number-rentals#1-renting-a-dedicated-number) für detaillierte Preise.
* **SIP-Integration:** Keine monatliche Gebühr, nur \$0,00045/Min. für KI-Bridging. Siehe [SIP-Integrations-Preise](/pricing/number-rentals#2-sip-integration-no-monthly-fee).
* **Anrufer-ID:** Keine monatliche Gebühr, regionsbasierte Minutenraten (z.B. \$0,01/Min. in den USA). Siehe [Anrufer-ID-Preise](/pricing/number-rentals#3-caller-id-no-monthly-fee).

Siehe [Telefonnummern-Typen](/phone-numbers/types) für detaillierte Erklärungen und [SIP-Integrationsleitfaden](/provisioning/sip-trunking/sip-integration) für VOIP-Einrichtung.

## Engine-Typ (Sprachverarbeitungsmodus)

Wählen Sie, wie Ihre KI Sprache verarbeitet und Antworten generiert. Jeder Modus ist für unterschiedliche Anwendungsfälle optimiert. Siehe [Assistenten-Modi](/ai-assistants/assistant-modes) für detaillierte Vergleiche.

### Pipeline-Modus

Traditionelle Speech-to-Text → LLM → Text-to-Speech-Pipeline. Bietet maximale Kontrolle über Stimmauswahl und Antwortgenerierung.

**Am besten für:** Komplexe Überlegungen, Funktionsaufrufe, benutzerdefinierte Stimmanforderungen

### Speech-to-Speech-Modus

Direkte Sprache-zu-Sprache-Generierung ohne Zwischentext-Verarbeitung. Bietet den natürlichsten Gesprächsfluss.

**Am besten für:** Schnelle Gespräche, natürlicher Hin-und-Her-Dialog

### Dualplex-Modus (Beta)

Kombiniert schnelle multimodale Verarbeitung mit Premium-ElevenLabs-Sprachausgabe.

**Am besten für:** Die meisten Anwendungsfälle - empfohlene Standardeinstellung

## Sprachkonfiguration

### Primärsprache

Die Hauptsprache, die Ihr Assistent für Spracherkennung und -synthese verwenden wird. Dies beeinflusst:

* Spracherkennungsgenauigkeit
* Verfügbare Stimmoptionen
* Füllwort-Audio-Phrasen
* Stimmmodell-Auswahl

Siehe [Sprachunterstützung](/conversation-design/language-support) für alle verfügbaren Sprachen und Akzente.

### Sekundärsprachen

Zusätzliche Sprachen, die Ihr Assistent verstehen und sprechen kann. Nützlich für:

* Mehrsprachigen Kundensupport
* Internationale Unternehmen
* Code-Switching-Gespräche

**Hinweis:** Die KI kann erkennen, welche Sprache der Kunde spricht, und entsprechend antworten.

## KI-Stimmauswahl

Ihr Assistent kann aus vorhandenen Stimmen wählen, benutzerdefinierte Stimmen klonen oder Stimmen aus der ElevenLabs-Bibliothek anfordern.

### Stimmoptionen

Sie haben drei Möglichkeiten, die perfekte Stimme für Ihren Assistenten zu erhalten:

**1. Aus vorhandenen Stimmen wählen:**

* **Professionelle Stimmen:** Vortrainierte, hochwertige Optionen von ElevenLabs
* **Mehrere Akzente:** Verfügbar für die meisten Sprachen
* **Geschlechtsoptionen:** Männliche und weibliche Stimmen für jede Sprache
* **Tonvielfalt:** Von formell geschäftlich bis lässig gesprächig

**2. Benutzerdefinierte Stimme klonen:**
Erstellen Sie eine benutzerdefinierte Stimme, indem Sie Audiosamples hochladen:

**Anforderungen:**

* Klares, hochwertiges Audiosample (1-5 Minuten empfohlen)
* MP3- oder WAV-Format
* Konsistentes Sprechtempo und Ton
* Minimaler Hintergrundgeräusch
* Durchgehend dieselbe Stimme verwendet

**Prozess:**

1. Nehmen Sie sich selbst oder einen Sprecher beim Lesen eines Beispieltextes auf
2. Laden Sie die Audiodatei in den Assistenteneinstellungen hoch
3. Warten Sie, bis das Training abgeschlossen ist (wenige Minuten bis Stunden)
4. Testen Sie die geklonte Stimme vor der Verwendung in der Produktion

**Anwendungsfälle:**

* Markenkonsistenz mit Unternehmenssprecher
* Persönliche Note für Kundenbeziehungen
* Stimme an spezifische Geschäftspersona anpassen

**3. Aus ElevenLabs-Bibliothek anfordern:**
Sie können spezifische Stimmen aus der öffentlichen ElevenLabs-Bibliothek anfordern - kontaktieren Sie den Support, um sie Ihrem Konto hinzuzufügen. Durchsuchen Sie die [ElevenLabs Voice Library](https://elevenlabs.io/docs/product-guides/voices/voice-library), um Tausende professioneller Stimmen in verschiedenen Sprachen, Akzenten und Anwendungsfällen zu entdecken.

Siehe [Stimmauswahl-Leitfaden](/ai-assistants/voice-selection) für detaillierte Einrichtungsanweisungen.

## Zeitzonen-Konfiguration

### Zeitzone

Legen Sie die Zeitzone fest, in der Ihr Assistent arbeitet. Dies beeinflusst:

* Zeitbasierte Variablen in Gesprächen
* Terminplanungsfunktionen
* "Aktuelle Zeit"-Referenzen in System-Prompts
* Zeitstempel in Anrufprotokollen und Datenextraktion

**Wichtig:** Wählen Sie die Zeitzone, in der Ihr Unternehmen tätig ist oder wo sich die meisten Kunden befinden. Der Assistent verwendet diese für alle zeitbezogenen Berechnungen oder Planungen.

## Audio-Verbesserungseinstellungen

### Umgebungsgeräusch

Optionales Hintergrundgeräusch, das unter die Stimme Ihres Assistenten gemischt wird, um Verarbeitungsverzögerungen zu überbrücken und ein natürlicheres Audioerlebnis zu schaffen.

**Optionen:**

* **Keine:** Kein Hintergrundgeräusch (Standard)
* **Büro:** Subtile Büroumgebungsgeräusche

**Lautstärkeregelung:** Passen Sie den Pegel des Umgebungsgeräuschs relativ zur Stimme an. Niedrigere Werte sind normalerweise besser - zu viel Hintergrundgeräusch kann die Spracherkennung stören.

<Tip>
  Ausschalten oder Lautstärke verringern, wenn der Assistent den Kunden nicht klar hört.
</Tip>

### Füllwort-Audio

Kurze Gesprächsphrasen wie "mhm", "okay", "Ich verstehe", die während der KI-Verarbeitungszeit abgespielt werden. Siehe [Füllwort-Audio-Leitfaden](/ai-assistants/filler-audio) für vollständige Details.

<Card title="Vorteile" icon="star">
  * Beseitigt unangenehme Stille während der Verarbeitung
  * Hält Anrufer engagiert
  * Schafft natürlicheren Gesprächsfluss
  * Reduziert Auflege-Raten
</Card>

**Sprachbewusste Konfiguration:** Füllphrasen werden automatisch für Ihre gewählte Sprache eingestellt:

<AccordionGroup>
  <Accordion title="Positive Antworten" icon="thumbs-up">
    "Großartig!", "Perfekt!", "Super!"
  </Accordion>

  <Accordion title="Negative Antworten" icon="thumbs-down">
    "Hmm.", "Ich verstehe.", "Okay."
  </Accordion>

  <Accordion title="Fragen-Antworten" icon="circle-question">
    "Richtig?", "Wirklich?", "Wie so?"
  </Accordion>

  <Accordion title="Neutrale Antworten" icon="circle">
    "Okay.", "Ich verstehe.", "Verstanden."
  </Accordion>
</AccordionGroup>

**Anpassung:** Sie können die Standardphrasen für jede Kategorie bearbeiten, um sie an Ihre Markenstimme oder regionale Präferenzen anzupassen.

<Note>
  Standardmäßig aktivieren - die meisten Gespräche profitieren von Füllwörtern. Testen Sie mit Ihrer Zielgruppe und passen Sie Phrasen an die Persönlichkeit Ihres Assistenten an.
</Note>

## Erweiterte Einstellungen

### LLM-Modellauswahl

Wählen Sie das beste Sprachmodell für den Modus Ihres Assistenten. Siehe [LLM-Modellauswahl-Leitfaden](/ai-assistants/assistant-configuration#3-select-an-llm-model) für detaillierte Empfehlungen.

**Empfohlene Modelle nach Modus:**

| Modell                   | Stärken                                        | Am besten für                                |
| ------------------------ | ---------------------------------------------- | -------------------------------------------- |
| **GPT-5 Mini**           | Ausgewogene Überlegung mit geringer Latenz     | **Pipeline**-Modus für komplexe Überlegungen |
| **GPT-5 Realtime**       | Ultra-niedrige-Latenz-Sprachwendungen          | **Speech-to-Speech** und **Dualplex**        |
| **GPT-4o**               | Starke Überlegung und multimodales Verständnis | Komplexe Aufgaben (höhere Latenz)            |
| **Gemini Flash 2.0/2.5** | Ultra-schnell für Sprachwendungen              | **Dualplex/Multimodal** für minimale Latenz  |

**Schnellauswahl-Leitfaden:**

* **Geschwindigkeit ist kritisch:** Verwenden Sie GPT-5 Realtime oder Gemini Flash 2.0/2.5
* **Umfangreiche Überlegung benötigt:** Verwenden Sie GPT-4o oder GPT-5 Mini mit Füllwort-Audios zur Latenzausgleichung

### LLM-Temperatur

**Bereich:** 0.0 - 1.0 | **Standard:** 0.1

Passen Sie den Kreativitätsgrad der KI bei der Generierung von Antworten an. Niedrigerer Wert ergibt bessere Funktionsaufrufergebnisse.

<CardGroup cols={2}>
  <Card title="Niedriger (0.0-0.3)" icon="snowflake">
    **Stabiler:** Vorhersagbare Antworten, besser für Funktionsaufrufe und Geschäftsanwendungen
  </Card>

  <Card title="Höher (0.7-1.0)" icon="fire">
    **Zufälliger:** Kreative und vielfältige Antworten, gut für lockere Gespräche
  </Card>
</CardGroup>

<Note>
  **Besonderes Verhalten:** Für GPT-5 Mini- und GPT-5 Nano-Modelle im Pipeline-Modus wird die Temperatur automatisch auf 1.0 für optimale Leistung gesetzt.
</Note>

### Dauereinstellungen

Steuern Sie Timing und Anruflimits, um Benutzererfahrung und Kosten zu optimieren:

<AccordionGroup>
  <Accordion title="Erneutes Engagement-Intervall" icon="clock">
    **Bereich:** 7 - 600 Sekunden | **Standard:** 30 Sekunden

    KI versucht, den Benutzer erneut anzusprechen, wenn innerhalb dieser Zeit keine Antwort erkannt wird.

    **Empfohlen:** 30-60 Sekunden für professionelle Anrufe.
  </Accordion>

  <Accordion title="Maximale Anrufdauer" icon="timer">
    **Bereich:** 20 - 1200 Sekunden | **Standard:** 600 Sekunden (10 Minuten)

    Anruf wird automatisch beendet, wenn dieser Wert erreicht wird.

    **Empfohlen:** 5-10 Minuten für Lead-Qualifizierung zur Kostenkontrolle.
  </Accordion>

  <Accordion title="Maximale Stillezeitdauer" icon="volume-off">
    **Bereich:** 1 - 120 Sekunden | **Standard:** 40 Sekunden

    Anruf wird beendet, wenn Benutzer innerhalb dieser Zeit nicht antwortet.

    **Empfohlen:** 30-45 Sekunden für Balance zwischen Geduld und Effizienz.
  </Accordion>

  <Accordion title="Klingelzeit" icon="phone">
    **Bereich:** 1 - 60 Sekunden | **Standard:** 30 Sekunden

    Wie lange der Anruf klingelt, bevor er als unbeantwortet markiert wird. **Gut, wenn Sie Voicemail vermeiden möchten, indem Sie einen niedrigeren Wert einstellen.**
  </Accordion>
</AccordionGroup>

<Tip>
  **Kostenoptimierung:** Niedrigere Dauerlimits helfen, Minutenkosten zu kontrollieren, besonders wichtig für Kampagnen mit hohem Volumen.
</Tip>

### Anrufschutzeinstellungen

<AccordionGroup>
  <Accordion title="Rauschunterdrückung" icon="shield">
    **Standard:** Aktiviert

    Filtert Hintergrundgeräusche des Anrufers für klarere Spracherkennung. AUSSCHALTEN, wenn Audio-Clipping auftritt.
  </Accordion>

  <Accordion title="Anruf bei Voicemail beenden" icon="voicemail">
    **Standard:** Aktiviert

    Beendet Anruf sofort, wenn Voicemail bei ausgehenden Anrufen erkannt wird (spart Kosten).
  </Accordion>

  <Accordion title="Anrufe aufzeichnen" icon="record-vinyl">
    **Standard:** Aktiviert

    Zeichnet Anruf-Audio zur Überprüfung und Analyse auf. **Stellen Sie Compliance mit lokalen Aufzeichnungsgesetzen sicher.**
  </Accordion>

  <Accordion title="Maximale anfängliche Stille" icon="timer">
    **Bereich:** 1 - 120 Sekunden | **Standard:** 20 Sekunden (wenn aktiviert)

    Wenn aktiviert, Anruf beenden, wenn keine erste Benutzerantwort innerhalb dieser Zeit. Zählt nur vom Anrufstart bis zur ersten Benutzerantwort.

    **Anwendungsfall:** Erkennen, ob tatsächlich jemand ans Telefon gegangen ist.
  </Accordion>
</AccordionGroup>

## Synthesizer-Einstellungen

Konfigurieren Sie Text-to-Speech-Stimmparameter für natürlich klingende Gespräche.

**Verfügbar für:** Nur Pipeline- und Dualplex-Modi. Speech-to-Speech-Modus verwendet native Stimmgenerierung.

### Stimmabstimmungs-Parameter

Feinabstimmung der Stimmcharakteristiken Ihres Assistenten für optimale Leistung:

<AccordionGroup>
  <Accordion title="Stimmstabilität" icon="wave-square">
    **Bereich:** 0.0 - 1.0 | **Standard:** 0.7

    Niedrigere Einstellungen machen die Stimme expressiver, aber weniger vorhersagbar, während höhere Einstellungen sie stetiger, aber weniger emotional machen.

    <CardGroup cols={2}>
      <Card title="Expressiver (0.0-0.3)" icon="sparkles">
        Dynamische und vielfältige Wiedergabe, aber weniger vorhersagbar
      </Card>

      <Card title="Stabiler (0.7-1.0)" icon="shield-check">
        Konsistent und stetig, aber weniger emotionaler Bereich
      </Card>
    </CardGroup>
  </Accordion>

  <Accordion title="Stimmähnlichkeit" icon="fingerprint">
    **Bereich:** 0.0 - 1.0 | **Standard:** 0.5

    Bestimmt, wie genau die KI die Originalstimme nachahmt. Höhere Einstellungen können unerwünschtes Rauschen aus der Originalaufnahme enthalten.

    <CardGroup cols={2}>
      <Card title="Stabiler (0.0-0.4)" icon="filter">
        Saubereres Audio, aber weniger genau zur Originalstimme
      </Card>

      <Card title="Ähnlicher (0.6-1.0)" icon="copy">
        Genau zum Original, kann aber Hintergrundgeräusche enthalten
      </Card>
    </CardGroup>

    <Warning>
      **Für geklonte Stimmen:** Bei 0.5 beginnen und schrittweise erhöhen. Höhere Ähnlichkeit kann unerwünschte Artefakte aus der Originalaufnahme einführen.
    </Warning>
  </Accordion>

  <Accordion title="Sprechgeschwindigkeit" icon="gauge">
    **Bereich:** 0.7 - 1.2 | **Standard:** 1.0

    Passen Sie die Geschwindigkeit der KI-Sprache für optimales Verständnis und Benutzererfahrung an.

    <CardGroup cols={3}>
      <Card title="Langsamer (0.7-0.85)" icon="turtle">
        Besser für komplexe Informationen oder ältere Demografien
      </Card>

      <Card title="Normal (0.9-1.1)" icon="clock">
        Standard-Gesprächstempo für die meisten Anwendungsfälle
      </Card>

      <Card title="Schneller (1.15-1.2)" icon="rabbit">
        Schnelle Gespräche oder zeitsensitive Szenarien
      </Card>
    </CardGroup>
  </Accordion>
</AccordionGroup>

## Transkriptions-Einstellungen

Konfigurieren Sie Speech-to-Text-Erkennung für optimale Genauigkeit und Geschwindigkeit.

**Verfügbar für:** Nur Pipeline-Modus. Speech-to-Speech- und Dualplex-Modi verwenden integrierte Transkription.

### Anbieterauswahl

Wählen Sie den besten Transkriptor für Ihre Sprache und Ihren Anwendungsfall. Der Anbieter, der zur Transkription der Benutzersprache verwendet wird.

<CardGroup cols={3}>
  <Card title="Azure" icon="cloud">
    **Genauigkeit:** ⭐⭐⭐⭐
    **Latenz:** Langsamer

    Am besten für höchste Transkriptionstreue, wenn Genauigkeit kritisch ist.
  </Card>

  <Card title="Gladia" icon="bolt">
    **Genauigkeit:** ⭐⭐⭐
    **Latenz:** Schneller

    Guter Allrounder für die meisten Sprachen. Unterstützt mehrsprachige Konfigurationen.
  </Card>

  <Card title="Deepgram" icon="waveform">
    **Genauigkeit:** ⭐⭐⭐
    **Latenz:** Schneller

    Solide Wahl für Englisch und Hauptsprachen.
  </Card>
</CardGroup>

<Note>
  Verschiedene Sprachen, Akzente oder Hintergrundgeräusche können jeden Anbieter unterschiedlich beeinflussen. Testen Sie, welcher für Ihre spezifische Sprache und Audio-Einrichtung besser funktioniert.
</Note>

### Endpunkt-Konfiguration

<CardGroup cols={2}>
  <Card title="KI-Wendeerkennung" icon="brain">
    Verwendet KI zur intelligenten Erkennung, wann der Anrufer zu Ende gesprochen hat
  </Card>

  <Card title="Sprachaktivitätserkennung (VAD)" icon="microphone">
    **Standard:** Traditionelle Sprachaktivitätserkennung

    Wählen Sie, wie die KI das Ende der Benutzerphrase erkennt
  </Card>
</CardGroup>

### Sprachaktivitätserkennung (VAD)

Steuern Sie, wann Ihr Assistent zu sprechen beginnt und aufhört. Siehe [Leitfaden zum Umgang mit Unterbrechungen](/conversation-design/interruptions) für detaillierte VAD-Konfiguration.

<Warning>
  Feinabstimmung dieser Einstellungen, wenn Unterbrechungsprobleme oder träge Antworten auftreten.
</Warning>

<AccordionGroup>
  <Accordion title="Endpunkt-Empfindlichkeit" icon="microphone">
    **Bereich:** 0 - 5 Sekunden | **Standard:** 0.5

    Passen Sie die Zeit an, die die KI wartet, bis der Benutzer nach dem letzten Wort spricht. Niedrigere Werte machen die KI schneller, höhere Werte sind besser für lange Benutzerphrasen.

    * **0 (Schneller):** Schnelle Antworten, kann aber Anrufer unterbrechen
    * **5 (Langsamer):** Wartet länger, reduziert Unterbrechungen
  </Accordion>

  <Accordion title="Unterbrechungs-Empfindlichkeit" icon="volume-off">
    Wie leicht der Assistent stoppt, wenn der Anrufer dazwischenredet. Steuert die Empfindlichkeit zur Erkennung, wann ein Anrufer versucht zu unterbrechen.
  </Accordion>

  <Accordion title="Minimale Unterbrechungswörter" icon="list-ol">
    Erfordern Sie mindestens N Anruferwörter vor der Unterbrechung des Assistenten.
    **Verwendung:** Verhindert falsche Auslöser durch Hintergrundgeräusche oder kurze Töne.
  </Accordion>
</AccordionGroup>

<Tip>
  **Profi-Tipp:** Beginnen Sie mit Standard-VAD-Einstellungen und passen Sie basierend auf echten Anruftests an. Erhöhen Sie die Endpunkt-Empfindlichkeit, wenn Anrufer unterbrochen werden, verringern Sie sie, wenn Antworten langsam wirken.
</Tip>
