Zum Inhalt springen

Profile und Stimmen

Ein Agentenprofil enthält zwei Einstellungen, die zwei verschiedene Fragen beantworten und nicht aneinander gekoppelt sind:

  • Antwortstufe – wie klug (und wie schnell) der Agent denkt.
  • Stimme – wie der Agent klingt.

Eine schnelle Antwortstufe schränkt die Wahl der Stimme nicht ein und umgekehrt – die Stufen und die Liste der Stimmen finden Sie in der Anleitung.

Vier Stufen, von der schnellsten bis zur gründlichsten: Fast, Standard (Voreinstellung), Smart und Realtime (Vorschau – wird wie ein Anruf der Stufe Smart abgerechnet; solange die Stufe für Ihre Umgebung noch nicht freigeschaltet ist, antwortet sie mit dem Verhalten von Smart, und es geht dabei nichts kaputt).

  • Fast – geringste Wartezeit; die Plattform wählt das schnellste verfügbare Modell.
  • Standard – die ausgewogene Voreinstellung zwischen Geschwindigkeit und Gründlichkeit.
  • Smart – nimmt für eine einzige, gründlichere Antwort mehr Wartezeit in Kauf.

Jede Stufe nutzt eine Spracherkennung mit automatischem Ausweichen. Ein Profil, das vor Einführung der Stufen gespeichert wurde, läuft genau wie bisher weiter; eine Umstellung wird nicht erzwungen.

Sowohl die Antwortstufe als auch die gewählte Stimme haben einen eigenen Preisfaktor, und beide werden miteinander multipliziert, statt dass einer den anderen ersetzt: Eine Minute kostet Dauer × Faktor der Antwortstufe × Faktor der Stimmstufe. Eine schnellere oder günstigere Antwortstufe erzwingt keine günstigere Stimmstufe und umgekehrt – die zwei unabhängigen Einstellungen gelten bis in die Abrechnung. Welche Stimmen zu welcher Stufe gehören, steht weiter unten unter Stimmstufen; wie eine Sitzung vom Typ WEB_TEXT (ohne Audio, also ohne Kosten für die Stimme) hineinpasst, steht unter Web-Widget und Textmodus.

Die Auswahl zeigt alle Stimmen, die für Ihre Umgebung verfügbar sind, gruppiert in drei Preisstufen:

  • Standard (ohne Aufpreis) – Nairon-Stimmen.
  • Premium (ab dem Growth-Tarif) – Premium-Stimmen.
  • HighRes (ab dem Professional-Tarif) – Stimmen in hoher Klangtreue.

Sie wählen eine Stimme nach Namen aus, ihre Stufe ergibt sich daraus, und eine Stimme oberhalb der Stufe Ihres Tarifs wird gesperrt angezeigt, statt stillschweigend ersetzt zu werden. Eigene Stimmen aus Ihren Tonaufnahmen (Stimmklonen) sind eine separate Funktion und nicht Gegenstand dieser Seite.

Diese Regeln gelten für jeden Anruf – Telefon, Web und Test – in einfachen wie in erweiterten Projekten.

  • Hauptsprache und Zeitzone. Jedes Profil hat eine Hauptsprache (eine seiner Sprachen) und eine Zeitzone (Standard: Mitteleuropäische Zeit, Zürich). Anrufe beginnen in der Hauptsprache, die Begrüßung ist in ihr verfasst, und Zeiten, die der Agent nennt (zum Beispiel Zeitfenster für Rückrufe), beziehen sich auf die Zeitzone des Profils. Ändern Sie die Hauptsprache und spricht Ihre Stimme diese Sprache nicht, wechselt die Auswahl zu einer Stimme, die sie spricht – es sei denn, Sie haben die Stimme selbst gewählt.
  • Der Sprache der anrufenden Person folgen. Wechselt die anrufende Person mit einem richtigen Satz in eine andere Sprache des Profils, folgt der Agent und bleibt bei dieser Sprache. Zahlen, Namen, ein einzelnes fremdsprachiges Wort, Grußformeln oder „Ja“/„Nein“ wechseln die Sprache nicht. Feste Ansagen wie die Warnung bei Stille werden in der aktuellen Sprache des Gesprächs gesprochen. Texte, die Sie in einem Ansageknoten verfassen, werden so gesprochen, wie sie geschrieben sind; Texte pro Sprache folgen demnächst.
  • Den Agenten unterbrechen. Die anrufende Person kann den Agenten mit einem einzigen gesprochenen Wort unterbrechen. Hintergrundgeräusche, die nicht als Wort erkannt werden, halten den Agenten nicht mehr an. In Browser-Sitzungen wird weiterhin gehört, was jemand während der Begrüßung sagt.
  • Stille. Nach 120 Sekunden, in denen die anrufende Person nicht spricht, spricht der Agent eine kurze Warnung. Kommt weiterhin keine Antwort, endet der Anruf 15 Sekunden nach der Warnung und wird mit dem Beendigungsgrund „Inaktivität“ gespeichert.