Zum Hauptinhalt springen

Funktion

Vorlesen: KI-Antworten in ClawAI anhören

Wie ClawAI eine Antwort mit serverseitig erzeugter Sprache vorliest: früh startende Wiedergabe, Pause und Stopp, Umgang mit langen Antworten und keine Kosten für fehlgeschlagene Abschnitte.

Alle Funktionen · Zuletzt geprüft:

So funktioniert die Wiedergabe

Jede Antwort des Assistenten hat eine Vorlesen-Taste mit Wiedergabe, Pause und Stopp. Die Antwort wird in Abschnitten umgewandelt, und die Wiedergabe beginnt, sobald der erste kurze Abschnitt fertig ist — Sie müssen also nicht warten, bis eine lange Antwort vollständig verarbeitet ist, bevor Sie etwas hören.

Lange Antworten und andere Sprachen

Bis zu 12.000 Zeichen einer Antwort werden vorgelesen, und Sie erfahren, wenn eine Antwort länger war und die Wiedergabe gekürzt wurde. Sätze werden für lateinische, arabische, Hindi- sowie chinesische, japanische und koreanische Texte korrekt getrennt, sodass eine mehrsprachige Antwort nicht an jedem Satzende stolpert.

Stimmen, Verfügbarkeit und Abrechnung

Die Stimmen stammen von Text-to-Speech-Modellen von Gemini oder OpenAI, ausgewählt vom Betreiber. Vorlesen ist eine Planfunktion; ist keine Stimme zugewiesen, sagt Ihnen die Taste das, statt stillschweigend zu scheitern. Abschnitte, deren Erzeugung fehlschlägt, werden nicht berechnet.

Häufig gestellte Fragen

Nutzt das Vorlesen die Stimme meines Browsers?
Nein. Die Sprache wird auf dem Server von einem Text-to-Speech-Modell von Gemini oder OpenAI erzeugt und klingt daher auf jedem Gerät und in jedem Browser gleich.
Kann es eine sehr lange Antwort vorlesen?
Es liest bis zu 12.000 Zeichen einer Antwort vor und sagt Ihnen, wenn die Antwort länger war, damit Sie wissen, dass die Wiedergabe vorzeitig endete.
Wird mir etwas berechnet, wenn das Vorlesen fehlschlägt?
Nur die Abschnitte, die tatsächlich erzeugt wurden. Ein fehlgeschlagener Abschnitt wird nicht berechnet, und Sie können die Antwort erneut abspielen.

Probieren Sie es selbst aus, statt uns zu glauben

Vorlesen ist eine Planfunktion, die ein vom Betreiber zugewiesenes serverseitiges Text-to-Speech-Modell nutzt; es ist nicht die Sprachausgabe des Browsers.