Sprachausgabe
- nichts wird laut vorgelesen
- Zuschauer hören die Stimme nicht im Stream
- die Stimme klingt roboterhaft
- wie stelle ich es ein, dass Chatnachrichten vorgelesen werden
- lange Spenden-Nachrichten werden abgeschnitten
Was diese Seite ist
Stimme → Sprachausgabe liest Spenden, Chat und Bot-Antworten laut vor. Die Zeile unter dem titel zeigt, woher der Ton kommt: "Synthese läuft auf diesem Rechner — kein Internet, keine Grenzen".
Wie man es einrichtet
Die Seite hat vier Tabs — Stimme, Was gesprochen wird, Regeln, Ton in OBS — und einen Speichern-Button oben rechts für alle. Über den Tabs läuft ein Live-Streifen: ein Punkt mit Stumm oder Spricht gerade, In Warteschlange: {count} darunter, während Zeilen warten, und zwei Buttons — Überspringen gilt für die Zeile, die gerade gelesen wird, Stoppen und leeren für alle auf einmal.
Stimme
- Der Block oben im Tab ist das Sprachpaket. Bei einer frischen Installation steht dort Neuronale Stimmen sind nicht installiert — "Ein Download von {size}. Bis dahin wird die Systemstimme von Windows verwendet — sie funktioniert überall, klingt aber deutlich schlechter." Drücke Stimmen herunterladen. Zuerst öffnet sich der Bedingungen-Bildschirm: aus welchem Modell die Stimmen stammen, unter welcher Lizenz und was sie verbietet. Akzeptieren und herunterladen startet den Download, Lizenz lesen öffnet den vollständigen Text im Browser, Abbrechen schließt den Bildschirm.
- Während es läuft, wird der Titel zu Wird heruntergeladen… {percent}% mit einem Fortschrittsbalken und der Datei, die abgerufen wird; Abbrechen stoppt es. Wenn es fertig ist, liest der Block Neuronale Stimmen sind bereit — "{size} auf der Festplatte. Zehn Stimmen, 31 Sprachen, alles bleibt auf diesem Rechner" — und der Button wird zu Entfernen, der zuerst fragt: "Sprachpaket entfernen? Sprachausgabe fällt auf die Systemstimme zurück, und der zwischengespeicherte Ton wird gelöscht. Einstellungen bleiben erhalten." Wenn ein Download unterbrochen wurde, liest der Titel Das Sprachpaket ist unvollständig; erneutes Herunterladen ersetzt die unvollständigen Dateien.
- Stimmen — Neuronale Stimmen oder Systemstimmen von Windows.
- Sprache — Alle Sprachen plus jede Sprache, die das Paket abdeckt. Der Hinweis erklärt den Sinn der Liste: "Wählen Sie eine Stimme für jede Sprache, in der Ihre Zuschauer schreiben. Die Sprache des Textes entscheidet, welche Stimme spricht — die Systemstimme benötigt keinen Download, aber klingt roboterhaft." Wählen Sie zuerst die Sprache, dann die Stimme dafür, und wiederholen Sie dies für die nächste Sprache.
- Unter der Liste sind die Sprachkarten, benannt Männlich 1, Weiblich 1 und so weiter. Klicken Sie auf eine Karte, um diese Stimme für die aktuell ausgewählte Sprache zu wählen; der Play-Button auf der Karte ist Anhören. Wenn Sie ihn drücken, bevor das Paket heruntergeladen ist, meldet es Laden Sie zuerst das Sprachpaket herunter.
- Bei Systemstimmen von Windows verschwinden die Sprachliste und die Karten und eine Notiz nimmt ihren Platz ein: Windows wählt die Stimme selbst aus — "Es liest mit der ersten Stimme, die für die Sprache des Textes installiert ist — hier gibt es nichts zu wählen. Laden Sie das Sprachpaket herunter, um eine Stimme auszuwählen und eine viel bessere zu bekommen."
- Im Abschnitt Ton: Sprechgeschwindigkeit — ein Schieberegler von 0,70 bis 1,50, standardmäßig 1,05 — und Lautstärke, standardmäßig 80%. Der Hinweis unten: "Lautstärke wird mit dem Schieberegler «Sprache (TTS)» in «Einstellungen → Ton» multipliziert. Außerhalb dieses Geschwindigkeitsbereichs beginnt das Modell, Silben zu verschlucken."
- Testphrase — ein Feld ("Geben Sie etwas ein und drücken Sie Sprechen") und der Sprechen-Button; Enter im Feld bewirkt dasselbe. "Sowohl die Anhören-Buttons als auch dieser lesen genau diese Phrase. Schreiben Sie sie in der Sprache, die Sie hören möchten." Die Phrase wird von Speichern beibehalten.
Was gesprochen wird
Vier Blöcke, jeder mit einem Schalter. Unter dem Namen eines Blocks steht Laut vorlesen oder Aus, und ein Block, der aus ist, verbirgt seine eigenen Einstellungen.
- Spenden — standardmäßig an. Mindestbetrag: "Verglichen in Ihrer Basiswährung, also wird eine Spende in einer anderen Währung korrekt beurteilt. Null liest jede Spende." Vorlage beginnt als "{user} spendete {amount} {currency} und sagt: {message}", und die Variablen, die sie akzeptiert, sind direkt unter dem Feld aufgelistet:
{user},{amount},{currency},{message}. Welche Quellen zählen ist eine Checkbox pro installiertem Spenden-Connector; diese Checkboxes wirken sofort, ohne Speichern. - Chat — standardmäßig aus. Vorlesen ist entweder Nur auf Befehl oder Jede Nachricht ("Jede Nachricht wird auf einem vollen Chat zu Lärm — dieser Modus ist für kleine Streams"), und Befehl enthält den Befehl selbst, standardmäßig
!tts. Pause zwischen Zeilen ist in Sekunden, standardmäßig 3: "Sekunden, pro Zuschauer gezählt. Spenden und Abonnements werden nie zurückgehalten." Vorlage beginnt als "{user} sagt: {message}" und nimmt{user}und{message}. - Bot-Antworten — standardmäßig an: "Was auch immer der KI-Agent per Stimme antwortet. Das Einschalten der Stimme für den Agenten selbst bleibt in seinen eigenen Einstellungen."
- Abonnements — standardmäßig aus. Abonnement-Vorlage beginnt als "{user} abonniert seit {months} Monaten" und nimmt
{user},{months},{tier}; Geschenkte Abos Vorlage beginnt als "{user} schenkte {count} Abonnements" und nimmt{user},{count},{tier}.
Regeln
- Länge — Längenlimit in Zeichen, standardmäßig 300 ("Zeichen. Null bedeutet kein Limit"), und Wenn es zu lang ist: Kürzen oder Ganze Nachricht überspringen.
- Filter — Links entfernen, standardmäßig an: "Sonst bezahlt ein Zuschauer, um die Bot eine Webadresse in Ihren Stream lesen zu lassen." Gesperrte Wörter, eines pro Zeile: "Eine Nachricht, die eines davon enthält, wird überhaupt nicht gesprochen. Ganze Wörter, nicht Teile davon." Gesperrte Zuschauer, ein Nickname pro Zeile.
- Warteschlange — Warteschlangenlimit, standardmäßig 10: "Wenn die Warteschlange voll ist, wird zuerst Chat verworfen — eine Spende verdrängt nie eine andere Spende. Alles Verworfenes wird ins Log geschrieben."
Ton in OBS
Der Tab ist die Anleitung selbst, unter Wie Sie die Stimme in den Stream bekommen: "In OBS: Quellen → + → Anwendungsaudioaufnahme, und wählen Sie strAImer in der Fensterliste", dann "Stellen Sie die Lautstärke in der App ein: Einstellungen → Ton, Schieberegler Sprache (TTS)", dann "Drücken Sie Testphrase auf dem «Stimme»-Tab und beobachten Sie die Quellen-Anzeige im OBS-Mixer". Eine Quelle deckt alles ab, was die App abspielt — Stimme, Alerts und Szenario-Töne gehen durch sie.
Der zweite Abschnitt, Das Stimmen-Overlay wird nicht mehr benötigt, bittet Sie, die Browserquelle des Stimmen-Overlays zu löschen: es spielt nichts mehr ab, weil "OBS eine Browserquelle in Stille in den Schlaf versetzt und den Anfang des Tons verliert, weshalb die Wiedergabe in die App verlegt wurde". Der letzte Abschnitt, Wenn es stumm bleibt, listet die drei Dinge auf, die man prüfen sollte: die Aufnahmequelle im OBS-Mixer, die Lautstärke in Einstellungen → Ton, und den Statusstreifen oben auf dieser Seite.
Was es nicht kann
- Die Anhören-Buttons und Sprechen lesen nur das, was in Testphrase steht — nichts anderes kann hier vorgehört werden.
- Systemstimmen von Windows bietet keine Stimmenauswahl: Weder die Sprachliste noch die Sprachkarten werden in diesem Modus angezeigt. Die Karten gehören zum heruntergeladenen Paket.
- Das Paket kommt als einzelner Download. Einzelne Stimmen oder Sprachen können nicht separat installiert werden, und Entfernen nimmt das Ganze weg.
- Die Sprechgeschwindigkeit kann nicht außerhalb des Schiebereglerbereichs liegen, und die Lautstärke hier ist nicht die endgültige Lautstärke: Sie wird mit Sprache (TTS) in Einstellungen → Ton multipliziert, was eine andere Seite ist.
- Die Warteschlange wird nicht zeilenweise angezeigt und kann nicht neu geordnet werden — der Streifen gibt die Anzahl, und die einzigen beiden Aktionen sind Überspringen und Stoppen und leeren.
- Jede Nachricht liest, was Zuschauer sagen, nicht was sie als Befehl eingeben. Eine Chatzeile, die mit einem Ausrufezeichen beginnt, wird im Moment des Eintreffens von Twitch, YouTube oder Kick als Befehl sortiert, und kein Befehl erreicht diesen Modus — nicht einmal
!ttsselbst. Befehle werden nur unter Nur auf Befehl gesprochen, und nur der eine, der in Befehl geschrieben steht. Nichts hier bewirkt, dass Jede Nachricht sie ebenfalls abdeckt. - Welche Quellen zählen existiert nur unter Spenden. Chat, Bot-Antworten und Abonnements haben keinen eigenen Quellenfilter.
- Ob der KI-Agent überhaupt per Stimme antwortet, wird hier nicht entschieden — das bleibt in den eigenen Einstellungen des Agenten.
- Stimme spielt nicht mehr durch eine Browserquelle, also gibt es auf dieser Seite keinen Overlay-Link.