Sprachausgabe

Oft gefragt als

Was diese Seite ist

Stimme → Sprachausgabe liest Spenden, Chat und Bot-Antworten laut vor. Die Zeile unter dem titel zeigt, woher der Ton kommt: "Synthese läuft auf diesem Rechner — kein Internet, keine Grenzen".

Wie man es einrichtet

Die Seite hat vier Tabs — Stimme, Was gesprochen wird, Regeln, Ton in OBS — und einen Speichern-Button oben rechts für alle. Über den Tabs läuft ein Live-Streifen: ein Punkt mit Stumm oder Spricht gerade, In Warteschlange: {count} darunter, während Zeilen warten, und zwei Buttons — Überspringen gilt für die Zeile, die gerade gelesen wird, Stoppen und leeren für alle auf einmal.

Stimme

  1. Der Block oben im Tab ist das Sprachpaket. Bei einer frischen Installation steht dort Neuronale Stimmen sind nicht installiert — "Ein Download von {size}. Bis dahin wird die Systemstimme von Windows verwendet — sie funktioniert überall, klingt aber deutlich schlechter." Drücke Stimmen herunterladen. Zuerst öffnet sich der Bedingungen-Bildschirm: aus welchem Modell die Stimmen stammen, unter welcher Lizenz und was sie verbietet. Akzeptieren und herunterladen startet den Download, Lizenz lesen öffnet den vollständigen Text im Browser, Abbrechen schließt den Bildschirm.
  2. Während es läuft, wird der Titel zu Wird heruntergeladen… {percent}% mit einem Fortschrittsbalken und der Datei, die abgerufen wird; Abbrechen stoppt es. Wenn es fertig ist, liest der Block Neuronale Stimmen sind bereit — "{size} auf der Festplatte. Zehn Stimmen, 31 Sprachen, alles bleibt auf diesem Rechner" — und der Button wird zu Entfernen, der zuerst fragt: "Sprachpaket entfernen? Sprachausgabe fällt auf die Systemstimme zurück, und der zwischengespeicherte Ton wird gelöscht. Einstellungen bleiben erhalten." Wenn ein Download unterbrochen wurde, liest der Titel Das Sprachpaket ist unvollständig; erneutes Herunterladen ersetzt die unvollständigen Dateien.
  3. StimmenNeuronale Stimmen oder Systemstimmen von Windows.
  4. SpracheAlle Sprachen plus jede Sprache, die das Paket abdeckt. Der Hinweis erklärt den Sinn der Liste: "Wählen Sie eine Stimme für jede Sprache, in der Ihre Zuschauer schreiben. Die Sprache des Textes entscheidet, welche Stimme spricht — die Systemstimme benötigt keinen Download, aber klingt roboterhaft." Wählen Sie zuerst die Sprache, dann die Stimme dafür, und wiederholen Sie dies für die nächste Sprache.
  5. Unter der Liste sind die Sprachkarten, benannt Männlich 1, Weiblich 1 und so weiter. Klicken Sie auf eine Karte, um diese Stimme für die aktuell ausgewählte Sprache zu wählen; der Play-Button auf der Karte ist Anhören. Wenn Sie ihn drücken, bevor das Paket heruntergeladen ist, meldet es Laden Sie zuerst das Sprachpaket herunter.
  6. Bei Systemstimmen von Windows verschwinden die Sprachliste und die Karten und eine Notiz nimmt ihren Platz ein: Windows wählt die Stimme selbst aus — "Es liest mit der ersten Stimme, die für die Sprache des Textes installiert ist — hier gibt es nichts zu wählen. Laden Sie das Sprachpaket herunter, um eine Stimme auszuwählen und eine viel bessere zu bekommen."
  7. Im Abschnitt Ton: Sprechgeschwindigkeit — ein Schieberegler von 0,70 bis 1,50, standardmäßig 1,05 — und Lautstärke, standardmäßig 80%. Der Hinweis unten: "Lautstärke wird mit dem Schieberegler «Sprache (TTS)» in «Einstellungen → Ton» multipliziert. Außerhalb dieses Geschwindigkeitsbereichs beginnt das Modell, Silben zu verschlucken."
  8. Testphrase — ein Feld ("Geben Sie etwas ein und drücken Sie Sprechen") und der Sprechen-Button; Enter im Feld bewirkt dasselbe. "Sowohl die Anhören-Buttons als auch dieser lesen genau diese Phrase. Schreiben Sie sie in der Sprache, die Sie hören möchten." Die Phrase wird von Speichern beibehalten.

Was gesprochen wird

Vier Blöcke, jeder mit einem Schalter. Unter dem Namen eines Blocks steht Laut vorlesen oder Aus, und ein Block, der aus ist, verbirgt seine eigenen Einstellungen.

  1. Spenden — standardmäßig an. Mindestbetrag: "Verglichen in Ihrer Basiswährung, also wird eine Spende in einer anderen Währung korrekt beurteilt. Null liest jede Spende." Vorlage beginnt als "{user} spendete {amount} {currency} und sagt: {message}", und die Variablen, die sie akzeptiert, sind direkt unter dem Feld aufgelistet: {user}, {amount}, {currency}, {message}. Welche Quellen zählen ist eine Checkbox pro installiertem Spenden-Connector; diese Checkboxes wirken sofort, ohne Speichern.
  2. Chat — standardmäßig aus. Vorlesen ist entweder Nur auf Befehl oder Jede Nachricht ("Jede Nachricht wird auf einem vollen Chat zu Lärm — dieser Modus ist für kleine Streams"), und Befehl enthält den Befehl selbst, standardmäßig !tts. Pause zwischen Zeilen ist in Sekunden, standardmäßig 3: "Sekunden, pro Zuschauer gezählt. Spenden und Abonnements werden nie zurückgehalten." Vorlage beginnt als "{user} sagt: {message}" und nimmt {user} und {message}.
  3. Bot-Antworten — standardmäßig an: "Was auch immer der KI-Agent per Stimme antwortet. Das Einschalten der Stimme für den Agenten selbst bleibt in seinen eigenen Einstellungen."
  4. Abonnements — standardmäßig aus. Abonnement-Vorlage beginnt als "{user} abonniert seit {months} Monaten" und nimmt {user}, {months}, {tier}; Geschenkte Abos Vorlage beginnt als "{user} schenkte {count} Abonnements" und nimmt {user}, {count}, {tier}.

Regeln

  1. LängeLängenlimit in Zeichen, standardmäßig 300 ("Zeichen. Null bedeutet kein Limit"), und Wenn es zu lang ist: Kürzen oder Ganze Nachricht überspringen.
  2. FilterLinks entfernen, standardmäßig an: "Sonst bezahlt ein Zuschauer, um die Bot eine Webadresse in Ihren Stream lesen zu lassen." Gesperrte Wörter, eines pro Zeile: "Eine Nachricht, die eines davon enthält, wird überhaupt nicht gesprochen. Ganze Wörter, nicht Teile davon." Gesperrte Zuschauer, ein Nickname pro Zeile.
  3. WarteschlangeWarteschlangenlimit, standardmäßig 10: "Wenn die Warteschlange voll ist, wird zuerst Chat verworfen — eine Spende verdrängt nie eine andere Spende. Alles Verworfenes wird ins Log geschrieben."

Ton in OBS

Der Tab ist die Anleitung selbst, unter Wie Sie die Stimme in den Stream bekommen: "In OBS: Quellen → + → Anwendungsaudioaufnahme, und wählen Sie strAImer in der Fensterliste", dann "Stellen Sie die Lautstärke in der App ein: Einstellungen → Ton, Schieberegler Sprache (TTS)", dann "Drücken Sie Testphrase auf dem «Stimme»-Tab und beobachten Sie die Quellen-Anzeige im OBS-Mixer". Eine Quelle deckt alles ab, was die App abspielt — Stimme, Alerts und Szenario-Töne gehen durch sie.

Der zweite Abschnitt, Das Stimmen-Overlay wird nicht mehr benötigt, bittet Sie, die Browserquelle des Stimmen-Overlays zu löschen: es spielt nichts mehr ab, weil "OBS eine Browserquelle in Stille in den Schlaf versetzt und den Anfang des Tons verliert, weshalb die Wiedergabe in die App verlegt wurde". Der letzte Abschnitt, Wenn es stumm bleibt, listet die drei Dinge auf, die man prüfen sollte: die Aufnahmequelle im OBS-Mixer, die Lautstärke in Einstellungen → Ton, und den Statusstreifen oben auf dieser Seite.

Was es nicht kann