Voz en off

La gente pregunta esto como

Qué es esta página

Voz → Voz en off lee en voz alta las donaciones, el chat y las respuestas del bot. La línea bajo el título indica de dónde viene el sonido: "La síntesis se ejecuta en esta máquina — sin internet, sin límites".

Cómo configurarlo

La página tiene cuatro pestañas — Voz, Qué decir, Reglas, Sonido en OBS — y un botón Guardar en la esquina superior derecha para todas ellas. Sobre las pestañas corre una franja en vivo: un punto con Silencio o Hablando ahora, En cola: {count} debajo mientras las líneas están esperando, y dos botones — Saltar se aplica a la línea que se está leyendo, Detener y limpiar a todo de una vez.

Voz

  1. El bloque en la parte superior de la pestaña es el paquete de voces. En una instalación nueva dice Las voces neuronales no están instaladas — "Una descarga de {size}. Hasta entonces se usa la voz del sistema de Windows — funciona en todas partes pero suena notablemente peor". Presiona Descargar voces. Primero se abre la pantalla de condiciones: de qué modelo proceden las voces, bajo qué licencia y qué prohíbe. Aceptar y descargar inicia la descarga, Leer la licencia abre el texto completo en el navegador, Cancelar cierra la pantalla.
  2. Mientras se ejecuta, el título se convierte en Descargando… {percent}% con una barra de progreso y el archivo que se está obteniendo; Cancelar lo detiene. Cuando termina, el bloque dice Las voces neuronales están listas — "{size} en disco. Diez voces, 31 idiomas, todo permanece en esta máquina" — y el botón se convierte en Eliminar, que primero pregunta: "¿Eliminar el paquete de voces? La voz en off volverá a la voz del sistema, y el audio almacenado en caché se borrará. La configuración se mantiene". Si una descarga fue interrumpida, el título dice El paquete de voces está incompleto; descargar de nuevo reemplaza los archivos incompletos.
  3. VocesVoces neuronales o Voces del sistema de Windows.
  4. IdiomaTodos los idiomas más cada idioma que cubre el paquete. La explicación aclara el propósito de la lista: "Elige una voz para cada idioma en el que escriban tus espectadores. El idioma del texto decide qué voz habla — la voz del sistema no necesita descarga pero suena robótica". Elige primero el idioma, luego la voz para él, y repite para el siguiente idioma.
  5. Bajo la lista están las tarjetas de voz, nombradas Masculino 1, Femenino 1 y así. Haz clic en una tarjeta para elegir esa voz para el idioma seleccionado actualmente; el botón de reproducción en la tarjeta es Escuchar. Presionarlo antes de que el paquete esté descargado informa Descarga primero el paquete de voces.
  6. Con Voces del sistema de Windows la lista de idiomas y las tarjetas desaparecen y una nota ocupa su lugar: Windows elige la voz automáticamente — "Lee con la primera voz instalada para el idioma del texto — no hay nada que elegir aquí. Descarga el paquete de voces para elegir una voz y obtener una mucho mejor".
  7. En la sección Sonido: Velocidad del habla — un control deslizante de 0.70 a 1.50, 1.05 por defecto — y Volumen, 80% por defecto. La explicación debajo: "El volumen se multiplica por el control deslizante «Voz (TTS)» en «Configuración → Sonido». Más allá de este rango de velocidad el modelo empieza a tragarse sílabas".
  8. Frase de prueba — un campo ("Escribe cualquier cosa y presiona Hablar") y el botón Hablar; Enter en el campo hace lo mismo. "Tanto los botones de escuchar como este leen exactamente esta frase. Escríbela en el idioma que quieras oír". La frase se guarda con Guardar.

Qué decir

Cuatro bloques, cada uno con un interruptor. Bajo el nombre de un bloque dice Lee en voz alta o Desactivado, y un bloque que está desactivado oculta sus propias configuraciones.

  1. Donaciones — activado por defecto. Monto mínimo: "Se compara en tu moneda base, así que una donación en otra moneda se juzga correctamente. Cero lee cada donación." Plantilla comienza como "{user} donó {amount} {currency} y dice: {message}", y las variables que acepta se listan justo bajo el campo: {user}, {amount}, {currency}, {message}. Qué fuentes cuentan es una casilla por conector de donación instalado; estas casillas surten efecto por sí solas, sin Guardar.
  2. Chat — desactivado por defecto. Leer es Solo por comando o Todos los mensajes ("Cada mensaje se convierte en ruido en un chat ocupado — ese modo es para streams pequeños"), y Comando contiene el comando mismo, !tts por defecto. Pausa entre líneas es en segundos, 3 por defecto: "Segundos, contados por espectador. Las donaciones y suscripciones nunca se retienen". Plantilla comienza como "{user} dice: {message}" y toma {user} y {message}.
  3. Respuestas del bot — activado por defecto: "Cualquier cosa que el agente de IA responda por voz. Activar la voz para el agente mismo permanece en sus propias configuraciones".
  4. Suscripciones — desactivado por defecto. Plantilla de suscripción comienza como "{user} se suscribió por {months} meses" y toma {user}, {months}, {tier}; Plantilla de suscripciones regaladas comienza como "{user} regaló {count} suscripciones" y toma {user}, {count}, {tier}.

Reglas

  1. LongitudLímite de longitud en caracteres, 300 por defecto ("Caracteres. Cero significa sin límite"), y Cuando es demasiado largo: Recortarlo o Omitir todo el mensaje.
  2. FiltrosEliminar enlaces, activado por defecto: "De lo contrario, un espectador paga para que el bot lea una dirección web en tu stream". Palabras bloqueadas, una por línea: "Un mensaje que contenga cualquiera de estas no se habla en absoluto. Palabras completas, no partes de ellas". Espectadores bloqueados, un apodo por línea.
  3. ColaLímite de cola, 10 por defecto: "Cuando la cola está llena, el chat se descarta primero — una donación nunca desplaza a otra donación. Cualquier cosa descartada se escribe en el registro".

Sonido en OBS

La pestaña es la instrucción misma, bajo Cómo llevar la voz a la transmisión: "En OBS: Fuentes → + → Captura de audio de aplicación, y elige strAImer en la lista de ventanas", luego "Ajusta el volumen en la app: Configuración → Sonido, control deslizante Voz (TTS)", luego "Presiona Frase de prueba en la pestaña «Voz» y observa el medidor de la fuente en el mezclador de OBS". Una fuente cubre todo lo que la app reproduce — voz, alertas y sonidos de escenario pasan por ella.

La segunda sección, Ya no se necesita la superposición de voz, te pide que elimines la fuente de navegador de la superposición de voz: ya no reproduce nada, porque "OBS pone una fuente de navegador a dormir en silencio y pierde el inicio del audio, por lo que la reproducción se movió a la app". La última sección, Si sigue en silencio, enumera las tres cosas que debes revisar: la fuente de captura en el mezclador de OBS, el volumen en Configuración → Sonido, y la franja de estado en la parte superior de esta página.

Qué no puede hacer