← Todos los proyectos

Voz / Demostración evaluada

Speech Studio

Texto que se convierte en voz controlable.

Vídeo real de la demo · Narración y subtítulos en inglés · Datos ficticios

EL PROBLEMA

Algunos flujos internos necesitan narración sintética con voces y formato de salida definidos.

EL FLUJO

Prepara texto en inglés, ajusta la voz y su velocidad, sintetiza un WAV local, escúchalo y descarga el audio.

  1. 01Texto en inglés
  2. 02Ajustes de voz
  3. 03Síntesis local
  4. 04Reproducción y descarga

EVIDENCIA REGISTRADA

Resultados, con contexto.

Resultados sobre datos sintéticos
ComprobaciónCasos
Formato PCM válido8/8
Frecuencia de 24 kHz8/8
Señal de audio presente8/8
Conjunto
synthetic-regression-v3-english
Casos completados
8/8
Mediana / p95 por caso
0.206 s / 8.76 s
Registro de evaluación (UTC)
2026-10-08

Fuente: registro de evaluación del proyecto, con inferencia local. Equipo registrado: NVIDIA GeForce RTX 5060 Ti, 595.84, 16311 MiB. La latencia incluye el caso HTTP completo y puede incluir la carga inicial del modelo. Estas mediciones no se han vuelto a ejecutar en el equipo que sirve esta web.

QUÉ PODRÍAMOS CONSTRUIR CONTIGO

Una integración privada de texto a voz con voces locales cuya licencia se revise para el uso previsto.

Qué definiríamos antes

Licencias de voces y modelo, idiomas, pronunciación y formato de audio.

Límites de esta demostración

Las ocho pruebas comprueban salida PCM a 24 kHz, duración y señal. No miden calidad perceptual ni clonan voces.

Hablemos de tu caso ↗
Captura de la interfaz de Speech Studio
Interfaz de revisión de la demostración.

Explora otros proyectos