speech-synthesis
Repositorios de código abierto monitorizados etiquetados con speech-synthesis, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a speech-synthesis en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con speech-synthesis.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
🐸💬 - Un conjunto de herramientas de aprendizaje profundo para texto a voz (TTS), probado en combate en investigación y producción
★ 45.985+18Variación de estrellas de los últimos 7 días - #2
VoxCPM2: TTS sin tokenizador para generación de voz multilingüe, diseño de voz creativo y clonación realista
★ 36.595+345Variación de estrellas de los últimos 7 días - #3
Un framework de IA generativa escalable creado para investigadores y desarrolladores que trabajan en Modelos de Lenguaje Grande, Multimodal y IA de Voz (Reconocimiento Automático de Voz y Text-to-Speech)
★ 18.379+21Variación de estrellas de los últimos 7 días - #4★ 17.476+1Variación de estrellas de los últimos 7 días
- #5
Scripts de Deep Learning de última generación organizados por modelos: fáciles de entrenar y desplegar con precisión y rendimiento reproducibles en infraestructura de nivel empresarial.
★ 14.846+4Variación de estrellas de los últimos 7 días - #6
TTS multilingüe, ultrarrápido y en el dispositivo, ejecutándose de forma nativa mediante ONNX.
★ 13.757+20Variación de estrellas de los últimos 7 días - #7
Crea agentes de voz con modelos de código abierto
★ 13.015+82Variación de estrellas de los últimos 7 días - #8
Gradio WebUI para creadores y desarrolladores, con TTS clave (Edge-TTS, kokoro) y clonación de voz zero-shot (E2 & F5-TTS, CosyVoice), procesamiento de audio con Whisper, descarga de YouTube, aislamiento vocal con Demucs y traducción multilingüe.
★ 12.730+54Variación de estrellas de los últimos 7 días - #9
Kit de herramientas de voz fácil de usar que incluye modelo de aprendizaje autosupervisado, ASR de transmisión/SOTA con puntuación, TTS de transmisión con interfaz de texto, sistema de verificación de hablantes, traducción de voz de extremo a extremo y detección de palabras clave. Ganador del premio al mejor demo en NAACL2022.
★ 12.676+5Variación de estrellas de los últimos 7 días - #10
Utiliza el servicio de conversión de texto a voz en línea de Microsoft Edge desde Python SIN necesidad de Microsoft Edge, Windows ni una clave de API
★ 11.847+29Variación de estrellas de los últimos 7 días - #11
Amphion (/æmˈfaɪən/) es un conjunto de herramientas para la generación de audio, música y voz. Su propósito es respaldar la investigación reproducible y ayudar a los investigadores y desarrolladores junior a iniciarse en el campo de la investigación y el desarrollo de la generación de audio, música y voz.
★ 10.276+1Variación de estrellas de los últimos 7 días - #12★ 9949+3Variación de estrellas de los últimos 7 días
- #13
Bifurcación (fork) de so-vits-svc con soporte en tiempo real, interfaz mejorada y más funciones.
★ 9329+3Variación de estrellas de los últimos 7 días - #14
EmotiVoice 😊: Un motor TTS multi-voz y controlado por avisos
★ 8522-1Variación de estrellas de los últimos 7 días - #15
Una biblioteca de texto a voz (TTS), voz a texto (STT) y voz a voz (STS) construida sobre el framework MLX de Apple, que proporciona un análisis de voz eficiente en Apple Silicon.
★ 7826+23Variación de estrellas de los últimos 7 días - #16
eSpeak NG es un sintetizador de voz de código abierto que admite más de cien idiomas y acentos.
★ 6802+13Variación de estrellas de los últimos 7 días - #17
StyleTTS 2: Hacia la conversión de texto a voz a nivel humano mediante difusión de estilo y entrenamiento adversarial con grandes modelos de lenguaje de voz
★ 6342+3Variación de estrellas de los últimos 7 días - #18
Silero Models: modelos de texto a voz preentrenados hechos extremadamente sencillos
★ 6084-1Variación de estrellas de los últimos 7 días - #19★ 5831+45Variación de estrellas de los últimos 7 días
- #20
DiffSinger: Síntesis de voz cantada mediante mecanismo de difusión superficial (SVS y TTS); AAAI 2022; Código oficial
★ 4855+3Variación de estrellas de los últimos 7 días - #21
Sistema de texto a voz de código abierto construido mediante la inversión de Whisper.
★ 4645+3Variación de estrellas de los últimos 7 días - #22★ 4258+18Variación de estrellas de los últimos 7 días
- #23
Modelo fundacional para TTS expresivo y de aspecto humano
★ 4203-1Variación de estrellas de los últimos 7 días - #24
Convierte texto a voz en tiempo real
★ 4021+2Variación de estrellas de los últimos 7 días - #25
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntesis de voz en tiempo real de vanguardia para TensorFlow 2 (compatible con inglés, francés, coreano, chino, alemán y fácil de adaptar a otros idiomas)
★ 3996+0Variación de estrellas de los últimos 7 días - #26★ 2864+0Variación de estrellas de los últimos 7 días
- #27★ 2818+1Variación de estrellas de los últimos 7 días
- #28
MARY TTS -- un sistema de síntesis de texto a voz multilingüe y de código abierto escrito en Java puro.
★ 2583+0Variación de estrellas de los últimos 7 días - #29
TTS en vietnamita con clonación de voz instantánea • En el dispositivo • Inferencia en CPU en tiempo real • Calidad de audio de 24 kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2468+21Variación de estrellas de los últimos 7 días - #30
HiFi-GAN: Redes Generativas Antagónicas para la síntesis de voz eficiente y de alta fidelidad
★ 2367+0Variación de estrellas de los últimos 7 días