tts
Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.
- #91
Speech-AI-Forge es un proyecto desarrollado en torno a un modelo de generación TTS, que implementa un servidor API y una interfaz web basada en Gradio.
★ 1418+0Variación de estrellas de los últimos 7 días - #92
Traducción sincronizada para videos. Doblaje de video
★ 1413+2Variación de estrellas de los últimos 7 días - #93
Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.
★ 1399+0Variación de estrellas de los últimos 7 días - #94
Restauración general de voz.
★ 1375+0Variación de estrellas de los últimos 7 días - #95
Una herramienta (para Windows) que permite grabar la síntesis de voz (TTS) del navegador Microsoft Edge y exportarla como audio .wav.
★ 1370+1Variación de estrellas de los últimos 7 días - #96
[ICASSP 2024] 🍵 Matcha-TTS: Una arquitectura de TTS rápida con conditional flow matching.
★ 1353+3Variación de estrellas de los últimos 7 días - #97★ 1347+6Variación de estrellas de los últimos 7 días
- #98
Plataforma de gestión empresarial Java para XiaoZhi ESP32, que ofrece una solución integral de backend y frontend para monitoreo de dispositivos, personalización de voz, cambio de roles y gestión de registros de diálogo.
★ 1337+1Variación de estrellas de los últimos 7 días - #99
Traducción al pasar el ratón para cualquier idioma - Extensión de Chrome: traductor de PDF, EBOOK, EPUB, OCR, TTS, NETFLIX, SUBTÍTULOS DUALES DE YOUTUBE, GOOGLE DOCS, IA, VISOR, GMAIL, ESCRITURA, IMAGEN, SUBTÍTULOS DUALES, MANGA, HOVER, DICCIONARIO, WEBTOON, EDGE, JAPONÉS, INGLÉS.
★ 1305+4Variación de estrellas de los últimos 7 días - #100
Humano digital interactivo en tiempo real, con apariencia y voz personalizables, soporte para clonación de voz y una latencia de respuesta de hasta 3 segundos.
★ 1303-1Variación de estrellas de los últimos 7 días - #101
StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.
★ 1288+0Variación de estrellas de los últimos 7 días - #102
Traducción de voz en tiempo real para macOS y Windows, TTS gratuito, sin servidor, solo usa tus propias claves API
★ 1278+2Variación de estrellas de los últimos 7 días - #103
Interfaz web para diversas redes neuronales relacionadas con audio.
★ 1246+0Variación de estrellas de los últimos 7 días - #104
Modelo de texto a voz basado en Flow Matching con control de estilo mediante emojis.
★ 1228+4Variación de estrellas de los últimos 7 días - #105
TTS de mejores prácticas basado en BERT y VITS con características de Natural Speech de Microsoft; ¡soporta salida de streaming ONNX!
★ 1226+0Variación de estrellas de los últimos 7 días - #106★ 1211+0Variación de estrellas de los últimos 7 días
- #107
Una integración de nodos personalizados para ComfyUI que permite el uso local de motores de conversión de texto a voz y voz a voz en múltiples idiomas. Soporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clásico y multilingüe), F5-TTS, Higgs Audio 2, 3 y VibeVoice, con longitud de texto ilimitada, temporización SRT, soporte de personajes y diversas herramientas de audio.
★ 1187+7Variación de estrellas de los últimos 7 días - #108
Traducción de voz bidireccional en tiempo real para reuniones bilingües: detecta automáticamente el idioma hablado y traduce en ambas direcciones, ya sea en la nube o completamente offline en el dispositivo. Disponible para escritorio (Windows, macOS, Linux) y extensiones de navegador (Chrome, Edge) para Zoom, Meet, Teams y cualquier aplicación.
★ 1186+40Variación de estrellas de los últimos 7 días - #109
Kit de herramientas de voz con IA para Apple Silicon: ASR, TTS, voz a voz, VAD y diarización impulsados por MLX y CoreML
★ 1161+4Variación de estrellas de los últimos 7 días - #110
Irina: un asistente de voz en ruso para trabajar sin conexión. Admite habilidades mediante complementos.
★ 1153+0Variación de estrellas de los últimos 7 días - #111
Bibliotecas de inferencia en C++ para múltiples SVC/TTS.
★ 1128-1Variación de estrellas de los últimos 7 días - #112
SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.
★ 1118+143Variación de estrellas de los últimos 7 días - #113
VTuber con IA para streaming en YouTube/Twitch.
★ 1115+1Variación de estrellas de los últimos 7 días - #114
NobodyWho es un motor de inferencia que permite ejecutar LLMs local y eficientemente en cualquier dispositivo.
★ 1094+13Variación de estrellas de los últimos 7 días - #115
GLM-TTS: TTS zero-shot controlable y con expresión emocional mediante aprendizaje por refuerzo con múltiples recompensas
★ 1063+7Variación de estrellas de los últimos 7 días - #116
Con un solo comando, crea un audiolibro con sonido natural a partir de una variedad de formatos de entrada (epub, mobi, txt, PDF, HTML y más).
★ 1058+1Variación de estrellas de los últimos 7 días - #117
API gratuita de texto a voz en línea
★ 1058+4Variación de estrellas de los últimos 7 días - #118
YourTTS: hacia un TTS multihablante Zero-Shot y conversión de voz Zero-Shot para todos.
★ 1053+0Variación de estrellas de los últimos 7 días - #119
Una API HTTP simple para VITS, desarrollada extendiendo Moegoe con funcionalidades adicionales.
★ 1051-1Variación de estrellas de los últimos 7 días - #120
Código de ejemplo de la API de Text-to-Speech de Microsoft en varios lenguajes, parte de Cognitive Services.
★ 1014+3Variación de estrellas de los últimos 7 días