tts
Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.
- #31
Una interfaz web nativa y sencilla que utiliza ChatTTS para sintetizar texto en voz, con soporte para ofrecer interfaces de API externas.
★ 7648+4Variación de estrellas de los últimos 7 días - #32
Biblioteca de conversión de texto a voz multilingüe de alta calidad de MyShell.ai. Compatible con inglés, español, francés, chino, japonés y coreano.
★ 7616+7Variación de estrellas de los últimos 7 días - #33
🤖 wukong-robot es un proyecto de robot de diálogo de voz en chino / altavoz inteligente simple, flexible y elegante. Admite la capacidad de conversación de múltiples turnos de ChatGPT y puede ser el primer proyecto de altavoz inteligente de código abierto que admite la interacción cerebro-computadora.
★ 7126+2Variación de estrellas de los últimos 7 días - #34
StyleTTS 2: Hacia la conversión de texto a voz a nivel humano mediante difusión de estilo y entrenamiento adversarial con grandes modelos de lenguaje de voz
★ 6342+3Variación de estrellas de los últimos 7 días - #35
Hacia voz con sonido natural
★ 6324+5Variación de estrellas de los últimos 7 días - #36
Herramienta de síntesis de voz de Microsoft, construida con Electron, Vue, ElementPlus y Vite
★ 6103+1Variación de estrellas de los últimos 7 días - #37
Silero Models: modelos de texto a voz preentrenados hechos extremadamente sencillos
★ 6084-1Variación de estrellas de los últimos 7 días - #38★ 5831+45Variación de estrellas de los últimos 7 días
- #39
Contenedor Docker compatible con la API de OpenAI para el modelo de conversión de texto a voz Kokoro-82M con PyTorch multiplataforma para CPU, AMD y GPU NVIDIA; múltiples locutores, mezcla de voces, unión automática, marcas de tiempo en subtítulos, SSML y una interfaz web de lectura.
★ 5399+19Variación de estrellas de los últimos 7 días - #40
Un motor de video AIGC de propósito general: desde el guion hasta la película terminada en un solo flujo de trabajo — dramas, anuncios, videos de productos, juegos otome y más.
★ 4900+384Variación de estrellas de los últimos 7 días - #41
DiffSinger: Síntesis de voz cantada mediante mecanismo de difusión superficial (SVS y TTS); AAAI 2022; Código oficial
★ 4855+3Variación de estrellas de los últimos 7 días - #42
Sistema de texto a voz de código abierto construido mediante la inversión de Whisper.
★ 4645+3Variación de estrellas de los últimos 7 días - #43
Esta es una aplicación TTS para el sistema Android, con interfaz de demostración de Microsoft integrada, solicitudes HTTP personalizables, importación de otros motores TTS locales, lectura con reconocimiento simple de narración/diálogo basado en comillas dobles chinas, reintento automático, configuración de respaldo, reemplazo de texto y más funciones.
★ 4488+5Variación de estrellas de los últimos 7 días - #44
MOSS-TTS-Nano es un modelo de generación de voz multilingüe pequeño y de código abierto de MOSI.AI y el equipo de OpenMOSS. Con solo 0.1B de parámetros, está diseñado para la generación de voz en tiempo real, puede ejecutarse directamente en la CPU sin GPU y mantiene la pila de implementación lo suficientemente simple para demostraciones locales, servicios web y la integración de productos ligeros.
★ 4282+11Variación de estrellas de los últimos 7 días - #45
Modelo fundacional para TTS expresivo y de aspecto humano
★ 4203-1Variación de estrellas de los últimos 7 días - #46
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntesis de voz en tiempo real de vanguardia para TensorFlow 2 (compatible con inglés, francés, coreano, chino, alemán y fácil de adaptar a otros idiomas)
★ 3996+0Variación de estrellas de los últimos 7 días - #47
Streamer-Sales: Un LLM para streamers de ventas que genera explicaciones de productos para incentivar la compra. Incluye flujo de datos, aceleración de inferencia con LMDeploy, RAG, TTS, generación de avatares digitales, agentes con búsqueda web, ASR, frontend en Vue, backend en FastAPI y despliegue con Docker-compose.
★ 3764+1Variación de estrellas de los últimos 7 días - #48
Una herramienta de conversión de voz simple y de alta calidad, enfocada en la facilidad de uso y el rendimiento.
★ 3674+14Variación de estrellas de los últimos 7 días - #49
Una WebUI única en Gradio + React con extensiones para ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T y Bark.
★ 3250+5Variación de estrellas de los últimos 7 días - #50
[AutoArk] ¡GPA (Audio de Propósito General) puede hacer reconocimiento de voz (ASR), síntesis de voz (TTS) y conversión de voz con un modelo diminuto!
★ 3061+164Variación de estrellas de los últimos 7 días - #51
OpenCTP proporciona interfaces compatibles con CTP API para diversos canales de trading (XTP, TORA, OST, EMT, TWS, TAP, QDP), permitiendo la integración fluida de programas CTP con múltiples plataformas bursátiles. Incluye un entorno de simulación basado en TTS para trading cuantitativo 24/7.
★ 2920+7Variación de estrellas de los últimos 7 días - #52★ 2864+0Variación de estrellas de los últimos 7 días
- #53
aeneas es una biblioteca de Python/C y un conjunto de herramientas para sincronizar automáticamente audio y texto (también conocido como alineación forzada)
★ 2862+0Variación de estrellas de los últimos 7 días - #54
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Lectures, Courses, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, AI, AI News, ML, ML News, News, Tech, Tech News, Kohya, Midjourney, RunPod
★ 2762-1Variación de estrellas de los últimos 7 días - #55
TTS con kokoro y onnx runtime
★ 2694+8Variación de estrellas de los últimos 7 días - #56
Biblioteca de Python y herramienta de línea de comandos para interactuar con la API de conversión de texto a voz de Google Translate
★ 2628+0Variación de estrellas de los últimos 7 días - #57★ 2586+1Variación de estrellas de los últimos 7 días
- #58
MARY TTS -- un sistema de síntesis de texto a voz multilingüe y de código abierto escrito en Java puro.
★ 2583+0Variación de estrellas de los últimos 7 días - #59
TTS en vietnamita con clonación de voz instantánea • En el dispositivo • Inferencia en CPU en tiempo real • Calidad de audio de 24 kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2468+21Variación de estrellas de los últimos 7 días - #60
HiFi-GAN: Redes Generativas Antagónicas para la síntesis de voz eficiente y de alta fidelidad
★ 2367+0Variación de estrellas de los últimos 7 días