tts
Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.
- #61
Lector de libros electrónicos multiplataforma impulsado por IA con búsqueda semántica, chat RAG, almacenamiento vectorial local, notas, TTS y sincronización WebDAV.
★ 2305+24Variación de estrellas de los últimos 7 días - #62
Herramienta de texto a voz de código abierto, compatible con textos muy largos y doblaje multirrol
★ 2296+7Variación de estrellas de los últimos 7 días - #63
Implementación en PyTorch de VALL-E (Texto a voz de disparo cero), Demo reproducida https://lifeiteng.github.io/valle/index.html
★ 2215+0Variación de estrellas de los últimos 7 días - #64
Motor de inferencia todo en uno escrito en C++ puro para modelos de audio, basado en ggml. Admite TTS, STT, VAD, conversión de voz, generación de música y más, con un rendimiento altamente optimizado y sin dependencias de Python.
★ 2214+115Variación de estrellas de los últimos 7 días - #65
¡Texto a voz controlable y rápido para más de 7000 idiomas!
★ 2207-1Variación de estrellas de los últimos 7 días - #66
Endpoint de API de texto a voz gratuito y de alta calidad para reemplazar OpenAI, Azure o ElevenLabs
★ 2075+5Variación de estrellas de los últimos 7 días - #67
Convertidor de EPUB a audiolibro, optimizado para Audiobookshelf, incluye WebUI
★ 2064+1Variación de estrellas de los últimos 7 días - #68
Juguetes de IA de voz en tiempo real con más de 100 modelos en Arduino ESP32 con WebSockets seguros y Edge Functions para compañeros y dispositivos de IA
★ 1938+5Variación de estrellas de los últimos 7 días - #69
Control de Yandex.Station y otros dispositivos de hogar inteligente con Alice desde Home Assistant
★ 1917-1Variación de estrellas de los últimos 7 días - #70★ 1912+1Variación de estrellas de los últimos 7 días
- #71
Flujo de trabajo a APLICACIÓN, Compartir pantalla y Vídeo flotante, GPT y 3D, Reconocimiento de voz y TTS
★ 1861-2Variación de estrellas de los últimos 7 días - #72★ 1836+1Variación de estrellas de los últimos 7 días
- #73
Una herramienta CLI de texto a voz que utiliza el modelo Kokoro, compatible con múltiples idiomas, voces (con mezcla) y varios formatos de entrada, incluidos libros EPUB y documentos PDF.
★ 1835+14Variación de estrellas de los últimos 7 días - #74★ 1760+3Variación de estrellas de los últimos 7 días
- #75
Bailing es un robot de conversación por voz similar a GPT-4o, implementado mediante ASR+LLM+TTS, que integra modelos avanzados como DeepSeek R1 y openClaw. Es un asistente de voz personal real con una latencia de hasta 800 ms, ejecutable en equipos de bajos recursos como Mac y con soporte para interrupciones.
★ 1759+2Variación de estrellas de los últimos 7 días - #76
🚀 Empleado de generación de video totalmente automatizado por IA | Your First AIGC Coworker. Chat an Idea. Get a Film. 🦞
★ 1749+14Variación de estrellas de los últimos 7 días - #77
Traduce automáticamente el texto de un video según un archivo de subtítulos y luego utiliza servicios de voz con IA para crear una nueva pista de audio doblada y traducida con el habla sincronizada utilizando los tiempos de los subtítulos.
★ 1746-1Variación de estrellas de los últimos 7 días - #78
Convierte un tema en un video explicativo o publicitario estilo Vox con collage de papel, automatizado de principio a fin en Atlas Cloud + ffmpeg. Una habilidad de agente.
★ 1698+67Variación de estrellas de los últimos 7 días - #79★ 1687+4Variación de estrellas de los últimos 7 días
- #80
Conoce a Ava, el agente de WhatsApp
★ 1675+2Variación de estrellas de los últimos 7 días - #81
Implementación no oficial de Parallel WaveGAN (+ MelGAN, Multi-band MelGAN, HiFi-GAN y StyleMelGAN) con Pytorch
★ 1646+1Variación de estrellas de los últimos 7 días - #82
Aplicación de notas para Linux. Permite tomar notas, leer y traducir con funciones offline de voz a texto, texto a voz y traducción automática.
★ 1622+8Variación de estrellas de los últimos 7 días - #83
Amica es una interfaz de código abierto para la comunicación interactiva con personajes 3D mediante síntesis de voz y reconocimiento de voz.
★ 1591-2Variación de estrellas de los últimos 7 días - #84
Una integración completa de ComfyUI para el modelo de texto a voz VibeVoice de Microsoft, que permite la síntesis de voz de alta calidad para uno o varios hablantes directamente dentro de tus flujos de trabajo de ComfyUI.
★ 1555+4Variación de estrellas de los últimos 7 días - #85★ 1548+60Variación de estrellas de los últimos 7 días
- #86
Aplicación de asistente Dicio para Android
★ 1463+3Variación de estrellas de los últimos 7 días - #87
Ejecuta LLMs locales como llama, deepseek-distill, kokoro y otros directamente en tu navegador.
★ 1449+1Variación de estrellas de los últimos 7 días - #88
Una aplicación de Python/Pytorch para sintetizar voces humanas fácilmente
★ 1440+0Variación de estrellas de los últimos 7 días - #89★ 1437+0Variación de estrellas de los últimos 7 días
- #90
Aloja localmente el potente modelo de TTS Chatterbox. Este servidor ofrece una interfaz web intuitiva, endpoints de API flexibles (compatibles con OpenAI), voces predefinidas, clonación de voz y procesamiento de texto a gran escala para audiolibros. Se ejecuta con aceleración en NVIDIA (CUDA), AMD (ROCm) y CPU.
★ 1427+1Variación de estrellas de los últimos 7 días