text-to-speech
Repositorios de código abierto monitorizados etiquetados con text-to-speech, ordenados por estrellas.
- #121
Paquete de conversión de texto a voz (TTS) para Flutter
★ 753+0Variación de estrellas de los últimos 7 días - #122
🔊 Kokoro Web: IA gratuita de texto a voz, en línea o autohospedada, compatible con OpenAI.
★ 733+2Variación de estrellas de los últimos 7 días - #123
Rapida es una plataforma de orquestación de voz con IA de código abierto para crear agentes de voz conversacionales en tiempo real, con streaming de audio, STT, TTS, VAD, integración multicanal, gestión de estado del agente y observabilidad.
★ 723+4Variación de estrellas de los últimos 7 días - #124
Conversión de voz a texto y subtítulos mediante entrada de teclado para OBS, VRChat, chat de Twitch y Discord
★ 718-1Variación de estrellas de los últimos 7 días - #125
Implementación en PyTorch de Voicebox, la nueva red SOTA de texto a voz de MetaAI.
★ 703+0Variación de estrellas de los últimos 7 días - #126
Creador de videos totalmente automatizado que utiliza gráficos en movimiento y síntesis de texto a voz para convertir boletines informativos en videos diarios de YouTube.
★ 703+0Variación de estrellas de los últimos 7 días - #127
Reconocimiento de voz sin conexión con OpenAI Whisper y TensorFlow Lite para Android
★ 689+0Variación de estrellas de los últimos 7 días - #128
API de texto a voz (TTS) local compatible con OpenAI que utiliza Chatterbox, permitiendo a los usuarios generar voz clonada en cualquier lugar donde se utilice la API de OpenAI (por ejemplo, Open WebUI, AnythingLLM, etc.).
★ 677+1Variación de estrellas de los últimos 7 días - #129
Una extensión de diccionario personalizable que admite búsquedas con doble clic en más de 20 idiomas, más de 1000 diccionarios, conversión de texto a voz, traducción e integración con Anki.
★ 671+1Variación de estrellas de los últimos 7 días - #130
LLaSA: Escalado de cómputo en tiempo de entrenamiento e inferencia para síntesis de voz basada en LLaMA.
★ 658+1Variación de estrellas de los últimos 7 días - #131
Implementación de F5-TTS en MLX.
★ 644+0Variación de estrellas de los últimos 7 días - #132★ 626+2Variación de estrellas de los últimos 7 días
- #133
Convierte PDFs y EPUBs en audiolibros; subtítulos o videos en videos doblados (incluyendo traducción) y más. Gratis. Pandrator utiliza modelos locales, incluyendo clonación de voz (instantánea, mejorada con RVC, ajuste fino con XTTS) y procesamiento LLM. Aspira a ser una aplicación fácil de usar con interfaz gráfica, instalador y paquetes todo en uno.
★ 620+3Variación de estrellas de los últimos 7 días - #134
Script simple en Python para interactuar con la API de TTS de TikTok.
★ 611+0Variación de estrellas de los últimos 7 días - #135
Nodo personalizado de ComfyUI para VibeVoice TTS. Audio conversacional expresivo, de formato largo y con múltiples hablantes
★ 596-1Variación de estrellas de los últimos 7 días - #136
Versión modificada de Chatterbox que acepta archivos de texto como entrada y no tiene restricciones de caracteres. La utilizo para crear audiolibros, especialmente para mis hijos.
★ 575-1Variación de estrellas de los últimos 7 días - #137
El sistema de autocodificación para tu aplicación: Alan AI SDK para React Native
★ 575+0Variación de estrellas de los últimos 7 días - #138
Ejecuta Qwen3-TTS de texto a voz localmente en Mac (M1/M2/M3/M4). Clonación de voz, diseño de voz y voces personalizadas. 100% offline usando MLX.
★ 561+2Variación de estrellas de los últimos 7 días - #139
🔥🔥🔥 Una lista seleccionada de artículos sobre generación multimodal basada en LLMs (imagen, video, 3D y audio).
★ 552+0Variación de estrellas de los últimos 7 días - #140
Ejecuta Orpheus 3B localmente con LM Studio
★ 549+0Variación de estrellas de los últimos 7 días - #141
Implementación no oficial de vits2-TTS en PyTorch
★ 549+1Variación de estrellas de los últimos 7 días - #142
AI Plugin es una potente extensión para Payload CMS que integra capacidades avanzadas de IA para mejorar la creación y gestión de contenido.
★ 547-1Variación de estrellas de los últimos 7 días - #143
Nodos OmniVoice TTS para ComfyUI: conversión de texto a voz multilingüe zero-shot con clonación de voz, diseño de voz y diálogos con múltiples hablantes
★ 545+5Variación de estrellas de los últimos 7 días - #144
Lightning-fast, free, local first voice dictation for macOS with on-device transcription
★ 544+11Variación de estrellas de los últimos 7 días - #145★ 525+2Variación de estrellas de los últimos 7 días
- #146
Implementación de E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", en Pytorch
★ 517+0Variación de estrellas de los últimos 7 días - #147
Un modelo de clonación de voz y texto a voz en vietnamita ✨
★ 516+0Variación de estrellas de los últimos 7 días - #148
Servidor de inferencia de lenguaje altamente optimizado, de código abierto, local y autohospedado, que admite ASR/STT, TTS y LLM a través de WebRTC, REST y WS.
★ 512+0Variación de estrellas de los últimos 7 días - #149
Nodo de ComfyUI para voz altamente expresiva y clonación de voz realista zero-shot.
★ 509-1Variación de estrellas de los últimos 7 días - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 506+5Variación de estrellas de los últimos 7 días