Saltar al contenido principal
buildradar
Sign in
Tema · tts

tts

Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.

189 repositorios
  • ReadAny@codedogQBY

    Lector de libros electrónicos multiplataforma impulsado por IA con búsqueda semántica, chat RAG, almacenamiento vectorial local, notas, TTS y sincronización WebDAV.

    2305+24Variación de estrellas de los últimos 7 días
  • easyVoice@cosin2077

    Herramienta de texto a voz de código abierto, compatible con textos muy largos y doblaje multirrol

    2296+7Variación de estrellas de los últimos 7 días
  • vall-e@lifeiteng

    Implementación en PyTorch de VALL-E (Texto a voz de disparo cero), Demo reproducida https://lifeiteng.github.io/valle/index.html

    2215+0Variación de estrellas de los últimos 7 días
  • audio.cpp@0xShug0

    Motor de inferencia todo en uno escrito en C++ puro para modelos de audio, basado en ggml. Admite TTS, STT, VAD, conversión de voz, generación de música y más, con un rendimiento altamente optimizado y sin dependencias de Python.

    2214+115Variación de estrellas de los últimos 7 días
  • IMS-Toucan@DigitalPhonetics

    ¡Texto a voz controlable y rápido para más de 7000 idiomas!

    2207-1Variación de estrellas de los últimos 7 días
  • openai-edge-tts@travisvn

    Endpoint de API de texto a voz gratuito y de alta calidad para reemplazar OpenAI, Azure o ElevenLabs

    2075+5Variación de estrellas de los últimos 7 días
  • Convertidor de EPUB a audiolibro, optimizado para Audiobookshelf, incluye WebUI

    2064+1Variación de estrellas de los últimos 7 días
  • ElatoAI@akdeb

    Juguetes de IA de voz en tiempo real con más de 100 modelos en Arduino ESP32 con WebSockets seguros y Edge Functions para compañeros y dispositivos de IA

    1938+5Variación de estrellas de los últimos 7 días
  • YandexStation@AlexxIT

    Control de Yandex.Station y otros dispositivos de hogar inteligente con Alice desde Home Assistant

    1917-1Variación de estrellas de los últimos 7 días
  • Dot@alexpinel

    Text-To-Speech, RAG y LLMs. ¡Todo local!

    1912+1Variación de estrellas de los últimos 7 días
  • comfyui-mixlab-nodes@MixLabPro

    Flujo de trabajo a APLICACIÓN, Compartir pantalla y Vídeo flotante, GPT y 3D, Reconocimiento de voz y TTS

    1861-2Variación de estrellas de los últimos 7 días
  • RHVoice@RHVoice

    Un sintetizador de voz libre y de código abierto para ruso y otros idiomas

    1836+1Variación de estrellas de los últimos 7 días
  • kokoro-tts@nazdridoy

    Una herramienta CLI de texto a voz que utiliza el modelo Kokoro, compatible con múltiples idiomas, voces (con mezcla) y varios formatos de entrada, incluidos libros EPUB y documentos PDF.

    1835+14Variación de estrellas de los últimos 7 días
  • Genie-TTS@High-Logic

    Motor de inferencia y convertidor de modelos ONNX para GPT-SoVITS

    1760+3Variación de estrellas de los últimos 7 días
  • bailing@wwbin2017

    Bailing es un robot de conversación por voz similar a GPT-4o, implementado mediante ASR+LLM+TTS, que integra modelos avanzados como DeepSeek R1 y openClaw. Es un asistente de voz personal real con una latencia de hasta 800 ms, ejecutable en equipos de bajos recursos como Mac y con soporte para interrupciones.

    1759+2Variación de estrellas de los últimos 7 días
  • VideoClaw@HITsz-TMG

    🚀 Empleado de generación de video totalmente automatizado por IA | Your First AIGC Coworker. Chat an Idea. Get a Film. 🦞

    1749+14Variación de estrellas de los últimos 7 días
  • Traduce automáticamente el texto de un video según un archivo de subtítulos y luego utiliza servicios de voz con IA para crear una nueva pista de audio doblada y traducida con el habla sincronizada utilizando los tiempos de los subtítulos.

    1746-1Variación de estrellas de los últimos 7 días
  • vox-director@Alisa0808

    Convierte un tema en un video explicativo o publicitario estilo Vox con collage de papel, automatizado de principio a fin en Atlas Cloud + ffmpeg. Una habilidad de agente.

    1698+67Variación de estrellas de los últimos 7 días
  • uzu@trymirai

    Un motor de inferencia de alto rendimiento para modelos de IA

    1687+4Variación de estrellas de los últimos 7 días
  • Conoce a Ava, el agente de WhatsApp

    1675+2Variación de estrellas de los últimos 7 días
  • ParallelWaveGAN@kan-bayashi

    Implementación no oficial de Parallel WaveGAN (+ MelGAN, Multi-band MelGAN, HiFi-GAN y StyleMelGAN) con Pytorch

    1646+1Variación de estrellas de los últimos 7 días
  • dsnote@mkiol

    Aplicación de notas para Linux. Permite tomar notas, leer y traducir con funciones offline de voz a texto, texto a voz y traducción automática.

    1622+8Variación de estrellas de los últimos 7 días
  • amica@semperai

    Amica es una interfaz de código abierto para la comunicación interactiva con personajes 3D mediante síntesis de voz y reconocimiento de voz.

    1591-2Variación de estrellas de los últimos 7 días
  • VibeVoice-ComfyUI@Enemyx-net

    Una integración completa de ComfyUI para el modelo de texto a voz VibeVoice de Microsoft, que permite la síntesis de voz de alta calidad para uno o varios hablantes directamente dentro de tus flujos de trabajo de ComfyUI.

    1555+4Variación de estrellas de los últimos 7 días
  • soprano@ekwek1

    Soprano: conversión de texto a voz instantánea y ultrarrealista

    1548+60Variación de estrellas de los últimos 7 días
  • dicio-android@DicioTeam

    Aplicación de asistente Dicio para Android

    1463+3Variación de estrellas de los últimos 7 días
  • BrowserAI@sauravpanda

    Ejecuta LLMs locales como llama, deepseek-distill, kokoro y otros directamente en tu navegador.

    1449+1Variación de estrellas de los últimos 7 días
  • Voice-Cloning-App@voice-cloning-app

    Una aplicación de Python/Pytorch para sintetizar voces humanas fácilmente

    1440+0Variación de estrellas de los últimos 7 días
  • OuteTTS@edwko

    Interfaz para modelos OuteTTS.

    1437+0Variación de estrellas de los últimos 7 días
  • Aloja localmente el potente modelo de TTS Chatterbox. Este servidor ofrece una interfaz web intuitiva, endpoints de API flexibles (compatibles con OpenAI), voces predefinidas, clonación de voz y procesamiento de texto a gran escala para audiolibros. Se ejecuta con aceleración en NVIDIA (CUDA), AMD (ROCm) y CPU.

    1427+1Variación de estrellas de los últimos 7 días
← Volver a temas