Saltar al contenido principal
buildradar
Sign in
Tema · tts

tts

Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.

189 repositorios
  • Speech-AI-Forge@lenML

    Speech-AI-Forge es un proyecto desarrollado en torno a un modelo de generación TTS, que implementa un servidor API y una interfaz web basada en Gradio.

    1418+0Variación de estrellas de los últimos 7 días
  • SoniTranslate@R3gm

    Traducción sincronizada para videos. Doblaje de video

    1413+2Variación de estrellas de los últimos 7 días
  • Una lista de corpus de voz accesibles para ASR, TTS y otras tecnologías de voz.

    1399+0Variación de estrellas de los últimos 7 días
  • voicefixer@haoheliu

    Restauración general de voz.

    1375+0Variación de estrellas de los últimos 7 días
  • edge-TTS-record@LuckyHookin

    Una herramienta (para Windows) que permite grabar la síntesis de voz (TTS) del navegador Microsoft Edge y exportarla como audio .wav.

    1370+1Variación de estrellas de los últimos 7 días
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: Una arquitectura de TTS rápida con conditional flow matching.

    1353+3Variación de estrellas de los últimos 7 días
  • voicemode@mbailey

    Conversaciones de voz naturales con Claude Code.

    1347+6Variación de estrellas de los últimos 7 días
  • Plataforma de gestión empresarial Java para XiaoZhi ESP32, que ofrece una solución integral de backend y frontend para monitoreo de dispositivos, personalización de voz, cambio de roles y gestión de registros de diálogo.

    1337+1Variación de estrellas de los últimos 7 días
  • MouseTooltipTranslator@ttop32

    Traducción al pasar el ratón para cualquier idioma - Extensión de Chrome: traductor de PDF, EBOOK, EPUB, OCR, TTS, NETFLIX, SUBTÍTULOS DUALES DE YOUTUBE, GOOGLE DOCS, IA, VISOR, GMAIL, ESCRITURA, IMAGEN, SUBTÍTULOS DUALES, MANGA, HOVER, DICCIONARIO, WEBTOON, EDGE, JAPONÉS, INGLÉS.

    1305+4Variación de estrellas de los últimos 7 días
  • VideoChat@Henry-23

    Humano digital interactivo en tiempo real, con apariencia y voz personalizables, soporte para clonación de voz y una latencia de respuesta de hasta 3 segundos.

    1303-1Variación de estrellas de los últimos 7 días
  • StreamSpeech@ictnlp

    StreamSpeech es un modelo integrado "Todo en uno" para el reconocimiento, traducción y síntesis de voz tanto fuera de línea como simultáneos.

    1288+0Variación de estrellas de los últimos 7 días
  • my-translator@phuc-nt

    Traducción de voz en tiempo real para macOS y Windows, TTS gratuito, sin servidor, solo usa tus propias claves API

    1278+2Variación de estrellas de los últimos 7 días
  • audio-webui@gitmylo

    Interfaz web para diversas redes neuronales relacionadas con audio.

    1246+0Variación de estrellas de los últimos 7 días
  • Irodori-TTS@Aratako

    Modelo de texto a voz basado en Flow Matching con control de estilo mediante emojis.

    1228+4Variación de estrellas de los últimos 7 días
  • vits_chinese@PlayVoice

    TTS de mejores prácticas basado en BERT y VITS con características de Natural Speech de Microsoft; ¡soporta salida de streaming ONNX!

    1226+0Variación de estrellas de los últimos 7 días
  • ekho@hgneng

    Motor de conversión de texto a voz en chino

    1211+0Variación de estrellas de los últimos 7 días
  • TTS-Audio-Suite@diodiogod

    Una integración de nodos personalizados para ComfyUI que permite el uso local de motores de conversión de texto a voz y voz a voz en múltiples idiomas. Soporta: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (clásico y multilingüe), F5-TTS, Higgs Audio 2, 3 y VibeVoice, con longitud de texto ilimitada, temporización SRT, soporte de personajes y diversas herramientas de audio.

    1187+7Variación de estrellas de los últimos 7 días
  • sokuji@kizuna-ai-lab

    Traducción de voz bidireccional en tiempo real para reuniones bilingües: detecta automáticamente el idioma hablado y traduce en ambas direcciones, ya sea en la nube o completamente offline en el dispositivo. Disponible para escritorio (Windows, macOS, Linux) y extensiones de navegador (Chrome, Edge) para Zoom, Meet, Teams y cualquier aplicación.

    1186+40Variación de estrellas de los últimos 7 días
  • speech-swift@soniqo

    Kit de herramientas de voz con IA para Apple Silicon: ASR, TTS, voz a voz, VAD y diarización impulsados por MLX y CoreML

    1161+4Variación de estrellas de los últimos 7 días
  • Irina: un asistente de voz en ruso para trabajar sin conexión. Admite habilidades mediante complementos.

    1153+0Variación de estrellas de los últimos 7 días
  • DragonianVoice@PriesiaMioShirakana

    Bibliotecas de inferencia en C++ para múltiples SVC/TTS.

    1128-1Variación de estrellas de los últimos 7 días
  • sglang-omni@sgl-project

    SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.

    1118+143Variación de estrellas de los últimos 7 días
  • AI-Waifu-Vtuber@ardha27

    VTuber con IA para streaming en YouTube/Twitch.

    1115+1Variación de estrellas de los últimos 7 días
  • nobodywho@nobodywho-ooo

    NobodyWho es un motor de inferencia que permite ejecutar LLMs local y eficientemente en cualquier dispositivo.

    1094+13Variación de estrellas de los últimos 7 días
  • GLM-TTS@zai-org

    GLM-TTS: TTS zero-shot controlable y con expresión emocional mediante aprendizaje por refuerzo con múltiples recompensas

    1063+7Variación de estrellas de los últimos 7 días
  • Con un solo comando, crea un audiolibro con sonido natural a partir de una variedad de formatos de entrada (epub, mobi, txt, PDF, HTML y más).

    1058+1Variación de estrellas de los últimos 7 días
  • ms-ra-forwarder@wxxxcxx

    API gratuita de texto a voz en línea

    1058+4Variación de estrellas de los últimos 7 días
  • YourTTS@Edresson

    YourTTS: hacia un TTS multihablante Zero-Shot y conversión de voz Zero-Shot para todos.

    1053+0Variación de estrellas de los últimos 7 días
  • vits-simple-api@Artrajz

    Una API HTTP simple para VITS, desarrollada extendiendo Moegoe con funcionalidades adicionales.

    1051-1Variación de estrellas de los últimos 7 días
  • Cognitive-Speech-TTS@Azure-Samples

    Código de ejemplo de la API de Text-to-Speech de Microsoft en varios lenguajes, parte de Cognitive Services.

    1014+3Variación de estrellas de los últimos 7 días
← Volver a temas