Saltar al contenido principal
buildradar
Sign in
Tema · tts

tts

Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.

189 repositorios
  • ChatTTS-ui@jianchang512

    Una interfaz web nativa y sencilla que utiliza ChatTTS para sintetizar texto en voz, con soporte para ofrecer interfaces de API externas.

    7648+4Variación de estrellas de los últimos 7 días
  • MeloTTS@myshell-ai

    Biblioteca de conversión de texto a voz multilingüe de alta calidad de MyShell.ai. Compatible con inglés, español, francés, chino, japonés y coreano.

    7616+7Variación de estrellas de los últimos 7 días
  • wukong-robot@wzpan

    🤖 wukong-robot es un proyecto de robot de diálogo de voz en chino / altavoz inteligente simple, flexible y elegante. Admite la capacidad de conversación de múltiples turnos de ChatGPT y puede ser el primer proyecto de altavoz inteligente de código abierto que admite la interacción cerebro-computadora.

    7126+2Variación de estrellas de los últimos 7 días
  • StyleTTS2@yl4579

    StyleTTS 2: Hacia la conversión de texto a voz a nivel humano mediante difusión de estilo y entrenamiento adversarial con grandes modelos de lenguaje de voz

    6342+3Variación de estrellas de los últimos 7 días
  • Orpheus-TTS@canopyai

    Hacia voz con sonido natural

    6324+5Variación de estrellas de los últimos 7 días
  • tts-vue@LokerL

    Herramienta de síntesis de voz de Microsoft, construida con Electron, Vue, ElementPlus y Vite

    6103+1Variación de estrellas de los últimos 7 días
  • silero-models@snakers4

    Silero Models: modelos de texto a voz preentrenados hechos extremadamente sencillos

    6084-1Variación de estrellas de los últimos 7 días
  • abogen@denizsafak

    Genera audiolibros a partir de EPUBs, PDFs y texto con subtítulos sincronizados.

    5831+45Variación de estrellas de los últimos 7 días
  • Kokoro-FastAPI@remsky

    Contenedor Docker compatible con la API de OpenAI para el modelo de conversión de texto a voz Kokoro-82M con PyTorch multiplataforma para CPU, AMD y GPU NVIDIA; múltiples locutores, mezcla de voces, unión automática, marcas de tiempo en subtítulos, SSML y una interfaz web de lectura.

    5399+19Variación de estrellas de los últimos 7 días
  • dramaclaw@dramaclaw

    Un motor de video AIGC de propósito general: desde el guion hasta la película terminada en un solo flujo de trabajo — dramas, anuncios, videos de productos, juegos otome y más.

    4900+384Variación de estrellas de los últimos 7 días
  • DiffSinger@MoonInTheRiver

    DiffSinger: Síntesis de voz cantada mediante mecanismo de difusión superficial (SVS y TTS); AAAI 2022; Código oficial

    4855+3Variación de estrellas de los últimos 7 días
  • WhisperSpeech@WhisperSpeech

    Sistema de texto a voz de código abierto construido mediante la inversión de Whisper.

    4645+3Variación de estrellas de los últimos 7 días
  • tts-server-android@jing332

    Esta es una aplicación TTS para el sistema Android, con interfaz de demostración de Microsoft integrada, solicitudes HTTP personalizables, importación de otros motores TTS locales, lectura con reconocimiento simple de narración/diálogo basado en comillas dobles chinas, reintento automático, configuración de respaldo, reemplazo de texto y más funciones.

    4488+5Variación de estrellas de los últimos 7 días
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano es un modelo de generación de voz multilingüe pequeño y de código abierto de MOSI.AI y el equipo de OpenMOSS. Con solo 0.1B de parámetros, está diseñado para la generación de voz en tiempo real, puede ejecutarse directamente en la CPU sin GPU y mantiene la pila de implementación lo suficientemente simple para demostraciones locales, servicios web y la integración de productos ligeros.

    4282+11Variación de estrellas de los últimos 7 días
  • metavoice-src@metavoiceio

    Modelo fundacional para TTS expresivo y de aspecto humano

    4203-1Variación de estrellas de los últimos 7 días
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntesis de voz en tiempo real de vanguardia para TensorFlow 2 (compatible con inglés, francés, coreano, chino, alemán y fácil de adaptar a otros idiomas)

    3996+0Variación de estrellas de los últimos 7 días
  • Streamer-Sales@PeterH0323

    Streamer-Sales: Un LLM para streamers de ventas que genera explicaciones de productos para incentivar la compra. Incluye flujo de datos, aceleración de inferencia con LMDeploy, RAG, TTS, generación de avatares digitales, agentes con búsqueda web, ASR, frontend en Vue, backend en FastAPI y despliegue con Docker-compose.

    3764+1Variación de estrellas de los últimos 7 días
  • Applio@IAHispano

    Una herramienta de conversión de voz simple y de alta calidad, enfocada en la facilidad de uso y el rendimiento.

    3674+14Variación de estrellas de los últimos 7 días
  • TTS-WebUI@rsxdalv

    Una WebUI única en Gradio + React con extensiones para ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T y Bark.

    3250+5Variación de estrellas de los últimos 7 días
  • GPA@AutoArk

    [AutoArk] ¡GPA (Audio de Propósito General) puede hacer reconocimiento de voz (ASR), síntesis de voz (TTS) y conversión de voz con un modelo diminuto!

    3061+164Variación de estrellas de los últimos 7 días
  • openctp@openctp

    OpenCTP proporciona interfaces compatibles con CTP API para diversos canales de trading (XTP, TORA, OST, EMT, TWS, TAP, QDP), permitiendo la integración fluida de programas CTP con múltiples plataformas bursátiles. Incluye un entorno de simulación basado en TTS para trading cuantitativo 24/7.

    2920+7Variación de estrellas de los últimos 7 días
  • lingvo@tensorflow

    Lingvo.

    2864+0Variación de estrellas de los últimos 7 días
  • aeneas@readbeyond

    aeneas es una biblioteca de Python/C y un conjunto de herramientas para sincronizar automáticamente audio y texto (también conocido como alineación forzada)

    2862+0Variación de estrellas de los últimos 7 días
  • Stable-Diffusion@FurkanGozukara

    FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Lectures, Courses, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, AI, AI News, ML, ML News, News, Tech, Tech News, Kohya, Midjourney, RunPod

    2762-1Variación de estrellas de los últimos 7 días
  • kokoro-onnx@thewh1teagle

    TTS con kokoro y onnx runtime

    2694+8Variación de estrellas de los últimos 7 días
  • gTTS@pndurette

    Biblioteca de Python y herramienta de línea de comandos para interactuar con la API de conversión de texto a voz de Google Translate

    2628+0Variación de estrellas de los últimos 7 días
  • polyglot@liou666

    🤖️ Aplicación multiplataforma de práctica de idiomas con IA

    2586+1Variación de estrellas de los últimos 7 días
  • marytts@marytts

    MARY TTS -- un sistema de síntesis de texto a voz multilingüe y de código abierto escrito en Java puro.

    2583+0Variación de estrellas de los últimos 7 días
  • VieNeu-TTS@pnnbao97

    TTS en vietnamita con clonación de voz instantánea • En el dispositivo • Inferencia en CPU en tiempo real • Calidad de audio de 24 kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2468+21Variación de estrellas de los últimos 7 días
  • hifi-gan@jik876

    HiFi-GAN: Redes Generativas Antagónicas para la síntesis de voz eficiente y de alta fidelidad

    2367+0Variación de estrellas de los últimos 7 días
← Volver a temas