Saltar al contenido principal
buildradar
Sign in
Tema · tts

tts

Repositorios de código abierto monitorizados etiquetados con tts, ordenados por estrellas.

Repositorios
189
Estrellas totales
1.061.717
Estrellas de media
5618
Proporción
0,06%

Temas que aparecen con frecuencia junto a tts en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con tts.

  • audio.cpp@0xShug0

    Motor de inferencia todo en uno escrito en C++ puro para modelos de audio, basado en ggml. Admite TTS, STT, VAD, conversión de voz, generación de música y más, con un rendimiento altamente optimizado y sin dependencias de Python.

    2214
  • vox-director@Alisa0808

    Convierte un tema en un video explicativo o publicitario estilo Vox con collage de papel, automatizado de principio a fin en Atlas Cloud + ffmpeg. Una habilidad de agente.

    1698
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    828
  • Herramienta de traducción de pantalla en tiempo real para Android sin necesidad de ROOT, ideal para juegos, novelas visuales y manga. Soporta OCR local y en la nube, LLM offline, múltiples servicios de traducción y síntesis de voz (TTS), con visualización directa sobre la pantalla.

    768
  • Orkas-VideoStudio@Orkas-AI

    Convierte tu agente de programación en un estudio de video: describe un video en lenguaje sencillo y tu agente escribirá la línea de tiempo y producirá el archivo.

    525
  • unsloth@unslothai

    Interfaz de usuario local para ejecutar y entrenar LLMs y modelos de difusión, incluyendo Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX y más.

    75.515+337Variación de estrellas de los últimos 7 días
  • GPT-SoVITS@RVC-Boss

    ¡1 minuto de datos de voz es suficiente para entrenar un buen modelo TTS! (clonación de voz con pocos ejemplos)

    61.476+138Variación de estrellas de los últimos 7 días
  • Clona una voz en 5 segundos para generar voz arbitraria en tiempo real

    60.117-4Variación de estrellas de los últimos 7 días
  • LocalAI@mudler

    LocalAI es el motor de IA de código abierto. Ejecuta cualquier modelo (LLM, visión, voz, imagen, video) en cualquier hardware. No requiere GPU.

    48.833+84Variación de estrellas de los últimos 7 días
  • TTS@coqui-ai

    🐸💬 - Un conjunto de herramientas de aprendizaje profundo para texto a voz (TTS), probado en combate en investigación y producción

    45.985+18Variación de estrellas de los últimos 7 días
  • ChatTTS@2noise

    Un modelo de voz generativa para el diálogo diario.

    39.814+9Variación de estrellas de los últimos 7 días
  • OpenVoice@myshell-ai

    Clonación de voz instantánea por MIT y MyShell. Modelo base de audio.

    37.419+61Variación de estrellas de los últimos 7 días
  • MockingBird@babysor

    🚀 Clona una voz en 5 segundos para generar voz arbitraria en tiempo real

    36.912+0Variación de estrellas de los últimos 7 días
  • VoxCPM@OpenBMB

    VoxCPM2: TTS sin tokenizador para generación de voz multilingüe, diseño de voz creativo y clonación realista

    36.595+345Variación de estrellas de los últimos 7 días
  • fish-speech@fishaudio

    TTS de código abierto de última generación (SOTA)

    32.510+52Variación de estrellas de los últimos 7 días
  • Pixelle-Video@ATH-MaaS

    Motor de videos cortos totalmente automatizado por IA

    27.702+236Variación de estrellas de los últimos 7 días
  • mastra@mastra-ai

    Mastra es el framework moderno de TypeScript para aplicaciones y agentes impulsados por IA.

    27.657+96Variación de estrellas de los últimos 7 días
  • readest@readest

    Readest es un lector de libros electrónicos moderno y rico en funciones, diseñado para lectores ávidos, que ofrece acceso multiplataforma fluido, herramientas potentes y una interfaz intuitiva para mejorar tu experiencia de lectura.

    24.008+138Variación de estrellas de los últimos 7 días
  • index-tts@index-tts

    Un sistema de texto a voz zero-shot eficiente y controlable a nivel industrial

    23.686+109Variación de estrellas de los últimos 7 días
  • CosyVoice@QwenAudio

    Modelo de generación de voz grande multilingüe, que proporciona capacidad de pila completa para inferencia, entrenamiento y despliegue.

    23.426+359Variación de estrellas de los últimos 7 días
  • ebook2audiobook@DrewThomasson

    ¡Genera audiolibros a partir de libros electrónicos, clonación de voz y más de 1158 idiomas!

    20.097+34Variación de estrellas de los últimos 7 días
  • pot-desktop@pot-app

    🌈 Un software multiplataforma para traducción de texto y reconocimiento OCR.

    19.408+28Variación de estrellas de los últimos 7 días
  • Speech@NVIDIA-NeMo

    Un framework de IA generativa escalable creado para investigadores y desarrolladores que trabajan en Modelos de Lenguaje Grande, Multimodal y IA de Voz (Reconocimiento Automático de Voz y Text-to-Speech)

    18.379+21Variación de estrellas de los últimos 7 días
  • VoiceStudio@debpalash

    VoiceStudio es la alternativa a ElevenLabs de código abierto y totalmente local: clonación de voz, diseño de voz, doblaje de vídeo, dictado, transcripción y creación de audiolibros en 646 idiomas.

    14.835+2880Variación de estrellas de los últimos 7 días
  • supertonic@supertone-inc

    TTS multilingüe, ultrarrápido y en el dispositivo, ejecutándose de forma nativa mediante ONNX.

    13.757+20Variación de estrellas de los últimos 7 días
  • voice-pro@abus-aikorea

    Gradio WebUI para creadores y desarrolladores, con TTS clave (Edge-TTS, kokoro) y clonación de voz zero-shot (E2 & F5-TTS, CosyVoice), procesamiento de audio con Whisper, descarga de YouTube, aislamiento vocal con Demucs y traducción multilingüe.

    12.730+54Variación de estrellas de los últimos 7 días
  • PaddleSpeech@PaddlePaddle

    Kit de herramientas de voz fácil de usar que incluye modelo de aprendizaje autosupervisado, ASR de transmisión/SOTA con puntuación, TTS de transmisión con interfaz de texto, sistema de verificación de hablantes, traducción de voz de extremo a extremo y detección de palabras clave. Ganador del premio al mejor demo en NAACL2022.

    12.676+5Variación de estrellas de los últimos 7 días
  • edge-tts@rany2

    Utiliza el servicio de conversión de texto a voz en línea de Microsoft Edge desde Python SIN necesidad de Microsoft Edge, Windows ni una clave de API

    11.847+29Variación de estrellas de los últimos 7 días
  • KrillinAI@krillinai

    Herramienta de traducción y doblaje de video con IA para humanos y Agentes de IA, impulsada por LLMs. Pipeline completo: descarga, transcripción, traducción, doblaje por TTS, reformateo y generación de portadas. Más de 100 idiomas, optimizado para YouTube, TikTok, Bilibili, Douyin y más.

    11.333+46Variación de estrellas de los últimos 7 días
  • moonshine@moonshine-ai

    Voz a texto, reconocimiento de intenciones y texto a voz de muy baja latencia para construir agentes e interfaces de voz.

    10.997+33Variación de estrellas de los últimos 7 días
  • voltagent@VoltAgent

    Plataforma de ingeniería de agentes de IA construida sobre un framework de agentes de IA de código abierto en TypeScript

    10.529+80Variación de estrellas de los últimos 7 días
  • Bert-VITS2@fishaudio

    Backbone vits2 con multilingual-bert.

    8794-3Variación de estrellas de los últimos 7 días
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Un motor TTS multi-voz y controlado por avisos

    8522-1Variación de estrellas de los últimos 7 días
  • audiblez@santinic

    Genera audiolibros a partir de libros electrónicos

    8479+9Variación de estrellas de los últimos 7 días
  • Vision-Agents@GetStream

    Open Vision Agents de Stream. Crea agentes de voz y visión rápidamente con cualquier modelo o proveedor de video. Utiliza la red perimetral de Stream para una latencia ultrabaja.

    8113+9Variación de estrellas de los últimos 7 días
← Volver a temas