Saltar al contenido principal
buildradar
Sign in
Tema · speech-synthesis

speech-synthesis

Repositorios de código abierto monitorizados etiquetados con speech-synthesis, ordenados por estrellas.

Repositorios
66
Estrellas totales
348.104
Estrellas de media
5274
Proporción
0,02%

Temas que aparecen con frecuencia junto a speech-synthesis en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con speech-synthesis.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • TTS@coqui-ai

    🐸💬 - Un conjunto de herramientas de aprendizaje profundo para texto a voz (TTS), probado en combate en investigación y producción

    45.985+18Variación de estrellas de los últimos 7 días
  • VoxCPM@OpenBMB

    VoxCPM2: TTS sin tokenizador para generación de voz multilingüe, diseño de voz creativo y clonación realista

    36.595+345Variación de estrellas de los últimos 7 días
  • Speech@NVIDIA-NeMo

    Un framework de IA generativa escalable creado para investigadores y desarrolladores que trabajan en Modelos de Lenguaje Grande, Multimodal y IA de Voz (Reconocimiento Automático de Voz y Text-to-Speech)

    18.379+21Variación de estrellas de los últimos 7 días
  • leon@leon-ai

    🧠 Leon es su asistente personal de código abierto.

    17.476+1Variación de estrellas de los últimos 7 días
  • DeepLearningExamples@NVIDIA

    Scripts de Deep Learning de última generación organizados por modelos: fáciles de entrenar y desplegar con precisión y rendimiento reproducibles en infraestructura de nivel empresarial.

    14.846+4Variación de estrellas de los últimos 7 días
  • supertonic@supertone-inc

    TTS multilingüe, ultrarrápido y en el dispositivo, ejecutándose de forma nativa mediante ONNX.

    13.757+20Variación de estrellas de los últimos 7 días
  • speech-to-speech@huggingface

    Crea agentes de voz con modelos de código abierto

    13.015+82Variación de estrellas de los últimos 7 días
  • voice-pro@abus-aikorea

    Gradio WebUI para creadores y desarrolladores, con TTS clave (Edge-TTS, kokoro) y clonación de voz zero-shot (E2 & F5-TTS, CosyVoice), procesamiento de audio con Whisper, descarga de YouTube, aislamiento vocal con Demucs y traducción multilingüe.

    12.730+54Variación de estrellas de los últimos 7 días
  • PaddleSpeech@PaddlePaddle

    Kit de herramientas de voz fácil de usar que incluye modelo de aprendizaje autosupervisado, ASR de transmisión/SOTA con puntuación, TTS de transmisión con interfaz de texto, sistema de verificación de hablantes, traducción de voz de extremo a extremo y detección de palabras clave. Ganador del premio al mejor demo en NAACL2022.

    12.676+5Variación de estrellas de los últimos 7 días
  • edge-tts@rany2

    Utiliza el servicio de conversión de texto a voz en línea de Microsoft Edge desde Python SIN necesidad de Microsoft Edge, Windows ni una clave de API

    11.847+29Variación de estrellas de los últimos 7 días
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) es un conjunto de herramientas para la generación de audio, música y voz. Su propósito es respaldar la investigación reproducible y ayudar a los investigadores y desarrolladores junior a iniciarse en el campo de la investigación y el desarrollo de la generación de audio, música y voz.

    10.276+1Variación de estrellas de los últimos 7 días
  • espnet@espnet

    Kit de herramientas de procesamiento de voz de extremo a extremo

    9949+3Variación de estrellas de los últimos 7 días
  • so-vits-svc-fork@voicepaw

    Bifurcación (fork) de so-vits-svc con soporte en tiempo real, interfaz mejorada y más funciones.

    9329+3Variación de estrellas de los últimos 7 días
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Un motor TTS multi-voz y controlado por avisos

    8522-1Variación de estrellas de los últimos 7 días
  • mlx-audio@Blaizzy

    Una biblioteca de texto a voz (TTS), voz a texto (STT) y voz a voz (STS) construida sobre el framework MLX de Apple, que proporciona un análisis de voz eficiente en Apple Silicon.

    7826+23Variación de estrellas de los últimos 7 días
  • espeak-ng@espeak-ng

    eSpeak NG es un sintetizador de voz de código abierto que admite más de cien idiomas y acentos.

    6802+13Variación de estrellas de los últimos 7 días
  • StyleTTS2@yl4579

    StyleTTS 2: Hacia la conversión de texto a voz a nivel humano mediante difusión de estilo y entrenamiento adversarial con grandes modelos de lenguaje de voz

    6342+3Variación de estrellas de los últimos 7 días
  • silero-models@snakers4

    Silero Models: modelos de texto a voz preentrenados hechos extremadamente sencillos

    6084-1Variación de estrellas de los últimos 7 días
  • abogen@denizsafak

    Genera audiolibros a partir de EPUBs, PDFs y texto con subtítulos sincronizados.

    5831+45Variación de estrellas de los últimos 7 días
  • DiffSinger@MoonInTheRiver

    DiffSinger: Síntesis de voz cantada mediante mecanismo de difusión superficial (SVS y TTS); AAAI 2022; Código oficial

    4855+3Variación de estrellas de los últimos 7 días
  • WhisperSpeech@WhisperSpeech

    Sistema de texto a voz de código abierto construido mediante la inversión de Whisper.

    4645+3Variación de estrellas de los últimos 7 días
  • OpenUtau@openutau

    Plataforma de síntesis de canto abierta / Sucesor de código abierto de UTAU

    4258+18Variación de estrellas de los últimos 7 días
  • metavoice-src@metavoiceio

    Modelo fundacional para TTS expresivo y de aspecto humano

    4203-1Variación de estrellas de los últimos 7 días
  • RealtimeTTS@KoljaB

    Convierte texto a voz en tiempo real

    4021+2Variación de estrellas de los últimos 7 días
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntesis de voz en tiempo real de vanguardia para TensorFlow 2 (compatible con inglés, francés, coreano, chino, alemán y fácil de adaptar a otros idiomas)

    3996+0Variación de estrellas de los últimos 7 días
  • lingvo@tensorflow

    Lingvo.

    2864+0Variación de estrellas de los últimos 7 días
  • MARS5-TTS@Camb-ai

    Modelo de voz (TTS) MARS5 de CAMB.AI

    2818+1Variación de estrellas de los últimos 7 días
  • marytts@marytts

    MARY TTS -- un sistema de síntesis de texto a voz multilingüe y de código abierto escrito en Java puro.

    2583+0Variación de estrellas de los últimos 7 días
  • VieNeu-TTS@pnnbao97

    TTS en vietnamita con clonación de voz instantánea • En el dispositivo • Inferencia en CPU en tiempo real • Calidad de audio de 24 kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2468+21Variación de estrellas de los últimos 7 días
  • hifi-gan@jik876

    HiFi-GAN: Redes Generativas Antagónicas para la síntesis de voz eficiente y de alta fidelidad

    2367+0Variación de estrellas de los últimos 7 días
← Volver a temas