Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech-synthesis

speech-synthesis

Repositórios de código aberto acompanhados marcados com speech-synthesis, ordenados por estrelas.

Repositórios
66
Total de estrelas
348.104
Média de estrelas
5.274
Participação
0,02%

Tópicos que aparecem com frequência ao lado de speech-synthesis no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com speech-synthesis.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • TTS@coqui-ai

    🐸💬 - um conjunto de ferramentas de deep learning para conversão de texto em fala (Text-to-Speech), testado em pesquisa e produção

    45.985+18Variação de estrelas nos últimos 7 dias
  • VoxCPM@OpenBMB

    VoxCPM2: TTS sem tokenizador para geração de fala multilíngue, design de voz criativo e clonagem realista

    36.595+345Variação de estrelas nos últimos 7 dias
  • Speech@NVIDIA-NeMo

    Um framework de IA generativa escalável criado para pesquisadores e desenvolvedores que trabalham com Grandes Modelos de Linguagem, Multimodal e IA de Voz (Reconhecimento Automático de Fala e Conversão de Texto em Fala)

    18.379+21Variação de estrelas nos últimos 7 dias
  • leon@leon-ai

    🧠 Leon é seu assistente pessoal de código aberto

    17.476+1Variação de estrelas nos últimos 7 dias
  • DeepLearningExamples@NVIDIA

    Scripts de Deep Learning de última geração organizados por modelos - fáceis de treinar e implantar com precisão e desempenho reproduzíveis em infraestrutura de nível empresarial.

    14.846+4Variação de estrelas nos últimos 7 dias
  • supertonic@supertone-inc

    TTS multilíngue, ultrarrápido e on-device, executado nativamente via ONNX.

    13.757+20Variação de estrelas nos últimos 7 dias
  • speech-to-speech@huggingface

    Crie agentes de voz com modelos de código aberto

    13.015+82Variação de estrelas nos últimos 7 dias
  • voice-pro@abus-aikorea

    Interface Web Gradio para criadores e desenvolvedores, apresentando TTS (Edge-TTS, kokoro) e clonagem de voz zero-shot (E2 & F5-TTS, CosyVoice), com processamento de áudio Whisper, download do YouTube, isolamento vocal Demucs e tradução multilíngue.

    12.730+54Variação de estrelas nos últimos 7 dias
  • PaddleSpeech@PaddlePaddle

    Kit de ferramentas de fala fácil de usar, incluindo modelo de aprendizado autossupervisionado, ASR SOTA/Streaming com pontuação, TTS de streaming com frontend de texto, sistema de verificação de locutor, tradução de fala de ponta a ponta e detecção de palavras-chave. Vencedor do prêmio NAACL2022 Best Demo.

    12.676+5Variação de estrelas nos últimos 7 dias
  • edge-tts@rany2

    Use o serviço de conversão de texto em fala online do Microsoft Edge a partir do Python, sem precisar do Microsoft Edge, Windows ou de uma chave de API.

    11.847+29Variação de estrelas nos últimos 7 dias
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) é um kit de ferramentas para geração de áudio, música e fala. Seu objetivo é apoiar pesquisas reprodutíveis e ajudar pesquisadores e engenheiros iniciantes a começar na área de pesquisa e desenvolvimento de geração de áudio, música e fala.

    10.276+1Variação de estrelas nos últimos 7 dias
  • espnet@espnet

    Toolkit de processamento de fala de ponta a ponta

    9.949+3Variação de estrelas nos últimos 7 dias
  • so-vits-svc-fork@voicepaw

    Fork do so-vits-svc com suporte em tempo real, interface aprimorada e mais recursos.

    9.329+3Variação de estrelas nos últimos 7 dias
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: um motor de TTS multivoz e controlado por prompt.

    8.522-1Variação de estrelas nos últimos 7 dias
  • mlx-audio@Blaizzy

    Uma biblioteca de text-to-speech (TTS), speech-to-text (STT) e speech-to-speech (STS) construída sobre o framework MLX da Apple, oferecendo análise de fala eficiente em Apple Silicon.

    7.826+23Variação de estrelas nos últimos 7 dias
  • espeak-ng@espeak-ng

    eSpeak NG é um sintetizador de voz de código aberto que suporta mais de cem idiomas e sotaques.

    6.802+13Variação de estrelas nos últimos 7 dias
  • StyleTTS2@yl4579

    StyleTTS 2: Rumo à conversão de texto em fala de nível humano através de difusão de estilo e treinamento adversarial com grandes modelos de linguagem de fala

    6.342+3Variação de estrelas nos últimos 7 dias
  • silero-models@snakers4

    Silero Models: modelos de conversão de texto em fala pré-treinados feitos de forma extremamente simples

    6.084-1Variação de estrelas nos últimos 7 dias
  • abogen@denizsafak

    Gere audiolivros a partir de EPUBs, PDFs e textos com legendas sincronizadas.

    5.831+45Variação de estrelas nos últimos 7 dias
  • DiffSinger@MoonInTheRiver

    DiffSinger: Síntese de voz cantada via mecanismo de difusão superficial (SVS e TTS); AAAI 2022; código oficial

    4.855+3Variação de estrelas nos últimos 7 dias
  • WhisperSpeech@WhisperSpeech

    Um sistema de conversão de texto em fala de código aberto construído invertendo o Whisper.

    4.645+3Variação de estrelas nos últimos 7 dias
  • OpenUtau@openutau

    Plataforma de síntese de canto aberta / sucessor de código aberto do UTAU

    4.258+18Variação de estrelas nos últimos 7 dias
  • metavoice-src@metavoiceio

    Modelo fundamental para TTS expressivo e semelhante ao humano.

    4.203-1Variação de estrelas nos últimos 7 dias
  • RealtimeTTS@KoljaB

    Converte texto em fala em tempo real.

    4.021+2Variação de estrelas nos últimos 7 dias
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Síntese de fala de última geração em tempo real para o TensorFlow 2 (suporta inglês, francês, coreano, chinês, alemão e é fácil de adaptar para outros idiomas)

    3.996+0Variação de estrelas nos últimos 7 dias
  • lingvo@tensorflow

    Lingvo

    2.864+0Variação de estrelas nos últimos 7 dias
  • MARS5-TTS@Camb-ai

    Modelo de fala (TTS) MARS5 da CAMB.AI

    2.818+1Variação de estrelas nos últimos 7 dias
  • marytts@marytts

    MARY TTS: um sistema de síntese de voz multilingue de código aberto escrito em Java puro

    2.583+0Variação de estrelas nos últimos 7 dias
  • VieNeu-TTS@pnnbao97

    TTS em vietnamita com clonagem de voz instantânea • No dispositivo • Inferência de CPU em tempo real • Qualidade de áudio de 24kHz.

    2.468+21Variação de estrelas nos últimos 7 dias
  • hifi-gan@jik876

    HiFi-GAN: Redes Adversárias Generativas para síntese de fala eficiente e de alta fidelidade

    2.367+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos