Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech-synthesis

speech-synthesis

Repositórios de código aberto acompanhados marcados com speech-synthesis, ordenados por estrelas.

66 repositórios
  • chat-with-gpt@cogentapps

    Um aplicativo ChatGPT de código aberto com voz.

    2.350-1Variação de estrelas nos últimos 7 dias
  • IMS-Toucan@DigitalPhonetics

    Conversão de texto em fala rápida e controlável para mais de 7000 idiomas!

    2.207-1Variação de estrelas nos últimos 7 dias
  • RHVoice@RHVoice

    Um sintetizador de voz gratuito e de código aberto para russo e outros idiomas.

    1.836+1Variação de estrelas nos últimos 7 dias
  • ParallelWaveGAN@kan-bayashi

    Implementação não oficial de Parallel WaveGAN (+ MelGAN, Multi-band MelGAN, HiFi-GAN e StyleMelGAN) com Pytorch.

    1.646+1Variação de estrelas nos últimos 7 dias
  • dsnote@mkiol

    Aplicativo Speech Note para Linux. Tomada de notas, leitura e tradução com conversão de fala em texto, texto em fala e tradução automática offline.

    1.622+8Variação de estrelas nos últimos 7 dias
  • Nós personalizados que estendem as capacidades do Comfyui

    1.525+1Variação de estrelas nos últimos 7 dias
  • SAM@s-macke

    Software Automatic Mouth - Um pequeno sintetizador de voz

    1.498+0Variação de estrelas nos últimos 7 dias
  • SpeechT5@microsoft

    Pré-treinamento multimodal de fala e texto para processamento de linguagem falada

    1.449+0Variação de estrelas nos últimos 7 dias
  • Auto-hospede o poderoso modelo de TTS Chatterbox. Este servidor oferece uma interface web amigável, endpoints de API flexíveis (incluindo compatibilidade com OpenAI), vozes predefinidas, clonagem de voz e processamento de texto em escala de audiolivros. Executa com aceleração em NVIDIA (CUDA), AMD (ROCm) e CPU.

    1.427+1Variação de estrelas nos últimos 7 dias
  • Uma lista de corpora de fala acessíveis para ASR, TTS e outras tecnologias de fala.

    1.399+0Variação de estrelas nos últimos 7 dias
  • voicefixer@haoheliu

    Restauração geral de fala.

    1.375+0Variação de estrelas nos últimos 7 dias
  • World@mmorise

    Um sistema de alta qualidade para análise, manipulação e síntese de fala

    1.339+0Variação de estrelas nos últimos 7 dias
  • StreamSpeech@ictnlp

    StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.

    1.288+0Variação de estrelas nos últimos 7 dias
  • Irodori-TTS@Aratako

    Um modelo de conversão de texto em fala baseado em Flow Matching com controle de estilo via emoji

    1.228+4Variação de estrelas nos últimos 7 dias
  • BigVGAN@NVIDIA

    Implementação oficial em PyTorch do BigVGAN (ICLR 2023)

    1.227+1Variação de estrelas nos últimos 7 dias
  • Irina - assistente de voz em russo para uso offline. Suporta habilidades via plugins.

    1.153+0Variação de estrelas nos últimos 7 dias
  • AI-Waifu-Vtuber@ardha27

    AI Vtuber para streaming no YouTube/Twitch

    1.116+2Variação de estrelas nos últimos 7 dias
  • autovc@auspicious3000

    AutoVC: Transferência de estilo de voz zero-shot usando apenas perda de autoencoder

    1.100+0Variação de estrelas nos últimos 7 dias
  • YourTTS@Edresson

    YourTTS: Rumo a TTS multi-falante Zero-Shot e conversão de voz Zero-Shot para todos.

    1.054+0Variação de estrelas nos últimos 7 dias
  • Cognitive-Speech-TTS@Azure-Samples

    Código de exemplo da API de conversão de texto em fala da Microsoft em várias linguagens, parte dos Cognitive Services.

    1.014+3Variação de estrelas nos últimos 7 dias
  • alexandria-audiobook@Finrandojin

    Gerador de audiolivros com múltiplas vozes impulsionado por IA — anotação de script por LLM, clonagem de voz, design de voz, treinamento LoRA, controle de estilo por linha e exportação para MP3, M4B com capítulos ou multifaixa para Audacity. Construído sobre o Qwen3-TTS.

    1.000+20Variação de estrelas nos últimos 7 dias
  • NISQA@gabrielmittag

    NISQA - Avaliação não intrusiva da qualidade de fala e naturalidade de TTS.

    972+3Variação de estrelas nos últimos 7 dias
  • Tornar as vozes TTS naturais do Azure acessíveis a qualquer aplicativo compatível com SAPI 5.

    934+13Variação de estrelas nos últimos 7 dias
  • FireRedTTS@FireRedTeam

    Um sistema TTS de base potencializado por LLM de código aberto

    919+1Variação de estrelas nos últimos 7 dias
  • Um LLM falante que roda no seu próprio computador sem precisar de internet.

    891+2Variação de estrelas nos últimos 7 dias
  • diffwave@lmnt-com

    DiffWave é um vocoder neural rápido e de alta qualidade e sintetizador de formas de onda.

    884+0Variação de estrelas nos últimos 7 dias
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: um mecanismo de TTS multilíngue e interlíngue do tipo zero-shot

    794+10Variação de estrelas nos últimos 7 dias
  • vui@fluxions-ai

    Assistente de voz em tempo real — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatível com a API Realtime da OpenAI. Clonagem de voz, interrupção (barge-in), ~9× em tempo real em uma 4090. Apache 2.0.

    759+10Variação de estrelas nos últimos 7 dias
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Uma voz TTS em alemão de alta qualidade, gratuita e offline, disponível para qualquer projeto sem complicações de licença.

    729+1Variação de estrelas nos últimos 7 dias
  • Artigos do INTERSPEECH 2023-2024: Uma coleção completa de artigos de pesquisa influentes e empolgantes da conferência INTERSPEECH 2023-24. Explore os avanços mais recentes em processamento de fala e linguagem. Código incluído. Dê uma estrela no repositório para apoiar o avanço da tecnologia de fala!

    684+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos