Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech

speech

Repositórios de código aberto acompanhados marcados com speech, ordenados por estrelas.

74 repositórios
  • TTS-papers@coqui-ai

    🐸 Coleção de artigos sobre TTS

    734+1Variação de estrelas nos últimos 7 dias
  • MASR@yeyupiaoling

    Framework de reconhecimento automático de fala em PyTorch para streaming e não streaming, compatível com reconhecimento online e offline. Atualmente suporta os modelos Conformer, Squeezeformer e DeepSpeech2, além de vários métodos de aumento de dados.

    727+0Variação de estrelas nos últimos 7 dias
  • FreeVC@OlaWod

    FreeVC: Rumo à conversão de voz one-shot sem texto de alta qualidade

    716+0Variação de estrelas nos últimos 7 dias
  • openspeech@openspeech-team

    Toolkit de código aberto para reconhecimento de fala ponta a ponta utilizando PyTorch-Lightning e Hydra.

    714+0Variação de estrelas nos últimos 7 dias
  • BabelDuck@Orenoid

    Aplicativo de prática de conversação em IA amigável para iniciantes.

    693+1Variação de estrelas nos últimos 7 dias
  • chatterbox-tts-api@travisvn

    API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)

    677+5Variação de estrelas nos últimos 7 dias
  • MOSS-Audio@OpenMOSS

    MOSS-Audio é um modelo de base de código aberto para compreensão unificada de áudio, permitindo fala, som, música, legendagem, QA e raciocínio em cenários do mundo real.

    656+5Variação de estrelas nos últimos 7 dias
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) para Node com detecção de palavra-chave offline

    638+0Variação de estrelas nos últimos 7 dias
  • Laboratórios, empresas, recursos e estágios na área de fala/voz, recomendações e auto-recomendações são bem-vindos

    610+1Variação de estrelas nos últimos 7 dias
  • Uma lista de conjuntos de dados de resposta ao impulso de sala disponíveis publicamente e scripts para baixá-los.

    609+2Variação de estrelas nos últimos 7 dias
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: uma plataforma de benchmarking ampla, robusta e abrangente para Reconhecimento Automático de Fala (ASR).

    553+3Variação de estrelas nos últimos 7 dias
  • tacotron@google

    Amostras de áudio que acompanham publicações relacionadas ao Tacotron, um modelo de síntese de fala end-to-end.

    539+0Variação de estrelas nos últimos 7 dias
  • knn-vc@bshall

    Conversão de voz com apenas vizinhos mais próximos

    524+1Variação de estrelas nos últimos 7 dias
  • StarGANv2-VC@yl4579

    StarGANv2-VC: A Diverse, Unsupervised, Non-parallel Framework for Natural-Sounding Voice Conversion

    522+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos