Pular para o conteúdo principal
buildradar
Sign in
Tópico · speech-processing

speech-processing

Repositórios de código aberto acompanhados marcados com speech-processing, ordenados por estrelas.

Repositórios
20
Total de estrelas
71.137
Média de estrelas
3.557
Participação
0,00%

Tópicos que aparecem com frequência ao lado de speech-processing no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com speech-processing.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • speechbrain@speechbrain

    Um kit de ferramentas de fala baseado em PyTorch

    11.792+22Variação de estrelas nos últimos 7 dias
  • pyannote-audio@pyannote

    Blocos de construção neural para diarização de locutores: detecção de atividade de fala, detecção de mudança de locutor, detecção de fala sobreposta, embutimento de locutor

    10.484+38Variação de estrelas nos últimos 7 dias
  • silero-vad@snakers4

    Silero VAD: Detector de Atividade de Voz pré-treinado de nível empresarial

    10.083+52Variação de estrelas nos últimos 7 dias
  • maths-cs-ai-compendium@HenryNdubuaku

    Torne-se um pesquisador ou engenheiro de IA/ML de alto nível com este livro didático não convencional que cobre matemática, computação e ML com intuição.

    7.379+33Variação de estrelas nos últimos 7 dias
  • Lista de leitura para tópicos de pesquisa em aprendizado de máquina multimodal

    6.925+0Variação de estrelas nos últimos 7 dias
  • torchscale@microsoft

    Arquitetura de base para (M)LLMs

    3.138+1Variação de estrelas nos últimos 7 dias
  • whisper-timestamped@linto-ai

    Reconhecimento automático de fala multilíngue com carimbos de data/hora em nível de palavra e confiança

    2.841+2Variação de estrelas nos últimos 7 dias
  • resemble-enhance@resemble-ai

    Redução de ruído e aprimoramento de fala com tecnologia de IA

    2.401+6Variação de estrelas nos últimos 7 dias
  • ten-vad@TEN-framework

    Detector de Atividade de Voz (VAD): baixa latência, alto desempenho e leve

    2.250+4Variação de estrelas nos últimos 7 dias
  • IMS-Toucan@DigitalPhonetics

    Conversão de texto em fala rápida e controlável para mais de 7000 idiomas!

    2.208+0Variação de estrelas nos últimos 7 dias
  • Uma lista selecionada de artigos, bibliotecas, conjuntos de dados e outros recursos incríveis sobre Diarização de Locutores.

    1.893+2Variação de estrelas nos últimos 7 dias
  • Uma lista de corpora de fala acessíveis para ASR, TTS e outras tecnologias de fala.

    1.399+0Variação de estrelas nos últimos 7 dias
  • voicefixer@haoheliu

    Restauração geral de fala.

    1.376+3Variação de estrelas nos últimos 7 dias
  • CrisperWhisper@nyrahealth

    Transcrição controlável. Verbatim (cada palavra, preenchimento, pausa, gagueira, som vocal) ou pretendida (o que o falante quis dizer, otimizado para legibilidade) com carimbos de data/hora em nível de palavra.

    1.362+21Variação de estrelas nos últimos 7 dias
  • StreamSpeech@ictnlp

    StreamSpeech é um modelo "tudo em um" contínuo para reconhecimento, tradução e síntese de fala offline e simultânea.

    1.288+2Variação de estrelas nos últimos 7 dias
  • audino@midas-research

    Ferramenta de anotação de áudio de código aberto para humanos

    1.146+0Variação de estrelas nos últimos 7 dias
  • SLAM-LLM@X-LANCE

    Um framework para processamento de fala, linguagem, áudio e música com Large Language Model

    1.056+0Variação de estrelas nos últimos 7 dias
  • Você pode encontrar os algoritmos de fala desejados aqui.

    879+1Variação de estrelas nos últimos 7 dias
  • MultiBench@pliang279

    [NeurIPS 2021] Benchmarks em Multiuso para Aprendizado de Representação Multimodal

    636+0Variação de estrelas nos últimos 7 dias
  • Laboratórios, empresas, recursos e estágios na área de fala/voz, recomendações e auto-recomendações são bem-vindos

    609+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos