yeyupiaoling
Repositórios de código aberto acompanhados de yeyupiaoling, ordenados por estrelas.
- #1
Este projeto usa uma variedade de modelos avançados de reconhecimento de impressão vocal, como EcapaTdnn, ResNetSE, ERes2Net, CAM++, etc. Não está excluído o suporte a mais modelos no futuro. Ao mesmo tempo, este projeto também suporta os métodos de pré-processamento de dados MelSpectrogram e Spectrogram
★ 1.313+1Variação de estrelas nos últimos 7 dias - #2
Ajuste fino do modelo de reconhecimento de fala Whisper para suportar treinamento sem dados de timestamp, com dados de timestamp e sem dados de fala. Acelere a inferência e suporte a implantação na Web, desktop Windows e Android.
★ 1.222-1Variação de estrelas nos últimos 7 dias - #3
Implementação de reconhecimento de fala em chinês de ponta a ponta baseada em PaddlePaddle, do básico ao avançado, com exemplos simples e projetos corporativos práticos. Suporta os modelos DeepSpeech2, Conformer e Squeezeformer mais populares atualmente.
★ 870+0Variação de estrelas nos últimos 7 dias - #4
Reconhecimento de fala em chinês implementado com base no PaddlePaddle. Projeto completo com excelentes resultados de reconhecimento. Suporta treinamento e predição em Windows e Linux, além de predição na placa Nvidia Jetson.
★ 762+0Variação de estrelas nos últimos 7 dias - #5
Framework de reconhecimento automático de fala em PyTorch para streaming e não streaming, compatível com reconhecimento online e offline. Atualmente suporta os modelos Conformer, Squeezeformer e DeepSpeech2, além de vários métodos de aumento de dados.
★ 727+0Variação de estrelas nos últimos 7 dias - #6
A implementação em PyTorch de classificação de som suporta EcapaTdnn, PANNS, TDNN, Res2Net, ResNetSE e outros modelos, bem como uma variedade de métodos de pré-processamento.
★ 603-1Variação de estrelas nos últimos 7 dias