yeyupiaoling
Các kho mã nguồn mở đang theo dõi của yeyupiaoling, sắp xếp theo số sao.
- #1
Dự án này sử dụng nhiều mô hình nhận dạng giọng nói nâng cao khác nhau như EcapaTdnn, ResNetSE, ERes2Net, CAM++, v.v. Không loại trừ khả năng sẽ hỗ trợ thêm nhiều mô hình trong tương lai. Đồng thời, dự án này cũng hỗ trợ các phương pháp tiền xử lý dữ liệu MelSpectrogram, Spectrogram
★ 1.313+0Thay đổi số sao trong 7 ngày qua - #2
Tinh chỉnh mô hình nhận dạng giọng nói Whisper để hỗ trợ huấn luyện không có dữ liệu dấu thời gian, huấn luyện có dữ liệu dấu thời gian và huấn luyện không có dữ liệu giọng nói. Tăng tốc suy luận và hỗ trợ triển khai Web, Windows desktop và Android
★ 1.222+0Thay đổi số sao trong 7 ngày qua - #3
Triển khai nhận dạng giọng nói tiếng Trung đầu cuối dựa trên PaddlePaddle, từ cơ bản đến thực tế, với các ví dụ nhập môn đơn giản và dự án doanh nghiệp thiết thực. Hỗ trợ các mô hình phổ biến hiện nay như DeepSpeech2, Conformer và Squeezeformer.
★ 870-1Thay đổi số sao trong 7 ngày qua - #4
Nhận dạng giọng nói tiếng Trung dựa trên PaddlePaddle. Dự án hoàn thiện với hiệu suất nhận dạng tốt. Hỗ trợ huấn luyện và dự đoán trên Windows, Linux, cũng như hỗ trợ dự đoán trên bo mạch phát triển Nvidia Jetson.
★ 763+1Thay đổi số sao trong 7 ngày qua - #5
Khung nhận dạng giọng nói tự động (ASR) dựa trên PyTorch, hỗ trợ cả chế độ trực tuyến và ngoại tuyến, các mô hình Conformer, Squeezeformer, DeepSpeech2 và nhiều phương pháp tăng cường dữ liệu
★ 727+0Thay đổi số sao trong 7 ngày qua - #6
Triển khai Pytorch cho phân loại âm thanh, hỗ trợ EcapaTdnn, PANNS, TDNN, Res2Net, ResNetSE và các mô hình khác, cùng nhiều phương pháp tiền xử lý đa dạng.
★ 603+0Thay đổi số sao trong 7 ngày qua