k2-fsa
Các kho mã nguồn mở đang theo dõi của k2-fsa, sắp xếp theo số sao.
- #1
Chuyển đổi giọng nói thành văn bản, văn bản thành giọng nói, phân đoạn người nói, cải thiện giọng nói, tách nguồn âm thanh và VAD sử dụng Kaldi thế hệ mới với onnxruntime không cần kết nối Internet. Hỗ trợ hệ thống nhúng, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, máy chủ x86_64, websocket server/client, hỗ trợ 12 ngôn ngữ lập trình
★ 14.575+95Thay đổi số sao trong 7 ngày qua - #2★ 9.641+104Thay đổi số sao trong 7 ngày qua
- #3
Nhận dạng giọng nói thời gian thực và phát hiện hoạt động giọng nói (VAD) sử dụng Kaldi thế hệ mới với ncnn mà không cần kết nối Internet. Hỗ trợ iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, v.v.
★ 1.777-1Thay đổi số sao trong 7 ngày qua - #4★ 1.484+1Thay đổi số sao trong 7 ngày qua
- #5★ 1.354+2Thay đổi số sao trong 7 ngày qua
- #6
Chuyển đổi văn bản thành giọng nói Zero-Shot nhanh chóng và chất lượng cao với Flow Matching
★ 1.053+6Thay đổi số sao trong 7 ngày qua - #7★ 984+4Thay đổi số sao trong 7 ngày qua