k2-fsa
Dépôts open source suivis de k2-fsa, triés par étoiles.
- #1
Transcription, synthèse vocale, diarisation, amélioration de la parole, séparation de sources et VAD utilisant la nouvelle génération de Kaldi avec onnxruntime, sans connexion Internet. Supporte les systèmes embarqués, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, NPU RK, NPU Axera, NPU Ascend, serveurs x86_64, client/serveur websocket, et 12 langages de programmation.
★ 14 575+95Évolution des étoiles sur les 7 derniers jours - #2★ 9 641+104Évolution des étoiles sur les 7 derniers jours
- #3
Reconnaissance vocale en temps réel et détection d'activité vocale (VAD) utilisant la nouvelle génération de Kaldi avec ncnn, sans connexion Internet. Supporte iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, etc.
★ 1 777-1Évolution des étoiles sur les 7 derniers jours - #4★ 1 484+1Évolution des étoiles sur les 7 derniers jours
- #5★ 1 354+2Évolution des étoiles sur les 7 derniers jours
- #6
Synthèse vocale (Text-to-Speech) zero-shot rapide et de haute qualité avec Flow Matching
★ 1 053+6Évolution des étoiles sur les 7 derniers jours - #7
Framework de serveur de reconnaissance vocale (speech-to-text) avec Kaldi nouvelle génération.
★ 984+4Évolution des étoiles sur les 7 derniers jours