k2-fsa
Repositorios de código abierto monitorizados de k2-fsa, ordenados por estrellas.
- #1
Conversión de voz a texto, de texto a voz, diarización de hablantes, mejora de voz, separación de fuentes y VAD utilizando la nueva generación de Kaldi con onnxruntime sin conexión a Internet. Soporta sistemas embebidos, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, servidores x86_64, servidor/cliente websocket y 12 lenguajes de programación.
★ 14.575+95Variación de estrellas de los últimos 7 días - #2★ 9641+104Variación de estrellas de los últimos 7 días
- #3
Reconocimiento de voz en tiempo real y detección de actividad de voz (VAD) utilizando la nueva generación de Kaldi con ncnn sin conexión a Internet. Compatible con iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, entre otros.
★ 1777-1Variación de estrellas de los últimos 7 días - #4★ 1484+1Variación de estrellas de los últimos 7 días
- #5★ 1354+2Variación de estrellas de los últimos 7 días
- #6
Conversión de texto a voz de alta calidad y rápida mediante Zero-Shot con Flow Matching.
★ 1053+6Variación de estrellas de los últimos 7 días - #7★ 984+4Variación de estrellas de los últimos 7 días