funasr
Dépôts open source suivis étiquetés funasr, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de funasr sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés funasr.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Boîte à outils de reconnaissance vocale open source pour l'entraînement, l'inférence, l'ASR en streaming, le VAD, la ponctuation, les pipelines de diarisation du locuteur et le service compatible OpenAI/MCP.
★ 20 136+98Évolution des étoiles sur les 7 derniers jours - #2
Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.
★ 9 209+53Évolution des étoiles sur les 7 derniers jours - #3
Outil de transcription vidéo, de génération de sous-titres et de découpage assisté par LLM basé sur FunASR, avec une interface Gradio locale.
★ 6 210+18Évolution des étoiles sur les 7 derniers jours - #4
Outil de bureau open source tout-en-un pour générer, traduire, doubler et graver des sous-titres vidéo. Basé sur des modèles locaux comme Whisper / FunASR, avec traitement par lots, accélération GPU et compatibilité Windows, macOS et Linux.
★ 4 863+83Évolution des étoiles sur les 7 derniers jours - #5
Extraction rapide de contenu audio et vidéo pour organiser des notes structurées en Markdown.
★ 2 483+11Évolution des étoiles sur les 7 derniers jours - #6
Alternative open-source et gratuite à Wispr Flow | Flux de travail vocal de bureau chinois de nouvelle génération intégrant le modèle local FunASR et des modèles de langage configurables
★ 2 278+7Évolution des étoiles sur les 7 derniers jours - #7
Bailing est un assistant vocal conversationnel similaire à GPT-4o, utilisant ASR, LLM et TTS. Intègre des modèles comme DeepSeek R1 et openClaw, avec une latence réduite à 800ms, fonctionnant sur Mac et configurations légères.
★ 1 759+2Évolution des étoiles sur les 7 derniers jours - #8
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 512+14Évolution des étoiles sur les 7 derniers jours - #9
MTools est une application de bureau polyvalente intégrant le traitement audio/vidéo, l'édition d'images, la manipulation de texte et des outils de codage, avec des fonctionnalités d'IA intégrées pour simplifier votre flux de travail et améliorer votre productivité.
★ 1 305+7Évolution des étoiles sur les 7 derniers jours - #10
VocoType est un outil de saisie vocale local, privé et sécurisé, permettant de convertir la parole en texte en temps réel via des raccourcis clavier. Il prend en charge le MCP de transcription, l'optimisation de texte par IA, les dictionnaires de remplacement personnalisés et la transcription d'enregistrements audio/vidéo.
★ 922+2Évolution des étoiles sur les 7 derniers jours - #11
Traduction audio en temps réel, capture l'audio système et le micro, exécute ASR (Whisper/SenseVoice), traduit via l'API LLM avec affichage en streaming. Idéal pour les VTubers, les streamers et le visionnage de contenus étrangers.
★ 613+18Évolution des étoiles sur les 7 derniers jours