speaker-diarization
Dépôts open source suivis étiquetés speaker-diarization, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de speaker-diarization sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés speaker-diarization.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Boîte à outils de reconnaissance vocale open source pour l'entraînement, l'inférence, l'ASR en streaming, le VAD, la ponctuation, les pipelines de diarisation du locuteur et le service compatible OpenAI/MCP.
★ 20 136+64Évolution des étoiles sur les 7 derniers jours - #2
Une boîte à outils pour la parole basée sur PyTorch.
★ 11 802+10Évolution des étoiles sur les 7 derniers jours - #3
Transcription parole-texte locale en temps réel avec ASR en streaming, diarisation des locuteurs, traduction et API compatibles OpenAI/Deepgram.
★ 10 990+16Évolution des étoiles sur les 7 derniers jours - #4
Blocs de construction neuronaux pour la diarisation du locuteur : détection d'activité vocale, détection de changement de locuteur, détection de chevauchement vocal, et embedding de locuteur.
★ 10 500+16Évolution des étoiles sur les 7 derniers jours - #5★ 9 949+3Évolution des étoiles sur les 7 derniers jours
- #6
IA vocale embarquée pour Apple Silicon
★ 6 353+8Évolution des étoiles sur les 7 derniers jours - #7
Reconnaissance vocale automatique avec diarisation des locuteurs basée sur OpenAI Whisper.
★ 5 634+1Évolution des étoiles sur les 7 derniers jours - #8
Exécutables autonomes pour Whisper et Faster-Whisper pour ceux qui ne souhaitent pas utiliser Python.
★ 3 171+2Évolution des étoiles sur les 7 derniers jours - #9
Dépôt pour la vérification, la reconnaissance et la diarisation de locuteurs, en mode simple et multimodal
★ 3 128+3Évolution des étoiles sur les 7 derniers jours - #10
Reconnaissance vocale automatique multilingue avec horodatages au niveau du mot et indices de confiance
★ 2 842+1Évolution des étoiles sur les 7 derniers jours - #11
Modèles audio CoreML de pointe dans vos applications : synthèse vocale, reconnaissance vocale, détection d'activité vocale et diarisation des locuteurs. En Swift, propulsé par des solutions open source SOTA.
★ 2 723+13Évolution des étoiles sur les 7 derniers jours - #12★ 2 024+1Évolution des étoiles sur les 7 derniers jours
- #13
Une liste organisée d'articles, de bibliothèques, de jeux de données et d'autres ressources sur la diarisation du locuteur.
★ 1 894+1Évolution des étoiles sur les 7 derniers jours - #14
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 512+10Évolution des étoiles sur les 7 derniers jours - #15
Boîte à outils de vérification, de reconnaissance et de diarisation du locuteur orientée recherche et production.
★ 1 402+8Évolution des étoiles sur les 7 derniers jours - #16
Boîte à outils vocale IA pour Apple Silicon — ASR, TTS, speech-to-speech, VAD et diarisation propulsés par MLX et CoreML
★ 1 161+4Évolution des étoiles sur les 7 derniers jours - #17
Service de transcription et de diarisation hors ligne, auto-hébergé et clé en main, avec résumé par LLM
★ 948+2Évolution des étoiles sur les 7 derniers jours - #18
Logiciel de génération de sous-titres tout-en-un entièrement automatisé : téléchargement, transcription, traduction et encodage sans intervention humaine
★ 810+3Évolution des étoiles sur les 7 derniers jours - #19★ 677+0Évolution des étoiles sur les 7 derniers jours
- #20
Réimplémentation en Python des algorithmes de clustering spectral (contraint) utilisés dans les articles de Google sur la diarisation du locuteur.
★ 555+0Évolution des étoiles sur les 7 derniers jours