speech-recognition
Dépôts open source suivis étiquetés speech-recognition, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de speech-recognition sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés speech-recognition.
- #1
Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.
★ 2 362 - #2
Lightning-fast, free, local first voice dictation for macOS with on-device transcription
★ 540 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501 - #4
早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.
★ 327
- #1
🤗 Transformers : le framework de définition de modèles pour l'apprentissage automatique de pointe en texte, vision, audio et multimodal, pour l'inférence et l'entraînement.
★ 164 731+119Évolution des étoiles sur les 7 derniers jours - #2
Portage du modèle Whisper d'OpenAI en C/C++.
★ 53 389+103Évolution des étoiles sur les 7 derniers jours - #3
Transcription Faster Whisper optimisée avec CTranslate2
★ 25 206+71Évolution des étoiles sur les 7 derniers jours - #4
WhisperX : reconnaissance vocale automatique avec horodatage au niveau du mot et diarisation.
★ 23 864+61Évolution des étoiles sur les 7 derniers jours - #5
Boîte à outils de reconnaissance vocale open source pour l'entraînement, l'inférence, l'ASR en streaming, le VAD, la ponctuation, les pipelines de diarisation du locuteur et le service compatible OpenAI/MCP.
★ 20 136+64Évolution des étoiles sur les 7 derniers jours - #6★ 17 476+1Évolution des étoiles sur les 7 derniers jours
- #7★ 15 474+3Évolution des étoiles sur les 7 derniers jours
- #8
API de reconnaissance vocale hors ligne pour Android, iOS, Raspberry Pi et serveurs avec Python, Java, C# et Node.
★ 15 101+17Évolution des étoiles sur les 7 derniers jours - #9
Scripts de Deep Learning de pointe organisés par modèles - faciles à entraîner et à déployer avec une précision et des performances reproductibles sur une infrastructure de niveau entreprise.
★ 14 846+4Évolution des étoiles sur les 7 derniers jours - #10
Plongez dans le Deep Learning, l'apprentissage par renforcement, le Machine Learning, la vision par ordinateur et le NLP grâce à ces cours passionnants !
★ 12 939+3Évolution des étoiles sur les 7 derniers jours - #11
Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.
★ 12 730+54Évolution des étoiles sur les 7 derniers jours - #12
Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.
★ 12 676+5Évolution des étoiles sur les 7 derniers jours - #13
Une boîte à outils pour la parole basée sur PyTorch.
★ 11 802+10Évolution des étoiles sur les 7 derniers jours - #14
Transcription parole-texte locale en temps réel avec ASR en streaming, diarisation des locuteurs, traduction et API compatibles OpenAI/Deepgram.
★ 10 990+16Évolution des étoiles sur les 7 derniers jours - #15
OpenVINO™ est une boîte à outils open source pour l'optimisation et le déploiement de l'inférence IA.
★ 10 793+30Évolution des étoiles sur les 7 derniers jours - #16★ 9 949+3Évolution des étoiles sur les 7 derniers jours
- #17
Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.
★ 9 209+37Évolution des étoiles sur les 7 derniers jours - #18
Module de reconnaissance vocale pour Python, prenant en charge plusieurs moteurs et API, en ligne et hors ligne.
★ 8 987+0Évolution des étoiles sur les 7 derniers jours - #19
Système de reconnaissance vocale chinoise basé sur l'apprentissage profond.
★ 8 386+0Évolution des étoiles sur les 7 derniers jours - #20
Une bibliothèque de synthèse vocale (TTS), de reconnaissance vocale (STT) et de conversion parole-à-parole (STS) basée sur le framework MLX d'Apple, offrant une analyse vocale efficace sur Apple Silicon.
★ 7 826+23Évolution des étoiles sur les 7 derniers jours - #21★ 6 815-1Évolution des étoiles sur les 7 derniers jours
- #22
Boîte à outils de reconnaissance vocale automatique de Facebook AI Research.
★ 6 437+1Évolution des étoiles sur les 7 derniers jours - #23
IA vocale embarquée pour Apple Silicon
★ 6 353+8Évolution des étoiles sur les 7 derniers jours - #24★ 6 254+3Évolution des étoiles sur les 7 derniers jours
- #25
Outil de transcription vidéo, de génération de sous-titres et de découpage assisté par LLM basé sur FunASR, avec une interface Gradio locale.
★ 6 210+13Évolution des étoiles sur les 7 derniers jours - #26
Reconnaissance vocale automatique avec diarisation des locuteurs basée sur OpenAI Whisper.
★ 5 634+1Évolution des étoiles sur les 7 derniers jours - #27★ 5 229+1Évolution des étoiles sur les 7 derniers jours
- #28★ 4 928+3Évolution des étoiles sur les 7 derniers jours
- #29★ 4 927+5Évolution des étoiles sur les 7 derniers jours
- #30
Outil de reconnaissance vocale hors ligne pour générer des sous-titres au format JSON, SRT ou texte brut.
★ 4 780+9Évolution des étoiles sur les 7 derniers jours