Aller au contenu principal
buildradar
Sign in
Sujet · speech-recognition

speech-recognition

Dépôts open source suivis étiquetés speech-recognition, triés par étoiles.

Dépôts
156
Total d'étoiles
675 280
Étoiles en moyenne
4 329
Part
0,04%

Sujets qui apparaissent souvent aux côtés de speech-recognition sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés speech-recognition.

  • qwen-audio-agent@QwenAudio

    Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.

    2 362
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    540
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • hayamimi@oboroge0

    早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.

    327
  • transformers@huggingface

    🤗 Transformers : le framework de définition de modèles pour l'apprentissage automatique de pointe en texte, vision, audio et multimodal, pour l'inférence et l'entraînement.

    164 731+119Évolution des étoiles sur les 7 derniers jours
  • whisper.cpp@ggml-org

    Portage du modèle Whisper d'OpenAI en C/C++.

    53 389+103Évolution des étoiles sur les 7 derniers jours
  • faster-whisper@SYSTRAN

    Transcription Faster Whisper optimisée avec CTranslate2

    25 206+71Évolution des étoiles sur les 7 derniers jours
  • whisperX@m-bain

    WhisperX : reconnaissance vocale automatique avec horodatage au niveau du mot et diarisation.

    23 864+61Évolution des étoiles sur les 7 derniers jours
  • FunASR@modelscope

    Boîte à outils de reconnaissance vocale open source pour l'entraînement, l'inférence, l'ASR en streaming, le VAD, la ponctuation, les pipelines de diarisation du locuteur et le service compatible OpenAI/MCP.

    20 136+64Évolution des étoiles sur les 7 derniers jours
  • leon@leon-ai

    Leon est votre assistant personnel open source.

    17 476+1Évolution des étoiles sur les 7 derniers jours
  • kaldi@kaldi-asr

    kaldi-asr/kaldi est le dépôt officiel du projet Kaldi.

    15 474+3Évolution des étoiles sur les 7 derniers jours
  • vosk-api@alphacep

    API de reconnaissance vocale hors ligne pour Android, iOS, Raspberry Pi et serveurs avec Python, Java, C# et Node.

    15 101+17Évolution des étoiles sur les 7 derniers jours
  • DeepLearningExamples@NVIDIA

    Scripts de Deep Learning de pointe organisés par modèles - faciles à entraîner et à déployer avec une précision et des performances reproductibles sur une infrastructure de niveau entreprise.

    14 846+4Évolution des étoiles sur les 7 derniers jours
  • Plongez dans le Deep Learning, l'apprentissage par renforcement, le Machine Learning, la vision par ordinateur et le NLP grâce à ces cours passionnants !

    12 939+3Évolution des étoiles sur les 7 derniers jours
  • voice-pro@abus-aikorea

    Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.

    12 730+54Évolution des étoiles sur les 7 derniers jours
  • PaddleSpeech@PaddlePaddle

    Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.

    12 676+5Évolution des étoiles sur les 7 derniers jours
  • speechbrain@speechbrain

    Une boîte à outils pour la parole basée sur PyTorch.

    11 802+10Évolution des étoiles sur les 7 derniers jours
  • WhisperLiveKit@QuentinFuxa

    Transcription parole-texte locale en temps réel avec ASR en streaming, diarisation des locuteurs, traduction et API compatibles OpenAI/Deepgram.

    10 990+16Évolution des étoiles sur les 7 derniers jours
  • openvino@openvinotoolkit

    OpenVINO™ est une boîte à outils open source pour l'optimisation et le déploiement de l'inférence IA.

    10 793+30Évolution des étoiles sur les 7 derniers jours
  • espnet@espnet

    Boîte à outils de traitement de la parole de bout en bout

    9 949+3Évolution des étoiles sur les 7 derniers jours
  • SenseVoice@QwenAudio

    Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.

    9 209+37Évolution des étoiles sur les 7 derniers jours
  • Module de reconnaissance vocale pour Python, prenant en charge plusieurs moteurs et API, en ligne et hors ligne.

    8 987+0Évolution des étoiles sur les 7 derniers jours
  • Système de reconnaissance vocale chinoise basé sur l'apprentissage profond.

    8 386+0Évolution des étoiles sur les 7 derniers jours
  • mlx-audio@Blaizzy

    Une bibliothèque de synthèse vocale (TTS), de reconnaissance vocale (STT) et de conversion parole-à-parole (STS) basée sur le framework MLX d'Apple, offrant une analyse vocale efficace sur Apple Silicon.

    7 826+23Évolution des étoiles sur les 7 derniers jours
  • annyang@TalAter

    Reconnaissance vocale pour votre site web.

    6 815-1Évolution des étoiles sur les 7 derniers jours
  • wav2letter@flashlight

    Boîte à outils de reconnaissance vocale automatique de Facebook AI Research.

    6 437+1Évolution des étoiles sur les 7 derniers jours
  • argmax-oss-swift@argmaxinc

    IA vocale embarquée pour Apple Silicon

    6 353+8Évolution des étoiles sur les 7 derniers jours
  • PaddleX@PaddlePaddle

    Outil de développement tout-en-un basé sur PaddlePaddle.

    6 254+3Évolution des étoiles sur les 7 derniers jours
  • FunClip@modelscope

    Outil de transcription vidéo, de génération de sous-titres et de découpage assisté par LLM basé sur FunASR, avec une interface Gradio locale.

    6 210+13Évolution des étoiles sur les 7 derniers jours
  • whisper-diarization@MahmoudAshraf97

    Reconnaissance vocale automatique avec diarisation des locuteurs basée sur OpenAI Whisper.

    5 634+1Évolution des étoiles sur les 7 derniers jours
  • wenet@wenet-e2e

    Boîte à outils de reconnaissance vocale de bout en bout, prête pour la production

    5 229+1Évolution des étoiles sur les 7 derniers jours
  • porcupine@Picovoice

    Détection de mot d'activation sur appareil basée sur l'apprentissage profond

    4 928+3Évolution des étoiles sur les 7 derniers jours
  • ml-road@yanshengjia

    Ressources, pratique et recherche en apprentissage automatique et IA agentique

    4 927+5Évolution des étoiles sur les 7 derniers jours
  • stt@jianchang512

    Outil de reconnaissance vocale hors ligne pour générer des sous-titres au format JSON, SRT ou texte brut.

    4 780+9Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets