Aller au contenu principal
buildradar
Sign in
Sujet · speech-recognition

speech-recognition

Dépôts open source suivis étiquetés speech-recognition, triés par étoiles.

156 dépôts
  • whisper-jax@sanchit-gandhi

    Implémentation JAX du modèle Whisper d'OpenAI, offrant jusqu'à 70x plus de vitesse sur TPU.

    4 679-1Évolution des étoiles sur les 7 derniers jours
  • pocketsphinx@cmusphinx

    Un petit moteur de reconnaissance vocale.

    4 337+2Évolution des étoiles sur les 7 derniers jours
  • distil-whisper@huggingface

    Variante distillée de Whisper pour la reconnaissance vocale. 6 fois plus rapide, 50 % plus petite, avec un taux d'erreur sur les mots inférieur à 1 %.

    4 114+2Évolution des étoiles sur les 7 derniers jours
  • API de service web ASR pour OpenAI Whisper.

    3 328+2Évolution des étoiles sur les 7 derniers jours
  • Exécutables autonomes pour Whisper et Faster-Whisper pour ceux qui ne souhaitent pas utiliser Python.

    3 171+2Évolution des étoiles sur les 7 derniers jours
  • willow@HeyWillow

    Alternative open source, locale et auto-hébergée aux assistants vocaux Amazon Echo et Google Home.

    3 101+1Évolution des étoiles sur les 7 derniers jours
  • whishper@pluja

    Transcrivez n'importe quel audio en texte, traduisez et modifiez des sous-titres 100 % localement avec une interface web. Propulsé par les modèles whisper !

    3 068+2Évolution des étoiles sur les 7 derniers jours
  • lingvo@tensorflow

    Lingvo

    2 864+0Évolution des étoiles sur les 7 derniers jours
  • whisper-timestamped@linto-ai

    Reconnaissance vocale automatique multilingue avec horodatages au niveau du mot et indices de confiance

    2 842+1Évolution des étoiles sur les 7 derniers jours
  • STT@coqui-ai

    🐸STT - La boîte à outils de deep learning pour la conversion parole-texte. L'entraînement et le déploiement de modèles STT n'ont jamais été aussi simples.

    2 606+1Évolution des étoiles sur les 7 derniers jours
  • qwen-audio-agent@QwenAudio

    Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.

    2 362+72Évolution des étoiles sur les 7 derniers jours
  • 🎙 Reconnaissance vocale utilisant le framework de deep learning TensorFlow et des réseaux de neurones sequence-to-sequence

    2 173+0Évolution des étoiles sur les 7 derniers jours
  • parlor@fikrikarim

    IA multimodale en temps réel sur appareil, avec des fonctionnalités similaires à GPT-Live

    2 048+7Évolution des étoiles sur les 7 derniers jours
  • FireRedASR@FireRedTeam

    Modèles ASR open-source de qualité industrielle prenant en charge le mandarin, les dialectes chinois et l'anglais, atteignant un nouvel état de l'art sur les benchmarks ASR publics en mandarin, tout en offrant une capacité exceptionnelle de reconnaissance des paroles de chansons.

    1 975+2Évolution des étoiles sur les 7 derniers jours
  • masr@nobody132

    Reconnaissance vocale automatique pour le mandarin.

    1 968+0Évolution des étoiles sur les 7 derniers jours
  • julius@julius-speech

    Moteur de reconnaissance vocale continue à large vocabulaire open source.

    1 935+1Évolution des étoiles sur les 7 derniers jours
  • Une liste organisée d'articles, de bibliothèques, de jeux de données et d'autres ressources sur la diarisation du locuteur.

    1 894+1Évolution des étoiles sur les 7 derniers jours
  • alan-sdk-ios@alan-ai

    Le système d'auto-codage pour votre application — SDK Alan AI pour iOS

    1 878-3Évolution des étoiles sur les 7 derniers jours
  • Le système d'auto-codage pour votre application — SDK Alan AI pour Android

    1 807-1Évolution des étoiles sur les 7 derniers jours
  • whisper-turbo@FL33TW00D

    Whisper multiplateforme accéléré par GPU

    1 794+0Évolution des étoiles sur les 7 derniers jours
  • sherpa-ncnn@k2-fsa

    Reconnaissance vocale en temps réel et détection d'activité vocale (VAD) utilisant la nouvelle génération de Kaldi avec ncnn, sans connexion Internet. Supporte iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, etc.

    1 777-1Évolution des étoiles sur les 7 derniers jours
  • Le système d'auto-codage pour votre application — SDK Alan AI pour Flutter

    1 756-1Évolution des étoiles sur les 7 derniers jours
  • alan-sdk-ionic@alan-ai

    Le système d'auto-codage pour votre application — SDK Alan AI pour Ionic.

    1 649-1Évolution des étoiles sur les 7 derniers jours
  • dsnote@mkiol

    Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.

    1 622+8Évolution des étoiles sur les 7 derniers jours
  • Plugin OBS pour la reconnaissance vocale et le sous-titrage local utilisant l'IA.

    1 597+8Évolution des étoiles sur les 7 derniers jours
  • amica@semperai

    Amica est une interface open source pour la communication interactive avec des personnages 3D, incluant la synthèse vocale et la reconnaissance vocale.

    1 591-2Évolution des étoiles sur les 7 derniers jours
  • Nœuds personnalisés étendant les capacités de Comfyui.

    1 525+1Évolution des étoiles sur les 7 derniers jours
  • SALMONN@bytedance

    Famille SALMONN : une suite de LLM multimodaux avancés.

    1 521+3Évolution des étoiles sur les 7 derniers jours
  • Fun-ASR@QwenAudio

    Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.

    1 512+10Évolution des étoiles sur les 7 derniers jours
  • SpeechT5@microsoft

    Pré-entraînement parole-texte multimodal unifié pour le traitement du langage parlé

    1 449+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets