voice-recognition
Dépôts open source suivis étiquetés voice-recognition, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de voice-recognition sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés voice-recognition.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
API de reconnaissance vocale hors ligne pour Android, iOS, Raspberry Pi et serveurs avec Python, Java, C# et Node.
★ 15 101+17Évolution des étoiles sur les 7 derniers jours - #2
Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.
★ 12 676+5Évolution des étoiles sur les 7 derniers jours - #3
Une boîte à outils pour la parole basée sur PyTorch.
★ 11 802+10Évolution des étoiles sur les 7 derniers jours - #4
Reconnaissance vocale, intentionnelle et synthèse vocale à très faible latence pour la création d'agents et d'interfaces vocaux.
★ 10 997+33Évolution des étoiles sur les 7 derniers jours - #5
Silero VAD : détecteur d'activité vocale pré-entraîné de qualité professionnelle.
★ 10 112+29Évolution des étoiles sur les 7 derniers jours - #6
Une implémentation quasi en temps réel de Whisper d'OpenAI.
★ 4 246+3Évolution des étoiles sur les 7 derniers jours - #7
Bibliothèque utilitaire complète pour les caractères chinois (pinyin, traits, radicaux, idiomes, synthèse vocale, visualisation, etc.).
★ 3 087+3Évolution des étoiles sur les 7 derniers jours - #8
🐸STT - La boîte à outils de deep learning pour la conversion parole-texte. L'entraînement et le déploiement de modèles STT n'ont jamais été aussi simples.
★ 2 606+1Évolution des étoiles sur les 7 derniers jours - #9
Détecteur d'activité vocale (VAD) : faible latence, haute performance et léger.
★ 2 256+7Évolution des étoiles sur les 7 derniers jours - #10
🔊 Une liste exhaustive de jeux de données open source pour le traitement de la voix et du son (plus de 95 jeux de données).
★ 2 223+1Évolution des étoiles sur les 7 derniers jours - #11
Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.
★ 1 399+0Évolution des étoiles sur les 7 derniers jours - #12
Ce projet utilise divers modèles avancés de reconnaissance d'empreinte vocale tels que EcapaTdnn, ResNetSE, ERes2Net, CAM++, etc. D'autres modèles pourraient être pris en charge à l'avenir. Le projet prend également en charge les méthodes de prétraitement de données MelSpectrogram et Spectrogram.
★ 1 313+1Évolution des étoiles sur les 7 derniers jours - #13
Assistant IA en Python 🧠
★ 1 014+0Évolution des étoiles sur les 7 derniers jours - #14
Journal de bord et carte stellaire 3D pour Elite Dangerous.
★ 898+2Évolution des étoiles sur les 7 derniers jours - #15
Moteur de conversion de la parole en intention sur l'appareil propulsé par l'apprentissage profond
★ 712+2Évolution des étoiles sur les 7 derniers jours - #16
Voicetypr - Outil de dictée vocale hors-ligne propulsé par l'IA pour les fondateurs occupés, codeurs de vibe et utilisateurs intensifs d'IA sur macOS et Windows. Alternative à wispr flow et superwhisper.
★ 709+12Évolution des étoiles sur les 7 derniers jours - #17
Framework de benchmark pour la reconnaissance vocale (speech-to-text)
★ 697+0Évolution des étoiles sur les 7 derniers jours - #18
Reconnaissance vocale pour les projets React Native Expo
★ 677+5Évolution des étoiles sur les 7 derniers jours - #19
Moteur de diffusion de reconnaissance vocale à la volée exécuté sur appareil, alimenté par l'apprentissage profond.
★ 671+0Évolution des étoiles sur les 7 derniers jours - #20
:speech_balloon: /so.nus/ STT (speech to text) pour Node avec détection de mots-clés hors ligne
★ 638+0Évolution des étoiles sur les 7 derniers jours - #21
Traduction audio en temps réel, capture l'audio système et le micro, exécute ASR (Whisper/SenseVoice), traduit via l'API LLM avec affichage en streaming. Idéal pour les VTubers, les streamers et le visionnage de contenus étrangers.
★ 625+34Évolution des étoiles sur les 7 derniers jours - #22
Transcription en temps réel utilisant faster-whisper
★ 614+0Évolution des étoiles sur les 7 derniers jours - #23
🗣 Un overlay qui obtient la permission vocale et la saisie de l'utilisateur sous forme de texte dans une interface personnalisable
★ 557+1Évolution des étoiles sur les 7 derniers jours