speech-to-text
Dépôts open source suivis étiquetés speech-to-text, triés par étoiles.
- #91
面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。
★ 1 018+424Évolution des étoiles sur les 7 derniers jours - #92
TensorFlowASR : Reconnaissance vocale automatique quasi à l'état de l'art sous Tensorflow 2. Langues supportées utilisant des caractères ou des sous-mots.
★ 1 010+0Évolution des étoiles sur les 7 derniers jours - #93★ 1 006-1Évolution des étoiles sur les 7 derniers jours
- #94
Whisper-Flow est un framework conçu pour permettre la transcription en temps réel de contenu audio via le modèle Whisper d'OpenAI. Au lieu de traiter des fichiers complets après leur téléchargement (mode batch), Whisper-Flow accepte un flux continu de segments audio et produit des transcriptions incrémentales immédiates.
★ 964+25Évolution des étoiles sur les 7 derniers jours - #95
Transcription audio en temps quasi réel utilisant Whisper auto-hébergé et WebSocket en Python/JS
★ 960+0Évolution des étoiles sur les 7 derniers jours - #96
Traitement vocal Botium
★ 943+0Évolution des étoiles sur les 7 derniers jours - #97
Whisper.net. La conversion parole-texte simplifiée grâce aux modèles Whisper.
★ 942+1Évolution des étoiles sur les 7 derniers jours - #98
Évaluez votre système de reconnaissance vocale avec des mesures de similarité telles que le taux d'erreur sur les mots (WER).
★ 928+2Évolution des étoiles sur les 7 derniers jours - #99
Exemples pour .NET MAUI.
★ 915+0Évolution des étoiles sur les 7 derniers jours - #100★ 911+2Évolution des étoiles sur les 7 derniers jours
- #101
Modèles Whisper optimisés pour le streaming et l'utilisation sur appareil
★ 897-1Évolution des étoiles sur les 7 derniers jours - #102
Application de saisie vocale gratuite, open source et axée sur la confidentialité pour macOS.
★ 896+4Évolution des étoiles sur les 7 derniers jours - #103
Reconnaissance vocale chinoise de bout en bout basée sur PaddlePaddle, de l'initiation à la pratique, avec des cas d'étude simples et des projets d'entreprise concrets. Prend en charge les modèles DeepSpeech2, Conformer et Squeezeformer les plus populaires.
★ 870-1Évolution des étoiles sur les 7 derniers jours - #104
💬 Reconnaissance vocale pour votre application React.
★ 842+0Évolution des étoiles sur les 7 derniers jours - #105
Créez des applications web de transcription vocale en temps réel en utilisant Whisper d'OpenAI
★ 835+0Évolution des étoiles sur les 7 derniers jours - #106★ 823-1Évolution des étoiles sur les 7 derniers jours
- #107
Logiciel de génération de sous-titres tout-en-un entièrement automatisé : téléchargement, transcription, traduction et encodage sans intervention humaine
★ 811+3Évolution des étoiles sur les 7 derniers jours - #108
Dictée vocale gratuite, open-source et 100% hors ligne pour Linux. Parlez et tapez n'importe où via whisper.cpp, les moteurs Whisper et VOSK, accéléré par GPU, fonctionne sur X11 + Wayland !
★ 809+17Évolution des étoiles sur les 7 derniers jours - #109
🎤 Lobe TTS - Une bibliothèque TTS/STT fiable et de haute qualité pour serveur et navigateur.
★ 805-1Évolution des étoiles sur les 7 derniers jours - #110
Speech to Text to Speech. Chanson en cours de lecture. Envoie du texte sous forme de messages OSC vers VRChat pour affichage sur l'avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 804+5Évolution des étoiles sur les 7 derniers jours - #111
Chatbot vocal local pour des conversations engageantes, propulsé par Ollama, Hugging Face Transformers et Coqui TTS Toolkit
★ 788+1Évolution des étoiles sur les 7 derniers jours - #112
Projet permettant d'utiliser un microphone avec OpenAI Whisper.
★ 787+0Évolution des étoiles sur les 7 derniers jours - #113
Le moyen le plus simple de transcrire de l'audio en Swift
★ 785+0Évolution des étoiles sur les 7 derniers jours - #114
Application de transcription vocale par IA 100 % privée convertissant la parole en texte dans plus de 100 langues. Développée avec Compose Multiplatform pour Android et iOS en utilisant Whisper AI ; aucun transfert vers le cloud, tout le traitement est effectué localement pour une confidentialité totale.
★ 779+4Évolution des étoiles sur les 7 derniers jours - #115
Un SDK Swift modulaire pour le traitement audio avec MLX sur Apple Silicon
★ 774+5Évolution des étoiles sur les 7 derniers jours - #116
BiBi Keyboard : une application de clavier de saisie vocale LLM et ASR pour la plateforme Android, basée sur Kotlin
★ 774+15Évolution des étoiles sur les 7 derniers jours - #117
Reconnaissance vocale chinoise basée sur PaddlePaddle. Projet complet avec d'excellentes performances. Supporte l'entraînement et l'inférence sur Windows et Linux, ainsi que sur les cartes de développement Nvidia Jetson.
★ 763+1Évolution des étoiles sur les 7 derniers jours - #118★ 754+1Évolution des étoiles sur les 7 derniers jours
- #119
Exécution du modèle de reconnaissance vocale whisper.cpp dans Unity3d en local
★ 751+1Évolution des étoiles sur les 7 derniers jours - #120
Clavier et service de reconnaissance vocale privés et exécutés directement sur l'appareil pour Android.
★ 745+2Évolution des étoiles sur les 7 derniers jours