automatic-speech-recognition
Dépôts open source suivis étiquetés automatic-speech-recognition, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de automatic-speech-recognition sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés automatic-speech-recognition.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Transcription parole-texte locale en temps réel avec ASR en streaming, diarisation des locuteurs, traduction et API compatibles OpenAI/Deepgram.
★ 10 990+16Évolution des étoiles sur les 7 derniers jours - #2★ 5 229+1Évolution des étoiles sur les 7 derniers jours
- #3
API de service web ASR pour OpenAI Whisper.
★ 3 328+2Évolution des étoiles sur les 7 derniers jours - #4
[AutoArk] GPA (General Purpose Audio) permet la reconnaissance vocale (ASR), la synthèse vocale (TTS) et la conversion de voix avec un seul modèle compact.
★ 3 061+164Évolution des étoiles sur les 7 derniers jours - #5
Modèles audio CoreML de pointe dans vos applications : synthèse vocale, reconnaissance vocale, détection d'activité vocale et diarisation des locuteurs. En Swift, propulsé par des solutions open source SOTA.
★ 2 723+13Évolution des étoiles sur les 7 derniers jours - #6
🐸STT - La boîte à outils de deep learning pour la conversion parole-texte. L'entraînement et le déploiement de modèles STT n'ont jamais été aussi simples.
★ 2 606+1Évolution des étoiles sur les 7 derniers jours - #7
Détecteur d'activité vocale (VAD) : faible latence, haute performance et léger.
★ 2 256+7Évolution des étoiles sur les 7 derniers jours - #8
Modèles ASR open-source de qualité industrielle prenant en charge le mandarin, les dialectes chinois et l'anglais, atteignant un nouvel état de l'art sur les benchmarks ASR publics en mandarin, tout en offrant une capacité exceptionnelle de reconnaissance des paroles de chansons.
★ 1 975+2Évolution des étoiles sur les 7 derniers jours - #9
TensorFlowASR : Reconnaissance vocale automatique quasi à l'état de l'art sous Tensorflow 2. Langues supportées utilisant des caractères ou des sous-mots.
★ 1 010+0Évolution des étoiles sur les 7 derniers jours - #10
Évaluez votre système de reconnaissance vocale avec des mesures de similarité telles que le taux d'erreur sur les mots (WER).
★ 927+1Évolution des étoiles sur les 7 derniers jours - #11
Collection de ressources sur les applications des grands modèles de langage (LLM) dans l'IA audio.
★ 738+1Évolution des étoiles sur les 7 derniers jours - #12
Reconnaissance vocale hors ligne avec OpenAI Whisper et TensorFlow Lite pour Android
★ 688+0Évolution des étoiles sur les 7 derniers jours - #13
Moteur de diffusion de reconnaissance vocale à la volée exécuté sur appareil, alimenté par l'apprentissage profond.
★ 671+0Évolution des étoiles sur les 7 derniers jours - #14
Système ASR industriel tout-en-un de pointe incluant des modules ASR, VAD, LID et de ponctuation. FireRedASR2 prend en charge le chinois, l'anglais, le code-switching ainsi que la reconnaissance de la parole et du chant.
★ 669+12Évolution des étoiles sur les 7 derniers jours