speech-processing
Dépôts open source suivis étiquetés speech-processing, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de speech-processing sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés speech-processing.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Une boîte à outils pour la parole basée sur PyTorch.
★ 11 792+22Évolution des étoiles sur les 7 derniers jours - #2
Blocs de construction neuronaux pour la diarisation du locuteur : détection d'activité vocale, détection de changement de locuteur, détection de chevauchement vocal, et embedding de locuteur.
★ 10 484+38Évolution des étoiles sur les 7 derniers jours - #3
Silero VAD : détecteur d'activité vocale pré-entraîné de qualité professionnelle.
★ 10 083+52Évolution des étoiles sur les 7 derniers jours - #4
Devenez un chercheur/ingénieur IA/ML chevronné avec ce manuel non conventionnel couvrant les mathématiques, l'informatique et le ML par l'intuition.
★ 7 379+33Évolution des étoiles sur les 7 derniers jours - #5
Liste de lecture pour les sujets de recherche en apprentissage automatique multimodal.
★ 6 925+0Évolution des étoiles sur les 7 derniers jours - #6
Architecture fondamentale pour (M)LLM.
★ 3 138+1Évolution des étoiles sur les 7 derniers jours - #7
Reconnaissance vocale automatique multilingue avec horodatages au niveau du mot et indices de confiance
★ 2 841+2Évolution des étoiles sur les 7 derniers jours - #8
Réduction du bruit et amélioration de la parole assistées par IA.
★ 2 401+6Évolution des étoiles sur les 7 derniers jours - #9
Détecteur d'activité vocale (VAD) : faible latence, haute performance et léger.
★ 2 250+4Évolution des étoiles sur les 7 derniers jours - #10
Synthèse vocale rapide et contrôlable pour plus de 7000 langues.
★ 2 208+0Évolution des étoiles sur les 7 derniers jours - #11
Une liste organisée d'articles, de bibliothèques, de jeux de données et d'autres ressources sur la diarisation du locuteur.
★ 1 893+2Évolution des étoiles sur les 7 derniers jours - #12
Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.
★ 1 399+0Évolution des étoiles sur les 7 derniers jours - #13
Restauration de parole générale
★ 1 376+3Évolution des étoiles sur les 7 derniers jours - #14
Transcription contrôlable. Verbatim (chaque mot, remplissage, pause, bégaiement, son vocal) ou intentionnelle (ce que l'orateur voulait dire, optimisé pour la lisibilité) avec horodatage au niveau du mot.
★ 1 362+21Évolution des étoiles sur les 7 derniers jours - #15
StreamSpeech est un modèle tout-en-un fluide pour la reconnaissance vocale, la traduction et la synthèse vocale, en mode hors ligne et simultané.
★ 1 288+2Évolution des étoiles sur les 7 derniers jours - #16★ 1 146+0Évolution des étoiles sur les 7 derniers jours
- #17
Un framework pour le traitement de la parole, du langage, de l'audio et de la musique basé sur des modèles de langage de grande taille.
★ 1 056+0Évolution des étoiles sur les 7 derniers jours - #18
Vous trouverez ici les algorithmes de traitement de la parole que vous recherchez
★ 878+1Évolution des étoiles sur les 7 derniers jours - #19
[NeurIPS 2021] Benchmarks multi-échelles pour l'apprentissage de représentations multimodales
★ 636+0Évolution des étoiles sur les 7 derniers jours - #20
Laboratoires, entreprises, ressources et stages dans le domaine de la voix, recommandations et candidatures spontanées bienvenues
★ 609+0Évolution des étoiles sur les 7 derniers jours