speech
Dépôts open source suivis étiquetés speech, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de speech sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés speech.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
🐸💬 - Une boîte à outils de deep learning pour la synthèse vocale (Text-to-Speech), éprouvée en recherche et en production.
★ 45 967+36Évolution des étoiles sur les 7 derniers jours - #2
🚀 Clonez une voix en 5 secondes pour générer n'importe quel discours en temps réel.
★ 36 912-1Évolution des étoiles sur les 7 derniers jours - #3
VoxCPM2 : TTS sans tokenizer pour la génération de parole multilingue, la conception de voix créatives et le clonage vocal réaliste.
★ 36 250+293Évolution des étoiles sur les 7 derniers jours - #4
WhisperX : reconnaissance vocale automatique avec horodatage au niveau du mot et diarisation.
★ 23 803+117Évolution des étoiles sur les 7 derniers jours - #5
🤗 La plus grande plateforme de jeux de données prêts à l'emploi pour les modèles d'IA, avec des outils de manipulation de données rapides, simples et efficaces
★ 21 878+34Évolution des étoiles sur les 7 derniers jours - #6
Grounded SAM : associe Grounding DINO avec Segment Anything, Stable Diffusion et Recognize Anything pour détecter, segmenter et générer automatiquement n'importe quel élément.
★ 17 713+3Évolution des étoiles sur les 7 derniers jours - #7★ 15 471+7Évolution des étoiles sur les 7 derniers jours
- #8
Créez des agents vocaux avec des modèles open-source
★ 12 933+180Évolution des étoiles sur les 7 derniers jours - #9
AudioGPT : Comprendre et générer de la parole, de la musique, du son et des visages parlants
★ 10 166-2Évolution des étoiles sur les 7 derniers jours - #10
Silero VAD : détecteur d'activité vocale pré-entraîné de qualité professionnelle.
★ 10 083+52Évolution des étoiles sur les 7 derniers jours - #11
ModelScope : donner vie au concept de Model-as-a-Service.
★ 9 117+19Évolution des étoiles sur les 7 derniers jours - #12
EmotiVoice 😊 : un moteur TTS multi-voix contrôlé par prompts
★ 8 523+2Évolution des étoiles sur les 7 derniers jours - #13
Maintenu officiellement et soutenu par PaddlePaddle, incluant CV, NLP, parole, recommandation, séries temporelles, grands modèles, etc.
★ 6 932+0Évolution des étoiles sur les 7 derniers jours - #14★ 6 816+1Évolution des étoiles sur les 7 derniers jours
- #15
Silero Models : modèles de synthèse vocale pré-entraînés rendus extrêmement simples.
★ 6 085+11Évolution des étoiles sur les 7 derniers jours - #16
Quantification, noyaux, runtime et moteur d'inférence pour mobiles, objets connectés, domotique et robots.
★ 5 955+71Évolution des étoiles sur les 7 derniers jours - #17
Reconnaissance vocale automatique avec diarisation des locuteurs basée sur OpenAI Whisper.
★ 5 633+7Évolution des étoiles sur les 7 derniers jours - #18
Outil de reconnaissance vocale hors ligne pour générer des sous-titres au format JSON, SRT ou texte brut.
★ 4 771+7Évolution des étoiles sur les 7 derniers jours - #19
Suppression du bruit utilisant le filtrage profond.
★ 4 636+14Évolution des étoiles sur les 7 derniers jours - #20★ 4 556+7Évolution des étoiles sur les 7 derniers jours
- #21
Une boîte à outils de traitement de la parole basée sur l'IA et des modèles pré-entraînés SOTA open source, prenant en charge l'amélioration, la séparation et l'extraction de la voix cible, etc.
★ 4 449+19Évolution des étoiles sur les 7 derniers jours - #22
Modèle fondamental pour une synthèse vocale (TTS) expressive et naturelle.
★ 4 204-1Évolution des étoiles sur les 7 derniers jours - #23
Collection organisée de scripts Python, des bases aux concepts avancés, incluant des scripts d'automatisation.
★ 3 663+5Évolution des étoiles sur les 7 derniers jours - #24
Outil de conversion vocale simple et de haute qualité, axé sur la facilité d'utilisation et la performance
★ 3 660+39Évolution des étoiles sur les 7 derniers jours - #25
API de service web ASR pour OpenAI Whisper.
★ 3 326+2Évolution des étoiles sur les 7 derniers jours - #26
Exemples de code pour les nouvelles API d'iOS 10.
★ 3 273-2Évolution des étoiles sur les 7 derniers jours - #27
Manipulation et transformation de données pour le traitement des signaux audio, propulsé par PyTorch.
★ 2 931+6Évolution des étoiles sur les 7 derniers jours - #28★ 2 864+0Évolution des étoiles sur les 7 derniers jours
- #29
aeneas est une bibliothèque Python/C et un ensemble d'outils pour synchroniser automatiquement l'audio et le texte (alignement forcé)
★ 2 862-1Évolution des étoiles sur les 7 derniers jours - #30
Reconnaissance vocale automatique multilingue avec horodatages au niveau du mot et indices de confiance
★ 2 841+2Évolution des étoiles sur les 7 derniers jours