text-to-speech
Dépôts open source suivis étiquetés text-to-speech, triés par étoiles.
- #121
Package Flutter de synthèse vocale (Text to Speech).
★ 753+0Évolution des étoiles sur les 7 derniers jours - #122
🔊 Kokoro Web : Synthèse vocale par IA gratuite, en ligne ou auto-hébergée, compatible OpenAI !
★ 733+2Évolution des étoiles sur les 7 derniers jours - #123
Rapida est une plateforme d'orchestration d'IA vocale open source pour créer des agents conversationnels en temps réel avec streaming audio, STT, TTS, VAD, intégration multicanal, gestion d'état et observabilité.
★ 723+4Évolution des étoiles sur les 7 derniers jours - #124
Transcription de la parole en texte et saisie de sous-titres via KB pour OBS, VRChat, le chat Twitch et Discord.
★ 718-1Évolution des étoiles sur les 7 derniers jours - #125
Implémentation en PyTorch de Voicebox, le nouveau réseau de synthèse vocale (Text-to-speech) SOTA de MetaAI
★ 703+0Évolution des étoiles sur les 7 derniers jours - #126
Générateur de vidéos entièrement automatisé utilisant le motion design et la synthèse vocale pour transformer des newsletters en vidéos YouTube quotidiennes.
★ 703+0Évolution des étoiles sur les 7 derniers jours - #127
Reconnaissance vocale hors ligne avec OpenAI Whisper et TensorFlow Lite pour Android
★ 689+1Évolution des étoiles sur les 7 derniers jours - #128
API locale de texte‑à‑parole (TTS) compatible OpenAI utilisant Chatterbox, permettant aux utilisateurs de générer de la parole clonée partout où l'API OpenAI est utilisée (par ex. Open WebUI, AnythingLLM, etc.)
★ 677+1Évolution des étoiles sur les 7 derniers jours - #129
📚 Une extension de dictionnaire personnalisable prenant en charge la consultation par double-clic dans plus de 20 langues, plus de 1000 dictionnaires, la synthèse vocale, la traduction et l'intégration Anki.
★ 671+1Évolution des étoiles sur les 7 derniers jours - #130
LLaSA : mise à l'échelle du calcul d'entraînement et d'inférence pour la synthèse vocale basée sur LLaMA
★ 658+1Évolution des étoiles sur les 7 derniers jours - #131
Implémentation de F5-TTS en MLX
★ 644+0Évolution des étoiles sur les 7 derniers jours - #132★ 626+2Évolution des étoiles sur les 7 derniers jours
- #133
Transformez des PDF et des EPUB en livres audio ; des sous-titres ou des vidéos en vidéos doublées (avec traduction), et plus encore. Gratuitement. Pandrator utilise des modèles locaux, incluant le clonage de voix (instantané, amélioré par RVC, affinage XTTS) et le traitement par LLM. Il ambitionne d'être une application conviviale avec une interface graphique, un installateur et des packages tout-en-un.
★ 620+3Évolution des étoiles sur les 7 derniers jours - #134
Script Python simple pour interagir avec l'API TTS de TikTok
★ 611+0Évolution des étoiles sur les 7 derniers jours - #135
Nœud personnalisé ComfyUI pour VibeVoice TTS. Audio conversationnel expressif, long et multi-locuteur
★ 596-1Évolution des étoiles sur les 7 derniers jours - #136
Le système d'autocodage pour votre application — Alan AI SDK pour React Native
★ 575+0Évolution des étoiles sur les 7 derniers jours - #137
Version modifiée de Chatterbox acceptant des fichiers texte en entrée sans restriction de caractères. Je l'utilise pour créer des livres audio, en particulier pour mes enfants.
★ 575-1Évolution des étoiles sur les 7 derniers jours - #138
Exécutez Qwen3-TTS text-to-speech localement sur Mac (M1/M2/M3/M4). Clonage de voix, design vocal, voix personnalisées. 100 % hors ligne via MLX.
★ 561+2Évolution des étoiles sur les 7 derniers jours - #139
Une liste organisée d'articles sur la génération multimodale basée sur les LLM (image, vidéo, 3D et audio).
★ 552+0Évolution des étoiles sur les 7 derniers jours - #140
Exécuter Orpheus 3B localement avec LM Studio
★ 549+0Évolution des étoiles sur les 7 derniers jours - #141
Implémentation non officielle de vits2-TTS en pytorch
★ 549+1Évolution des étoiles sur les 7 derniers jours - #142
AI Plugin est une extension puissante pour Payload CMS, intégrant des capacités d'IA avancées pour améliorer la création et la gestion de contenu.
★ 547-1Évolution des étoiles sur les 7 derniers jours - #143
Nœuds OmniVoice TTS pour ComfyUI - Synthèse vocale multilingue zero-shot avec clonage de voix, conception vocale et dialogue multi-locuteurs
★ 545+6Évolution des étoiles sur les 7 derniers jours - #144
Lightning-fast, free, local first voice dictation for macOS with on-device transcription
★ 544+13Évolution des étoiles sur les 7 derniers jours - #145★ 525+2Évolution des étoiles sur les 7 derniers jours
- #146
Implémentation en Pytorch de E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS".
★ 517+0Évolution des étoiles sur les 7 derniers jours - #147
Un modèle de synthèse vocale (TTS) pour le clonage de voix vietnamienne
★ 516-1Évolution des étoiles sur les 7 derniers jours - #148
Serveur d'inférence linguistique open-source, local et auto-hébergé, hautement optimisé, prenant en charge ASR/STT, TTS et LLM via WebRTC, REST et WS.
★ 512+0Évolution des étoiles sur les 7 derniers jours - #149
Nœud ComfyUI pour une parole hautement expressive et un clonage vocal zero-shot réaliste
★ 509+0Évolution des étoiles sur les 7 derniers jours - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 505+4Évolution des étoiles sur les 7 derniers jours