Aller au contenu principal
buildradar
Se connecter
Sujet · text-to-speech

text-to-speech

Dépôts open source suivis étiquetés text-to-speech, triés par étoiles.

150 dépôts
  • TTS-Audio-Suite@diodiogod

    Intégration de nœuds personnalisés pour ComfyUI dédiée à la synthèse vocale (TTS) et à la conversion de voix multi-moteurs et multilingue. Supporte RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2, 3 et VibeVoice avec gestion des durées illimitées, timing SRT et outils audio.

    1 187+0Évolution des étoiles sur les 7 derniers jours
  • Un laboratoire pratique pour construire, tester et évaluer des applications avec le framework Foundation Models d'Apple.

    1 178+0Évolution des étoiles sur les 7 derniers jours
  • dia2@nari-labs

    Modèle TTS capable de diffuser de l'audio conversationnel en temps réel.

    1 173+0Évolution des étoiles sur les 7 derniers jours
  • speech-swift@soniqo

    Boîte à outils vocale IA pour Apple Silicon — ASR, TTS, speech-to-speech, VAD et diarisation propulsés par MLX et CoreML

    1 161+0Évolution des étoiles sur les 7 derniers jours
  • Le système d'auto-codage pour votre application — SDK Alan AI pour Cordova

    1 132+0Évolution des étoiles sur les 7 derniers jours
  • sglang-omni@sgl-project

    SGLang-Omni permet un service haute performance pour les modèles TTS, ASR, vocaux et omnimodaux.

    1 118+56Évolution des étoiles sur les 7 derniers jours
  • Uncensored-Local-Studio@techjarves

    Studio d'IA local non censuré pour Windows, Linux et macOS. Interface graphique sans configuration pour la génération d'images, les LLM GGUF, la synthèse vocale et la reconnaissance vocale.

    1 118+13Évolution des étoiles sur les 7 derniers jours
  • Patter@PatterAI

    SDK d'IA vocale open-source. L'alternative à Vapi/Retell pour les développeurs souhaitant maîtriser leur stack. Donnez un numéro de téléphone à votre agent IA en 4 lignes — Python et TypeScript, sous licence MIT, compatible Twilio, Telnyx et Plivo.

    1 051+7Évolution des étoiles sur les 7 derniers jours
  • Cognitive-Speech-TTS@Azure-Samples

    Exemple de code pour l'API Microsoft Text-to-Speech dans plusieurs langages, faisant partie des Cognitive Services.

    1 014+1Évolution des étoiles sur les 7 derniers jours
  • alexandria-audiobook@Finrandojin

    Générateur de livres audio multi-voix propulsé par l'IA : annotation de script par LLM, clonage vocal, conception de voix, entraînement LoRA, contrôle de style par ligne et exportation en MP3, M4B chapitré ou multipiste Audacity. Basé sur Qwen3-TTS.

    1 000+10Évolution des étoiles sur les 7 derniers jours
  • Step-Audio-EditX@stepfun-ai

    Un puissant modèle d'édition audio basé sur l'apprentissage par renforcement et un LLM de 3 milliards de paramètres, spécialisé dans l'édition des émotions, du style de parole et des paralinguistiques, avec des capacités robustes de synthèse vocale zero-shot

    973+1Évolution des étoiles sur les 7 derniers jours
  • NISQA@gabrielmittag

    NISQA - Évaluation non intrusive de la qualité de la parole et du naturel de la synthèse vocale (TTS).

    972+4Évolution des étoiles sur les 7 derniers jours
  • botium-speech-processing@codeforequity-at

    Traitement vocal Botium

    943+0Évolution des étoiles sur les 7 derniers jours
  • Rendre les voix TTS naturelles d'Azure accessibles à toute application compatible SAPI 5.

    934+7Évolution des étoiles sur les 7 derniers jours
  • Client API REST Vonage pour PHP. Support API pour SMS, voix, synthèse vocale, numéros, vérification (2FA) et plus encore.

    931-1Évolution des étoiles sur les 7 derniers jours
  • FireRedTTS@FireRedTeam

    Un système de synthèse vocale (TTS) open source basé sur des LLM.

    919-1Évolution des étoiles sur les 7 derniers jours
  • EDDiscovery@EDDiscovery

    Journal de bord et carte stellaire 3D pour Elite Dangerous.

    900+4Évolution des étoiles sur les 7 derniers jours
  • diffwave@lmnt-com

    DiffWave est un vocodeur neuronal et un synthétiseur de forme d'onde rapide et de haute qualité.

    884-1Évolution des étoiles sur les 7 derniers jours
  • bark.cpp@PABannier

    Modèle Bark de Suno AI en C/C++ pour une génération rapide de synthèse vocale.

    868+2Évolution des étoiles sur les 7 derniers jours
  • lue@paulilaaso

    Lecteur d'eBook en terminal avec synthèse vocale de qualité livre audio — Prend en charge EPUB, PDF, DOCX, HTML, RTF, TXT et MD.

    805+1Évolution des étoiles sur les 7 derniers jours
  • lobe-tts@lobehub

    🎤 Lobe TTS - Une bibliothèque TTS/STT fiable et de haute qualité pour serveur et navigateur.

    805-1Évolution des étoiles sur les 7 derniers jours
  • CloneTTS@sipeter

    Moteur de synthèse vocale (TTS) Android léger et hors ligne, permettant le clonage de voix et la lecture de texte haute fidélité à l'échelle du système.

    804+5Évolution des étoiles sur les 7 derniers jours
  • Speech to Text to Speech. Chanson en cours de lecture. Envoie du texte sous forme de messages OSC vers VRChat pour affichage sur l'avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    804+5Évolution des étoiles sur les 7 derniers jours
  • ai-video-editor@MartinDelophy

    Éditeur vidéo open-source et local-first, permettant aux créateurs et aux agents IA d'éditer une même timeline en temps réel.

    798+82Évolution des étoiles sur les 7 derniers jours
  • Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.

    794+73Évolution des étoiles sur les 7 derniers jours
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS : un moteur de synthèse vocale (TTS) multilingue et inter-lingue zero-shot.

    794+6Évolution des étoiles sur les 7 derniers jours
  • june@mezbaul-h

    Chatbot vocal local pour des conversations engageantes, propulsé par Ollama, Hugging Face Transformers et Coqui TTS Toolkit

    788+1Évolution des étoiles sur les 7 derniers jours
  • mlx-audio-swift@Blaizzy

    Un SDK Swift modulaire pour le traitement audio avec MLX sur Apple Silicon

    774+5Évolution des étoiles sur les 7 derniers jours
  • vui@fluxions-ai

    Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.

    759+7Évolution des étoiles sur les 7 derniers jours
  • cboard@cboard-org

    Système de communication améliorée et alternative (CAA) avec synthèse vocale pour le navigateur

    756+9Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets