Aller au contenu principal
buildradar
Sign in
Sujet · speech-synthesis

speech-synthesis

Dépôts open source suivis étiquetés speech-synthesis, triés par étoiles.

66 dépôts
  • chat-with-gpt@cogentapps

    Une application ChatGPT open-source avec une interface vocale.

    2 350-1Évolution des étoiles sur les 7 derniers jours
  • IMS-Toucan@DigitalPhonetics

    Synthèse vocale rapide et contrôlable pour plus de 7000 langues.

    2 207-1Évolution des étoiles sur les 7 derniers jours
  • RHVoice@RHVoice

    Un synthétiseur vocal libre et open source pour le russe et d'autres langues

    1 836+1Évolution des étoiles sur les 7 derniers jours
  • ParallelWaveGAN@kan-bayashi

    Implémentation non officielle de Parallel WaveGAN (incluant MelGAN, Multi-band MelGAN, HiFi-GAN et StyleMelGAN) avec PyTorch.

    1 646+1Évolution des étoiles sur les 7 derniers jours
  • dsnote@mkiol

    Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.

    1 622+8Évolution des étoiles sur les 7 derniers jours
  • Nœuds personnalisés étendant les capacités de Comfyui.

    1 525+1Évolution des étoiles sur les 7 derniers jours
  • SAM@s-macke

    Software Automatic Mouth - Un synthétiseur vocal miniature

    1 498+0Évolution des étoiles sur les 7 derniers jours
  • SpeechT5@microsoft

    Pré-entraînement parole-texte multimodal unifié pour le traitement du langage parlé

    1 449+0Évolution des étoiles sur les 7 derniers jours
  • Auto-hébergez le puissant modèle TTS Chatterbox. Ce serveur propose une interface Web conviviale, des points de terminaison API flexibles (compatibles OpenAI), des voix prédéfinies, le clonage vocal et le traitement de texte à grande échelle pour les livres audio. Fonctionne en mode accéléré sur NVIDIA (CUDA), AMD (ROCm) et CPU.

    1 427+1Évolution des étoiles sur les 7 derniers jours
  • Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.

    1 399+0Évolution des étoiles sur les 7 derniers jours
  • voicefixer@haoheliu

    Restauration de parole générale

    1 375+0Évolution des étoiles sur les 7 derniers jours
  • World@mmorise

    Un système d'analyse, de manipulation et de synthèse vocale de haute qualité

    1 339+0Évolution des étoiles sur les 7 derniers jours
  • StreamSpeech@ictnlp

    StreamSpeech est un modèle tout-en-un fluide pour la reconnaissance vocale, la traduction et la synthèse vocale, en mode hors ligne et simultané.

    1 288+0Évolution des étoiles sur les 7 derniers jours
  • Irodori-TTS@Aratako

    Modèle de synthèse vocale basé sur le Flow Matching avec contrôle de style piloté par emoji

    1 228+4Évolution des étoiles sur les 7 derniers jours
  • BigVGAN@NVIDIA

    Implémentation officielle PyTorch de BigVGAN (ICLR 2023).

    1 227+1Évolution des étoiles sur les 7 derniers jours
  • Irina, un assistant vocal russe fonctionnant hors ligne, prenant en charge des compétences via des plugins.

    1 153+0Évolution des étoiles sur les 7 derniers jours
  • AI-Waifu-Vtuber@ardha27

    Vtuber IA pour le streaming sur Youtube/Twitch

    1 116+2Évolution des étoiles sur les 7 derniers jours
  • autovc@auspicious3000

    AutoVC : Transfert de style vocal Zero-Shot avec uniquement une perte d'auto-encodeur.

    1 100+0Évolution des étoiles sur les 7 derniers jours
  • YourTTS@Edresson

    YourTTS : vers une synthèse vocale multi-locuteur et une conversion de voix Zero-Shot pour tous.

    1 054+0Évolution des étoiles sur les 7 derniers jours
  • Cognitive-Speech-TTS@Azure-Samples

    Exemple de code pour l'API Microsoft Text-to-Speech dans plusieurs langages, faisant partie des Cognitive Services.

    1 014+3Évolution des étoiles sur les 7 derniers jours
  • alexandria-audiobook@Finrandojin

    Générateur de livres audio multi-voix propulsé par l'IA : annotation de script par LLM, clonage vocal, conception de voix, entraînement LoRA, contrôle de style par ligne et exportation en MP3, M4B chapitré ou multipiste Audacity. Basé sur Qwen3-TTS.

    1 000+20Évolution des étoiles sur les 7 derniers jours
  • NISQA@gabrielmittag

    NISQA - Évaluation non intrusive de la qualité de la parole et du naturel de la synthèse vocale (TTS).

    972+3Évolution des étoiles sur les 7 derniers jours
  • Rendre les voix TTS naturelles d'Azure accessibles à toute application compatible SAPI 5.

    934+13Évolution des étoiles sur les 7 derniers jours
  • FireRedTTS@FireRedTeam

    Un système de synthèse vocale (TTS) open source basé sur des LLM.

    919+1Évolution des étoiles sur les 7 derniers jours
  • Un LLM vocal qui s'exécute localement sur votre ordinateur sans nécessiter de connexion internet.

    891+2Évolution des étoiles sur les 7 derniers jours
  • diffwave@lmnt-com

    DiffWave est un vocodeur neuronal et un synthétiseur de forme d'onde rapide et de haute qualité.

    884+0Évolution des étoiles sur les 7 derniers jours
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS : un moteur de synthèse vocale (TTS) multilingue et inter-lingue zero-shot.

    794+10Évolution des étoiles sur les 7 derniers jours
  • vui@fluxions-ai

    Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.

    759+10Évolution des étoiles sur les 7 derniers jours
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice : une voix TTS allemande gratuite, utilisable hors ligne et de haute qualité, accessible à tous les projets sans contraintes de licence.

    729+1Évolution des étoiles sur les 7 derniers jours
  • Papers INTERSPEECH 2023-2024 : une collection complète de papiers influents et passionnants de la conférence INTERSPEECH 2023-24. Découvrez les dernières avancées dans le traitement du discours et du langage. Code inclus. Étoinez le dépôt pour soutenir l'avancement de la technologie vocale !

    684+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets