Aller au contenu principal
buildradar
Sign in
Sujet · tts

tts

Dépôts open source suivis étiquetés tts, triés par étoiles.

Dépôts
189
Total d'étoiles
1 061 717
Étoiles en moyenne
5 618
Part
0,06%

Sujets qui apparaissent souvent aux côtés de tts sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés tts.

  • audio.cpp@0xShug0

    Un moteur d'inférence tout-en-un en C++ pur pour les modèles audio, propulsé par ggml. Prend en charge TTS, STT, VAD, conversion vocale, génération musicale et plus encore, avec des performances hautement optimisées. Aucune dépendance Python.

    2 214
  • vox-director@Alisa0808

    Transformez un sujet en une vidéo explicative ou publicitaire de style Vox avec collage papier, automatisée de bout en bout sur Atlas Cloud et ffmpeg. Une compétence d'agent.

    1 698
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    829
  • Traducteur d'écran Android en temps réel open-source sans root, idéal pour les jeux, visual novels et mangas. Prend en charge l'OCR sur l'appareil et dans le cloud, les LLM hors ligne, divers services de traduction et la synthèse vocale (TTS), avec affichage direct des traductions à l'écran.

    786
  • cs-board@ChenShuo2004

    将参考声音和中文文案自动生成白板动画视频的本地 AI 工具。

    534
  • unsloth@unslothai

    Interface locale pour exécuter et entraîner des LLM et des modèles de diffusion, incluant Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX et plus encore.

    75 515+337Évolution des étoiles sur les 7 derniers jours
  • GPT-SoVITS@RVC-Boss

    1 minute de données vocales suffit pour entraîner un bon modèle TTS ! (clonage vocal en quelques exemples)

    61 476+138Évolution des étoiles sur les 7 derniers jours
  • Clonage de voix en 5 secondes pour générer n'importe quel discours en temps réel

    60 117-4Évolution des étoiles sur les 7 derniers jours
  • LocalAI@mudler

    LocalAI est le moteur d'IA open source. Exécutez n'importe quel modèle - LLM, vision, voix, image, vidéo - sur n'importe quel matériel. Aucun GPU requis.

    48 833+84Évolution des étoiles sur les 7 derniers jours
  • TTS@coqui-ai

    🐸💬 - Une boîte à outils de deep learning pour la synthèse vocale (Text-to-Speech), éprouvée en recherche et en production.

    45 985+18Évolution des étoiles sur les 7 derniers jours
  • ChatTTS@2noise

    Un modèle de synthèse vocale générative pour le dialogue quotidien.

    39 814+9Évolution des étoiles sur les 7 derniers jours
  • OpenVoice@myshell-ai

    Clonage vocal instantané par le MIT et MyShell. Modèle de fondation audio.

    37 419+61Évolution des étoiles sur les 7 derniers jours
  • MockingBird@babysor

    🚀 Clonez une voix en 5 secondes pour générer n'importe quel discours en temps réel.

    36 912+0Évolution des étoiles sur les 7 derniers jours
  • VoxCPM@OpenBMB

    VoxCPM2 : TTS sans tokenizer pour la génération de parole multilingue, la conception de voix créatives et le clonage vocal réaliste.

    36 595+345Évolution des étoiles sur les 7 derniers jours
  • fish-speech@fishaudio

    TTS open source SOTA

    32 510+52Évolution des étoiles sur les 7 derniers jours
  • Pixelle-Video@ATH-MaaS

    Moteur de création de courtes vidéos entièrement automatisé par IA.

    27 702+236Évolution des étoiles sur les 7 derniers jours
  • mastra@mastra-ai

    Mastra est le framework TypeScript moderne pour les applications et agents basés sur l'IA.

    27 657+96Évolution des étoiles sur les 7 derniers jours
  • readest@readest

    Readest est un lecteur d'ebook moderne et riche en fonctionnalités, conçu pour les lecteurs passionnés, offrant un accès multiplateforme fluide, des outils puissants et une interface intuitive pour améliorer votre expérience de lecture.

    24 008+138Évolution des étoiles sur les 7 derniers jours
  • index-tts@index-tts

    Système de synthèse vocale (TTS) Zero-Shot efficace et contrôlable de niveau industriel

    23 686+109Évolution des étoiles sur les 7 derniers jours
  • CosyVoice@QwenAudio

    Modèle multilingue de génération vocale à grande échelle, offrant des capacités complètes d'inférence, d'entraînement et de déploiement.

    23 426+359Évolution des étoiles sur les 7 derniers jours
  • ebook2audiobook@DrewThomasson

    Générez des livres audio à partir de livres numériques, avec clonage vocal et prise en charge de plus de 1158 langues.

    20 097+34Évolution des étoiles sur les 7 derniers jours
  • pot-desktop@pot-app

    Un logiciel multiplateforme de traduction et de reconnaissance optique de caractères (OCR) par survol de texte.

    19 408+28Évolution des étoiles sur les 7 derniers jours
  • Speech@NVIDIA-NeMo

    Framework d'IA générative évolutif conçu pour les chercheurs et développeurs travaillant sur les grands modèles de langage, le multimodal et l'IA vocale (ASR et TTS).

    18 379+21Évolution des étoiles sur les 7 derniers jours
  • VoiceStudio@debpalash

    VoiceStudio est l'alternative open source et entièrement locale à ElevenLabs : clonage vocal, design vocal, doublage vidéo, dictée, transcription et création de livres audio en 646 langues.

    14 835+2 880Évolution des étoiles sur les 7 derniers jours
  • supertonic@supertone-inc

    TTS multilingue ultra-rapide fonctionnant localement sur l'appareil via ONNX.

    13 757+20Évolution des étoiles sur les 7 derniers jours
  • voice-pro@abus-aikorea

    Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.

    12 730+54Évolution des étoiles sur les 7 derniers jours
  • PaddleSpeech@PaddlePaddle

    Boîte à outils vocale facile à utiliser incluant l'apprentissage auto-supervisé, la reconnaissance vocale (ASR) SOTA/en continu avec ponctuation, la synthèse vocale (TTS) en continu avec interface textuelle, un système de vérification du locuteur, la traduction vocale de bout en bout et la détection de mots-clés. Lauréat du prix Best Demo à NAACL2022.

    12 676+5Évolution des étoiles sur les 7 derniers jours
  • edge-tts@rany2

    Utilisez le service de synthèse vocale en ligne de Microsoft Edge depuis Python sans avoir besoin de Microsoft Edge, de Windows ou d'une clé API.

    11 847+29Évolution des étoiles sur les 7 derniers jours
  • KrillinAI@krillinai

    Outil de traduction et de doublage vidéo par IA pour humains et agents IA, propulsé par des LLM. Pipeline complet : téléchargement, transcription, traduction, doublage TTS, reformatage et génération de couverture. Plus de 100 langues, optimisé pour YouTube, TikTok, Bilibili, Douyin et plus encore.

    11 333+46Évolution des étoiles sur les 7 derniers jours
  • moonshine@moonshine-ai

    Reconnaissance vocale, intentionnelle et synthèse vocale à très faible latence pour la création d'agents et d'interfaces vocaux.

    10 997+33Évolution des étoiles sur les 7 derniers jours
  • voltagent@VoltAgent

    Plateforme d'ingénierie d'agents IA basée sur un framework d'agents IA open source en TypeScript.

    10 529+80Évolution des étoiles sur les 7 derniers jours
  • Bert-VITS2@fishaudio

    Backbone vits2 avec multilingual-bert.

    8 794-3Évolution des étoiles sur les 7 derniers jours
  • EmotiVoice@netease-youdao

    EmotiVoice 😊 : un moteur TTS multi-voix contrôlé par prompts

    8 522-1Évolution des étoiles sur les 7 derniers jours
  • audiblez@santinic

    Générer des livres audio à partir de livres numériques

    8 479+9Évolution des étoiles sur les 7 derniers jours
  • Vision-Agents@GetStream

    Open Vision Agents par Stream. Créez rapidement des agents vocaux et visuels avec n'importe quel modèle ou fournisseur vidéo. Utilise le réseau edge de Stream pour une latence ultra-faible.

    8 113+9Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets