Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-synthesis

speech-synthesis

Erfasste Open-Source-Repos mit dem Tag speech-synthesis, sortiert nach Sternen.

Repos
66
Sterne gesamt
348.104
Sterne im Schnitt
5.274
Anteil
0,02%

Themen, die häufig gemeinsam mit speech-synthesis am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit speech-synthesis getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • TTS@coqui-ai

    🐸💬 - ein Deep-Learning-Toolkit für Text‑zu‑Sprache, erprobt in Forschung und Produktion

    45.985+18Sterne-Änderung der letzten 7 Tage
  • VoxCPM@OpenBMB

    File Browser bietet eine Datei‑Verwaltungs‑Schnittstelle in einem angegebenen Verzeichnis und ermöglicht das Hochladen, Löschen, Vorschauen und Bearbeiten von Dateien.

    36.595+345Sterne-Änderung der letzten 7 Tage
  • Speech@NVIDIA-NeMo

    Ein skalierbares generatives KI-Framework für Forscher und Entwickler, die an Large Language Models, Multimodalität und Speech AI (automatische Spracherkennung und Sprachsynthese) arbeiten

    18.379+21Sterne-Änderung der letzten 7 Tage
  • leon@leon-ai

    🧠 Leon ist Ihr persönlicher Open-Source-Assistent.

    17.476+1Sterne-Änderung der letzten 7 Tage
  • DeepLearningExamples@NVIDIA

    Modernste Deep-Learning-Skripte, organisiert nach Modellen – einfach zu trainieren und bereitzustellen mit reproduzierbarer Genauigkeit und Leistung auf Infrastruktur für den Unternehmenseinsatz.

    14.846+4Sterne-Änderung der letzten 7 Tage
  • supertonic@supertone-inc

    Blitzschnelles, gerätebasiertes, mehrsprachiges TTS — läuft nativ über ONNX.

    13.757+20Sterne-Änderung der letzten 7 Tage
  • speech-to-speech@huggingface

    Erstellen Sie Sprachagenten mit Open-Source-Modellen

    13.015+82Sterne-Änderung der letzten 7 Tage
  • voice-pro@abus-aikorea

    Gradio WebUI für Creator und Entwickler mit wichtigen TTS-Funktionen (Edge-TTS, kokoro) und Zero-Shot Voice Cloning (E2 & F5-TTS, CosyVoice), inklusive Whisper-Audioverarbeitung, YouTube-Download, Demucs-Gesangsisolierung und mehrsprachiger Übersetzung.

    12.730+54Sterne-Änderung der letzten 7 Tage
  • PaddleSpeech@PaddlePaddle

    Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.

    12.676+5Sterne-Änderung der letzten 7 Tage
  • edge-tts@rany2

    Nutze den Online-Text-to-Speech-Dienst von Microsoft Edge aus Python, OHNE Microsoft Edge, Windows oder einen API-Key zu benötigen

    11.847+29Sterne-Änderung der letzten 7 Tage
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) ist ein Toolkit zur Audio-, Musik- und Sprachgenerierung. Sein Zweck ist es, reproduzierbare Forschung zu unterstützen und jüngeren Forschern sowie Ingenieuren den Einstieg in die Forschung und Entwicklung zur Audio-, Musik- und Sprachgenerierung zu erleichtern.

    10.276+1Sterne-Änderung der letzten 7 Tage
  • espnet@espnet

    End-to-End-Sprachverarbeitungs-Toolkit

    9.949+3Sterne-Änderung der letzten 7 Tage
  • so-vits-svc-fork@voicepaw

    so-vits-svc Fork mit Echtzeitunterstützung, verbesserter Benutzeroberfläche und weiteren Funktionen.

    9.329+3Sterne-Änderung der letzten 7 Tage
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Eine Multi-Voice- und Prompt-gesteuerte TTS-Engine

    8.522-1Sterne-Änderung der letzten 7 Tage
  • mlx-audio@Blaizzy

    Eine auf Apples MLX-Framework basierende Text-to-Speech (TTS)-, Speech-to-Text (STT)- und Speech-to-Speech (STS)-Bibliothek für effiziente Sprachanalyse auf Apple Silicon.

    7.826+23Sterne-Änderung der letzten 7 Tage
  • espeak-ng@espeak-ng

    eSpeak NG ist ein Open-Source-Sprachsynthesizer, der mehr als hundert Sprachen und Akzente unterstützt.

    6.802+13Sterne-Änderung der letzten 7 Tage
  • StyleTTS2@yl4579

    StyleTTS 2: Annäherung an menschliche Sprachsynthese durch Style Diffusion und adversariales Training mit großen Sprachmodellen für Sprache

    6.342+3Sterne-Änderung der letzten 7 Tage
  • silero-models@snakers4

    Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet

    6.084-1Sterne-Änderung der letzten 7 Tage
  • abogen@denizsafak

    Erstelle Hörbücher aus EPUBs, PDFs und Text mit synchronisierten Untertiteln.

    5.831+45Sterne-Änderung der letzten 7 Tage
  • DiffSinger@MoonInTheRiver

    :DiffSinger: Gesangssynthese über flachen Diffusionsmechanismus (SVS & TTS); AAAI 2022; Offizieller Code

    4.855+3Sterne-Änderung der letzten 7 Tage
  • WhisperSpeech@WhisperSpeech

    Ein Open-Source-Text-to-Speech-System, entwickelt durch Invertieren von Whisper.

    4.645+3Sterne-Änderung der letzten 7 Tage
  • OpenUtau@openutau

    Offene Gesangssynthese-Plattform / Open-Source-Nachfolger von UTAU

    4.258+18Sterne-Änderung der letzten 7 Tage
  • metavoice-src@metavoiceio

    Grundlegendes Modell für menschenähnliches, expressives TTS

    4.203-1Sterne-Änderung der letzten 7 Tage
  • RealtimeTTS@KoljaB

    Konvertiert Text in Echtzeit in Sprache.

    4.021+2Sterne-Änderung der letzten 7 Tage
  • TensorFlowTTS@TensorSpeech

    TensorFlowTTS: Echtzeit-Sprachsynthese auf dem neuesten Stand der Technik für TensorFlow 2 (unterstützt Englisch, Französisch, Koreanisch, Chinesisch, Deutsch und ist einfach für andere Sprachen anzupassen)

    3.996+0Sterne-Änderung der letzten 7 Tage
  • lingvo@tensorflow

    Lingvo

    2.864+0Sterne-Änderung der letzten 7 Tage
  • MARS5-TTS@Camb-ai

    MARS5-Sprachmodell (TTS) von CAMB.AI

    2.818+1Sterne-Änderung der letzten 7 Tage
  • marytts@marytts

    MARY TTS – Ein in reinem Java geschriebenes, Open-Source-basiertes und mehrsprachiges Text-to-Speech-Synthesesystem

    2.583+0Sterne-Änderung der letzten 7 Tage
  • VieNeu-TTS@pnnbao97

    Vietnamesisches TTS mit sofortigem Voice Cloning • On-Device • Echtzeit-CPU-Inferenz • 24kHz Audioqualität • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2.468+21Sterne-Änderung der letzten 7 Tage
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks für effiziente und hochpräzise Sprachsynthese

    2.367+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen