Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-synthesis

speech-synthesis

Erfasste Open-Source-Repos mit dem Tag speech-synthesis, sortiert nach Sternen.

66 Repos
  • chat-with-gpt@cogentapps

    Eine Open-Source-ChatGPT-App mit Sprachfunktion

    2.350-1Sterne-Änderung der letzten 7 Tage
  • IMS-Toucan@DigitalPhonetics

    Steuerbare und schnelle Text-to-Speech-Technologie für über 7000 Sprachen!

    2.207-1Sterne-Änderung der letzten 7 Tage
  • RHVoice@RHVoice

    Ein freier und Open-Source-Sprachsynthesizer für Russisch und andere Sprachen

    1.836+1Sterne-Änderung der letzten 7 Tage
  • ParallelWaveGAN@kan-bayashi

    Inoffizielles Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) mit PyTorch

    1.646+1Sterne-Änderung der letzten 7 Tage
  • dsnote@mkiol

    Speech Note Linux-App. Notizen erstellen, lesen und übersetzen mit Offline-Spracherkennung (Speech-to-Text), Sprachsynthese (Text-to-Speech) und maschineller Übersetzung.

    1.622+8Sterne-Änderung der letzten 7 Tage
  • Benutzerdefinierte Nodes, die die Funktionen von ComfyUI erweitern

    1.525+1Sterne-Änderung der letzten 7 Tage
  • SAM@s-macke

    Software Automatic Mouth – Ein winziger Sprachsynthesizer

    1.498+0Sterne-Änderung der letzten 7 Tage
  • SpeechT5@microsoft

    Einheitliches multimodales Sprach-Text-Pre-Training für die Sprachverarbeitung

    1.449+0Sterne-Änderung der letzten 7 Tage
  • Hosten Sie das leistungsstarke Chatterbox TTS-Modell selbst. Dieser Server bietet eine benutzerfreundliche Web-UI, flexible API-Endpunkte (inkl. OpenAI-Kompatibilität), vordefinierte Stimmen, Klonen von Stimmen und Textverarbeitung im Umfang großer Hörbücher. Läuft beschleunigt auf NVIDIA (CUDA), AMD (ROCm) und CPU.

    1.427+1Sterne-Änderung der letzten 7 Tage
  • 💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien

    1.399+0Sterne-Änderung der letzten 7 Tage
  • voicefixer@haoheliu

    Allgemeine Sprachwiederherstellung

    1.375+0Sterne-Änderung der letzten 7 Tage
  • World@mmorise

    Ein hochwertiges System zur Sprachanalyse, -manipulation und -synthese

    1.339+0Sterne-Änderung der letzten 7 Tage
  • StreamSpeech@ictnlp

    StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.

    1.288+0Sterne-Änderung der letzten 7 Tage
  • Irodori-TTS@Aratako

    Ein Flow Matching-basiertes Text-to-Speech-Modell mit Emoji-gesteuerter Stilkontrolle

    1.228+4Sterne-Änderung der letzten 7 Tage
  • BigVGAN@NVIDIA

    Offizielle PyTorch-Implementierung von BigVGAN (ICLR 2023)

    1.227+1Sterne-Änderung der letzten 7 Tage
  • Irina – ein russischer Sprachassistent für die Offline-Nutzung. Unterstützt Fähigkeiten über Plugins.

    1.153+0Sterne-Änderung der letzten 7 Tage
  • AI-Waifu-Vtuber@ardha27

    KI-Vtuber zum Streamen auf YouTube und Twitch.

    1.116+1Sterne-Änderung der letzten 7 Tage
  • autovc@auspicious3000

    AutoVC: Zero-Shot Voice Style Transfer nur mit Autoencoder-Verlust

    1.100+0Sterne-Änderung der letzten 7 Tage
  • YourTTS@Edresson

    YourTTS: Auf dem Weg zu Zero-Shot Multi-Speaker TTS und Zero-Shot Voice Conversion für jedermann

    1.053+0Sterne-Änderung der letzten 7 Tage
  • Cognitive-Speech-TTS@Azure-Samples

    Microsoft Text-to-Speech API-Beispielcode in mehreren Sprachen, Teil von Cognitive Services.

    1.014+3Sterne-Änderung der letzten 7 Tage
  • alexandria-audiobook@Finrandojin

    KI-gestützter Multistimmen-Hörbuchgenerator – LLM-Skriptannotation, Klonen von Stimmen, Stimmen-Design, LoRA-Training, zeilenbasierte Stilsteuerung und Export nach MP3, M4B mit Kapiteln oder als Audacity-Mehrspurprojekt. Basiert auf Qwen3-TTS.

    999+17Sterne-Änderung der letzten 7 Tage
  • NISQA@gabrielmittag

    NISQA – Nicht-intrusive Bewertung der Sprachqualität und TTS-Natürlichkeit

    971+2Sterne-Änderung der letzten 7 Tage
  • Macht natürliche Azure-TTS-Stimmen für jede SAPI-5-kompatible Anwendung zugänglich.

    934+12Sterne-Änderung der letzten 7 Tage
  • FireRedTTS@FireRedTeam

    Ein Open-Source-LLM-basiertes TTS-Fundamentalsystem

    920+1Sterne-Änderung der letzten 7 Tage
  • Ein sprechendes LLM, das auf deinem eigenen Computer ohne Internetverbindung läuft.

    891+2Sterne-Änderung der letzten 7 Tage
  • diffwave@lmnt-com

    DiffWave ist ein schneller, hochqualitativer neuronaler Vocoder und Wellenformsynthesizer.

    885+0Sterne-Änderung der letzten 7 Tage
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Eine mehrsprachige und sprachübergreifende Zero-Shot-TTS-Engine

    794+10Sterne-Änderung der letzten 7 Tage
  • vui@fluxions-ai

    Echtzeit-Sprachassistent — WebRTC-Streaming, faster-whisper ASR, lokales LLM, Vui Nano (300M) TTS. Kompatibel mit der OpenAI Realtime API. Sprachklonen, Barge-in, ca. 9-fache Echtzeit auf einer 4090. Apache 2.0.

    757+10Sterne-Änderung der letzten 7 Tage
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Eine kostenlose, offline funktionierende, hochwertige deutsche TTS-Stimme, die für jedes Projekt ohne Lizenzprobleme verfügbar sein soll.

    729+1Sterne-Änderung der letzten 7 Tage
  • INTERSPEECH 2023-2024 Papers: Eine vollständige Sammlung einflussreicher und spannender Forschungspapiere der INTERSPEECH 2023-24 Konferenz. Entdecken Sie die neuesten Fortschritte in der Sprach- und Textverarbeitung. Code enthalten. Sternen Sie das Repository, um den Fortschritt der Sprachtechnologie zu unterstützen!

    684+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen