speech
Erfasste Open-Source-Repos mit dem Tag speech, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit speech am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit speech getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
🐸💬 - ein Deep-Learning-Toolkit für Text‑zu‑Sprache, erprobt in Forschung und Produktion
★ 45.967+36Sterne-Änderung der letzten 7 Tage - #2
🚀Eine Stimme in 5 Sekunden klonen, um beliebiges Speech in Echtzeit zu erzeugen.
★ 36.912-1Sterne-Änderung der letzten 7 Tage - #3
File Browser bietet eine Datei‑Verwaltungs‑Schnittstelle in einem angegebenen Verzeichnis und ermöglicht das Hochladen, Löschen, Vorschauen und Bearbeiten von Dateien.
★ 36.250+293Sterne-Änderung der letzten 7 Tage - #4
WhisperX: Automatisches Spracherkennungs‑System mit Wort‑genauen Zeitstempeln (& Diarization)
★ 23.803+117Sterne-Änderung der letzten 7 Tage - #5
🤗 Der größte Hub für einsatzbereite Datensätze für KI-Modelle mit schnellen, benutzerfreundlichen und effizienten Datenbearbeitungswerkzeugen
★ 21.878+34Sterne-Änderung der letzten 7 Tage - #6
Grounded SAM: Verknüpfung von Grounding DINO mit Segment Anything, Stable Diffusion und Recognize Anything – automatisches Erkennen, Segmentieren und Generieren von Inhalten
★ 17.713+3Sterne-Änderung der letzten 7 Tage - #7★ 15.471+7Sterne-Änderung der letzten 7 Tage
- #8
Erstellen Sie Sprachagenten mit Open-Source-Modellen
★ 12.933+180Sterne-Änderung der letzten 7 Tage - #9★ 10.166-2Sterne-Änderung der letzten 7 Tage
- #10
Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene
★ 10.083+52Sterne-Änderung der letzten 7 Tage - #11
ModelScope: Das Konzept von Model-as-a-Service zum Leben erwecken.
★ 9.117+19Sterne-Änderung der letzten 7 Tage - #12
EmotiVoice 😊: Eine Multi-Voice- und Prompt-gesteuerte TTS-Engine
★ 8.523+2Sterne-Änderung der letzten 7 Tage - #13
Offiziell gewartet und unterstützt von PaddlePaddle, umfasst CV, NLP, Speech, Rec, TS, große Modelle und mehr.
★ 6.932+0Sterne-Änderung der letzten 7 Tage - #14★ 6.816+1Sterne-Änderung der letzten 7 Tage
- #15
Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet
★ 6.085+11Sterne-Änderung der letzten 7 Tage - #16
Quantisierung, Kernels, Laufzeit und Inferenz-Engine für Mobilgeräte, Wearables, Smart Home und Roboter.
★ 5.955+71Sterne-Änderung der letzten 7 Tage - #17
Automatische Spracherkennung mit Sprecher-Diarisierung basierend auf OpenAI Whisper
★ 5.633+7Sterne-Änderung der letzten 7 Tage - #18
Spracherkennungstool für Text / Ein lokal laufendes Offline-Tool zur Audio- und Video-Untertitelung, das JSON-, SRT- und Reintextformate ausgibt.
★ 4.771+7Sterne-Änderung der letzten 7 Tage - #19
Rauschunterdrückung mittels Deep Filtering
★ 4.636+14Sterne-Änderung der letzten 7 Tage - #20★ 4.556+7Sterne-Änderung der letzten 7 Tage
- #21
Ein KI-gestütztes Toolkit zur Sprachverarbeitung und Open-Source-SOTA-Vortrainierte Modelle zur Unterstützung von Sprachverbesserung, -trennung und Zielsprecher-Extraktion etc.
★ 4.449+19Sterne-Änderung der letzten 7 Tage - #22
Grundlegendes Modell für menschenähnliches, expressives TTS
★ 4.204-1Sterne-Änderung der letzten 7 Tage - #23
🚀 Kuratierte Sammlung fantastischer Python-Skripte von den Grundlagen bis zum Fortgeschrittenen mit Automatisierungs-Skripten.
★ 3.663+5Sterne-Änderung der letzten 7 Tage - #24
Ein einfaches, hochwertiges Sprachkonvertierungstool mit Fokus auf Benutzerfreundlichkeit und Leistung.
★ 3.660+39Sterne-Änderung der letzten 7 Tage - #25
OpenAI Whisper ASR Webservice API
★ 3.326+2Sterne-Änderung der letzten 7 Tage - #26
Codebeispiele für neue APIs von iOS 10.
★ 3.273-2Sterne-Änderung der letzten 7 Tage - #27
Datenmanipulation und -transformation für die Audiosignalverarbeitung, unterstützt durch PyTorch
★ 2.931+6Sterne-Änderung der letzten 7 Tage - #28★ 2.864+0Sterne-Änderung der letzten 7 Tage
- #29
aeneas ist eine Python/C-Bibliothek und eine Reihe von Werkzeugen zur automatischen Synchronisierung von Audio und Text (sogenanntes Forced Alignment)
★ 2.862-1Sterne-Änderung der letzten 7 Tage - #30
Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten
★ 2.841+2Sterne-Änderung der letzten 7 Tage