Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech

speech

Erfasste Open-Source-Repos mit dem Tag speech, sortiert nach Sternen.

Repos
72
Sterne gesamt
379.232
Sterne im Schnitt
5.267
Anteil
0,02%

Themen, die häufig gemeinsam mit speech am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit speech getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • TTS@coqui-ai

    🐸💬 - ein Deep-Learning-Toolkit für Text‑zu‑Sprache, erprobt in Forschung und Produktion

    45.967+36Sterne-Änderung der letzten 7 Tage
  • MockingBird@babysor

    🚀Eine Stimme in 5 Sekunden klonen, um beliebiges Speech in Echtzeit zu erzeugen.

    36.912-1Sterne-Änderung der letzten 7 Tage
  • VoxCPM@OpenBMB

    File Browser bietet eine Datei‑Verwaltungs‑Schnittstelle in einem angegebenen Verzeichnis und ermöglicht das Hochladen, Löschen, Vorschauen und Bearbeiten von Dateien.

    36.250+293Sterne-Änderung der letzten 7 Tage
  • whisperX@m-bain

    WhisperX: Automatisches Spracherkennungs‑System mit Wort‑genauen Zeitstempeln (& Diarization)

    23.803+117Sterne-Änderung der letzten 7 Tage
  • datasets@huggingface

    🤗 Der größte Hub für einsatzbereite Datensätze für KI-Modelle mit schnellen, benutzerfreundlichen und effizienten Datenbearbeitungswerkzeugen

    21.878+34Sterne-Änderung der letzten 7 Tage
  • Grounded-Segment-Anything@IDEA-Research

    Grounded SAM: Verknüpfung von Grounding DINO mit Segment Anything, Stable Diffusion und Recognize Anything – automatisches Erkennen, Segmentieren und Generieren von Inhalten

    17.713+3Sterne-Änderung der letzten 7 Tage
  • kaldi@kaldi-asr

    kaldi-asr/kaldi ist der offizielle Ort des Kaldi-Projekts.

    15.471+7Sterne-Änderung der letzten 7 Tage
  • speech-to-speech@huggingface

    Erstellen Sie Sprachagenten mit Open-Source-Modellen

    12.933+180Sterne-Änderung der letzten 7 Tage
  • AudioGPT@AIGC-Audio

    AudioGPT: Verstehen und Generieren von Sprache, Musik, Sound und Sprechköpfen

    10.166-2Sterne-Änderung der letzten 7 Tage
  • silero-vad@snakers4

    Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene

    10.083+52Sterne-Änderung der letzten 7 Tage
  • modelscope@modelscope

    ModelScope: Das Konzept von Model-as-a-Service zum Leben erwecken.

    9.117+19Sterne-Änderung der letzten 7 Tage
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Eine Multi-Voice- und Prompt-gesteuerte TTS-Engine

    8.523+2Sterne-Änderung der letzten 7 Tage
  • models@PaddlePaddle

    Offiziell gewartet und unterstützt von PaddlePaddle, umfasst CV, NLP, Speech, Rec, TS, große Modelle und mehr.

    6.932+0Sterne-Änderung der letzten 7 Tage
  • annyang@TalAter

    💬 Spracherkennung für Ihre Website

    6.816+1Sterne-Änderung der letzten 7 Tage
  • silero-models@snakers4

    Silero Models: Vorab trainierte Text-to-Speech-Modelle, denkbar einfach gestaltet

    6.085+11Sterne-Änderung der letzten 7 Tage
  • cactus@cactus-compute

    Quantisierung, Kernels, Laufzeit und Inferenz-Engine für Mobilgeräte, Wearables, Smart Home und Roboter.

    5.955+71Sterne-Änderung der letzten 7 Tage
  • whisper-diarization@MahmoudAshraf97

    Automatische Spracherkennung mit Sprecher-Diarisierung basierend auf OpenAI Whisper

    5.633+7Sterne-Änderung der letzten 7 Tage
  • stt@jianchang512

    Spracherkennungstool für Text / Ein lokal laufendes Offline-Tool zur Audio- und Video-Untertitelung, das JSON-, SRT- und Reintextformate ausgibt.

    4.771+7Sterne-Änderung der letzten 7 Tage
  • DeepFilterNet@Rikorose

    Rauschunterdrückung mittels Deep Filtering

    4.636+14Sterne-Änderung der letzten 7 Tage
  • ultravox@fixie-ai

    Ein schnelles multimodales LLM für Echtzeit-Sprache

    4.556+7Sterne-Änderung der letzten 7 Tage
  • ClearerVoice-Studio@modelscope

    Ein KI-gestütztes Toolkit zur Sprachverarbeitung und Open-Source-SOTA-Vortrainierte Modelle zur Unterstützung von Sprachverbesserung, -trennung und Zielsprecher-Extraktion etc.

    4.449+19Sterne-Änderung der letzten 7 Tage
  • metavoice-src@metavoiceio

    Grundlegendes Modell für menschenähnliches, expressives TTS

    4.204-1Sterne-Änderung der letzten 7 Tage
  • Amazing-Python-Scripts@avinashkranjan

    🚀 Kuratierte Sammlung fantastischer Python-Skripte von den Grundlagen bis zum Fortgeschrittenen mit Automatisierungs-Skripten.

    3.663+5Sterne-Änderung der letzten 7 Tage
  • Applio@IAHispano

    Ein einfaches, hochwertiges Sprachkonvertierungstool mit Fokus auf Benutzerfreundlichkeit und Leistung.

    3.660+39Sterne-Änderung der letzten 7 Tage
  • OpenAI Whisper ASR Webservice API

    3.326+2Sterne-Änderung der letzten 7 Tage
  • iOS-10-Sampler@shu223

    Codebeispiele für neue APIs von iOS 10.

    3.273-2Sterne-Änderung der letzten 7 Tage
  • audio@pytorch

    Datenmanipulation und -transformation für die Audiosignalverarbeitung, unterstützt durch PyTorch

    2.931+6Sterne-Änderung der letzten 7 Tage
  • lingvo@tensorflow

    Lingvo

    2.864+0Sterne-Änderung der letzten 7 Tage
  • aeneas@readbeyond

    aeneas ist eine Python/C-Bibliothek und eine Reihe von Werkzeugen zur automatischen Synchronisierung von Audio und Text (sogenanntes Forced Alignment)

    2.862-1Sterne-Änderung der letzten 7 Tage
  • whisper-timestamped@linto-ai

    Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten

    2.841+2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen