speaker-diarization
Erfasste Open-Source-Repos mit dem Tag speaker-diarization, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit speaker-diarization am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit speaker-diarization getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Open-Source-Spracherkennungs-Toolkit für Training, Inferenz, Streaming-ASR, VAD, Interpunktion, Sprecherdiarisierungs-Pipelines und OpenAI-kompatibles/MCP-Serving.
★ 20.136+64Sterne-Änderung der letzten 7 Tage - #2
Ein PyTorch-basiertes Speech-Toolkit
★ 11.802+10Sterne-Änderung der letzten 7 Tage - #3
Echtzeit-Sprach-zu-Text (lokal) mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.
★ 10.990+16Sterne-Änderung der letzten 7 Tage - #4
Neuronale Bausteine für Speaker Diarization: Spracherkennungsaktivität, Sprecherwechselerkennung, Erkennung überlappender Sprache, Sprecher-Embedding
★ 10.500+16Sterne-Änderung der letzten 7 Tage - #5★ 9.949+3Sterne-Änderung der letzten 7 Tage
- #6
On-Device-Sprach-KI für Apple Silicon
★ 6.353+8Sterne-Änderung der letzten 7 Tage - #7
Automatische Spracherkennung mit Sprecher-Diarisierung basierend auf OpenAI Whisper
★ 5.634+1Sterne-Änderung der letzten 7 Tage - #8
Whisper & Faster-Whisper Standalone-Executables für alle, die sich nicht mit Python herumschlagen möchten.
★ 3.171+2Sterne-Änderung der letzten 7 Tage - #9
Ein Repository für unimodale und multimodale Sprecherverifizierung, Sprechererkennung und Sprecher-Diarisierung
★ 3.128+3Sterne-Änderung der letzten 7 Tage - #10
Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten
★ 2.842+1Sterne-Änderung der letzten 7 Tage - #11
Modernste CoreML-Audiomodelle in Ihren Apps — Text-to-Speech, Speech-to-Text, Spracherkennung und Sprecherdiarisierung. In Swift, angetrieben von SOTA Open Source.
★ 2.723+13Sterne-Änderung der letzten 7 Tage - #12★ 2.024+1Sterne-Änderung der letzten 7 Tage
- #13
Eine kuratierte Liste von großartigen Arbeiten, Bibliotheken, Datensätzen und anderen Ressourcen zur Sprecherdiarisierung.
★ 1.894+1Sterne-Änderung der letzten 7 Tage - #14
Open-Source-LLM-basiertes ASR-Modellfamilie für Chinesisch, Dialekte, Akzente und mehrsprachige Sprache, mit FunASR, vLLM, Streaming- und llama.cpp-Runtimes.
★ 1.512+10Sterne-Änderung der letzten 7 Tage - #15
Forschungs- und produktionsorientiertes Toolkit für Sprecherverifizierung, -erkennung und -diarisierung.
★ 1.402+8Sterne-Änderung der letzten 7 Tage - #16
KI-Sprach-Toolkit für Apple Silicon – ASR, TTS, Speech-to-Speech, VAD und Diarisierung, angetrieben durch MLX und CoreML
★ 1.161+4Sterne-Änderung der letzten 7 Tage - #17
schlüsselfertiger, selbstgehosteter Offline-Transkriptions- und Diarisierungsdienst mit LLM-Zusammenfassung
★ 948+2Sterne-Änderung der letzten 7 Tage - #18
Eine automatisierte All-in-One-Software zur Untertitelgenerierung, die Herunterladen, Transkription, Übersetzung und Hardcoding komplett ohne menschliches Eingreifen abdeckt.
★ 810+3Sterne-Änderung der letzten 7 Tage - #19★ 677+0Sterne-Änderung der letzten 7 Tage
- #20
Python-Implementierung der (eingeschränkten) Spektral-Clustering-Algorithmen aus Googles Forschungsarbeiten zur Sprecherdiarisierung
★ 555+0Sterne-Änderung der letzten 7 Tage