speech-recognition
Erfasste Open-Source-Repos mit dem Tag speech-recognition, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit speech-recognition am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit speech-recognition getaggt wurden.
- #1
Eine Echtzeit-Sprachlaufzeitumgebung für KI-Agenten, die sie im Gespräch und aktiv hält.
★ 2.362 - #2
Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription
★ 540 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501 - #4
早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.
★ 327
- #1
🤗 Transformers: das Framework zur Modelldefinition für state-of-the-art Machine Learning Modelle in Text, Vision, Audio und multimodale Modelle, sowohl für Inferenz als auch für Training.
★ 164.731+119Sterne-Änderung der letzten 7 Tage - #2
Port des Whisper-Modells von OpenAI in C/C++
★ 53.389+103Sterne-Änderung der letzten 7 Tage - #3
Schnellere Whisper-Transkription mit CTranslate2
★ 25.206+71Sterne-Änderung der letzten 7 Tage - #4
WhisperX: Automatisches Spracherkennungs‑System mit Wort‑genauen Zeitstempeln (& Diarization)
★ 23.864+61Sterne-Änderung der letzten 7 Tage - #5
Open-Source-Spracherkennungs-Toolkit für Training, Inferenz, Streaming-ASR, VAD, Interpunktion, Sprecherdiarisierungs-Pipelines und OpenAI-kompatibles/MCP-Serving.
★ 20.136+64Sterne-Änderung der letzten 7 Tage - #6★ 17.476+1Sterne-Änderung der letzten 7 Tage
- #7★ 15.474+3Sterne-Änderung der letzten 7 Tage
- #8
Offline-Spracherkennungs-API für Android, iOS, Raspberry Pi und Server mit Python, Java, C# und Node.
★ 15.101+17Sterne-Änderung der letzten 7 Tage - #9
Modernste Deep-Learning-Skripte, organisiert nach Modellen – einfach zu trainieren und bereitzustellen mit reproduzierbarer Genauigkeit und Leistung auf Infrastruktur für den Unternehmenseinsatz.
★ 14.846+4Sterne-Änderung der letzten 7 Tage - #10
Tauchen Sie ein in Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision und NLP anhand dieser spannenden Vorlesungen!
★ 12.939+3Sterne-Änderung der letzten 7 Tage - #11
Gradio WebUI für Creator und Entwickler mit wichtigen TTS-Funktionen (Edge-TTS, kokoro) und Zero-Shot Voice Cloning (E2 & F5-TTS, CosyVoice), inklusive Whisper-Audioverarbeitung, YouTube-Download, Demucs-Gesangsisolierung und mehrsprachiger Übersetzung.
★ 12.730+54Sterne-Änderung der letzten 7 Tage - #12
Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.
★ 12.676+5Sterne-Änderung der letzten 7 Tage - #13
Ein PyTorch-basiertes Speech-Toolkit
★ 11.802+10Sterne-Änderung der letzten 7 Tage - #14
Echtzeit-Sprach-zu-Text (lokal) mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.
★ 10.990+16Sterne-Änderung der letzten 7 Tage - #15
OpenVINO™ ist ein Open-Source-Toolkit zur Optimierung und Bereitstellung von KI-Inferenz
★ 10.793+30Sterne-Änderung der letzten 7 Tage - #16★ 9.949+3Sterne-Änderung der letzten 7 Tage
- #17
Open-Source-Modell SenseVoiceSmall für ASR in Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch, Spracherkennung, Emotionserkennung und Audio-Ereigniserkennung.
★ 9.209+37Sterne-Änderung der letzten 7 Tage - #18
Spracherkennungsmodul für Python, das verschiedene Engines und APIs unterstützt, sowohl online als auch offline.
★ 8.987+0Sterne-Änderung der letzten 7 Tage - #19
Ein auf Deep Learning basierendes chinesisches Spracherkennungssystem
★ 8.386+0Sterne-Änderung der letzten 7 Tage - #20
Eine auf Apples MLX-Framework basierende Text-to-Speech (TTS)-, Speech-to-Text (STT)- und Speech-to-Speech (STS)-Bibliothek für effiziente Sprachanalyse auf Apple Silicon.
★ 7.826+23Sterne-Änderung der letzten 7 Tage - #21★ 6.815-1Sterne-Änderung der letzten 7 Tage
- #22
Toolkit für automatische Spracherkennung der Facebook AI Research
★ 6.437+1Sterne-Änderung der letzten 7 Tage - #23
On-Device-Sprach-KI für Apple Silicon
★ 6.353+8Sterne-Änderung der letzten 7 Tage - #24★ 6.254+3Sterne-Änderung der letzten 7 Tage
- #25
Ein auf FunASR basierendes Tool für Videotranskription, Untertitelgenerierung und LLM-gestützten Schnitt mit lokaler Gradio-Benutzeroberfläche.
★ 6.210+13Sterne-Änderung der letzten 7 Tage - #26
Automatische Spracherkennung mit Sprecher-Diarisierung basierend auf OpenAI Whisper
★ 5.634+1Sterne-Änderung der letzten 7 Tage - #27★ 5.229+1Sterne-Änderung der letzten 7 Tage
- #28★ 4.928+3Sterne-Änderung der letzten 7 Tage
- #29★ 4.927+5Sterne-Änderung der letzten 7 Tage
- #30
Spracherkennungstool für Text / Ein lokal laufendes Offline-Tool zur Audio- und Video-Untertitelung, das JSON-, SRT- und Reintextformate ausgibt.
★ 4.780+9Sterne-Änderung der letzten 7 Tage