vad
Erfasste Open-Source-Repos mit dem Tag vad, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit vad am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit vad getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene
★ 10.112+48Sterne-Änderung der letzten 7 Tage - #2★ 7.864+10Sterne-Änderung der letzten 7 Tage
- #3
faster_whisper GUI mit PySide6
★ 2.995+4Sterne-Änderung der letzten 7 Tage - #4
Modernste CoreML-Audiomodelle in Ihren Apps — Text-to-Speech, Speech-to-Text, Spracherkennung und Sprecherdiarisierung. In Swift, angetrieben von SOTA Open Source.
★ 2.723+22Sterne-Änderung der letzten 7 Tage - #5
Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig
★ 2.256+8Sterne-Änderung der letzten 7 Tage - #6
Echtzeit-Spracherkennung und Spracherkennungs-Erkennung (VAD) mit der nächsten Generation von Kaldi und ncnn ohne Internetverbindung. Unterstützt iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A usw.
★ 1.777-2Sterne-Änderung der letzten 7 Tage - #7
Whisper.net. Spracherkennung leicht gemacht mit Whisper Modellen.
★ 941+2Sterne-Änderung der letzten 7 Tage - #8★ 860+1Sterne-Änderung der letzten 7 Tage
- #9
Ein industrietaugliches All-in-One-ASR-System auf dem neuesten Stand der Technik mit ASR-, VAD-, LID- und Punc-Modulen. FireRedASR2 unterstützt Chinesisch (Mandarin, über 20 Dialekte/Akzente), Englisch, Code-Switching sowie Sprache- und Gesangs-ASR. FireRedVAD unterstützt Sprache/Gesang/Musik in über 100 Sprachen. FireRedLID unterstützt über 100 Sprachen und über 20 chinesische Dialekte. FireRedPunc unterstützt Chinesisch und Englisch.
★ 669+10Sterne-Änderung der letzten 7 Tage - #10
Eine optimierte Speech-to-Text-Pipeline für das Whisper-Modell mit Unterstützung für mehrere Inferenz-Engines
★ 578+1Sterne-Änderung der letzten 7 Tage - #11
ICASSP 2023-2024 Papers: Eine vollständige Sammlung einflussreicher und spannender Forschungsarbeiten der ICASSP 2023-24 Konferenzen. Entdecken Sie die neuesten Fortschritte in Akustik, Sprach- und Signalverarbeitung. Inklusive Code.
★ 526+0Sterne-Änderung der letzten 7 Tage - #12
Eine industrielle SOTA-Lösung zur Spracherkennungs- und Audioereigniserkennung, die über 100 Sprachen unterstützt und Silero-VAD, TEN-VAD, FunASR-VAD sowie WebRTC-VAD übertrifft.
★ 519+8Sterne-Änderung der letzten 7 Tage - #13
Android-Bibliothek für Voice Activity Detection (VAD). Unterstützt WebRTC VAD GMM, Silero VAD DNN und Yamnet VAD DNN Modelle.
★ 506+1Sterne-Änderung der letzten 7 Tage