automatic-speech-recognition
Erfasste Open-Source-Repos mit dem Tag automatic-speech-recognition, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit automatic-speech-recognition am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit automatic-speech-recognition getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Echtzeit-Sprach-zu-Text (lokal) mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.
★ 10.974+75Sterne-Änderung der letzten 7 Tage - #2★ 5.228+4Sterne-Änderung der letzten 7 Tage
- #3
OpenAI Whisper ASR Webservice API
★ 3.327+2Sterne-Änderung der letzten 7 Tage - #4
[AutoArk] GPA (General Purpose Audio) kann ASR, TTS und Sprachkonvertierung mit einem einzigen kleinen Modell durchführen!
★ 3.023+305Sterne-Änderung der letzten 7 Tage - #5
Modernste CoreML-Audiomodelle in Ihren Apps — Text-to-Speech, Speech-to-Text, Spracherkennung und Sprecherdiarisierung. In Swift, angetrieben von SOTA Open Source.
★ 2.721+40Sterne-Änderung der letzten 7 Tage - #6
🐸STT – Das Deep-Learning-Toolkit für Speech-to-Text. Das Trainieren und Bereitstellen von STT-Modellen war noch nie so einfach.
★ 2.605+1Sterne-Änderung der letzten 7 Tage - #7
Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig
★ 2.253+4Sterne-Änderung der letzten 7 Tage - #8
Open-Source-ASR-Modelle in Industriequalität, die Mandarin, chinesische Dialekte und Englisch unterstützen. Sie erreichen einen neuen SOTA-Standard auf öffentlichen Mandarin-ASR-Benchmarks und bieten zudem eine hervorragende Erkennung von Liedtexten.
★ 1.975+9Sterne-Änderung der letzten 7 Tage - #9
:zap: TensorFlowASR: Fast dem Stand der Technik entsprechende automatische Spracherkennung in Tensorflow 2. Unterstützte Sprachen, die Zeichen oder Subwörter verwenden können
★ 1.010+0Sterne-Änderung der letzten 7 Tage - #10
Evaluieren Sie Ihr Speech-to-Text-System mit Ähnlichkeitsmaßen wie der Word Error Rate (WER)
★ 926+3Sterne-Änderung der letzten 7 Tage - #11
Sammlung von Ressourcen zu Anwendungen von Large Language Models (LLMs) in der Audio-KI.
★ 737+0Sterne-Änderung der letzten 7 Tage - #12
Offline-Spracherkennung mit OpenAI Whisper und TensorFlow Lite für Android
★ 688+0Sterne-Änderung der letzten 7 Tage - #13★ 671+0Sterne-Änderung der letzten 7 Tage
- #14
Ein industrietaugliches All-in-One-ASR-System auf dem neuesten Stand der Technik mit ASR-, VAD-, LID- und Punc-Modulen. FireRedASR2 unterstützt Chinesisch (Mandarin, über 20 Dialekte/Akzente), Englisch, Code-Switching sowie Sprache- und Gesangs-ASR. FireRedVAD unterstützt Sprache/Gesang/Musik in über 100 Sprachen. FireRedLID unterstützt über 100 Sprachen und über 20 chinesische Dialekte. FireRedPunc unterstützt Chinesisch und Englisch.
★ 664+7Sterne-Änderung der letzten 7 Tage