voice-recognition
Erfasste Open-Source-Repos mit dem Tag voice-recognition, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit voice-recognition am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit voice-recognition getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Offline-Spracherkennungs-API für Android, iOS, Raspberry Pi und Server mit Python, Java, C# und Node.
★ 15.101+22Sterne-Änderung der letzten 7 Tage - #2
Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.
★ 12.676+6Sterne-Änderung der letzten 7 Tage - #3
Ein PyTorch-basiertes Speech-Toolkit
★ 11.802+17Sterne-Änderung der letzten 7 Tage - #4
Sprach-zu-Text, Absichtserkennung (Intent Recognition) und Text-zu-Sprache mit sehr geringer Latenz zum Erstellen von Sprachagenten und -schnittstellen
★ 10.997+53Sterne-Änderung der letzten 7 Tage - #5
Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene
★ 10.112+48Sterne-Änderung der letzten 7 Tage - #6
Eine Fast-Echtzeit-Implementierung von OpenAI Whisper.
★ 4.246+5Sterne-Änderung der letzten 7 Tage - #7
Funktionsreiche chinesische Zeichen-Bibliothek (Pinyin, Striche, Radikale, Redewendungen, Sprache, Visualisierung usw.)
★ 3.087+4Sterne-Änderung der letzten 7 Tage - #8
🐸STT – Das Deep-Learning-Toolkit für Speech-to-Text. Das Trainieren und Bereitstellen von STT-Modellen war noch nie so einfach.
★ 2.606+0Sterne-Änderung der letzten 7 Tage - #9
Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig
★ 2.256+8Sterne-Änderung der letzten 7 Tage - #10
🔊 Eine umfassende Liste von Open-Source-Datensätzen für Sprach- und Sound-Computing (über 95 Datensätze).
★ 2.223+1Sterne-Änderung der letzten 7 Tage - #11
💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien
★ 1.399+0Sterne-Änderung der letzten 7 Tage - #12
Dieses Projekt verwendet eine Vielzahl fortgeschrittener Stimmabdruck-Erkennungsmodelle wie EcapaTdnn, ResNetSE, ERes2Net, CAM++ usw. Die Unterstützung weiterer Modelle in der Zukunft ist nicht ausgeschlossen. Gleichzeitig unterstützt dieses Projekt auch MelSpectrogram- und Spectrogram-Datenvorverarbeitungsmethoden
★ 1.313+1Sterne-Änderung der letzten 7 Tage - #13
Python-KI-Assistent 🧠
★ 1.014+0Sterne-Änderung der letzten 7 Tage - #14
Captain's Log und 3D-Sternenkarte für Elite Dangerous
★ 898+0Sterne-Änderung der letzten 7 Tage - #15★ 711+1Sterne-Änderung der letzten 7 Tage
- #16
Voicetypr – KI-gestütztes, offlineeres Spracherkennungs-Diktiergerät für vielbeschäftigte Gründer, Vibe-Coder und Power-User auf macOS und Windows. Eine Alternative zu Wispr Flow und Superwhisper.
★ 707+10Sterne-Änderung der letzten 7 Tage - #17
Speech-to-Text-Benchmark-Framework
★ 697+0Sterne-Änderung der letzten 7 Tage - #18
Spracherkennung für React-Native-Expo-Projekte
★ 676+6Sterne-Änderung der letzten 7 Tage - #19★ 671+0Sterne-Änderung der letzten 7 Tage
- #20
:speech_balloon: /so.nus/ STT (Speech-to-Text) für Node mit Offline-Hotword-Erkennung
★ 638+0Sterne-Änderung der letzten 7 Tage - #21
Echtzeit-Audioübersetzung, die System-Audio und Mikrofon erfasst, ASR (Whisper/SenseVoice) ausführt und via LLM-API mit Streaming-Anzeige übersetzt. Ideal für VTuber, Livestreamer und das Ansehen fremdsprachiger Inhalte.
★ 621+18Sterne-Änderung der letzten 7 Tage - #22
Echtzeit-Transkription mit faster-whisper
★ 614+0Sterne-Änderung der letzten 7 Tage - #23
Ein Overlay, das die Mikrofonberechtigung des Benutzers abfragt und Spracheingaben in einer anpassbaren Benutzeroberfläche als Text ausgibt.
★ 557+0Sterne-Änderung der letzten 7 Tage