Zum Hauptinhalt springen
buildradar
Sign in
Thema · voice-recognition

voice-recognition

Erfasste Open-Source-Repos mit dem Tag voice-recognition, sortiert nach Sternen.

Repos
23
Sterne gesamt
85.588
Sterne im Schnitt
3.721
Anteil
0,00%

Themen, die häufig gemeinsam mit voice-recognition am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit voice-recognition getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • vosk-api@alphacep

    Offline-Spracherkennungs-API für Android, iOS, Raspberry Pi und Server mit Python, Java, C# und Node.

    15.101+22Sterne-Änderung der letzten 7 Tage
  • PaddleSpeech@PaddlePaddle

    Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.

    12.676+6Sterne-Änderung der letzten 7 Tage
  • speechbrain@speechbrain

    Ein PyTorch-basiertes Speech-Toolkit

    11.802+17Sterne-Änderung der letzten 7 Tage
  • moonshine@moonshine-ai

    Sprach-zu-Text, Absichtserkennung (Intent Recognition) und Text-zu-Sprache mit sehr geringer Latenz zum Erstellen von Sprachagenten und -schnittstellen

    10.997+53Sterne-Änderung der letzten 7 Tage
  • silero-vad@snakers4

    Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene

    10.112+48Sterne-Änderung der letzten 7 Tage
  • WhisperLive@collabora

    Eine Fast-Echtzeit-Implementierung von OpenAI Whisper.

    4.246+5Sterne-Änderung der letzten 7 Tage
  • cnchar@theajack

    Funktionsreiche chinesische Zeichen-Bibliothek (Pinyin, Striche, Radikale, Redewendungen, Sprache, Visualisierung usw.)

    3.087+4Sterne-Änderung der letzten 7 Tage
  • STT@coqui-ai

    🐸STT – Das Deep-Learning-Toolkit für Speech-to-Text. Das Trainieren und Bereitstellen von STT-Modellen war noch nie so einfach.

    2.606+0Sterne-Änderung der letzten 7 Tage
  • ten-vad@TEN-framework

    Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig

    2.256+8Sterne-Änderung der letzten 7 Tage
  • voice_datasets@jim-schwoebel

    🔊 Eine umfassende Liste von Open-Source-Datensätzen für Sprach- und Sound-Computing (über 95 Datensätze).

    2.223+1Sterne-Änderung der letzten 7 Tage
  • 💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien

    1.399+0Sterne-Änderung der letzten 7 Tage
  • Dieses Projekt verwendet eine Vielzahl fortgeschrittener Stimmabdruck-Erkennungsmodelle wie EcapaTdnn, ResNetSE, ERes2Net, CAM++ usw. Die Unterstützung weiterer Modelle in der Zukunft ist nicht ausgeschlossen. Gleichzeitig unterstützt dieses Projekt auch MelSpectrogram- und Spectrogram-Datenvorverarbeitungsmethoden

    1.313+1Sterne-Änderung der letzten 7 Tage
  • Python-KI-Assistent 🧠

    1.014+0Sterne-Änderung der letzten 7 Tage
  • EDDiscovery@EDDiscovery

    Captain's Log und 3D-Sternenkarte für Elite Dangerous

    898+0Sterne-Änderung der letzten 7 Tage
  • rhino@Picovoice

    Auf Deep Learning basierende On-Device-Speech-to-Intent-Engine

    711+1Sterne-Änderung der letzten 7 Tage
  • voicetypr@moinulmoin

    Voicetypr – KI-gestütztes, offlineeres Spracherkennungs-Diktiergerät für vielbeschäftigte Gründer, Vibe-Coder und Power-User auf macOS und Windows. Eine Alternative zu Wispr Flow und Superwhisper.

    707+10Sterne-Änderung der letzten 7 Tage
  • Speech-to-Text-Benchmark-Framework

    697+0Sterne-Änderung der letzten 7 Tage
  • Spracherkennung für React-Native-Expo-Projekte

    676+6Sterne-Änderung der letzten 7 Tage
  • cheetah@Picovoice

    Auf Deep Learning basierende On-Device-Streaming-Speech-to-Text-Engine

    671+0Sterne-Änderung der letzten 7 Tage
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (Speech-to-Text) für Node mit Offline-Hotword-Erkennung

    638+0Sterne-Änderung der letzten 7 Tage
  • LiveTranslate@TheDeathDragon

    Echtzeit-Audioübersetzung, die System-Audio und Mikrofon erfasst, ASR (Whisper/SenseVoice) ausführt und via LLM-API mit Streaming-Anzeige übersetzt. Ideal für VTuber, Livestreamer und das Ansehen fremdsprachiger Inhalte.

    621+18Sterne-Änderung der letzten 7 Tage
  • speech-to-text@reriiasu

    Echtzeit-Transkription mit faster-whisper

    614+0Sterne-Änderung der letzten 7 Tage
  • Ein Overlay, das die Mikrofonberechtigung des Benutzers abfragt und Spracheingaben in einer anpassbaren Benutzeroberfläche als Text ausgibt.

    557+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen