Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-recognition

speech-recognition

Erfasste Open-Source-Repos mit dem Tag speech-recognition, sortiert nach Sternen.

156 Repos
  • adapt@MycroftAI

    Adapt Intent Parser

    719+0Sterne-Änderung der letzten 7 Tage
  • curses@mmpneo

    Sprach-zu-Text- und KB-Eingabe-Untertitel für OBS, VRChat, Twitch-Chat und Discord

    718+0Sterne-Änderung der letzten 7 Tage
  • openspeech@openspeech-team

    Open-Source-Toolkit für End-to-End-Spracherkennung unter Verwendung von PyTorch-Lightning und Hydra.

    714+0Sterne-Änderung der letzten 7 Tage
  • rhino@Picovoice

    Auf Deep Learning basierende On-Device-Speech-to-Intent-Engine

    712+3Sterne-Änderung der letzten 7 Tage
  • speech-demo@Baidu-AIP

    Sprach-API-Beispiele

    708+0Sterne-Änderung der letzten 7 Tage
  • Speech-to-Text-Benchmark-Framework

    697+0Sterne-Änderung der letzten 7 Tage
  • Offline-Spracherkennung mit OpenAI Whisper und TensorFlow Lite für Android

    688+0Sterne-Änderung der letzten 7 Tage
  • INTERSPEECH 2023-2024 Papers: Eine vollständige Sammlung einflussreicher und spannender Forschungspapiere der INTERSPEECH 2023-24 Konferenz. Entdecken Sie die neuesten Fortschritte in der Sprach- und Textverarbeitung. Code enthalten. Sternen Sie das Repository, um den Fortschritt der Sprachtechnologie zu unterstützen!

    684+0Sterne-Änderung der letzten 7 Tage
  • Ein kostenloser Audiodatensatz gesprochener Ziffern. Eine Audio-Version von MNIST.

    678+0Sterne-Änderung der letzten 7 Tage
  • Spracherkennung für React-Native-Expo-Projekte

    678+6Sterne-Änderung der letzten 7 Tage
  • FireRedASR2S@FireRedTeam

    Ein industrietaugliches All-in-One-ASR-System auf dem neuesten Stand der Technik mit ASR-, VAD-, LID- und Punc-Modulen. FireRedASR2 unterstützt Chinesisch (Mandarin, über 20 Dialekte/Akzente), Englisch, Code-Switching sowie Sprache- und Gesangs-ASR. FireRedVAD unterstützt Sprache/Gesang/Musik in über 100 Sprachen. FireRedLID unterstützt über 100 Sprachen und über 20 chinesische Dialekte. FireRedPunc unterstützt Chinesisch und Englisch.

    672+13Sterne-Änderung der letzten 7 Tage
  • cheetah@Picovoice

    Auf Deep Learning basierende On-Device-Streaming-Speech-to-Text-Engine

    671+0Sterne-Änderung der letzten 7 Tage
  • hear@sveinbjornt

    Befehlszeilenschnittstelle für die integrierten Spracherkennungs- und Transkriptionsfunktionen in macOS.

    669+0Sterne-Änderung der letzten 7 Tage
  • gpt-home@judahpaul16

    ChatGPT zu Hause! Eine bessere Alternative zu kommerziellen Smart-Home-Assistenten, basierend auf dem Raspberry Pi mit LiteLLM und LangGraph.

    648+1Sterne-Änderung der letzten 7 Tage
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (Speech-to-Text) für Node mit Offline-Hotword-Erkennung

    638+0Sterne-Änderung der letzten 7 Tage
  • whisperIME@woheller69

    Android Input Method Editor (IME) basierend auf Whisper

    633+6Sterne-Änderung der letzten 7 Tage
  • LiveTranslate@TheDeathDragon

    Echtzeit-Audioübersetzung, die System-Audio und Mikrofon erfasst, ASR (Whisper/SenseVoice) ausführt und via LLM-API mit Streaming-Anzeige übersetzt. Ideal für VTuber, Livestreamer und das Ansehen fremdsprachiger Inhalte.

    626+38Sterne-Änderung der letzten 7 Tage
  • speech-to-text@reriiasu

    Echtzeit-Transkription mit faster-whisper

    614+0Sterne-Änderung der letzten 7 Tage
  • CrispASR@CrispStrobe

    C++ ggml Runtime-Hub für mehrsprachige ASR- und TTS-Modelle: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 sowie universelles Forced Alignment und mehr.

    611+20Sterne-Änderung der letzten 7 Tage
  • CTCWordBeamSearch@githubharald

    Connectionist Temporal Classification (CTC)-Decoder mit Wörterbuch und Sprachmodell.

    580+1Sterne-Änderung der letzten 7 Tage
  • WhisperS2T@shashikg

    Eine optimierte Speech-to-Text-Pipeline für das Whisper-Modell mit Unterstützung für mehrere Inferenz-Engines

    578+1Sterne-Änderung der letzten 7 Tage
  • Das selbstkodierende System für Ihre App – Alan AI SDK für React Native.

    575+0Sterne-Änderung der letzten 7 Tage
  • VRCOSC@VolcanicArts

    Eine modulare Node-Programmiersprache, Programm-Editor, Animationssystem, Toolkit, Router und Debugger für VRChat.

    562-1Sterne-Änderung der letzten 7 Tage
  • Ein Overlay, das die Mikrofonberechtigung des Benutzers abfragt und Spracheingaben in einer anpassbaren Benutzeroberfläche als Text ausgibt.

    557+1Sterne-Änderung der letzten 7 Tage
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: eine große, robuste und umfassende Benchmarking-Plattform für automatische Spracherkennung.

    553+3Sterne-Änderung der letzten 7 Tage
  • Liste der STT-APIs für koreanische Spracherkennung inklusive Leistungsbenchmarks

    547+1Sterne-Änderung der letzten 7 Tage
  • Talkify@tornikegomareli

    Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription

    541+14Sterne-Änderung der letzten 7 Tage
  • CleanS2S@opendilab

    Hochwertiger, interaktiver Speech-to-Speech-Agent mit Streaming-Funktion in einer einzigen Datei.

    540+0Sterne-Änderung der letzten 7 Tage
  • parrots@shibing624

    Engine für automatische Spracherkennung (ASR) und Text-to-Speech (TTS). Unterstützt Chinesisch, Englisch und weitere Sprachen mit hoher Genauigkeit und Multi-Rollen-Sprachsynthese

    530+1Sterne-Änderung der letzten 7 Tage
  • vosk-browser@ccoreilly

    Eine Spracherkennungsbibliothek für den Browser, basierend auf einem WebAssembly-Build von Vosk.

    529+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen