Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-recognition

speech-recognition

Erfasste Open-Source-Repos mit dem Tag speech-recognition, sortiert nach Sternen.

156 Repos
  • whisper-jax@sanchit-gandhi

    JAX-Implementierung des Whisper-Modells von OpenAI für eine bis zu 70-fache Beschleunigung auf TPUs.

    4.679-1Sterne-Änderung der letzten 7 Tage
  • pocketsphinx@cmusphinx

    Ein kleiner Spracherkenner

    4.337+2Sterne-Änderung der letzten 7 Tage
  • distil-whisper@huggingface

    Kompaktversion von Whisper für Spracherkennung. 6x schneller, 50% kleiner, mit einer Wortfehlerrate von unter 1%.

    4.114+2Sterne-Änderung der letzten 7 Tage
  • OpenAI Whisper ASR Webservice API

    3.328+2Sterne-Änderung der letzten 7 Tage
  • Whisper & Faster-Whisper Standalone-Executables für alle, die sich nicht mit Python herumschlagen möchten.

    3.171+2Sterne-Änderung der letzten 7 Tage
  • willow@HeyWillow

    Open-Source-, lokale und selbst gehostete Sprachassistenten-Alternative als Konkurrenz zu Amazon Echo/Google Home

    3.101+1Sterne-Änderung der letzten 7 Tage
  • whishper@pluja

    Transkribieren Sie jegliches Audio in Text, übersetzen und bearbeiten Sie Untertitel 100% lokal mit einer Web-Benutzeroberfläche. Unterstützt durch Whisper-Modelle!

    3.068+2Sterne-Änderung der letzten 7 Tage
  • lingvo@tensorflow

    Lingvo

    2.864+0Sterne-Änderung der letzten 7 Tage
  • whisper-timestamped@linto-ai

    Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten

    2.842+1Sterne-Änderung der letzten 7 Tage
  • STT@coqui-ai

    🐸STT – Das Deep-Learning-Toolkit für Speech-to-Text. Das Trainieren und Bereitstellen von STT-Modellen war noch nie so einfach.

    2.606+1Sterne-Änderung der letzten 7 Tage
  • qwen-audio-agent@QwenAudio

    Eine Echtzeit-Sprachlaufzeitumgebung für KI-Agenten, die sie im Gespräch und aktiv hält.

    2.362+72Sterne-Änderung der letzten 7 Tage
  • 🎙 Spracherkennung mit dem Deep-Learning-Framework TensorFlow und Sequence-to-Sequence-neuronalen Netzen

    2.173+0Sterne-Änderung der letzten 7 Tage
  • parlor@fikrikarim

    On-Device, multimodale Echtzeit-KI mit ähnlichen Funktionen wie GPT-Live

    2.048+7Sterne-Änderung der letzten 7 Tage
  • FireRedASR@FireRedTeam

    Open-Source-ASR-Modelle in Industriequalität, die Mandarin, chinesische Dialekte und Englisch unterstützen. Sie erreichen einen neuen SOTA-Standard auf öffentlichen Mandarin-ASR-Benchmarks und bieten zudem eine hervorragende Erkennung von Liedtexten.

    1.975+2Sterne-Änderung der letzten 7 Tage
  • masr@nobody132

    Chinesische Spracherkennung; Mandarin Automatic Speech Recognition;

    1.968+0Sterne-Änderung der letzten 7 Tage
  • julius@julius-speech

    Open-Source-Engine für kontinuierliche Spracherkennung mit großem Vokabular

    1.935+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von großartigen Arbeiten, Bibliotheken, Datensätzen und anderen Ressourcen zur Sprecherdiarisierung.

    1.894+1Sterne-Änderung der letzten 7 Tage
  • alan-sdk-ios@alan-ai

    Das selbstkodierende System für Ihre App — Alan AI SDK für iOS

    1.878-3Sterne-Änderung der letzten 7 Tage
  • Das selbstkodierende System für Ihre App — Alan AI SDK für Android

    1.807-1Sterne-Änderung der letzten 7 Tage
  • whisper-turbo@FL33TW00D

    Plattformübergreifendes, GPU-beschleunigtes Whisper 🏎️

    1.794+0Sterne-Änderung der letzten 7 Tage
  • sherpa-ncnn@k2-fsa

    Echtzeit-Spracherkennung und Spracherkennungs-Erkennung (VAD) mit der nächsten Generation von Kaldi und ncnn ohne Internetverbindung. Unterstützt iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A usw.

    1.777-1Sterne-Änderung der letzten 7 Tage
  • Das Self-Coding-System für Ihre App — Alan AI SDK für Flutter

    1.756-1Sterne-Änderung der letzten 7 Tage
  • alan-sdk-ionic@alan-ai

    Das Self-Coding-System für Ihre App — Alan AI SDK für Ionic

    1.649-1Sterne-Änderung der letzten 7 Tage
  • dsnote@mkiol

    Speech Note Linux-App. Notizen erstellen, lesen und übersetzen mit Offline-Spracherkennung (Speech-to-Text), Sprachsynthese (Text-to-Speech) und maschineller Übersetzung.

    1.622+8Sterne-Änderung der letzten 7 Tage
  • OBS-Plugin für lokale Spracherkennung und Untertitelung mittels KI

    1.597+8Sterne-Änderung der letzten 7 Tage
  • amica@semperai

    Amica ist eine Open-Source-Schnittstelle für die interaktive Kommunikation mit 3D-Charakteren inklusive Sprachsynthese und Spracherkennung.

    1.591-2Sterne-Änderung der letzten 7 Tage
  • Benutzerdefinierte Nodes, die die Funktionen von ComfyUI erweitern

    1.525+1Sterne-Änderung der letzten 7 Tage
  • SALMONN@bytedance

    SALMONN-Familie: Eine Suite fortschrittlicher multimodaler LLMs

    1.521+3Sterne-Änderung der letzten 7 Tage
  • Fun-ASR@QwenAudio

    Open-Source-LLM-basiertes ASR-Modellfamilie für Chinesisch, Dialekte, Akzente und mehrsprachige Sprache, mit FunASR, vLLM, Streaming- und llama.cpp-Runtimes.

    1.512+10Sterne-Änderung der letzten 7 Tage
  • SpeechT5@microsoft

    Einheitliches multimodales Sprach-Text-Pre-Training für die Sprachverarbeitung

    1.449+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen