Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-recognition

speech-recognition

Erfasste Open-Source-Repos mit dem Tag speech-recognition, sortiert nach Sternen.

Repos
156
Sterne gesamt
675.280
Sterne im Schnitt
4.329
Anteil
0,04%

Themen, die häufig gemeinsam mit speech-recognition am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit speech-recognition getaggt wurden.

  • qwen-audio-agent@QwenAudio

    Eine Echtzeit-Sprachlaufzeitumgebung für KI-Agenten, die sie im Gespräch und aktiv hält.

    2.362
  • Talkify@tornikegomareli

    Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription

    540
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • hayamimi@oboroge0

    早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.

    327
  • transformers@huggingface

    🤗 Transformers: das Framework zur Modelldefinition für state-of-the-art Machine Learning Modelle in Text, Vision, Audio und multimodale Modelle, sowohl für Inferenz als auch für Training.

    164.731+119Sterne-Änderung der letzten 7 Tage
  • whisper.cpp@ggml-org

    Port des Whisper-Modells von OpenAI in C/C++

    53.389+103Sterne-Änderung der letzten 7 Tage
  • faster-whisper@SYSTRAN

    Schnellere Whisper-Transkription mit CTranslate2

    25.206+71Sterne-Änderung der letzten 7 Tage
  • whisperX@m-bain

    WhisperX: Automatisches Spracherkennungs‑System mit Wort‑genauen Zeitstempeln (& Diarization)

    23.864+61Sterne-Änderung der letzten 7 Tage
  • FunASR@modelscope

    Open-Source-Spracherkennungs-Toolkit für Training, Inferenz, Streaming-ASR, VAD, Interpunktion, Sprecherdiarisierungs-Pipelines und OpenAI-kompatibles/MCP-Serving.

    20.136+64Sterne-Änderung der letzten 7 Tage
  • leon@leon-ai

    🧠 Leon ist Ihr persönlicher Open-Source-Assistent.

    17.476+1Sterne-Änderung der letzten 7 Tage
  • kaldi@kaldi-asr

    kaldi-asr/kaldi ist der offizielle Ort des Kaldi-Projekts.

    15.474+3Sterne-Änderung der letzten 7 Tage
  • vosk-api@alphacep

    Offline-Spracherkennungs-API für Android, iOS, Raspberry Pi und Server mit Python, Java, C# und Node.

    15.101+17Sterne-Änderung der letzten 7 Tage
  • DeepLearningExamples@NVIDIA

    Modernste Deep-Learning-Skripte, organisiert nach Modellen – einfach zu trainieren und bereitzustellen mit reproduzierbarer Genauigkeit und Leistung auf Infrastruktur für den Unternehmenseinsatz.

    14.846+4Sterne-Änderung der letzten 7 Tage
  • Tauchen Sie ein in Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision und NLP anhand dieser spannenden Vorlesungen!

    12.939+3Sterne-Änderung der letzten 7 Tage
  • voice-pro@abus-aikorea

    Gradio WebUI für Creator und Entwickler mit wichtigen TTS-Funktionen (Edge-TTS, kokoro) und Zero-Shot Voice Cloning (E2 & F5-TTS, CosyVoice), inklusive Whisper-Audioverarbeitung, YouTube-Download, Demucs-Gesangsisolierung und mehrsprachiger Übersetzung.

    12.730+54Sterne-Änderung der letzten 7 Tage
  • PaddleSpeech@PaddlePaddle

    Benutzerfreundliches Speech Toolkit mit selbstüberwachtem Lernmodell, SOTA/Streaming-ASR mit Interpunktion, Streaming-TTS mit Text-Frontend, Sprecherverifizierungssystem, End-to-End-Sprachübersetzung und Keyword-Spotting. Gewinner des NAACL2022 Best Demo Award.

    12.676+5Sterne-Änderung der letzten 7 Tage
  • speechbrain@speechbrain

    Ein PyTorch-basiertes Speech-Toolkit

    11.802+10Sterne-Änderung der letzten 7 Tage
  • WhisperLiveKit@QuentinFuxa

    Echtzeit-Sprach-zu-Text (lokal) mit Streaming-ASR, Sprecher-Diarisierung, Übersetzung und OpenAI/Deepgram-kompatiblen APIs.

    10.990+16Sterne-Änderung der letzten 7 Tage
  • openvino@openvinotoolkit

    OpenVINO™ ist ein Open-Source-Toolkit zur Optimierung und Bereitstellung von KI-Inferenz

    10.793+30Sterne-Änderung der letzten 7 Tage
  • espnet@espnet

    End-to-End-Sprachverarbeitungs-Toolkit

    9.949+3Sterne-Änderung der letzten 7 Tage
  • SenseVoice@QwenAudio

    Open-Source-Modell SenseVoiceSmall für ASR in Mandarin, Kantonesisch, Englisch, Japanisch und Koreanisch, Spracherkennung, Emotionserkennung und Audio-Ereigniserkennung.

    9.209+37Sterne-Änderung der letzten 7 Tage
  • Spracherkennungsmodul für Python, das verschiedene Engines und APIs unterstützt, sowohl online als auch offline.

    8.987+0Sterne-Änderung der letzten 7 Tage
  • Ein auf Deep Learning basierendes chinesisches Spracherkennungssystem

    8.386+0Sterne-Änderung der letzten 7 Tage
  • mlx-audio@Blaizzy

    Eine auf Apples MLX-Framework basierende Text-to-Speech (TTS)-, Speech-to-Text (STT)- und Speech-to-Speech (STS)-Bibliothek für effiziente Sprachanalyse auf Apple Silicon.

    7.826+23Sterne-Änderung der letzten 7 Tage
  • annyang@TalAter

    💬 Spracherkennung für Ihre Website

    6.815-1Sterne-Änderung der letzten 7 Tage
  • wav2letter@flashlight

    Toolkit für automatische Spracherkennung der Facebook AI Research

    6.437+1Sterne-Änderung der letzten 7 Tage
  • argmax-oss-swift@argmaxinc

    On-Device-Sprach-KI für Apple Silicon

    6.353+8Sterne-Änderung der letzten 7 Tage
  • PaddleX@PaddlePaddle

    All-in-One-Entwicklungstool basierend auf PaddlePaddle

    6.254+3Sterne-Änderung der letzten 7 Tage
  • FunClip@modelscope

    Ein auf FunASR basierendes Tool für Videotranskription, Untertitelgenerierung und LLM-gestützten Schnitt mit lokaler Gradio-Benutzeroberfläche.

    6.210+13Sterne-Änderung der letzten 7 Tage
  • whisper-diarization@MahmoudAshraf97

    Automatische Spracherkennung mit Sprecher-Diarisierung basierend auf OpenAI Whisper

    5.634+1Sterne-Änderung der letzten 7 Tage
  • wenet@wenet-e2e

    Produktionsorientiertes und einsatzbereites End-to-End-Spracherkennungstoolkit

    5.229+1Sterne-Änderung der letzten 7 Tage
  • porcupine@Picovoice

    Geräteinterne Erkennung von Weckwörtern mittels Deep Learning

    4.928+3Sterne-Änderung der letzten 7 Tage
  • ml-road@yanshengjia

    Ressourcen, Praxis und Forschung zu maschinellem Lernen und Agentic AI

    4.927+5Sterne-Änderung der letzten 7 Tage
  • stt@jianchang512

    Spracherkennungstool für Text / Ein lokal laufendes Offline-Tool zur Audio- und Video-Untertitelung, das JSON-, SRT- und Reintextformate ausgibt.

    4.780+9Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen