Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-to-text

speech-to-text

Erfasste Open-Source-Repos mit dem Tag speech-to-text, sortiert nach Sternen.

152 Repos
  • Sammlung von Ressourcen zu Anwendungen von Large Language Models (LLMs) in der Audio-KI.

    738+1Sterne-Änderung der letzten 7 Tage
  • MASR@yeyupiaoling

    Ein in PyTorch implementiertes Framework für die automatische Spracherkennung (Streaming und Non-Streaming), das sowohl Online- als auch Offline-Erkennung unterstützt, derzeit die Modelle Conformer, Squeezeformer und DeepSpeech2 sowie verschiedene Datenaugmentierungsmethoden unterstützt.

    727+0Sterne-Änderung der letzten 7 Tage
  • voice-ai@rapidaai

    Rapida ist eine Open-Source-End-to-End-Voice-AI-Orchestrierungsplattform zum Erstellen von Echtzeit-Sprachassistenten mit Audiostreaming, STT, TTS, VAD, Mehrkanalintegration, Agenten-Zustandsverwaltung und Observability.

    723+2Sterne-Änderung der letzten 7 Tage
  • adapt@MycroftAI

    Adapt Intent Parser

    719+0Sterne-Änderung der letzten 7 Tage
  • curses@mmpneo

    Sprach-zu-Text- und KB-Eingabe-Untertitel für OBS, VRChat, Twitch-Chat und Discord

    718+0Sterne-Änderung der letzten 7 Tage
  • speech-demo@Baidu-AIP

    Sprach-API-Beispiele

    707+0Sterne-Änderung der letzten 7 Tage
  • Speech-to-Text-Benchmark-Framework

    698+0Sterne-Änderung der letzten 7 Tage
  • WhisperSubTranslate@Blue-B

    Eine kostenlose lokale Desktop-App zum Extrahieren von Untertiteln (SRT) aus Videos und Übersetzen in jede Sprache – unbegrenzte Nutzung, keine Registrierung, keine Cloud.

    684+27Sterne-Änderung der letzten 7 Tage
  • Spracherkennung für React-Native-Expo-Projekte

    678+7Sterne-Änderung der letzten 7 Tage
  • openlrc@zh-plus

    Transkribiert und übersetzt Sprache mithilfe von Whisper und LLMs (GPT, Claude etc.) in eine LRC-Datei.

    675+0Sterne-Änderung der letzten 7 Tage
  • cheetah@Picovoice

    Auf Deep Learning basierende On-Device-Streaming-Speech-to-Text-Engine

    671+0Sterne-Änderung der letzten 7 Tage
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (Speech-to-Text) für Node mit Offline-Hotword-Erkennung

    638+0Sterne-Änderung der letzten 7 Tage
  • Proctoring-AI@vardanagarwal

    Erstellung einer Software zur automatischen Überwachung bei Online-Prüfungen

    634-1Sterne-Änderung der letzten 7 Tage
  • macparakeet@moona3k

    Schnelle, private und lokal arbeitende Sprach-App für Apple Silicon Macs – Diktierfunktion, Datei-/Medientranskription, Meeting-Aufzeichnung, Transformationen und ein öffentliches Automatisierungs-CLI. Kostenlos und Open Source.

    630+17Sterne-Änderung der letzten 7 Tage
  • pindrop@watzon

    Eine native macOS-Menüleisten-Diktier-App mit lokalem Speech-to-Text über WhisperKit

    620+3Sterne-Änderung der letzten 7 Tage
  • speech-to-text@reriiasu

    Echtzeit-Transkription mit faster-whisper

    614+0Sterne-Änderung der letzten 7 Tage
  • CrispASR@CrispStrobe

    C++ ggml Runtime-Hub für mehrsprachige ASR- und TTS-Modelle: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 sowie universelles Forced Alignment und mehr.

    612+22Sterne-Änderung der letzten 7 Tage
  • Sayboard@ElishaAz

    Eine Open-Source-Sprach-IME (Tastatur) für Android unter Verwendung der Vosk-Bibliothek.

    581+3Sterne-Änderung der letzten 7 Tage
  • Eine Python-Bibliothek zur Lösung von reCAPTCHA v2 und v3 mit Playwright

    579+5Sterne-Änderung der letzten 7 Tage
  • WhisperS2T@shashikg

    Eine optimierte Speech-to-Text-Pipeline für das Whisper-Modell mit Unterstützung für mehrere Inferenz-Engines

    578+1Sterne-Änderung der letzten 7 Tage
  • VRCOSC@VolcanicArts

    Eine modulare Node-Programmiersprache, Programm-Editor, Animationssystem, Toolkit, Router und Debugger für VRChat.

    563-2Sterne-Änderung der letzten 7 Tage
  • Ein Overlay, das die Mikrofonberechtigung des Benutzers abfragt und Spracheingaben in einer anpassbaren Benutzeroberfläche als Text ausgibt.

    557+1Sterne-Änderung der letzten 7 Tage
  • Liste der STT-APIs für koreanische Spracherkennung inklusive Leistungsbenchmarks

    547+1Sterne-Änderung der letzten 7 Tage
  • localstudio@ErickWendel

    Browser-only Canva-style presentation studio, powered by local Web AI.

    544Sterne-Änderung der letzten 7 Tage
  • Talkify@tornikegomareli

    Blitzschnelle, kostenlose und lokale Sprachdiktat-Software für macOS mit On-Device-Transkription

    542+15Sterne-Änderung der letzten 7 Tage
  • vosk-browser@ccoreilly

    Eine Spracherkennungsbibliothek für den Browser, basierend auf einem WebAssembly-Build von Vosk.

    529+1Sterne-Änderung der letzten 7 Tage
  • Phonetisaurus@AdolfVonKleist

    Phonetisaurus G2P

    521-1Sterne-Änderung der letzten 7 Tage
  • Dieses Tool verwendet KI zur Bewertung Ihrer Aussprache

    517+2Sterne-Änderung der letzten 7 Tage
  • transcribee@bugbakery

    Open-Source-Software für Audio- und Videotranskription

    515+2Sterne-Änderung der letzten 7 Tage
  • Open-Source, lokaler und selbst gehosteter, hochoptimierter Sprachinferenz-Server mit Unterstützung für ASR/STT, TTS und LLM über WebRTC, REST und WS.

    512+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen