Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-to-text

speech-to-text

Erfasste Open-Source-Repos mit dem Tag speech-to-text, sortiert nach Sternen.

152 Repos
  • LiveStream-Agent-Studio@HanyuanWang

    面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。

    1.013+613Sterne-Änderung der letzten 7 Tage
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Fast dem Stand der Technik entsprechende automatische Spracherkennung in Tensorflow 2. Unterstützte Sprachen, die Zeichen oder Subwörter verwenden können

    1.010+0Sterne-Änderung der letzten 7 Tage
  • voquill@voquill

    Open-Source-Sprachdiktiertechnologie

    1.006-2Sterne-Änderung der letzten 7 Tage
  • whisper-flow@dimastatz

    Whisper-Flow ist ein Framework zur Echtzeit-Transkription von Audioinhalten mit dem Whisper-Modell von OpenAI. Statt ganzer Dateien nach dem Hochladen im Batch-Modus verarbeitet Whisper-Flow kontinuierliche Audio-Chunks und liefert sofort inkrementelle Transkripte.

    961+28Sterne-Änderung der letzten 7 Tage
  • VoiceStreamAI@alesaccoia

    Near-Realtime-Audio-Transkription mit selbstgehostetem Whisper und WebSocket in Python/JS

    960+1Sterne-Änderung der letzten 7 Tage
  • botium-speech-processing@codeforequity-at

    Botium Sprachverarbeitung

    943+0Sterne-Änderung der letzten 7 Tage
  • whisper.net@sandrohanea

    Whisper.net. Spracherkennung leicht gemacht mit Whisper Modellen.

    942+1Sterne-Änderung der letzten 7 Tage
  • jiwer@jitsi

    Evaluieren Sie Ihr Speech-to-Text-System mit Ähnlichkeitsmaßen wie der Word Error Rate (WER)

    928+2Sterne-Änderung der letzten 7 Tage
  • MauiSamples@VladislavAntonyuk

    .NET MAUI Beispiele

    915+0Sterne-Änderung der letzten 7 Tage
  • voicy@backmeupplz

    Hauptrepository des @voicybot Telegram-Bots

    911+2Sterne-Änderung der letzten 7 Tage
  • TheWhisper@TheStageAI

    Optimierte Whisper-Modelle für Streaming und den Einsatz auf Geräten

    897+0Sterne-Änderung der letzten 7 Tage
  • TypeNo@marswaveai

    Eine kostenlose, Open-Source-basierte und datenschutzorientierte Spracheingabe-App für macOS.

    896+4Sterne-Änderung der letzten 7 Tage
  • PPASR@yeyupiaoling

    End-to-End-Mandarin-Spracherkennung basierend auf PaddlePaddle, von den Grundlagen zur Praxis: ein super einfaches Einstiegsbeispiel und ein hochpraktisches Unternehmensprojekt. Unterstützt die aktuell beliebtesten Modelle DeepSpeech2, Conformer und Squeezeformer.

    870-1Sterne-Änderung der letzten 7 Tage
  • react-speech-recognition@JamesBrill

    💬 Spracherkennung für Ihre React-App

    842+1Sterne-Änderung der letzten 7 Tage
  • whisper-playground@saharmor

    Erstellen Sie Echtzeit-Speech-to-Text-Web-Apps mit OpenAIs Whisper https://openai.com/blog/whisper/

    835+0Sterne-Änderung der letzten 7 Tage
  • kur@deepgram

    Deskriptives Deep Learning

    823-1Sterne-Änderung der letzten 7 Tage
  • MioSub@corvo007

    Eine automatisierte All-in-One-Software zur Untertitelgenerierung, die Herunterladen, Transkription, Übersetzung und Hardcoding komplett ohne menschliches Eingreifen abdeckt.

    811+4Sterne-Änderung der letzten 7 Tage
  • vocalinux@VocaHQ

    Kostenlose, Open-Source-basierte, 100 % offline funktionierende Sprachdiktat-Software für Linux. Sprechen und tippen Sie überall über whisper.cpp-, Whisper- und VOSK-Engines, GPU-beschleunigt, funktioniert unter X11 und Wayland!

    809+23Sterne-Änderung der letzten 7 Tage
  • lobe-tts@lobehub

    🎤 Lobe TTS – Eine hochwertige und zuverlässige TTS/STT-Bibliothek für Server und Browser

    805+1Sterne-Änderung der letzten 7 Tage
  • Sprache zu Text zu Sprache. Song wird jetzt abgespielt. Sendet Text als OSC-Nachrichten an VRChat zur Anzeige auf dem Avatar. (STTTS) (Sprache zu TTS) (VRC-STT-System) (VTuber-TTS)

    804+4Sterne-Änderung der letzten 7 Tage
  • june@mezbaul-h

    Lokaler Sprach-Chatbot für ansprechende Konversationen, basierend auf Ollama, Hugging Face Transformers und dem Coqui TTS Toolkit

    788+1Sterne-Änderung der letzten 7 Tage
  • whisper_mic@mallorbc

    Projekt, mit dem ein Mikrofon mit OpenAI Whisper verwendet werden kann.

    787+0Sterne-Änderung der letzten 7 Tage
  • SwiftWhisper@exPHAT

    Der einfachste Weg, Audio in Swift zu transkribieren

    785-1Sterne-Änderung der letzten 7 Tage
  • NotelyVoice@Notely-Voice

    Eine zu 100 % private KI-Sprachtranskriptions-App, die Sprache in über 100 Sprachen in Text umwandelt. Entwickelt mit Compose Multiplatform für Android und iOS unter Verwendung von Whisper AI – keine Cloud-Uploads, die gesamte Verarbeitung erfolgt auf dem Gerät für absolute Privatsphäre.

    779+1Sterne-Änderung der letzten 7 Tage
  • mlx-audio-swift@Blaizzy

    Ein modulares Swift-SDK zur Audioverarbeitung mit MLX auf Apple Silicon

    774+6Sterne-Änderung der letzten 7 Tage
  • BiBi-Keyboard@BryceWG

    Ein auf Kotlin basierendes LLM- und ASR-Spracheingabe-Tastatur-App für die Android-Plattform

    774+21Sterne-Änderung der letzten 7 Tage
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    Auf PaddlePaddle basierende Spracherkennung für Chinesisch. Ausgereiftes Projekt mit hervorragenden Erkennungsergebnissen. Unterstützt Training und Vorhersage unter Windows und Linux sowie auf Nvidia Jetson-Entwicklerboards.

    763+1Sterne-Änderung der letzten 7 Tage
  • chaplin@amanvirparhar

    Ein Echtzeit-Tool zur stummen Spracherkennung.

    754+2Sterne-Änderung der letzten 7 Tage
  • Ausführen eines Speech-to-Text-Modells (whisper.cpp) in Unity3d auf Ihrem lokalen Computer.

    751+1Sterne-Änderung der letzten 7 Tage
  • Transcribro@soupslurpr

    Private Spracherkennungs-Tastatur und ein -Dienst für Android, die lokal auf dem Gerät laufen.

    745+6Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen