Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-to-text

speech-to-text

Erfasste Open-Source-Repos mit dem Tag speech-to-text, sortiert nach Sternen.

152 Repos
  • typewhisper-mac@TypeWhisper

    Lokale Spracherkennung für macOS mit On-Device-KI, vollständig privat, optionale Cloud

    1.759+12Sterne-Änderung der letzten 7 Tage
  • react-native-executorch@software-mansion

    Deklarative Möglichkeit, KI-Modelle in React Native auf dem Gerät auszuführen, angetrieben von ExecuTorch.

    1.707+5Sterne-Änderung der letzten 7 Tage
  • Sammelt alle Inhalte von Hu Chenfeng

    1.650+2Sterne-Änderung der letzten 7 Tage
  • dsnote@mkiol

    Speech Note Linux-App. Notizen erstellen, lesen und übersetzen mit Offline-Spracherkennung (Speech-to-Text), Sprachsynthese (Text-to-Speech) und maschineller Übersetzung.

    1.622+8Sterne-Änderung der letzten 7 Tage
  • OBS-Plugin für lokale Spracherkennung und Untertitelung mittels KI

    1.597+8Sterne-Änderung der letzten 7 Tage
  • vllm-mlx@waybarrios

    Leistungsstarker, mit OpenAI und Anthropic kompatibler LLM-Inferenzserver für Apple Silicon. Nativer MLX, Continuous Batching, multimodale Modelle, MCP-Tool-Aufrufe und Claude-Code-Unterstützung.

    1.557+6Sterne-Änderung der letzten 7 Tage
  • TikTokLive@isaackogan

    TikTok LIVE API für Python: Die definitive Drittanbieter-Bibliothek zum Empfangen von Livestream-Ereignissen (Kommentare, Geschenke usw.) in Echtzeit von TikTok LIVE.

    1.544+8Sterne-Änderung der letzten 7 Tage
  • RCLI@RunanywhereAI

    Mit dem Mac sprechen, Dokumente abfragen, keine Cloud erforderlich. Sprach-KI auf dem Gerät + RAG

    1.542+0Sterne-Änderung der letzten 7 Tage
  • Benutzerdefinierte Nodes, die die Funktionen von ComfyUI erweitern

    1.525+1Sterne-Änderung der letzten 7 Tage
  • amical@amicalhq

    🎙️ KI-Diktier-App – Open Source und Local-First ⚡ 3x schneller tippen, keine Tastatur erforderlich. 🆓 Angetrieben von Open-Source-Modellen, offline funktionsfähig, schnell und präzise.

    1.520+8Sterne-Änderung der letzten 7 Tage
  • Fun-ASR@QwenAudio

    Open-Source-LLM-basiertes ASR-Modellfamilie für Chinesisch, Dialekte, Akzente und mehrsprachige Sprache, mit FunASR, vLLM, Streaming- und llama.cpp-Runtimes.

    1.512+10Sterne-Änderung der letzten 7 Tage
  • minutes@silverstein

    Jedes Meeting, jede Idee, jede Sprachnotiz durchsuchbar durch Ihre KI. Open-Source-Konversationsspeicherschicht mit Fokus auf Datenschutz.

    1.462+6Sterne-Änderung der letzten 7 Tage
  • SoniTranslate@R3gm

    Synchronisierte Übersetzung für Videos. Videovertonung

    1.413+2Sterne-Änderung der letzten 7 Tage
  • 💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien

    1.399+0Sterne-Änderung der letzten 7 Tage
  • mlx-tune@ARahim3

    Fine-Tuning von LLMs auf Ihrem Mac mit Apple Silicon. SFT-, DPO-, GRPO-, Vision-, TTS-, STT-, Embedding- und OCR-Fine-Tuning – nativ auf MLX. Unsloth-kompatible API.

    1.398+8Sterne-Änderung der letzten 7 Tage
  • Multi-Backend-Whisper-App. Bl Blitzschnell. Optimiert für Mac-arm. Einfache Installation. Lokale Datei oder URL eingeben und dieser Dienst transkribiert sie mit Whisper AI. Vollständig privat und kostenlos 🤯🤯🤯

    1.394+0Sterne-Änderung der letzten 7 Tage
  • whisper-ctranslate2@Softcatala

    Whisper-Kommandozeilenclient, kompatibel mit dem originalen OpenAI-Client basierend auf CTranslate2.

    1.346+2Sterne-Änderung der letzten 7 Tage
  • voxtype@peteonrails

    Sprach-zu-Text mit Push-to-Talk für Wayland-Compositor

    1.338+42Sterne-Änderung der letzten 7 Tage
  • gp.nvim@Robitx

    Gp.nvim (GPT prompt) Neovim AI-Plugin: ChatGPT-Sitzungen & instruierbare Text-/Code-Operationen & Spracherkennung [OpenAI, Ollama, Anthropic, ..]

    1.320+0Sterne-Änderung der letzten 7 Tage
  • airunner@Capsize-Games

    Offline-Inferenz-Engine für Kunst, Echtzeit-Sprachkonversationen, LLM-gestützte Chatbots und automatisierte Workflows

    1.314+0Sterne-Änderung der letzten 7 Tage
  • StreamSpeech@ictnlp

    StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.

    1.288+0Sterne-Änderung der letzten 7 Tage
  • quillman@modal-labs

    Eine Voice-Chat-App

    1.212-1Sterne-Änderung der letzten 7 Tage
  • hyprwhspr@goodroot

    Native Sprache-zu-Text-Funktion für Linux – Schnelles, genaue, private und erweiterbare systemweite Diktierfunktion

    1.189+10Sterne-Änderung der letzten 7 Tage
  • Uncensored-Local-Studio@techjarves

    Unzensiertes lokales KI-Studio für Windows, Linux und macOS. Installationsfreie GUI für Bildgenerierung, GGUF-LLMs, Text-to-Speech & Speech-to-Text

    1.118+87Sterne-Änderung der letzten 7 Tage
  • AI-Waifu-Vtuber@ardha27

    KI-Vtuber zum Streamen auf YouTube und Twitch.

    1.116+2Sterne-Änderung der letzten 7 Tage
  • Whisperboard@Saik0s

    Die Open-Source-iOS-App, die hochwertige Sprachtranskription auf Mobilgeräten zugänglicher macht.

    1.102+8Sterne-Änderung der letzten 7 Tage
  • whisper-writer@savbell

    💬📝 Eine kleine Diktier-App, die das Whisper-Spracherkennungsmodell von OpenAI nutzt.

    1.100+2Sterne-Änderung der letzten 7 Tage
  • muesli@Muesli-HQ

    Muesli – Agenten-native lokale Meeting-Transkription + Diktat für macOS (Alternative zu Granola + WisprFlow)

    1.091+43Sterne-Änderung der letzten 7 Tage
  • murmure@Kieirra

    Vollständig lokale, private und plattformübergreifende Spracherkennung (Speech-to-Text) mit LLM-Nachbearbeitung

    1.055+17Sterne-Änderung der letzten 7 Tage
  • Patter@PatterAI

    Open-Source-Voice-KI-SDK. Die Vapi/Retell-Alternative für Entwickler, die den Stack selbst kontrollieren möchten. Verleihen Sie Ihrem KI-Agenten in 4 Zeilen eine Telefonnummer — Python und TypeScript, unter MIT-Lizenz, Twilio, Telnyx und Plivo.

    1.051+11Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen