मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · speech-to-text

speech-to-text

speech-to-text टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

152 रिपॉजिटरी
  • LiveStream-Agent-Studio@HanyuanWang

    面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。

    1,019+424पिछले 7 दिनों में स्टार का बदलाव
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Tensorflow 2 में लगभग अत्याधुनिक (State-of-the-art) स्वचालित वाक् पहचान (ASR)। समर्थित भाषाओं में वर्णों या सबवर्ड का उपयोग किया जा सकता है।

    1,010+0पिछले 7 दिनों में स्टार का बदलाव
  • voquill@voquill

    ओपन सोर्स वॉयस डिक्टेशन तकनीक

    1,006-1पिछले 7 दिनों में स्टार का बदलाव
  • whisper-flow@dimastatz

    Whisper-Flow एक ऐसा फ्रेमवर्क है जिसे OpenAI के Whisper मॉडल का उपयोग करके ऑडियो सामग्री के रीयल-टाइम ट्रांसक्रिप्शन को सक्षम करने के लिए डिज़ाइन किया गया है। पूरी फाइलों को अपलोड करने के बाद प्रोसेस करने (“बैच मोड”) के बजाय, Whisper-Flow ऑडियो चunks की एक निरंतर धारा को स्वीकार करता है और तुरंत वृद्धिशील ट्रांसक्रिप्ट उत्पन्न करता है।

    964+25पिछले 7 दिनों में स्टार का बदलाव
  • VoiceStreamAI@alesaccoia

    Python/JS में सेल्फ-होस्टेड Whisper और WebSocket का उपयोग करके नियर-रियलटाइम ऑडियो ट्रांसक्रिप्शन

    960+0पिछले 7 दिनों में स्टार का बदलाव
  • botium-speech-processing@codeforequity-at

    Botium Speech Processing

    943+0पिछले 7 दिनों में स्टार का बदलाव
  • whisper.net@sandrohanea

    Whisper.net। Whisper मॉडल का उपयोग करके स्पीच टू टेक्स्ट को आसान बनाया गया।

    942+1पिछले 7 दिनों में स्टार का बदलाव
  • jiwer@jitsi

    Word Error Rate (WER) जैसे समानता मापदंडों के साथ अपने स्पीच-टू-टेक्स्ट सिस्टम का मूल्यांकन करें।

    928+2पिछले 7 दिनों में स्टार का बदलाव
  • MauiSamples@VladislavAntonyuk

    .NET MAUI के नमूने

    915+0पिछले 7 दिनों में स्टार का बदलाव
  • voicy@backmeupplz

    @voicybot Telegram bot का मुख्य रिपॉजिटरी

    911+2पिछले 7 दिनों में स्टार का बदलाव
  • TheWhisper@TheStageAI

    स्ट्रीमिंग और ऑन-डिवाइस उपयोग के लिए ऑप्टिमाइज़्ड Whisper मॉडल

    897-1पिछले 7 दिनों में स्टार का बदलाव
  • TypeNo@marswaveai

    macOS के लिए एक मुफ़्त, ओपन सोर्स, गोपनीयता-प्रथम वॉइस इनपुट ऐप।

    896+4पिछले 7 दिनों में स्टार का बदलाव
  • PPASR@yeyupiaoling

    PaddlePaddle पर आधारित एंड-टू-एंड चीनी वॉयस रिकग्निशन, शुरुआती से लेकर व्यावहारिक प्रोजेक्ट्स तक। DeepSpeech2, Conformer और Squeezeformer मॉडल्स का समर्थन करता है।

    869-1पिछले 7 दिनों में स्टार का बदलाव
  • react-speech-recognition@JamesBrill

    💬 आपके React ऐप के लिए स्पीच रिकग्निशन

    842+0पिछले 7 दिनों में स्टार का बदलाव
  • whisper-playground@saharmor

    OpenAI के Whisper का उपयोग करके रीयल-टाइम speech2text वेब ऐप्स बनाएं https://openai.com/blog/whisper/

    835+0पिछले 7 दिनों में स्टार का बदलाव
  • kur@deepgram

    डिस्क्रिप्टिव डीप लर्निंग

    823-1पिछले 7 दिनों में स्टार का बदलाव
  • vocalinux@VocaHQ

    Linux के लिए मुफ्त, ओपन-सोर्स, 100% ऑफ़लाइन वॉयस डिक्टेशन। whisper.cpp, Whisper और VOSK इंजन के माध्यम से कहीं भी बोलें और टाइप करें, GPU-त्वरित, X11 + Wayland पर काम करता है!

    816+17पिछले 7 दिनों में स्टार का बदलाव
  • MioSub@corvo007

    वन-स्टॉप स्वचालित उपशीर्षक जनरेटर। डाउनलोडिंग, ट्रांसक्रिप्शन, अनुवाद और हार्डकोडिंग को संभालता है - किसी मानवीय हस्तक्षेप की आवश्यकता नहीं है।

    811+3पिछले 7 दिनों में स्टार का बदलाव
  • lobe-tts@lobehub

    🎤 Lobe TTS - सर्वर और ब्राउज़र के लिए एक उच्च-गुणवत्ता और विश्वसनीय TTS/STT लाइब्रेरी

    805-1पिछले 7 दिनों में स्टार का बदलाव
  • Speech to Text to Speech। गाना अभी चल रहा है। अवतार पर प्रदर्शित करने के लिए टेक्स्ट को OSC संदेशों के रूप में VRChat पर भेजता है। (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    805+5पिछले 7 दिनों में स्टार का बदलाव
  • june@mezbaul-h

    Ollama, Hugging Face Transformers और Coqui TTS टूलकिट द्वारा संचालित आकर्षक बातचीत के लिए लोकल वॉयस चैटबॉट।

    788+1पिछले 7 दिनों में स्टार का बदलाव
  • whisper_mic@mallorbc

    एक प्रोजेक्ट जो OpenAI whisper के साथ माइक्रोफ़ोन का उपयोग करने की अनुमति देता है।

    787+0पिछले 7 दिनों में स्टार का बदलाव
  • SwiftWhisper@exPHAT

    Swift में ऑडियो ट्रांसक्राइब करने का सबसे आसान तरीका।

    785+0पिछले 7 दिनों में स्टार का बदलाव
  • NotelyVoice@Notely-Voice

    एक 100% निजी AI वॉइस ट्रांसक्रिप्शन ऐप जो 100+ भाषाओं में भाषण को टेक्स्ट में बदलता है। पूर्ण गोपनीयता के लिए बिना किसी क्लाउड अपलोड के Whisper AI का उपयोग करके Android और iOS के लिए Compose Multiplatform के साथ निर्मित।

    782+4पिछले 7 दिनों में स्टार का बदलाव
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Kotlin पर आधारित Android प्लेटफॉर्म के लिए एक LLM और ASR वॉयस इनपुट मेथड कीबोर्ड एप्लिकेशन।

    778+15पिछले 7 दिनों में स्टार का बदलाव
  • mlx-audio-swift@Blaizzy

    Apple Silicon पर MLX के साथ ऑडियो प्रोसेसिंग के लिए एक मॉड्यूलर Swift SDK

    774+5पिछले 7 दिनों में स्टार का बदलाव
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    PaddlePaddle पर आधारित वाक् पहचान (Speech Recognition), चीनी वाक् पहचान। परियोजना परिपक्व है और पहचान प्रभाव अच्छा है। Windows और Linux के तहत प्रशिक्षण और पूर्वानुमान का समर्थन करता है, और Nvidia Jetson विकास बोर्ड पूर्वानुमान का समर्थन करता है।

    763+1पिछले 7 दिनों में स्टार का बदलाव
  • chaplin@amanvirparhar

    एक रीयल-टाइम साइलेंट स्पीच रिकग्निशन टूल।

    755+1पिछले 7 दिनों में स्टार का बदलाव
  • Unity3d में स्थानीय मशीन पर स्पीच-टू-टेक्स्ट मॉडल (whisper.cpp) चलाना।

    751+1पिछले 7 दिनों में स्टार का बदलाव
  • Transcribro@soupslurpr

    Android के लिए प्राइवेट और ऑन-डिवाइस स्पीच रिकग्निशन कीबोर्ड और सर्विस।

    745+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस