मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · speech-recognition

speech-recognition

speech-recognition टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

156 रिपॉजिटरी
  • 💎 ASR, TTS और अन्य Speech Technologies के लिए एक्सेसिबल स्पीच कॉर्पोरा की एक सूची

    1,399+0पिछले 7 दिनों में स्टार का बदलाव
  • mlx-tune@ARahim3

    Apple Silicon वाले Mac पर LLM को फाइन-ट्यून करें। SFT, DPO, GRPO, Vision, TTS, STT, Embedding और OCR फाइन-ट्यूनिंग — MLX पर नेटिव रूप से। Unsloth-compatible API।

    1,398+8पिछले 7 दिनों में स्टार का बदलाव
  • CrisperWhisper@nyrahealth

    नियंत्रित ट्रांसक्रिप्शन। शब्द-स्तर के टाइमस्टैम्प के साथ सटीक (प्रत्येक फिलर, विराम, हकलाना, स्वर ध्वनि) या इच्छित (वक्ता क्या कहना चाहता था, पठनीयता के लिए अनुकूलित)।

    1,371+13पिछले 7 दिनों में स्टार का बदलाव
  • whisper-ctranslate2@Softcatala

    CTranslate2 पर आधारित मूल OpenAI क्लाइंट के साथ संगत Whisper कमांड लाइन क्लाइंट।

    1,346+2पिछले 7 दिनों में स्टार का बदलाव
  • J.A.R.V.I.S@GauravSingh9356

    पायथन लाइब्रेरी का उपयोग करके बनाया गया पर्सनल असिस्टेंट। यह लगभग कुछ भी करता है जिसमें ईमेल भेजना, ऑप्टिकल टेक्स्ट रिकग्निशन, एपीआई इंटीग्रेशन के साथ किसी भी समय गतिशील समाचार रिपोर्टिंग, टू-डू लिस्ट जनरेटर, केवल एक वॉयस कमांड से कोई भी वेबसाइट खोलना, संगीत बजाना, विकिपीडिया खोजना, इंटेलिजेंट सेंसिंग यानी ऑटो स्पेल चेकिंग के साथ डिक्शनरी, मौसम रिपोर्टिंग यानी तापमान, हवा की गति, आर्द्रता शामिल है।

    1,341+5पिछले 7 दिनों में स्टार का बदलाव
  • voxtype@peteonrails

    Wayland कंपोजिटर्स के लिए पुश-टू-टॉक के साथ वॉइस-टू-टेक्स्ट

    1,338+42पिछले 7 दिनों में स्टार का बदलाव
  • StreamSpeech@ictnlp

    StreamSpeech ऑफ़लाइन और एक साथ स्पीच रिकग्निशन, स्पीच ट्रांसलेशन और स्पीच सिंथेसिस के लिए एक "ऑल इन वन" सीमलेस मॉडल है।

    1,288+0पिछले 7 दिनों में स्टार का बदलाव
  • pruna@PrunaAI

    Pruna डेवलपर्स के लिए बनाया गया एक मॉडल ऑप्टिमाइज़ेशन फ्रेमवर्क है, जो आपको न्यूनतम ओवरहेड के साथ तेज़, अधिक कुशल मॉडल डिलीवर करने में सक्षम बनाता है।

    1,274+1पिछले 7 दिनों में स्टार का बदलाव
  • vosk-server@alphacep

    Vosk और Kaldi लाइब्रेरी पर आधारित WebSocket, gRPC और WebRTC स्पीच रिकग्निशन सर्वर

    1,262+1पिछले 7 दिनों में स्टार का बदलाव
  • Whisper-Finetune@yeyupiaoling

    टाइमस्टैम्प डेटा के बिना, टाइमस्टैम्प डेटा के साथ, और स्पीच डेटा के बिना ट्रेनिंग का समर्थन करने के लिए Whisper स्पीच रिकग्निशन मॉडल को फाइन-ट्यून करें। इन्फेरेंस को तेज करें और Web डिप्लॉयमेंट, Windows डेस्कटॉप डिप्लॉयमेंट, और Android डिप्लॉयमेंट का समर्थन करें।

    1,222-1पिछले 7 दिनों में स्टार का बदलाव
  • quillman@modal-labs

    एक वॉयस चैट ऐप

    1,212-1पिछले 7 दिनों में स्टार का बदलाव
  • Treasure-of-Transformers@ashishpatel26

    💁 Natural Language Processing के लिए Transformers Models का बेहतरीन खजाना, जिसमें पेपर्स, वीडियो, ब्लॉग, आधिकारिक रेपो और colab Notebooks शामिल हैं। 🛫☑️

    1,179+0पिछले 7 दिनों में स्टार का बदलाव
  • Apple के Foundation Models फ्रेमवर्क के साथ ऐप्स बनाने, परीक्षण करने और मूल्यांकन करने के लिए एक व्यावहारिक लैब।

    1,178+1पिछले 7 दिनों में स्टार का बदलाव
  • lotti@matthiasn

    व्यक्तिगत AI सहायकों के साथ एक निजी logbook। Agents आपके रिकॉर्ड किए गए डेटा को पढ़ते हैं और आगे के कार्यों का सुझाव देते हैं — आप परिवर्तनों को स्वीकृत करते हैं। आपके अपने डिवाइसों के बीच End-to-end encrypted sync — सर्वर केवल ciphertext देख सकते हैं। Local AI वैकल्पिक है।

    1,168+3पिछले 7 दिनों में स्टार का बदलाव
  • speech-swift@soniqo

    Apple Silicon के लिए AI स्पीच टूलकिट — MLX और CoreML द्वारा संचालित ASR, TTS, स्पीच-टू-स्पीच, VAD और डायराइजेशन

    1,161+4पिछले 7 दिनों में स्टार का बदलाव
  • इरीना - ऑफ़लाइन काम करने के लिए रूसी वॉयस असिस्टेंट। प्लगइन्स के माध्यम से कौशल का समर्थन करता है।

    1,153+0पिछले 7 दिनों में स्टार का बदलाव
  • lhotse@lhotse-speech

    मशीन लर्निंग प्रोजेक्ट्स में मल्टीमॉडल डेटा को संभालने के लिए उपकरण।

    1,149-1पिछले 7 दिनों में स्टार का बदलाव
  • conformer@sooftware

    "Conformer: Convolution-augmented Transformer for Speech Recognition" (INTERSPEECH 2020) का [अनौपचारिक] PyTorch कार्यान्वयन

    1,132+1पिछले 7 दिनों में स्टार का बदलाव
  • आपके ऐप के लिए सेल्फ-कोडिंग सिस्टम — Cordova के लिए Alan AI SDK

    1,132+0पिछले 7 दिनों में स्टार का बदलाव
  • sglang-omni@sgl-project

    SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।

    1,118+143पिछले 7 दिनों में स्टार का बदलाव
  • AI-Waifu-Vtuber@ardha27

    Youtube/Twitch पर स्ट्रीमिंग के लिए AI Vtuber

    1,116+1पिछले 7 दिनों में स्टार का बदलाव
  • Whisperboard@Saik0s

    ओपन-सोर्स iOS ऐप जो मोबाइल उपकरणों पर गुणवत्तापूर्ण वॉयस ट्रांसक्रिप्शन को अधिक सुलभ बना रहा है।

    1,102+8पिछले 7 दिनों में स्टार का बदलाव
  • whisper-writer@savbell

    💬📝 OpenAI के Whisper स्पीच रिकग्निशन मॉडल का उपयोग करने वाला एक छोटा डिक्टेशन ऐप

    1,100+2पिछले 7 दिनों में स्टार का बदलाव
  • Kaldi टूलकिट और GStreamer फ्रेमवर्क पर आधारित रीयल-टाइम फुल-डुप्लेक्स स्पीच रिकग्निशन सर्वर।

    1,094+1पिछले 7 दिनों में स्टार का बदलाव
  • Vosk लाइब्रेरी के साथ Android के लिए ऑफलाइन स्पीच रिकग्निशन

    1,056+0पिछले 7 दिनों में स्टार का बदलाव
  • pykaldi@pykaldi

    Kaldi के लिए एक Python रैपर।

    1,040+1पिछले 7 दिनों में स्टार का बदलाव
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Tensorflow 2 में लगभग अत्याधुनिक (State-of-the-art) स्वचालित वाक् पहचान (ASR)। समर्थित भाषाओं में वर्णों या सबवर्ड का उपयोग किया जा सकता है।

    1,010+0पिछले 7 दिनों में स्टार का बदलाव
  • StoryToolkitAI@octimot

    ChatGPT और अन्य AI मॉडल के साथ एकीकृत, आपके फुटेज में किसी भी चीज़ को ट्रांसक्राइब करने, सामग्री को समझने और खोजने के लिए AI का उपयोग करने वाला एक संपादन टूल

    1,009+2पिछले 7 दिनों में स्टार का बदलाव
  • sherpa@k2-fsa

    नेक्स्ट-जेन Kaldi के साथ स्पीच-टू-टेक्स्ट सर्वर फ्रेमवर्क

    984+4पिछले 7 दिनों में स्टार का बदलाव
  • VoiceStreamAI@alesaccoia

    Python/JS में सेल्फ-होस्टेड Whisper और WebSocket का उपयोग करके नियर-रियलटाइम ऑडियो ट्रांसक्रिप्शन

    960+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस