nlp
nlp टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #181
Python के लिए सबसे सटीक नेचुरल लैंग्वेज डिटेक्शन लाइब्रेरी, जो छोटे टेक्स्ट और मिश्रित-भाषा के टेक्स्ट के लिए उपयुक्त है
★ 1,788+2पिछले 7 दिनों में स्टार का बदलाव - #182★ 1,778-2पिछले 7 दिनों में स्टार का बदलाव
- #183★ 1,774+2पिछले 7 दिनों में स्टार का बदलाव
- #184
तेज़ और कुशल असंरचित डेटा निष्कर्षण। कई भाषाओं के लिए बाइंडिंग के साथ Rust में लिखा गया।
★ 1,772+0पिछले 7 दिनों में स्टार का बदलाव - #185
प्राकृतिक भाषा प्रसंस्करण, ज्ञान ग्राफ़, संवाद प्रणाली, बड़े मॉडल और अन्य तकनीकों का अनुसंधान और अनुप्रयोग।
★ 1,766+2पिछले 7 दिनों में स्टार का बदलाव - #186★ 1,763+0पिछले 7 दिनों में स्टार का बदलाव
- #187
:आर्किटेक्चर परिवर्तन और स्केलिंग दोनों के माध्यम से BERT को आधुनिकता में लाना।
★ 1,716+3पिछले 7 दिनों में स्टार का बदलाव - #188
अद्भुत आर्टिफिशियल इंटेलिजेंस, मशीन लर्निंग और डीप लर्निंग जैसा कि हम सीखते हैं। अध्ययन नोट्स और ऐसे विषयों के अद्भुत संसाधनों की एक क्यूरेटेड सूची।
★ 1,713+2पिछले 7 दिनों में स्टार का बदलाव - #189
📚 AI, LLM, NLP, CV के हजारों शीर्ष सम्मेलनों के शोध पत्रों की व्याख्या, प्रत्येक पत्र के मुख्य विचार को 5 मिनट में समझें।
★ 1,709+53पिछले 7 दिनों में स्टार का बदलाव - #190
Graph4nlp, NLP के लिए Graph Neural Networks के आसान उपयोग हेतु लाइब्रेरी है। विभिन्न शिक्षण संसाधनों के लिए हमारी DLG4NLP वेबसाइट (https://dlg4nlp.github.io/index.html) पर जाने के लिए स्वागत है!
★ 1,690+0पिछले 7 दिनों में स्टार का बदलाव - #191★ 1,680+0पिछले 7 दिनों में स्टार का बदलाव
- #192★ 1,672+4पिछले 7 दिनों में स्टार का बदलाव
- #193
Tika-Python, Apache Tika™ REST सेवाओं के लिए एक Python बाइंडिंग है जो Python कम्युनिटी में Tika को नेटिव रूप से कॉल करने की अनुमति देती है।
★ 1,667+0पिछले 7 दिनों में स्टार का बदलाव - #194
प्री-ट्रेन्ड चाइनीज XLNet (चीनी XLNet पूर्व-प्रशिक्षित मॉडल)
★ 1,646+0पिछले 7 दिनों में स्टार का बदलाव - #195
:us: संरचित न किए गए संयुक्त राज्य अमेरिका के पते की स्ट्रिंग्स को एड्रेस घटकों में पार्स करने के लिए एक python लाइब्रेरी
★ 1,637+1पिछले 7 दिनों में स्टार का बदलाव - #196
पुनरुत्पादक गहरे学習 (deep learning) अध्ययनों के लिए PyTorch पर निर्मित एक कोडिंग-मुक्त फ्रेमवर्क। PyTorch इकोसिस्टम। 🏆 TPAMI, CVPR, ICLR, ECCV, NeurIPS, ICCV, AAAI आदि में प्रस्तुत 22 ज्ञान आसवन (knowledge distillation) विधियाँ अब तक लागू की गई हैं। 🎁 पुनरुत्पादकता और बेंचमार्क सुनिश्चित करने के लिए प्रशिक्षित मॉडल, प्रशिक्षण लॉग और कॉन्फ़िगरेशन उपलब्ध हैं।
★ 1,630+0पिछले 7 दिनों में स्टार का बदलाव - #197
WikiChat एक बेहतर RAG है। यह एक कॉर्पस से डेटा पुनर्प्राप्त करके बड़े भाषा मॉडल के मतिभ्रम (hallucination) को रोकता है।
★ 1,615+0पिछले 7 दिनों में स्टार का बदलाव - #198★ 1,602+0पिछले 7 दिनों में स्टार का बदलाव
- #199
ExtractThinker LLM के लिए एक डॉक्यूमेंट इंटेलिजेंस लाइब्रेरी है, जो लचीले और शक्तिशाली डॉक्यूमेंट वर्कफ़्लो के लिए ORM-शैली की सहभागिता प्रदान करती है।
★ 1,596+1पिछले 7 दिनों में स्टार का बदलाव - #200
"WebArena: A Realistic Web Environment for Building Autonomous Agents" के लिए कोड रिपो
★ 1,592+1पिछले 7 दिनों में स्टार का बदलाव - #201
similarity: Java के लिए एक टेक्स्ट समानता गणना टूलकिट। इसका उपयोग टेक्स्ट समानता गणना, भावना विश्लेषण और अन्य कार्यों के लिए किया जा सकता है, जो उपयोग के लिए तैयार है।
★ 1,584-1पिछले 7 दिनों में स्टार का बदलाव - #202
यह पाठकों के लिए साहित्य में नवीनतम Text-to-SQL तकनीकों को आसानी से ट्रैक करने और शोधकर्ताओं तथा प्रैक्टिशनर्स को व्यावहारिक मार्गदर्शन प्रदान करने के लिए लगातार अपडेट की जाने वाली हैंडबुक है।
★ 1,580+2पिछले 7 दिनों में स्टार का बदलाव - #203
आपके डेटा में क्या है? डेटासेट से स्कीमा, सांख्यिकी (statistics) और एंटिटीज निकालें
★ 1,579+0पिछले 7 दिनों में स्टार का बदलाव - #204
टेक्स्टुअल एडवरसैरियल अटैक और डिफेंस पर अवश्य पढ़ने योग्य शोध पत्र
★ 1,575+0पिछले 7 दिनों में स्टार का बदलाव - #205
नेम्ड एंटिटी रिकग्निशन (NER) और एंटिटी रिकग्निशन कार्यों के लिए कॉर्पोरा का एक संग्रह। ये एनोटेट किए गए डेटासेट विभिन्न भाषाओं, डोमेन और एंटिटी प्रकारों को कवर करते हैं।
★ 1,574+0पिछले 7 दिनों में स्टार का बदलाव - #206
रोबोटिक प्रोसेस ऑटोमेशन (RPA) के लिए ओपन-सोर्स लाइब्रेरी और टूल्स का संग्रह, जिसे Robot Framework और Python दोनों के साथ उपयोग करने के लिए डिज़ाइन किया गया है
★ 1,555+0पिछले 7 दिनों में स्टार का बदलाव - #207★ 1,553-1पिछले 7 दिनों में स्टार का बदलाव
- #208
CPU और GPU पर ट्रांसफॉर्मर इन्फेरेंस (Bert, Albert, GPT2, Decoders, आदि) के लिए एक तेज़ और उपयोगकर्ता-अनुकूल रनटाइम।
★ 1,550+1पिछले 7 दिनों में स्टार का बदलाव - #209★ 1,538+0पिछले 7 दिनों में स्टार का बदलाव
- #210
यह प्रोजेक्ट एक बेसिक पैकेज है, जो अधिकांश NLP प्रोजेक्ट्स में उपयोग होने वाले सामान्य टूल्स को रैप करता है।
★ 1,507+0पिछले 7 दिनों में स्टार का बदलाव