nlp
nlp टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #121
📖 टेक्स्ट प्रोसेसिंग के लिए एक Golang लाइब्रेरी, जिसमें टोकनाइजेशन, पार्ट-ऑफ-स्पीच टैगिंग और नेम्ड-एंटिटी एक्सट्रैक्शन शामिल है।
★ 3,086+0पिछले 7 दिनों में स्टार का बदलाव - #122
Rust नेटिव उपयोग के लिए तैयार NLP पाइपलाइन और ट्रांसफॉर्मर-आधारित मॉडल (BERT, DistilBERT, GPT2, आदि)
★ 3,077+0पिछले 7 दिनों में स्टार का बदलाव - #123
Chinese-LLaMA 1&2, Chinese-Falcon बेस मॉडल; ChatFlow चाइनीज डायलॉग मॉडल; चाइनीज OpenLLaMA मॉडल; NLP प्री-ट्रेनिंग/इंस्ट्रक्शन फाइन-ट्यूनिंग डेटासेट
★ 3,043+0पिछले 7 दिनों में स्टार का बदलाव - #124
आपके एजेंट को आवश्यक सभी मॉडलों के लिए ओपन-सोर्स इन्फेरेंस सर्वर और प्रोडक्शन क्लस्टर।
★ 3,030+0पिछले 7 दिनों में स्टार का बदलाव - #125
डीप लर्निंग और डीप रीइंफोर्समेंट लर्निंग शोध पत्र और कुछ कोड
★ 3,026+0पिछले 7 दिनों में स्टार का बदलाव - #126
ChatGLM-6B & ChatGLM2-6B & ChatGLM3 & GLM4(V) का C++ कार्यान्वयन
★ 2,962+0पिछले 7 दिनों में स्टार का बदलाव - #127★ 2,890+0पिछले 7 दिनों में स्टार का बदलाव
- #128★ 2,864+0पिछले 7 दिनों में स्टार का बदलाव
- #129
aeneas एक Python/C लाइब्रेरी और टूल्स का एक सेट है जो ऑडियो और टेक्स्ट को स्वचालित रूप से सिंक करता है (जिसे फोर्स्ड अलाइनमेंट भी कहते हैं)
★ 2,862+0पिछले 7 दिनों में स्टार का बदलाव - #130
कुशल बहुभाषी NLP और टेक्स्ट सेगमेंटेशन; अंग्रेजी, चीनी, जापानी और अन्य का समर्थन करता है।
★ 2,842+0पिछले 7 दिनों में स्टार का बदलाव - #131★ 2,826+0पिछले 7 दिनों में स्टार का बदलाव
- #132
मशीन लर्निंग क्लासिफ़ायर्स को डिबग/निरीक्षण करने और उनकी भविष्यवाणियों को समझाने के लिए एक लाइब्रेरी
★ 2,817+0पिछले 7 दिनों में स्टार का बदलाव - #133★ 2,788+0पिछले 7 दिनों में स्टार का बदलाव
- #134★ 2,679+0पिछले 7 दिनों में स्टार का बदलाव
- #135
टेक्स्ट माइनिंग और प्रीप्रोसेसिंग टूल (टेक्स्ट क्लीनिंग, नए शब्दों की खोज, भावना विश्लेषण, एंटिटी रिकग्निशन लिंकिंग, कीवर्ड एक्सट्रैक्शन, नॉलेज एक्सट्रैक्शन, सिंटैक्स एनालिसिस आदि), अनसुपरवाइज्ड या वीकली सुपरवाइज्ड तरीकों का उपयोग करके
★ 2,629+0पिछले 7 दिनों में स्टार का बदलाव - #136
चीनी मेडिकल NLP सार्वजनिक संसाधनों का संकलन: शब्दावली/कॉर्पस/वर्ड वेक्टर/प्री-ट्रेनिंग मॉडल/नॉलेज ग्राफ/नेम एंटिटी रिकग्निशन/QA/सूचना निष्कर्षण/मॉडल/पेपर/आदि
★ 2,627+0पिछले 7 दिनों में स्टार का बदलाव - #137
PyTorch का उपयोग करके मशीन लर्निंग और डीप लर्निंग के साथ वास्तविक दुनिया की समस्याओं को हल करने पर Jupyter Notebook ट्यूटोरियल। विषय: Detectron 2 के साथ चेहरा पहचान, LSTM ऑटोएन्कोडर के साथ टाइम सीरीज़ विसंगति पहचान, YOLO v5 के साथ ऑब्जेक्ट डिटेक्शन, अपना पहला न्यूरल नेटवर्क बनाएं, कोरोनावायरस दैनिक मामलों के लिए टाइम सीरीज़ पूर्वानुमान, BERT के साथ सेंटीमेंट विश्लेषण
★ 2,503+0पिछले 7 दिनों में स्टार का बदलाव - #138★ 2,492+0पिछले 7 दिनों में स्टार का बदलाव
- #139
news-please - समाचारों के लिए एक एकीकृत वेब क्रॉलर और सूचना एक्सट्रैक्टर जो सुचारू रूप से काम करता है।
★ 2,485+0पिछले 7 दिनों में स्टार का बदलाव - #140
ओपन लार्ज लैंग्वेज मॉडल के लिए OpenAI-शैली का API, ChatGPT की तरह LLM का उपयोग करें! LLaMA, LLaMA-2, BLOOM, Falcon, Baichuan, Qwen, Xverse, SqlCoder, CodeLLaMA, ChatGLM, ChatGLM2, ChatGLM3 आदि के लिए समर्थन। ओपन-सोर्स बड़े मॉडल के लिए एकीकृत बैकएंड इंटरफ़ेस
★ 2,461+0पिछले 7 दिनों में स्टार का बदलाव - #141
सभी असंरचित डेटा से निपटना, जैसे रिवर्स इमेज सर्च, ऑडियो सर्च, मॉलिक्यूलर सर्च, वीडियो विश्लेषण, प्रश्न और उत्तर प्रणाली, NLP, आदि।
★ 2,445+0पिछले 7 दिनों में स्टार का बदलाव - #142
👩🏫 spaCy के साथ एडवांस्ड NLP: एक मुफ्त ऑनलाइन कोर्स
★ 2,428+0पिछले 7 दिनों में स्टार का बदलाव - #143
आपके ऐप के लिए सेल्फ-कोडिंग सिस्टम — वेब के लिए Alan AI SDK
★ 2,427+0पिछले 7 दिनों में स्टार का बदलाव - #144
🧠 शानदार ChatGPT संसाधनों की एक क्यूरेटेड सूची, जिसमें लाइब्रेरी, SDKs, APIs और बहुत कुछ शामिल है। 🌟 कृपया इस प्रोजेक्ट को स्टार देकर समर्थन करने पर विचार करें।
★ 2,397+0पिछले 7 दिनों में स्टार का बदलाव - #145★ 2,395+0पिछले 7 दिनों में स्टार का बदलाव
- #146
Kashgari टेक्स्ट-लेबलिंग और टेक्स्ट-क्लासिफिकेशन के लिए tf.keras के ऊपर बनाया गया एक प्रोडक्शन-लेवल NLP ट्रांसफर लर्निंग फ्रेमवर्क है, जिसमें Word2Vec, BERT और GPT2 लैंग्वेज एम्बेडिंग शामिल हैं।
★ 2,380+0पिछले 7 दिनों में स्टार का बदलाव - #147
लार्ज कॉन्सेप्ट मॉडल: एक वाक्य प्रतिनिधित्व स्थान में भाषा मॉडलिंग
★ 2,377+0पिछले 7 दिनों में स्टार का बदलाव - #148
दस्तावेज़ प्रकारों के बीच भाषा कैसे भिन्न होती है, इसके सुंदर विजुअलाइजेशन।
★ 2,341+0पिछले 7 दिनों में स्टार का बदलाव - #149
स्कैनर, ई-मेल और अन्य स्रोतों से प्राप्त दस्तावेजों के ढेर को न्यूनतम प्रयास के साथ व्यवस्थित करने में सहायता करें
★ 2,317+0पिछले 7 दिनों में स्टार का बदलाव - #150
सूचना पुनर्प्राप्ति के लिए एक विषम बेंचमार्क। उपयोग में आसान, 15+ से अधिक विभिन्न IR डेटासेट पर अपने मॉडल का मूल्यांकन करें।
★ 2,283+0पिछले 7 दिनों में स्टार का बदलाव