nlp
nlp टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #331
💥 spaCy में सीधे नवीनतम Stanza (StanfordNLP) अनुसंधान मॉडल का उपयोग करें
★ 746+0पिछले 7 दिनों में स्टार का बदलाव - #332★ 745+0पिछले 7 दिनों में स्टार का बदलाव
- #333★ 742+3पिछले 7 दिनों में स्टार का बदलाव
- #334
अत्याधुनिक बहुभाषी प्रश्नोत्तर (Multilingual Question Answering) अनुसंधान और विकास के लिए मुख्य रिपॉजिटरी
★ 738-1पिछले 7 दिनों में स्टार का बदलाव - #335
:clipboard: PubMed ओपन-एक्सेस XML सबसेट और MEDLINE XML डेटासेट के लिए एक Python पार्सर
★ 738+0पिछले 7 दिनों में स्टार का बदलाव - #336
कानूनी पाठ विश्लेषण (Legal Text Analytics) के लिए समर्पित चयनित संसाधनों, विधियों और उपकरणों की एक सूची।
★ 735+1पिछले 7 दिनों में स्टार का बदलाव - #337
बिना रिट्रेनिंग के, निरंतर मेमोरी उपयोग के साथ मौजूदा LLMs को उनकी मूल प्रशिक्षण लंबाई से काफी आगे बढ़ाएं
★ 734-1पिछले 7 दिनों में स्टार का बदलाव - #338
PromptKG फैमिली: प्रॉम्प्ट लर्निंग और KG-संबंधित शोध कार्यों, टूलकिट और पेपर-लिस्ट की एक गैलरी।
★ 734+1पिछले 7 दिनों में स्टार का बदलाव - #339★ 729+0पिछले 7 दिनों में स्टार का बदलाव
- #340★ 726+0पिछले 7 दिनों में स्टार का बदलाव
- #341
PyTorch में OpenAI CLIP मॉडल का सरल कार्यान्वयन।
★ 726+0पिछले 7 दिनों में स्टार का बदलाव - #342★ 721+1पिछले 7 दिनों में स्टार का बदलाव
- #343★ 720+4पिछले 7 दिनों में स्टार का बदलाव
- #344
LLM / ChatGPT / OpenAI API पर आधारित ग्राउंडेड सर्च इंजन (स्रोत संदर्भ के साथ)। यह वेब सर्च और फाइल कंटेंट सर्च आदि का समर्थन करता है।
★ 711+0पिछले 7 दिनों में स्टार का बदलाव - #345
VectorFlow एक उच्च-वॉल्यूम वेक्टर एम्बेडिंग पाइपलाइन है जो कच्चे डेटा को इनजेस्ट करती है, उसे वेक्टर में बदलती है और आपकी पसंद के वेक्टर DB में लिखती है।
★ 703+0पिछले 7 दिनों में स्टार का बदलाव - #346
प्राकृतिक भाषा समझ और मशीन लर्निंग पर आधारित चैटबॉट, जो मल्टी-यूज़र कॉनकरेंसी और कस्टम मल्टी-टर्न डायलॉग का समर्थन करता है
★ 702+0पिछले 7 दिनों में स्टार का बदलाव - #347
एक फुल स्टैक ML (मशीन लर्निंग) रोडमैप जिसमें डेटा संग्रह और प्रीप्रोसेसिंग, मॉडल डेवलपमेंट, डिप्लॉयमेंट और मेंटेनेंस सहित मशीन लर्निंग के सभी पहलुओं में कुशल बनने के लिए आवश्यक कौशल और तकनीकों को सीखना शामिल है।
★ 701+0पिछले 7 दिनों में स्टार का बदलाव - #348
असंरचित कानूनी टेक्स्ट पर NLP के लिए एक spaCy पाइपलाइन और मॉडल।
★ 696+0पिछले 7 दिनों में स्टार का बदलाव - #349★ 691+0पिछले 7 दिनों में स्टार का बदलाव
- #350
LLM-संचालित Dart/Flutter एप्लिकेशन बनाएं।
★ 686+0पिछले 7 दिनों में स्टार का बदलाव - #351
Stanford Open Information Extraction को सरल बनाया गया!
★ 682+0पिछले 7 दिनों में स्टार का बदलाव - #352
Rankify: रिट्रीवल, री-रैंकिंग और रिट्रीवल-ऑगमेंटेड जनरेशन के लिए एक व्यापक Python टूलकिट। यह टूलकिट 40 प्री-रिट्रीव्ड बेंचमार्क डेटासेट को एकीकृत करता है और 7+ रिट्रीवल तकनीक, 24+ अत्याधुनिक री-रैंकिंग मॉडल और कई RAG विधियों का समर्थन करता है।
★ 682+1पिछले 7 दिनों में स्टार का बदलाव - #353★ 675+1पिछले 7 दिनों में स्टार का बदलाव
- #354
SpaCy के लिए चीनी भाषा मॉडल।
★ 673+0पिछले 7 दिनों में स्टार का बदलाव - #355
Ekphrasis एक टेक्स्ट प्रोसेसिंग टूल है, जो Twitter या Facebook जैसे सोशल नेटवर्क के टेक्स्ट के लिए बनाया गया है। यह 2 बड़े कॉर्पोरा (अंग्रेजी Wikipedia, Twitter - 330 मिलियन अंग्रेजी ट्वीट्स) के सांख्यिकी का उपयोग करके टोकनाइज़ेशन, वर्ड नॉर्मलाइज़ेशन, वर्ड सेगमेंटेशन (हैशटैग को विभाजित करने के लिए) और स्पेल करेक्शन करता है।
★ 673+0पिछले 7 दिनों में स्टार का बदलाव - #356
पायथन का उपयोग करके टेक्स्ट के भीतर तारीखें खोजें और datetime ऑब्जेक्ट्स प्राप्त करें
★ 665+0पिछले 7 दिनों में स्टार का बदलाव - #357
टेक्स्ट को अर्थपूर्ण टुकड़ों में विभाजित करने के लिए एक तेज़, हल्का और उपयोग में आसान Python लाइब्रेरी।
★ 665+1पिछले 7 दिनों में स्टार का बदलाव - #358★ 664+1पिछले 7 दिनों में स्टार का बदलाव
- #359
Sentiment Analysis और Social NLP कार्यों के लिए एक Python बहुभाषी टूलकिट।
★ 660+0पिछले 7 दिनों में स्टार का बदलाव - #360
Obsidian में ChatGPT के साथ अपने नोट्स को जल्दी से फॉर्मेट करें।
★ 658-2पिछले 7 दिनों में स्टार का बदलाव