nlp
nlp टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #151
HanLP के लेखक की नई पुस्तक 'नेचुरल लैंग्वेज प्रोसेसिंग इंट्रोडक्शन' के विस्तृत नोट्स! उद्योग की एक बेहतरीन कृति, जिसमें बोरिंग फॉर्मूलों की भरमार के बजाय आसान भाषा में एल्गोरिदम मॉडल समझाए गए हैं। बुनियादी अवधारणाओं से शुरू करते हुए, चीनी वर्ड सेगमेंटेशन, पार्ट-ऑफ-स्पीच टैगिंग, नेम्ड एंटिटी रिकग्निशन, इंफॉर्मेशन एक्सट्रैक्शन, टेक्स्ट क्लस्टरिंग, टेक्स्ट क्लासिफ़िकेशन और सिंटैक्स एनालिसिस जैसे लोकप्रिय मुद्दों के एल्गोरिदम सिद्धांतों और इंजीनियरिंग कार्यान्वयन को चरण-दर-चरण प्रस्तुत किया गया है।
★ 2,270+0पिछले 7 दिनों में स्टार का बदलाव - #152
IDCNN/biLSTM+CRF के साथ चीनी नामित एंटिटी पहचान, और biGRU+2ATT के साथ संबंध निष्कर्षण
★ 2,264+0पिछले 7 दिनों में स्टार का बदलाव - #153★ 2,259+0पिछले 7 दिनों में स्टार का बदलाव
- #154★ 2,257+0पिछले 7 दिनों में स्टार का बदलाव
- #155
[पेपर लिस्ट] ज्ञान ग्राफ़ (KGs) और बड़े भाषा मॉडल (LLMs) को एकीकृत करने वाले पेपर
★ 2,228+0पिछले 7 दिनों में स्टार का बदलाव - #156
वाक्यांश निष्कर्षण के लिए TextRank एल्गोरिदम ("textgraphs") का Python कार्यान्वयन
★ 2,219+0पिछले 7 दिनों में स्टार का बदलाव - #157★ 2,196+0पिछले 7 दिनों में स्टार का बदलाव
- #158★ 2,189+0पिछले 7 दिनों में स्टार का बदलाव
- #159★ 2,186+0पिछले 7 दिनों में स्टार का बदलाव
- #160
NLP भाषा मॉडल की व्याख्या, विश्लेषण और विज़ुअलाइज़ करें। Ecco सीधे Jupyter notebooks में इंटरैक्टिव विज़ुअलाइज़یشن बनाता है जो Transformer-आधारित भाषा मॉडल (जैसे GPT2, BERT, RoBERTA, T5, और T0) के व्यवहार को समझाता है।
★ 2,103+0पिछले 7 दिनों में स्टार का बदलाव - #161
एक ऑन-प्रिमाइसेस, OCR-मुक्त असं estructured डेटा निष्कर्षण, मार्कडाउन रूपांतरण और बेंचमार्किंग टूलकिट। (https://idp-leaderboard.org/)
★ 2,086+0पिछले 7 दिनों में स्टार का बदलाव - #162
बड़े मॉडल की सुरक्षा, संरक्षा और गोपनीयता के लिए एक पठन सूची (Awesome LLM Security, Safety, आदि सहित)।
★ 2,070+0पिछले 7 दिनों में स्टार का बदलाव - #163★ 2,041+0पिछले 7 दिनों में स्टार का बदलाव
- #164
नैचुरल लैंग्वेज प्रोसेसिंग से संबंधित सभी विषयों के लिए एक व्यापक संदर्भ
★ 2,038+0पिछले 7 दिनों में स्टार का बदलाव - #165
निर्देश-पालन करने वाले भाषा मॉडल के लिए एक स्वचालित मूल्यांकनकर्ता। मानव-सत्यापित, उच्च-गुणवत्ता, सस्ती और तेज़।
★ 2,012+0पिछले 7 दिनों में स्टार का बदलाव - #166
ContextGem: दस्तावेजों से सहज LLM निष्कर्षण
★ 1,996+0पिछले 7 दिनों में स्टार का बदलाव - #167
RAG (Retrieval-Augmented Generation) फ्रेमवर्क, प्रोजेक्ट्स और संसाधनों का एक कम्युनिटी-संचालित संग्रह। विकसित हो रहे RAG इकोसिस्टम में योगदान करें और इसे explore करें।
★ 1,991+0पिछले 7 दिनों में स्टार का बदलाव - #168★ 1,987+0पिछले 7 दिनों में स्टार का बदलाव
- #169
Meta Llama 3 से विकसित चीनी लामा-3 LLM (Chinese Llama-3 LLMs) तीसरा चरण परियोजना
★ 1,980+0पिछले 7 दिनों में स्टार का बदलाव - #170
🌸 TypeScript के साथ जापानी व्याकरण सीखें
★ 1,945+0पिछले 7 दिनों में स्टार का बदलाव - #171
💫 spaCy नेचुरल लैंग्वेज प्रोसेसिंग (NLP) लाइब्रेरी के लिए मॉडल्स
★ 1,901+0पिछले 7 दिनों में स्टार का बदलाव - #172
Transformers लाइब्रेरी के लिए त्वरित आरंभ ट्यूटोरियल
★ 1,892+0पिछले 7 दिनों में स्टार का बदलाव - #173
नॉलेज ग्राफ़ से संबंधित शिक्षण सामग्री, डेटाबेस, टूल्स और अन्य संसाधनों की क्यूरेटेड सूची।
★ 1,885+0पिछले 7 दिनों में स्टार का बदलाव - #174
वन-क्लिक चीनी डेटा संवर्धन पैकेज; NLP डेटा संवर्धन, bert डेटा संवर्धन, EDA: pip install nlpcda
★ 1,879+0पिछले 7 दिनों में स्टार का बदलाव - #175
[ICML 2024] LLMCompiler: समानांतर फ़ंक्शन कॉलिंग के लिए एक LLM कंपाइलर
★ 1,879+0पिछले 7 दिनों में स्टार का बदलाव - #176★ 1,850+0पिछले 7 दिनों में स्टार का बदलाव
- #177★ 1,828+0पिछले 7 दिनों में स्टार का बदलाव
- #178
चीनी लॉन्ग टेक्स्ट क्लासिफिकेशन, शॉर्ट सेंटेंस क्लासिफिकेशन, मल्टी-लेबल क्लासिफिकेशन, दो वाक्यों की समानता (Keras NLP का चीनी टेक्स्ट क्लासिफिकेशन, मल्टी-लेबल क्लासिफिकेशन, या सेंटेंस क्लासिफिकेशन, लॉन्ग या शॉर्ट), वर्ड/कैरेक्टर/सेंटेंस एम्बेडिंग लेयर और ग्राफ कंस्ट्रक्शन बेस क्लास, FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, कैप्सूल नेटवर्क-CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN
★ 1,808+0पिछले 7 दिनों में स्टार का बदलाव - #179
Underthesea - AI सहायक
★ 1,803+0पिछले 7 दिनों में स्टार का बदलाव - #180
Microsoft.Recognizers.Text कई भाषाओं में संख्याओं, इकाइयों, तिथि/समय आदि की पहचान और समाधान प्रदान करता है।
★ 1,794+0पिछले 7 दिनों में स्टार का बदलाव