nlp
Erfasste Open-Source-Repos mit dem Tag nlp, sortiert nach Sternen.
- #151
Detaillierte Notizen zum neuen Buch „Einführung in die natürliche Sprachverarbeitung“ des HanLP-Autors! Ein Meisterwerk der Branche, das statt trockener Formeln leicht verständliche Algorithmenmodelle in Alltagssprache erklärt. Ausgehend von grundlegenden Konzepten werden die Algorithmenprinzipien und technischen Implementierungen populärer Themen wie chinesische Wortsegmentierung, Part-of-Speech-Tagging, Eigennamenerkennung, Informationsextraktion, Text-Clustering, Textklassifikation und syntaktische Analyse Schritt für Schritt vorgestellt.
★ 2.270+0Sterne-Änderung der letzten 7 Tage - #152
Chinesische Named Entity Recognition mit IDCNN/biLSTM+CRF und Relation Extraction mit biGRU+2ATT (Chinesische Entitätserkennung und Beziehungsextraktion)
★ 2.264+0Sterne-Änderung der letzten 7 Tage - #153★ 2.259+0Sterne-Änderung der letzten 7 Tage
- #154★ 2.257+0Sterne-Änderung der letzten 7 Tage
- #155
[Paper-Liste] Paper zur Integration von Wissensgraphen (KGs) und Large Language Models (LLMs)
★ 2.228+0Sterne-Änderung der letzten 7 Tage - #156
Python-Implementierung von TextRank-Algorithmen ("textgraphs") zur Phrasenextraktion
★ 2.219+0Sterne-Änderung der letzten 7 Tage - #157★ 2.196+0Sterne-Änderung der letzten 7 Tage
- #158★ 2.189+0Sterne-Änderung der letzten 7 Tage
- #159★ 2.186+0Sterne-Änderung der letzten 7 Tage
- #160
NLP-Sprachmodelle erklären, analysieren und visualisieren. Ecco erstellt interaktive Visualisierungen direkt in Jupyter Notebooks, um das Verhalten von Transformer-basierten Sprachmodellen (wie GPT2, BERT, RoBERTA, T5 und T0) zu erklären.
★ 2.103+0Sterne-Änderung der letzten 7 Tage - #161
Ein lokales, OCR-freies Toolkit zur Extraktion unstrukturierter Daten, Markdown-Konvertierung und Leistungsbewertung. (https://idp-leaderboard.org/)
★ 2.086+0Sterne-Änderung der letzten 7 Tage - #162
Eine Leseliste zur Sicherheit, dem Schutz und der Privatsphäre großer Modelle (einschließlich Awesome LLM Security, Safety usw.).
★ 2.070+0Sterne-Änderung der letzten 7 Tage - #163
Sammlung von Encoder-Decodern von ALIbaba aus dem MinD (Machine IntelligeNce of Damo) Lab
★ 2.041+0Sterne-Änderung der letzten 7 Tage - #164
Ein umfassendes Nachschlagewerk für alle Themen rund um die natürliche Sprachverarbeitung (NLP)
★ 2.038+0Sterne-Änderung der letzten 7 Tage - #165
Ein automatischer Evaluator für anweisungsbefolgende Sprachmodelle. Von Menschen validiert, qualitativ hochwertig, günstig und schnell.
★ 2.012+0Sterne-Änderung der letzten 7 Tage - #166
ContextGem: Mühelose LLM-Extraktion aus Dokumenten
★ 1.996+0Sterne-Änderung der letzten 7 Tage - #167
Eine von der Community betriebene Sammlung von RAG-Frameworks (Retrieval-Augmented Generation), Projekten und Ressourcen. Tragen Sie bei und erkunden Sie das sich entwickelnde RAG-Ökosystem.
★ 1.991+0Sterne-Änderung der letzten 7 Tage - #168
Eine vollständige spaCy-Pipeline und Modelle für wissenschaftliche/biomedizinische Dokumente.
★ 1.987+0Sterne-Änderung der letzten 7 Tage - #169
Chinesisches Llama-3 LLM-Projekt der dritten Generation, entwickelt auf Basis von Meta Llama 3
★ 1.980+0Sterne-Änderung der letzten 7 Tage - #170
🌸 Japanische Grammatik lernen mit TypeScript
★ 1.945+0Sterne-Änderung der letzten 7 Tage - #171
💫 Modelle für die Natural Language Processing (NLP)-Bibliothek spaCy
★ 1.901+0Sterne-Änderung der letzten 7 Tage - #172
Einführungstutorial für die Transformers-Bibliothek
★ 1.892+0Sterne-Änderung der letzten 7 Tage - #173
Eine kuratierte Liste von Lernmaterialien, Datenbanken, Tools und anderen Ressourcen rund um Knowledge Graphs.
★ 1.885+0Sterne-Änderung der letzten 7 Tage - #174
[ICML 2024] LLMCompiler: Ein LLM-Compiler für paralleles Funktionsaufrufen
★ 1.879+0Sterne-Änderung der letzten 7 Tage - #175
Ein-Klick-Paket für chinesische Datenerweiterung; NLP-Datenerweiterung, BERT-Datenerweiterung, EDA: pip install nlpcda
★ 1.879+0Sterne-Änderung der letzten 7 Tage - #176★ 1.850+0Sterne-Änderung der letzten 7 Tage
- #177★ 1.828+0Sterne-Änderung der letzten 7 Tage
- #178
Chinesische Textklassifizierung, Kurzsatzklassifizierung, Multi-Label-Klassifizierung, Satzähnlichkeit, Basisklassen für die Erstellung von Wort-/Satz-Vektoreinbettungsschichten (embeddings) und Netzwerkschichten (graph), FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN
★ 1.808+0Sterne-Änderung der letzten 7 Tage - #179
Underthesea – KI-Assistent
★ 1.803+0Sterne-Änderung der letzten 7 Tage - #180
Microsoft.Recognizers.Text bietet Erkennung und Auflösung von Zahlen, Einheiten, Datum/Uhrzeit usw. in mehreren Sprachen (ZH, EN, FR, ES, PT, DE, IT, TR, HI, NL. Teilweise Unterstützung für JA, KO, AR, SV). Pakete verfügbar unter: https://www.nuget.org/profiles/Recognizers.Text, https://www.npmjs.com/~recognizers.text
★ 1.794+0Sterne-Änderung der letzten 7 Tage