跳到主要內容
buildradar
登入
主題 · nlp

nlp

標記 nlp 主題、收錄中的開源專案,依星數排序。

共 440 個專案
  • Introduction-NLP@NLP-LOVE

    HanLP 作者的新書《自然語言處理入門》詳細筆記!業界良心之作,書中不是枯燥無味的公式羅列,而是用白話闡述通俗易懂的演算法模型。從基本概念出發,逐步介紹中文分詞、詞性標註、命名實體識別、資訊抽取、文字聚類、文字分類、句法分析這幾個熱門問題的演算法原理與工程實現。

    2,270+0近 7 天星數變化
  • 使用 IDCNN/biLSTM+CRF 的中文命名實體識別,以及使用 biGRU+2ATT 的關係提取 中文实体识别与关系提取

    2,264+0近 7 天星數變化
  • TigerBot@TigerResearch

    TigerBot:一個多語言多任務 LLM

    2,259+0近 7 天星數變化
  • mt-dnn@namisan

    用於自然語言理解的多任務深度神經網路

    2,257+0近 7 天星數變化
  • [論文列表] 整合知識圖譜 (KGs) 與大型語言模型 (LLMs) 的論文

    2,228+0近 7 天星數變化
  • pytextrank@DerwenAI

    用於片語擷取的 TextRank 演算法(「textgraphs」)Python 實作。

    2,219+0近 7 天星數變化
  • xlstm@NX-AI

    xLSTM 的官方儲存庫。

    2,196+0近 7 天星數變化
  • model2vec@MinishLab

    快速且先進的靜態嵌入

    2,189+0近 7 天星數變化
  • EasyNLP@alibaba

    EasyNLP:全面且易用的 NLP 工具包

    2,186+0近 7 天星數變化
  • ecco@jalammar

    解釋、分析與視覺化 NLP 語言模型。Ecco 直接在 Jupyter notebooks 中建立互動式視覺化,用以解釋基於 Transformer 的語言模型(如 GPT2、BERT、RoBERTA、T5 與 T0)的行為。

    2,103+0近 7 天星數變化
  • docext@NanoNets

    本地部署、無需 OCR 的非結構化資料萃取、Markdown 轉換與基準測試工具包。(https://idp-leaderboard.org/)

    2,086+0近 7 天星數變化
  • Awesome-LM-SSP@CryptoAILab

    大型模型安全、防護與隱私的閱讀清單(包含 Awesome LLM Security, Safety 等)。

    2,070+0近 7 天星數變化
  • AliceMind@alibaba

    阿里達摩院機器智能實驗室 (MinD Lab) 的編碼器-解碼器集合

    2,041+0近 7 天星數變化
  • The-NLP-Pandect@ivan-bilan

    自然語言處理所有相關主題的全面參考資料

    2,038+0近 7 天星數變化
  • alpaca_eval@tatsu-lab

    指令遵循語言模型的自動評估器。經人工驗證、高品質、低成本且快速。

    2,012+0近 7 天星數變化
  • contextgem@shcherbak-ai

    ContextGem:輕鬆從文件中進行 LLM 萃取

    1,996+0近 7 天星數變化
  • RAGHub@Andrew-Jang

    社群驅動的 RAG(檢索增強生成)框架、專案與資源集合。歡迎貢獻並探索不斷演進的 RAG 生態系統。

    1,991+0近 7 天星數變化
  • scispacy@allenai

    用於科學/生物醫學文件的完整 spaCy 管道與模型。

    1,987+0近 7 天星數變化
  • 基於 Meta Llama 3 開發的中文羊駝大模型三期專案 (Chinese Llama-3 LLMs)

    1,980+0近 7 天星數變化
  • typed-japanese@typedgrammar

    🌸 使用 TypeScript 學習日語文法

    1,945+0近 7 天星數變化
  • spacy-models@explosion

    💫 用於 spaCy 自然語言處理 (NLP) 函式庫的模型

    1,901+0近 7 天星數變化
  • Transformers 庫快速入門教程

    1,892+0近 7 天星數變化
  • 知識圖譜相關的學習資料、資料庫、工具及其他資源精選清單

    1,885+0近 7 天星數變化
  • LLMCompiler@SqueezeAILab

    [ICML 2024] LLMCompiler:用於平行函式呼叫的 LLM 編譯器

    1,879+0近 7 天星數變化
  • nlpcda@425776024

    一鍵中文數據增強包 ; NLP數據增強、bert數據增強、EDA:pip install nlpcda

    1,879+0近 7 天星數變化
  • spago@nlpodyssey

    Go 語言編寫的獨立機器學習與自然語言處理函式庫。

    1,850+0近 7 天星數變化
  • nltk_data@nltk

    NLTK 資料

    1,828+0近 7 天星數變化
  • 中文長文本分類、短句子分類、多標籤分類、兩句子相似度(Chinese Text Classification of Keras NLP, multi-label classify, or sentence classify, long or short),字詞句向量嵌入層(embeddings)和網路層(graph)構建基類,FastText,TextCNN,CharCNN,TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, 膠囊網路-CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN

    1,808+0近 7 天星數變化
  • underthesea@undertheseanlp

    Underthesea - AI 助理

    1,803+0近 7 天星數變化
  • Microsoft.Recognizers.Text 提供多語言(ZH、EN、FR、ES、PT、DE、IT、TR、HI、NL,部分支援 JA、KO、AR、SV)的數字、單位、日期/時間等辨識與解析功能。套件可於以下位置取得:https://www.nuget.org/profiles/Recognizers.Text、https://www.npmjs.com/~recognizers.text

    1,794+0近 7 天星數變化
← 返回主題列表