跳到主要內容
buildradar
登入
主題 · nlp

nlp

標記 nlp 主題、收錄中的開源專案,依星數排序。

共 440 個專案
  • lingua-py@pemistahl

    Python 中最準確的自然語言偵測函式庫,適用於短文字與混合語言文字

    1,788+0近 7 天星數變化
  • paperai@neuml

    📄 🤖 針對醫療與科學論文的 AI 工具

    1,778+0近 7 天星數變化
  • budoux@google
    1,774+0近 7 天星數變化
  • extractous@yobix-ai

    快速且高效的非結構化資料萃取。以 Rust 編寫,並提供多種語言的綁定。

    1,772+0近 7 天星數變化
  • 自然語言處理、知識圖譜、對話系統、大模型等技術研究與應用。

    1,766+0近 7 天星數變化
  • Research@PaddlePaddle

    使用 PaddlePaddle 進行的新穎深度學習研究工作。

    1,763+0近 7 天星數變化
  • ModernBERT@AnswerDotAI

    透過架構變更與擴展將 BERT 帶入現代化

    1,716+0近 7 天星數變化
  • awesome-ai-ml-dl@neomatrix369

    我們在學習過程中收集的人工智慧、機器學習與深度學習精選內容。包含學習筆記以及此類主題的優質資源列表。

    1,713+0近 7 天星數變化
  • Paper-Notes@zhaoyang97

    📚 數千篇 AI、LLM、NLP、CV 頂會論文解讀,每篇 5 分鐘讀懂核心思想。

    1,709+0近 7 天星數變化
  • graph4nlp@graph4ai

    Graph4nlp 是一個能輕鬆將圖神經網路(GNN)應用於 NLP 的函式庫。歡迎造訪我們的 DLG4NLP 網站 (https://dlg4nlp.github.io/index.html) 獲取各種學習資源!

    1,690+0近 7 天星數變化
  • sense2vec@explosion

    🦆 具備上下文鍵值的詞向量

    1,680+0近 7 天星數變化
  • Jackrong-llm-finetuning-guide@R6410418
    1,672+0近 7 天星數變化
  • tika-python@chrismattmann

    Tika-Python 是 Apache Tika™ REST 服務的 Python 綁定,允許在 Python 社群中原生呼叫 Tika。

    1,667+0近 7 天星數變化
  • Chinese-XLNet@ymcui

    預訓練中文 XLNet 模型

    1,646+0近 7 天星數變化
  • usaddress@datamade

    一個用於將非結構化美國地址字串解析為地址元件的 python 函式庫。

    1,637+0近 7 天星數變化
  • torchdistill@yoshitomo-matsubara

    基於 PyTorch 構建的無程式碼框架,用於可重複的深度學習研究。PyTorch 生態系統。🏆 至今已實作 26 種發表於 TPAMI、CVPR、IClR、ECCV、NeurIPS、ICCV、AAAI 等會議的知識蒸餾方法。🎁 提供已訓練模型、訓練日誌與設定檔,以確保可重複性與基準測試。

    1,630+0近 7 天星數變化
  • WikiChat@stanford-oval

    WikiChat 是一個改進的 RAG。它透過從語料庫檢索資料來阻止大型語言模型的幻覺。

    1,615+0近 7 天星數變化
  • opennlp@apache

    Apache OpenNLP

    1,602+0近 7 天星數變化
  • ExtractThinker@enoch3712

    ExtractThinker 是一個針對 LLM 的文件智慧函式庫,提供 ORM 風格的互動以實現靈活且強大的文件工作流程。

    1,596+0近 7 天星數變化
  • webarena@web-arena-x

    「WebArena: A Realistic Web Environment for Building Autonomous Agents」的程式碼儲存庫

    1,592+0近 7 天星數變化
  • similarity@shibing624

    similarity:Java 撰寫的文字相似度計算工具包,可用於文字相似度計算、情感分析等任務,開箱即用。

    1,584+0近 7 天星數變化
  • NL2SQL_Handbook@HKUSTDial

    這是一本持續更新的手冊,供讀者輕鬆追蹤文獻中的最新 Text-to-SQL 技術,並為研究人員與實務工作者提供實用指南。

    1,580+0近 7 天星數變化
  • DataProfiler@capitalone

    你的資料裡有什麼?從資料集中萃取 Schema、統計數據與實體

    1,579+0近 7 天星數變化
  • TAADpapers@thunlp

    關於文字對抗攻擊與防禦的必讀論文

    1,575+0近 7 天星數變化
  • 命名實體識別 (NER) 與實體識別任務的語料庫集合。這些標註資料集涵蓋多種語言、領域和實體類型。

    1,574+0近 7 天星數變化
  • rpaframework@robocorp

    機器人流程自動化(RPA)的開源函式庫與工具集合,設計用於 Robot Framework 與 Python

    1,555+0近 7 天星數變化
  • DeepMoji@bfelbo

    用於分析情感、情緒、諷刺等的先進深度學習模型。

    1,553+0近 7 天星數變化
  • 用於 CPU 與 GPU 上 transformer 推論(Bert、Albert、GPT2、Decoders 等)的快速且使用者友善的執行環境。

    1,550+0近 7 天星數變化
  • dolma@allenai

    用於產生與檢查 OLMo 預訓練資料的資料與工具。

    1,538+0近 7 天星數變化
  • nlp-lang@NLPchina

    這個專案是一個基本套件,封裝了大多數 NLP 專案中常用的工具

    1,507+0近 7 天星數變化
← 返回主題列表