跳到主要內容
buildradar
登入
主題 · nlp

nlp

標記 nlp 主題、收錄中的開源專案,依星數排序。

共 440 個專案
  • spacy-stanza@explosion

    💥 直接在 spaCy 中使用最新的 Stanza (StanfordNLP) 研究模型

    746+0近 7 天星數變化
  • Octopii@redhuntlabs

    一個由 AI 驅動的個人識別資訊(PII)掃描器。

    745+0近 7 天星數變化
  • poetry@sheepzh

    地球上最全的華語現代詩歌語料庫,3k+ 詩人,80K+ 詩歌,15M+ 字

    743+3近 7 天星數變化
  • primeqa@primeqa

    用於最先進多語言問答研究與開發的主要儲存庫。

    738-1近 7 天星數變化
  • pubmed_parser@titipata

    :clipboard: 用於 PubMed 開放存取 XML 子集與 MEDLINE XML 資料集的 Python 解析器

    738+0近 7 天星數變化
  • Legal-Text-Analytics@Liquid-Legal-Institute

    專門用於法律文字分析的精選資源、方法與工具列表。

    734+1近 7 天星數變化
  • attention_sinks@tomaarsen

    在常數記憶體用量下,將現有 LLM 的長度大幅擴充套件至原始訓練長度之外,且無需重新訓練

    734-1近 7 天星數變化
  • PromptKG@zjunlp

    PromptKG 家族:Prompt 學習與知識圖譜(KG)相關研究工作、工具包與論文列表的展示庫。

    734+1近 7 天星數變化
  • 729+0近 7 天星數變化
  • OpenAI-CLIP@moein-shariatnia

    在 PyTorch 中簡單實現 OpenAI CLIP 模型

    726+0近 7 天星數變化
  • xgen@salesforce

    具備 8k 序列長度的 Salesforce 開源 LLM。

    726+0近 7 天星數變化
  • karukan@togatoga

    適用於 Linux 與 macOS 的日文輸入法系統,具備神經網路假名漢字轉換引擎

    721+4近 7 天星數變化
  • 重新審視中文自然語言處理的預訓練模型(MacBERT)。

    721+1近 7 天星數變化
  • searchGPT@michaelthwan

    基於 LLM / ChatGPT / OpenAI API 的接地搜尋引擎(即附帶來源參照)。支援網路搜尋、檔案內容搜尋等功能。

    711+0近 7 天星數變化
  • vectorflow@dgarnitz

    VectorFlow 是一個高吞吐量的向量嵌入管線,能擷取原始資料、將其轉換為向量,並寫入您選擇的向量資料庫中。

    703+0近 7 天星數變化
  • chat@Decalogue

    基於自然語言理解與機器學習的聊天機器人,支援多用戶併發及自定義多輪對話

    702+0近 7 天星數變化
  • 全端機器學習(ML)學習藍圖涵蓋成為機器學習各方面專家所需的技能與技術,包含資料收集與前處理、模型開發、部署與維護。

    700-1近 7 天星數變化
  • Blackstone@ICLRandD

    用於非結構化法律文字 NLP 的 spaCy 管道與模型。

    696+0近 7 天星數變化
  • WeCron@polyrabbit

    :heavy_check_mark: 微信上的定時提醒 - Cron on WeChat

    691+0近 7 天星數變化
  • langchain_dart@davidmigloz

    建構由 LLM 驅動的 Dart/Flutter 應用程式。

    686+0近 7 天星數變化
  • Rankify@DataScienceUIBK

    🔥 Rankify:用於檢索、重新排序與檢索增強生成(RAG)的全方位 Python 工具包 🔥。本工具包整合了 40 個預先檢索的基準資料集,並支援 7 種以上檢索技術、24 種以上最先進的 Reranking 模型以及多種 RAG 方法。

    683+2近 7 天星數變化
  • stanford-openie-python@philipperemy

    讓 Stanford Open Information Extraction 變得簡單!

    682+0近 7 天星數變化
  • medspacy@medspacy

    用於臨床 NLP 的 spaCy 函式庫。

    676+2近 7 天星數變化
  • Chinese_models_for_SpaCy@howl-anderson

    SpaCy 中文模型

    673+0近 7 天星數變化
  • ekphrasis@cbaziotis

    Ekphrasis 是一個文字處理工具,專為來自 Twitter 或 Facebook 等社群網路的文字而設計。Ekphrasis 使用來自兩個大型語料庫(英文維基百科、Twitter - 3.3億條英文推文)的單字統計數據,執行標記化、單字正規化、單字分割(用於分割 hashtag)和拼字校正。

    673+0近 7 天星數變化
  • semchunk@isaacus-dev

    一個快速、輕量且易於使用的 Python 函式庫,用於將文字分割成具有語意意義的語塊。

    666+2近 7 天星數變化
  • JamSpell@bakwc

    現代化的拼字檢查函式庫 - 準確、快速、多語言支援。

    665+2近 7 天星數變化
  • datefinder@akoumjian

    使用 Python 在文字中尋找日期並傳回 datetime 物件

    665+0近 7 天星數變化
  • pysentimiento@pysentimiento

    用於情感分析與社群 NLP 任務的 Python 多語言工具包

    659-1近 7 天星數變化
  • obsidian-ava@different-ai

    在 Obsidian 中使用 ChatGPT 快速格式化你的筆記

    658-2近 7 天星數變化
← 返回主題列表