跳到主要內容
buildradar
登入
主題 · nlp

nlp

標記 nlp 主題、收錄中的開源專案,依星數排序。

共 440 個專案
  • donut@clovaai

    官方實作 OCR-free Document Understanding Transformer(Donut)與 Synthetic Document Generator(SynthDoG),ECCV 2022。

    6,917+0近 7 天星數變化
  • trafilatura@adbar

    Python 與命令列工具,用於在網路上收集文字與中繼資料:爬蟲、擷取、抽取,輸出為 CSV、JSON、HTML、MD、TXT、XML

    6,754+0近 7 天星數變化
  • nlp.js@axa-group

    用於構建機器人之自然語言處理函式庫,具備實體抽取、情感分析、自動語言辨識等功能

    6,588+0近 7 天星數變化
  • courses@SkalskiP

    此倉庫是關於人工智慧(AI)的各種課程與資源的精選鏈接集合

    6,482+0近 7 天星數變化
  • argos-translate@argosopentech

    用 Python 编写的开源离线翻译库

    6,425+0近 7 天星數變化
  • smile@haifengl

    統計機器智慧與學習引擎

    6,416+0近 7 天星數變化
  • TagUI@aisingapore

    AI Singapore 提供的免費 RPA 工具

    6,327+0近 7 天星數變化
  • tensorflow_cookbook@nfmcclure

    Tensorflow 机器学习 Cookbook 的代码

    6,238+0近 7 天星數變化
  • Parsr@axa-group

    將PDF、文件和圖像轉換為增強結構化數據

    6,176+0近 7 天星數變化
  • 👮‍♂️ Java 敏感詞工具(敏感詞/違禁詞/違法詞/髒詞)。基於 DFA 演算法的高效能 Java 敏感詞過濾框架,內建單詞標籤分類分級。請勿發布涉及政治、廣告、營銷、翻牆、違反國家法律法規等內容。高效能敏感詞檢測過濾元件,附繁體簡體互換、全角半角互換、漢字轉拼音、模糊搜尋等功能。

    6,036+0近 7 天星數變化
  • Chinese-CLIP@OFA-Sys

    中文版本的 CLIP,實現中文跨模態檢索與表徵生成。

    6,001+0近 7 天星數變化
  • flashtext@vi3k6i5

    从句子中提取关键词或替换句子中的关键词

    5,709+0近 7 天星數變化
  • Awesome Pretrained Chinese NLP Models,高品質中文預訓練模型、 大模型、多模態模型與大語言模型集合。

    5,584+0近 7 天星數變化
  • ltp@HIT-SCIR

    語言技術平台。

    5,259+0近 7 天星數變化
  • openmed@maziyarpanahi

    本地優先醫療 AI:臨床 NER 與 HIPAA PII 去識別化,100% 端上執行,2,200+ 醫療模型,21 種語言,Apple MLX + Python,無雲端,無病患資料離開網路。Apache-2.0

    5,199+0近 7 天星數變化
  • im-not-ai@epoko77-ai

    AI 撰寫的韓文被 Claude 重新寫成像人類文字的技能 — Korean AI-text humanizer:偵測並重寫翻譯痕跡、機械式平行、以及 71 種其他 AI 特色

    5,178+0近 7 天星數變化
  • EasyR1@hiyouga

    EasyR1:一個基於 veRL 的高效、可擴展、多模態 RL 訓練框架。

    5,141+0近 7 天星數變化
  • Synonyms@chatopera

    :herb: 中文近義詞:聊天機器人,智能問答工具包

    5,111+0近 7 天星數變化
  • argilla@argilla-io

    Argilla 是一個協作工具,供 AI 工程師與領域專家構建高品質資料集

    5,093+0近 7 天星數變化
  • BenCao(原名:HuaTuo)模型倉庫,基於中文醫學知識的大語言模型指令微調

    4,989+0近 7 天星數變化
  • text2vec@shibing624

    text2vec,文本转向量。文本向量表征工具,把文本转化为向量矩阵,实现了 Word2Vec、RankBM25、Sentence-BERT、CoSENT 等文本表征、文本相似度计算模型,开箱即用

    4,974+0近 7 天星數變化
  • ml-road@yanshengjia

    機器學習與代理式 AI 資源、實踐與研究

    4,927+0近 7 天星數變化
  • OpenPrompt@thunlp

    一個開源 Prompt‑Learning 框架

    4,889+0近 7 天星數變化
  • libpostal@openvenues

    一個用於解析/標準化全球街道地址的 C 函式庫,採用統計 NLP 與開放地理資料

    4,880+0近 7 天星數變化
  • Learn_Prompting@trigaten

    Prompt Engineering、生成式 AI 與 LLM 指南,由 Learn Prompting 提供 | 加入我們的 Discord,加入最大的 Prompt Engineering 學習社群

    4,728+0近 7 天星數變化
  • nlpaug@makcedward

    用於 NLP 的資料增強

    4,665+0近 7 天星數變化
  • Promptify@promptslab

    Prompt Engineering | Prompt Versioning | 使用 GPT 或其他基於 Prompt 的模型獲取結構化輸出。加入我們的 Discord,了解 Prompt-Engineering、LLM 及其他最新研究

    4,637+0近 7 天星數變化
  • pytorch-sentiment-analysis@bentrevett

    使用 PyTorch 與 TorchText 進行情感分析的入門教學

    4,612+0近 7 天星數變化
  • LLMBook-zh.github.io@LLMBook-zh

    《大語言模型》作者:趙鑫,李軍毅,周昆,唐天一,文繼榮

    4,557+0近 7 天星數變化
  • 精選大型語言模型、AI 繪畫等教程與資源。

    4,537+0近 7 天星數變化
← 返回主題列表