跳到主要内容
buildradar
Sign in
主题 · text-classification

text-classification

标记 text-classification 主题、收录中的开源项目,按星标数排序。

项目数
37
总星标数
133,930
平均星标数
3,620
占比
0.01%

常跟 text-classification 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 text-classification 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • HanLP@hankcs

    中文分词、词性标注、命名实体识别、依存句法分析、成分句法分析、语义依存分析、语义角色标注、指代消解、风格转换、语义相似度、新词发现、关键词短语提取、自动摘要、文本分类聚类、拼音简繁转换、自然语言处理

    36,484+3近 7 天星标变化
  • spaCy@explosion

    💫 工业级自然语言处理(NLP)于 Python

    33,869+8近 7 天星标变化
  • 大规模中文自然语言处理语料库 Large Scale Chinese Corpus for NLP

    9,912+2近 7 天星标变化
  • CNN-RNN 中文文本分类,基于 TensorFlow

    4,301+0近 7 天星标变化
  • simpletransformers@ThilinaRajapakse

    信息检索、文本分类、NER、QA、语言建模、语言生成、T5、多模态与对话式 AI 的 Transformers

    4,253-1近 7 天星标变化
  • spark-nlp@JohnSnowLabs

    前沿自然语言处理

    4,160+1近 7 天星标变化
  • mteb@embeddings-benchmark

    MTEB:跨语言与多模态嵌入的最先进评估

    3,414+5近 7 天星标变化
  • catalyst@catalyst-team

    加速深度学习研发

    3,382+0近 7 天星标变化
  • pythoncode-tutorials@x4nth055

    Python 代码教程

    3,000-1近 7 天星标变化
  • Kashgari@BrikerMan

    Kashgari 是一个构建在 tf.keras 之上的生产级 NLP 迁移学习框架,用于文本标记与文本分类,包含 Word2Vec、BERT 与 GPT2 语言嵌入。

    2,380-1近 7 天星标变化
  • EasyNLP@alibaba

    EasyNLP:全面且易用的 NLP 工具包

    2,186+2近 7 天星标变化
  • [ACL 2023] 单一嵌入器,任何任务:指令微调文本嵌入

    2,023+0近 7 天星标变化
  • 文本分类算法综述

    1,818-1近 7 天星标变化
  • 中文长文本分类、短句子分类、多标签分类、两句子相似度(Chinese Text Classification of Keras NLP, multi-label classify, or sentence classify, long or short),字词句向量嵌入层(embeddings)和网络层(graph)构建基类,FastText,TextCNN,CharCNN,TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, 胶囊网络-CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN

    1,808+0近 7 天星标变化
  • torchdistill@yoshitomo-matsubara

    基于 PyTorch 构建的无代码框架,用于可复现的深度学习研究。PyTorch 生态系统。🏆 至今已实现 26 种发表于 TPAMI、CVPR、ICLR、ECCV、NeurIPS、ICCV、AAAI 等会议的知识蒸馏方法。🎁 提供已训练模型、训练日志与配置文件,以确保可复现性与基准测试。

    1,630+0近 7 天星标变化
  • DeepMoji@bfelbo

    用于分析情感、情绪、讽刺等的先进深度学习模型。

    1,553-1近 7 天星标变化
  • refinery@code-kern-ai

    数据科学家用来规模化、评估与维护自然语言数据的开源首选。将训练数据视同软件构件来对待。

    1,469+0近 7 天星标变化
  • obsei@obsei

    Obsei 是一个低代码的 AI 驱动自动化工具。可用于社交聆听、基于 AI 的警报、品牌形象分析、比较研究等各种业务流程。

    1,425-2近 7 天星标变化
  • spacy-llm@explosion

    🦙 将 LLM 整合至结构化 NLP 流水线中

    1,394+0近 7 天星标变化
  • bert4torch@Tongjilibo

    一个优雅的 transformers 的 PyTorch 实现

    1,327-1近 7 天星标变化
  • whatlang-rs@greyblake

    适用于 Rust 的自然语言检测库。在线试用:https://whatlang.org/

    1,087+0近 7 天星标变化
  • wikipedia2vec@wikipedia2vec

    从维基百科学习单词与实体向量表示的工具

    971+0近 7 天星标变化
  • nlu@JohnSnowLabs

    只需 1 行代码即可使用数百种语言中数千个最先进的 NLP 模型。解决文本问题最快且最准确的方法。

    966-1近 7 天星标变化
  • PIXIU@The-FinAI

    本仓库介绍 PIXIU,这是一个开源资源,包含首批金融大型语言模型(LLMs)、指令微调数据与评估基准,以全面评估金融 LLMs。我们的目标是持续推进金融人工智能(AI)的开源发展。

    886+2近 7 天星标变化
  • spacy-streamlit@explosion

    👑 适用于 Streamlit 应用程序的 spaCy 构建块与可视化工具

    862+2近 7 天星标变化
  • 多标签文本分类,多标签分类,文本分类,multi-label,classifier,text classification,BERT,seq2seq,attention,multi-label-classification

    805+0近 7 天星标变化
  • nucliadb@nuclia

    NucliaDB,用于 RAG 的 AI 搜索数据库

    721+0近 7 天星标变化
  • small-text@webis-de

    Python 文本分类的主动学习

    647+0近 7 天星标变化
  • BERTweet@VinAIResearch

    BERTweet:针对英文推文的预训练语言模型 (EMNLP-2020)

    609+0近 7 天星标变化
  • TextClassificationBenchmark@FreedomIntelligence

    基于 PyTorch 的文本分类基准测试

    608+0近 7 天星标变化
← 返回主题列表