跳到主要内容
buildradar
Sign in
主题 · corpus

corpus

标记 corpus 主题、收录中的开源项目,按星标数排序。

项目数
15
总星标数
38,503
平均星标数
2,567
占比
0.00%

常跟 corpus 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 corpus 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • 大规模中文自然语言处理语料库 Large Scale Chinese Corpus for NLP

    9,912+2近 7 天星标变化
  • corpora@dariusk

    一组小型语料库,供创建机器人及类似用途的有趣数据集合。

    5,108+1近 7 天星标变化
  • 中文人名语料库。人名生成器。中文姓名、姓氏、名字、称呼、日本人名、翻译人名、英文人名。可用于中文分词、人名实体识别

    4,328+1近 7 天星标变化
  • CLUE@CLUEbenchmark

    中文语言理解测评基准 Chinese Language Understanding Evaluation Benchmark:数据集、基线、预训练模型、语料库与排行榜

    4,278-1近 7 天星标变化
  • 深度学习与深度强化学习研究论文及部分代码

    3,026+2近 7 天星标变化
  • Awesome-Chatbot@fendouai

    精选聊天机器人项目、语料库、论文、教程。中文聊天机器人 =>:

    2,187+0近 7 天星标变化
  • Classical-Modern@NiuTrans

    非常全面的文言文(古文)-现代文平行语料

    1,485+5近 7 天星标变化
  • chatterbot-corpus@gunthercox

    一个多语言对话语料库

    1,417+0近 7 天星标变化
  • 公司名语料库。机构名语料库。公司简称、缩写、品牌词、企业名。可用于中文分词、机构名实体识别。

    1,296+0近 7 天星标变化
  • insuranceqa-corpus-zh@chatopera

    :helicopter: 保险行业语料库,聊天机器人

    1,064-1近 7 天星标变化
  • CLUECorpus2020@CLUEbenchmark

    中文 100G 大规模预训练语料库

    1,020+1近 7 天星标变化
  • ChatGPT 中文语料库 对话语料 小说语料 客服语料 用于训练大模型

    965+1近 7 天星标变化
  • quanteda@quanteda

    用于文本数据定量分析的 R 软件包

    887+0近 7 天星标变化
  • efaqa-corpus-zh@chatopera

    ❤️情感急救数据集,心理咨询问答、聊天机器人语料库

    774+3近 7 天星标变化
  • Wordless@BLKSerene

    一个支持多语言的集成语料库工具,用于语言、文学与翻译研究

    759+0近 7 天星标变化
← 返回主题列表