跳到主要內容
buildradar
Sign in
主題 · corpus

corpus

標記 corpus 主題、收錄中的開源專案,依星數排序。

專案數
15
總星數
38,503
平均星數
2,567
佔比
0.00%

常跟 corpus 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 corpus 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • 大規模中文自然語言處理語料庫 Large Scale Chinese Corpus for NLP

    9,912+2近 7 天星數變化
  • corpora@dariusk

    一組小型語料庫,供創建機器人及類似用途的有趣數據集合。

    5,108+1近 7 天星數變化
  • 中文人名語料庫。人名生成器。中文姓名、姓氏、名字、稱呼、日本人名、翻譯人名、英文人名。可用於中文分詞、人名實體識別

    4,328+1近 7 天星數變化
  • CLUE@CLUEbenchmark

    中文語言理解測評基準 Chinese Language Understanding Evaluation Benchmark:資料集、基線、預訓練模型、語料庫與排行榜

    4,278-1近 7 天星數變化
  • 深度學習與深度強化學習研究論文及部分程式碼

    3,026+2近 7 天星數變化
  • Awesome-Chatbot@fendouai

    精選聊天機器人專案、語料庫、論文、教學。中文聊天機器人 =>:

    2,187+0近 7 天星數變化
  • Classical-Modern@NiuTrans

    非常全面的文言文(古文)-現代文平行語料庫

    1,485+5近 7 天星數變化
  • chatterbot-corpus@gunthercox

    一個多語言對話語料庫

    1,417+0近 7 天星數變化
  • 公司名語料庫。機構名語料庫。公司簡稱、縮寫、品牌詞、企業名。可用於中文分詞、機構名實體識別。

    1,296+0近 7 天星數變化
  • insuranceqa-corpus-zh@chatopera

    :helicopter: 保險行業語料庫,聊天機器人

    1,064-1近 7 天星數變化
  • CLUECorpus2020@CLUEbenchmark

    中文 100G 大規模預訓練語料庫

    1,020+2近 7 天星數變化
  • ChatGPT 中文語料庫 對話語料 小說語料 客服語料 用於訓練大模型

    965+1近 7 天星數變化
  • quanteda@quanteda

    用於文字資料量化分析的 R 套件

    887-1近 7 天星數變化
  • efaqa-corpus-zh@chatopera

    ❤️情感急救資料集,心理諮詢問答、聊天機器人語料庫

    774+3近 7 天星數變化
  • Wordless@BLKSerene

    一個支援多語言的整合語料庫工具,用於語言、文學與翻譯研究

    759+0近 7 天星數變化
← 返回主題列表