メインコンテンツへスキップ
buildradar
Sign in
トピック · nlp

nlp

nlp がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

440 件のリポジトリ
  • Introduction-NLP@NLP-LOVE

    HanLPの作者による新著『自然語言処理入門』の詳細なノート。業界の良心的な作品であり、退屈な公式の羅列ではなく、平易な言葉で分かりやすくアルゴリズムモデルを解説している。基本概念から出発し、単語分割、品詞タグ付け、固有表現抽出、情報抽出、テキストクラスタリング、テキスト分類、構文解析という主要な課題のアルゴリズム原理と実装を段階的に紹介する。

    2,270+0直近 7 日のスター増減
  • IDCNN/biLSTM+CRF を使用した中国語の固有表現抽出、および biGRU+2ATT を使用した関係抽出

    2,264+0直近 7 日のスター増減
  • TigerBot@TigerResearch

    TigerBot: 多言語・マルチタスク対応の LLM

    2,259+0直近 7 日のスター増減
  • mt-dnn@namisan

    自然言語理解のためのマルチタスク深層ニューラルネットワーク

    2,257+0直近 7 日のスター増減
  • [論文リスト] 知識グラフ(KG)と大規模言語モデル(LLM)を統合した論文集

    2,228+0直近 7 日のスター増減
  • pytextrank@DerwenAI

    フレーズ抽出のための TextRank アルゴリズム(「textgraphs」)の Python 実装

    2,219+0直近 7 日のスター増減
  • xlstm@NX-AI

    xLSTMの公式リポジトリ

    2,196+0直近 7 日のスター増減
  • model2vec@MinishLab

    高速で最先端の静的エンベディング

    2,189+0直近 7 日のスター増減
  • EasyNLP@alibaba

    EasyNLP:包括的で使いやすい NLP ツールキット。

    2,186+0直近 7 日のスター増減
  • ecco@jalammar

    NLP 言語モデルの説明、分析、可視化。Ecco は Jupyter ノートブック内で直接インタラクティブな可視化を作成し、Transformer ベースの言語モデル(GPT2、BERT、RoBERTA、T5、T0 など)の動作を説明します。

    2,103+0直近 7 日のスター増減
  • docext@NanoNets

    オンプレミスで OCR 不要の非構造化データ抽出、マークダウン変換、ベンチマーク用のツールキット (https://idp-leaderboard.org/)

    2,086+0直近 7 日のスター増減
  • Awesome-LM-SSP@CryptoAILab

    大規模モデルの安全性、セキュリティ、プライバシーに関するリーディングリスト(Awesome LLM Security や Safety などを含む)

    2,070+0直近 7 日のスター増減
  • AliceMind@alibaba

    AlibabaのMinD(Machine IntelligeNce of Damo)ラボによるエンコーダ・デコーダのコレクション

    2,041+0直近 7 日のスター増減
  • The-NLP-Pandect@ivan-bilan

    自然言語処理に関するすべてのトピックに関する包括的なリファレンス

    2,038+0直近 7 日のスター増減
  • alpaca_eval@tatsu-lab

    指示追従型言語モデルのための自動評価ツール。人間による検証済み、高品質、低コスト、高速。

    2,012+0直近 7 日のスター増減
  • contextgem@shcherbak-ai

    ContextGem: ドキュメントからの簡単な LLM 抽出

    1,996+0直近 7 日のスター増減
  • RAGHub@Andrew-Jang

    RAG(検索拡張生成)のフレームワーク、プロジェクト、リソースを集めたコミュニティ駆動のコレクション。進化するRAGエコシステムの探索と貢献に。

    1,991+0直近 7 日のスター増減
  • scispacy@allenai

    科学・生物医学文書向けの完全なspaCyパイプラインおよびモデル。

    1,987+0直近 7 日のスター増減
  • Meta Llama 3をベースに開発された中国語Llama-3 LLMプロジェクト(中文羊驼大模型三期项目)

    1,980+0直近 7 日のスター増減
  • typed-japanese@typedgrammar

    🌸 TypeScriptで日本語の文法を学ぶ

    1,945+0直近 7 日のスター増減
  • spacy-models@explosion

    💫 spaCy 自然言語処理(NLP)ライブラリ用のモデル

    1,901+0直近 7 日のスター増減
  • Transformersライブラリクイックスタートチュートリアル

    1,892+0直近 7 日のスター増減
  • ナレッジグラフ関連の学習資料、データベース、ツールなどの厳選されたリソースリスト

    1,885+0直近 7 日のスター増減
  • nlpcda@425776024

    ワンクリック中国語データ拡張パッケージ;NLPデータ拡張、BERTデータ拡張、EDA:pip install nlpcda

    1,879+0直近 7 日のスター増減
  • LLMCompiler@SqueezeAILab

    [ICML 2024] LLMCompiler: 並列関数呼び出しのための LLM コンパイラ

    1,879+0直近 7 日のスター増減
  • spago@nlpodyssey

    Go 言語で書かれた、スタンドアロンな機械学習および自然言語処理ライブラリ

    1,850+0直近 7 日のスター増減
  • nltk_data@nltk

    NLTK データ

    1,828+0直近 7 日のスター増減
  • 中国語長文・短文分類、マルチラベル分類、文間類似度判定、埋め込み層およびネットワーク層の構築用基底クラス、FastText、TextCNN、CharCNN、TextRNN、RCNN、DCNN、DPCNN、VDCNN、CRNN、Bert、Xlnet、Albert、Attention、DeepMoji、HAN、CapsuleNet、Transformer-encode、Seq2seq、SWEM、LEAM、TextGCN

    1,808+0直近 7 日のスター増減
  • underthesea@undertheseanlp

    Underthesea - AIアシスタント

    1,803+0直近 7 日のスター増減
  • Microsoft.Recognizers.Text は、複数言語での数値、単位、日付/時刻などの認識と解決を提供します(ZH, EN, FR, ES, PT, DE, IT, TR, HI, NL。JA, KO, AR, SV は部分サポート)。パッケージは NuGet および npm で入手可能

    1,794+0直近 7 日のスター増減
← トピック一覧に戻る