メインコンテンツへスキップ
buildradar
ログイン
トピック · nlp

nlp

nlp がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

440 件のリポジトリ
  • donut@clovaai

    OCRフリーのDocument Understanding Transformer (Donut) および Synthetic Document Generator (SynthDoG) の公式実装 (ECCV 2022)

    6,917+0直近 7 日のスター増減
  • trafilatura@adbar

    Pythonおよびコマンドラインツール。Web上のテキストとメタデータを収集:クローリング、スクレイピング、抽出、CSV、JSON、HTML、MD、TXT、XMLとしての出力。

    6,754+0直近 7 日のスター増減
  • nlp.js@axa-group

    エンティティ抽出、感情分析、自動言語識別など、ボット構築のためのNLPライブラリ

    6,588+0直近 7 日のスター増減
  • courses@SkalskiP

    このリポジトリは、人工知能(AI)に関する様々なコースやリソースへのキュレーションされたリンク集です。

    6,482+0直近 7 日のスター増減
  • argos-translate@argosopentech

    Pythonで記述されたオープンソースのオフライン翻訳ライブラリ

    6,425+0直近 7 日のスター増減
  • smile@haifengl

    統計的機械知能&学習エンジン。

    6,416+0直近 7 日のスター増減
  • TagUI@aisingapore

    AI Singapore による無料 RPA ツール

    6,327+0直近 7 日のスター増減
  • tensorflow_cookbook@nfmcclure

    Tensorflow機械学習クックブックのコード。

    6,238+0直近 7 日のスター増減
  • Parsr@axa-group

    PDF、ドキュメント、画像をリッチな構造化データに変換する。

    6,176+0直近 7 日のスター増減
  • 👮‍♂️Java用のセンシティブワードツール。(敏感語/禁止語/違法語/俗語。DFAアルゴリズムに基づいた高性能なJavaセンシティブワードフィルタリングツールフレームワーク。単語タグの分類・階級付けを内蔵サポート。政治、広告、マーケティング、VPN利用、国家法規違反などに関連するコンテンツの投稿を禁止。高性能なセンシティブワード検出・フィルタリングコンポーネントで、繁体字と簡体字の相互変換、全角と半角の相互変換、漢字からピンインへの変換、あいまい検索などの機能に対応。)

    6,036+0直近 7 日のスター増減
  • Chinese-CLIP@OFA-Sys

    中国語のCLIP版。中国語のクロスモーダル検索と表現生成を実現。

    6,001+0直近 7 日のスター増減
  • flashtext@vi3k6i5

    文からキーワードを抽出、または文中のキーワードを置換する。

    5,709+0直近 7 日のスター増減
  • 優れた事前学習済み中国語NLPモデル。高品質な中文事前学習モデル、大規模モデル、マルチモーダルモデル、大規模言語モデルの集合。

    5,584+0直近 7 日のスター増減
  • ltp@HIT-SCIR

    言語技術プラットフォーム

    5,259+0直近 7 日のスター増減
  • openmed@maziyarpanahi

    ローカルファーストのヘルスケアAI:臨床NERおよびHIPAA PIIの非識別化を100%オンデバイスで実行。2,200以上の医療モデル、21言語、Apple MLX + Python対応。クラウド不要、患者データはネットワーク外に出ない。Apache-2.0

    5,199+0直近 7 日のスター増減
  • im-not-ai@epoko77-ai

    AIが書いたハングルを人間らしい文章に校正するClaudeスキル — 韓国語AIテキストヒューマナイザー: 機械的な並行表現や71のその他のAI的特徴を検出し書き直す

    5,178+0直近 7 日のスター増減
  • EasyR1@hiyouga

    EasyR1: veRLに基づいた、効率的でスケーラブルなマルチモーダルRLトレーニングフレームワーク

    5,141+0直近 7 日のスター増減
  • Synonyms@chatopera

    :herb: 中国語の類義語:チャットボット、インテリジェントQ&Aツールキット

    5,111+0直近 7 日のスター増減
  • argilla@argilla-io

    Argillaは、AIエンジニアやドメインエキスパートが高品質なデータセットを構築するためのコラボレーションツールです。

    5,093+0直近 7 日のスター増減
  • BenCao(元名: HuaTuo (华驼))のリポジトリ。中国の医学知識を用いた大規模言語モデルのインストラクションチューニング。本草(元名: 华驼)モデル倉庫、中国語医学知識に基づく大規模言語モデルの指令微調整

    4,989+0直近 7 日のスター増減
  • text2vec@shibing624

    text2vec、テキストからベクトルへ。テキストをベクトル行列に変換するツールで、Word2Vec、RankBM25、Sentence-BERT、CoSENTなどのテキスト表現およびテキスト類似度計算モデルを実装しており、すぐに使用できます。

    4,974+0直近 7 日のスター増減
  • ml-road@yanshengjia

    機械学習およびエージェンティックAIのリソース、実践、研究

    4,927+0直近 7 日のスター増減
  • OpenPrompt@thunlp

    Prompt-Learningのためのオープンソースフレームワーク。

    4,889+0直近 7 日のスター増減
  • libpostal@openvenues

    世界中の住所を解析・正規化するためのCライブラリ。統計的NLPとオープンジオデータによって動作します。

    4,880+0直近 7 日のスター増減
  • Learn_Prompting@trigaten

    Learn Promptingによるプロンプトエンジニアリング、生成AI、LLMガイド | 最大のプロンプトエンジニアリング学習コミュニティに参加しよう

    4,728+0直近 7 日のスター増減
  • nlpaug@makcedward

    NLPのためのデータ拡張

    4,665+0直近 7 日のスター増減
  • Promptify@promptslab

    Prompt Engineering | Prompt Versioning | GPTまたはその他のプロンプトベースのモデルを使用して構造化された出力を取得。Prompt-Engineering、LLM、その他の最新研究のためにDiscordに参加してください

    4,637+0直近 7 日のスター増減
  • pytorch-sentiment-analysis@bentrevett

    PyTorchとTorchTextを使った感情分析の入門チュートリアル。

    4,612+0直近 7 日のスター増減
  • LLMBook-zh.github.io@LLMBook-zh

    『大语言模型』著者:赵鑫、李军毅、周昆、唐天一、文继荣

    4,557+0直近 7 日のスター増減
  • 大規模言語モデル (Large Language Models)、AIペインティングなどの厳選されたチュートリアルとリソース。

    4,537+0直近 7 日のスター増減
← トピック一覧に戻る