nlp
nlp がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #61
OCRフリーのDocument Understanding Transformer (Donut) および Synthetic Document Generator (SynthDoG) の公式実装 (ECCV 2022)
★ 6,917+0直近 7 日のスター増減 - #62
Pythonおよびコマンドラインツール。Web上のテキストとメタデータを収集:クローリング、スクレイピング、抽出、CSV、JSON、HTML、MD、TXT、XMLとしての出力。
★ 6,754+0直近 7 日のスター増減 - #63★ 6,588+0直近 7 日のスター増減
- #64★ 6,482+0直近 7 日のスター増減
- #65
Pythonで記述されたオープンソースのオフライン翻訳ライブラリ
★ 6,425+0直近 7 日のスター増減 - #66★ 6,416+0直近 7 日のスター増減
- #67★ 6,327+0直近 7 日のスター増減
- #68
Tensorflow機械学習クックブックのコード。
★ 6,238+0直近 7 日のスター増減 - #69★ 6,176+0直近 7 日のスター増減
- #70
👮♂️Java用のセンシティブワードツール。(敏感語/禁止語/違法語/俗語。DFAアルゴリズムに基づいた高性能なJavaセンシティブワードフィルタリングツールフレームワーク。単語タグの分類・階級付けを内蔵サポート。政治、広告、マーケティング、VPN利用、国家法規違反などに関連するコンテンツの投稿を禁止。高性能なセンシティブワード検出・フィルタリングコンポーネントで、繁体字と簡体字の相互変換、全角と半角の相互変換、漢字からピンインへの変換、あいまい検索などの機能に対応。)
★ 6,036+0直近 7 日のスター増減 - #71
中国語のCLIP版。中国語のクロスモーダル検索と表現生成を実現。
★ 6,001+0直近 7 日のスター増減 - #72★ 5,709+0直近 7 日のスター増減
- #73
優れた事前学習済み中国語NLPモデル。高品質な中文事前学習モデル、大規模モデル、マルチモーダルモデル、大規模言語モデルの集合。
★ 5,584+0直近 7 日のスター増減 - #74★ 5,259+0直近 7 日のスター増減
- #75
ローカルファーストのヘルスケアAI:臨床NERおよびHIPAA PIIの非識別化を100%オンデバイスで実行。2,200以上の医療モデル、21言語、Apple MLX + Python対応。クラウド不要、患者データはネットワーク外に出ない。Apache-2.0
★ 5,199+0直近 7 日のスター増減 - #76
AIが書いたハングルを人間らしい文章に校正するClaudeスキル — 韓国語AIテキストヒューマナイザー: 機械的な並行表現や71のその他のAI的特徴を検出し書き直す
★ 5,178+0直近 7 日のスター増減 - #77★ 5,141+0直近 7 日のスター増減
- #78★ 5,111+0直近 7 日のスター増減
- #79★ 5,093+0直近 7 日のスター増減
- #80
BenCao(元名: HuaTuo (华驼))のリポジトリ。中国の医学知識を用いた大規模言語モデルのインストラクションチューニング。本草(元名: 华驼)モデル倉庫、中国語医学知識に基づく大規模言語モデルの指令微調整
★ 4,989+0直近 7 日のスター増減 - #81
text2vec、テキストからベクトルへ。テキストをベクトル行列に変換するツールで、Word2Vec、RankBM25、Sentence-BERT、CoSENTなどのテキスト表現およびテキスト類似度計算モデルを実装しており、すぐに使用できます。
★ 4,974+0直近 7 日のスター増減 - #82★ 4,927+0直近 7 日のスター増減
- #83
Prompt-Learningのためのオープンソースフレームワーク。
★ 4,889+0直近 7 日のスター増減 - #84★ 4,880+0直近 7 日のスター増減
- #85
Learn Promptingによるプロンプトエンジニアリング、生成AI、LLMガイド | 最大のプロンプトエンジニアリング学習コミュニティに参加しよう
★ 4,728+0直近 7 日のスター増減 - #86★ 4,665+0直近 7 日のスター増減
- #87
Prompt Engineering | Prompt Versioning | GPTまたはその他のプロンプトベースのモデルを使用して構造化された出力を取得。Prompt-Engineering、LLM、その他の最新研究のためにDiscordに参加してください
★ 4,637+0直近 7 日のスター増減 - #88
PyTorchとTorchTextを使った感情分析の入門チュートリアル。
★ 4,612+0直近 7 日のスター増減 - #89
『大语言模型』著者:赵鑫、李军毅、周昆、唐天一、文继荣
★ 4,557+0直近 7 日のスター増減 - #90
大規模言語モデル (Large Language Models)、AIペインティングなどの厳選されたチュートリアルとリソース。
★ 4,537+0直近 7 日のスター増減