メインコンテンツへスキップ
buildradar
ログイン

jeinlee1991/chinese-llm-benchmark

@jeinlee1991

NoneLinear - ReLE評価:中国語AI大規模言語モデル能力評価(継続更新):現在374のLLMを網羅しており、ChatGPT、GPT-5.4、Google Gemini-3.1-Pro、Claude-4.6、文心ERNIE-X1.1、ERNIE-5.0、Qwen3.6-Max、Qwen3.6-Plus、百川、讯飞星火、商汤SenseChatなどの商用モデル、およびstep3.5-flash、Kimi-K2.6、ERNIE4.5、MiniMax-M2.7、DeepSeek-V4、Qwen3.6、Llama4、智谱GLM-5.1、MiMo-V2、LongCat、Gemma4、MistralなどのオープンソースLLMをカバーしています。ランキングを提供するだけでなく、200万を超える大規模モデルの欠陥ライブラリも提供!コミュニティがLLMの研究、分析、改善を容易にします。

スター
6,415
フォーク
263
言語
ライセンス
最終プッシュ
1 週間前
agentic-aiartificial-intelligencellm-evaluationllm-agent

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。