मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

jeinlee1991/chinese-llm-benchmark

@jeinlee1991

NoneLinear - ReLE मूल्यांकन: चीनी AI बड़े भाषा मॉडल (LLM) की क्षमता का मूल्यांकन (निरंतर अपडेट): वर्तमान में 374 मॉडल शामिल हैं, जिनमें ChatGPT, GPT-5.4, Google Gemini-3.1-Pro, Claude-4.6, ERNIE-X1.1, ERNIE-5.0, Qwen3.6-Max, Qwen3.6-Plus, Baichuan, iFlytek Spark, SenseChat जैसे वाणिज्यिक मॉडल, और Step3.5-Flash, Kimi-K2.6, Ernie4.5, MiniMax-M2.7, DeepSeek-V4, Qwen3.6, Llama4, GLM-5.1, MiMo-V2, LongCat, Gemma4, Mistral जैसे ओपन-सोर्स मॉडल शामिल हैं। यह न केवल लीडरबोर्ड प्रदान करता है, बल्कि 2 मिलियन से अधिक का मॉडल दोष डेटाबेस भी प्रदान करता है!

स्टार
6,415
फ़ोर्क
263
भाषा
लाइसेंस
आख़िरी push
1 सप्ताह पहले
agentic-aiartificial-intelligencellm-evaluationllm-agent

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।