jeinlee1991/chinese-llm-benchmark
@jeinlee1991NoneLinear - ReLE 평가: 중국어 AI 대형 모델 성능 평가(지속 업데이트). ChatGPT, GPT-5.4, Google Gemini-3.1-pro, Claude-4.6, Wenxin ERNIE-X1.1, ERNIE-5.0, qwen3.6-max, qwen3.6-plus, Baichuan, iFlytek Spark, SenseChat 등 상용 모델과 step3.5-flash, kimi-k2.6, ernie4.5, MiniMax-M2.7, deepseek-v4, Qwen3.6, llama4, Zhipu GLM-5.1, MiMo-V2, LongCat, gemma4, mistral 등 오픈소스 대형 모델을 포함하여 총 374개의 대형 모델을 수록. 순위표뿐만 아니라 200만 건 이상의 대형 모델 결함 라이브러리도 제공하여 커뮤니티의 연구 분석 및 대형 모델 개선을 지원함.
스타
6,415
포크
263
언어
—
라이선스
—
마지막 푸시
1주 전
관련 인텔 (0)
아직 관련 인텔이 없습니다
이 저장소는 radar가 추적하는 어떤 소스에도 아직 등장하지 않았습니다. 수집기는 예약에 따라 실행됩니다——이 저장소를 다루게 되면 다시 확인하세요.