Lompat ke konten utama
buildradar
Sign in
Topik · evaluation-framework

evaluation-framework

Repositori open source terpantau bertanda evaluation-framework, diurutkan berdasarkan bintang.

Repositori
10
Total bintang
70.407
Rata-rata bintang
7.041
Porsi
0,00%

Topik yang sering muncul berdampingan dengan evaluation-framework di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda evaluation-framework.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • promptfoo@promptfoo

    Uji prompt, agen, dan RAG Anda. Red teaming/pentesting/pemindaian kerentanan untuk AI. Bandingkan performa GPT, Claude, Gemini, DeepSeek, dan lainnya. Konfigurasi deklaratif sederhana dengan integrasi baris perintah dan CI/CD. Digunakan oleh OpenAI dan Anthropic.

    24.664+215Perubahan bintang dalam 7 hari terakhir
  • deepeval@confident-ai

    Kerangka kerja evaluasi LLM

    17.953+184Perubahan bintang dalam 7 hari terakhir
  • lm-evaluation-harness@EleutherAI

    Framework untuk evaluasi few-shot model bahasa.

    13.827+89Perubahan bintang dalam 7 hari terakhir
  • Kiln@Kiln-AI

    Membangun, Mengevaluasi, dan Mengoptimalkan Sistem AI. Mencakup evaluasi, RAG, agen, fine-tuning, pembuatan data sintetis, manajemen dataset, MCP, dan lainnya.

    5.037+7Perubahan bintang dalam 7 hari terakhir
  • lighteval@huggingface

    Lighteval adalah perangkat lengkap Anda untuk mengevaluasi LLM di berbagai backend

    2.530+8Perubahan bintang dalam 7 hari terakhir
  • EvalAI@Cloud-CV

    Mengevaluasi teknologi AI terkini (state of the art).

    2.037-2Perubahan bintang dalam 7 hari terakhir
  • future-agi@future-agi

    Platform sumber terbuka end-to-end untuk mengevaluasi, mengawasi, dan meningkatkan aplikasi LLM dan agen AI. Penelusuran · Evaluasi · Simulasi · Kumpulan Data · Gateway · Guardrails. Dapat di-host sendiri. Apache 2.0.

    1.873+89Perubahan bintang dalam 7 hari terakhir
  • ai-agents-the-definitive-guide@Nicolepcx

    Repositori untuk AI Agents The Definitive Guide

    1.386+422Perubahan bintang dalam 7 hari terakhir
  • AgentLab@ServiceNow

    AgentLab: Kerangka kerja open-source untuk mengembangkan, menguji, dan membandingkan web agent pada berbagai tugas, dirancang untuk skalabilitas dan reproduksibilitas.

    627+2Perubahan bintang dalam 7 hari terakhir
  • continuous-eval@relari-ai

    Evaluasi Berbasis Data untuk Aplikasi Bertenaga LLM

    517+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik