Lompat ke konten utama
buildradar
Sign in
Topik · agent-evaluation

agent-evaluation

Repositori open source terpantau bertanda agent-evaluation, diurutkan berdasarkan bintang.

Repositori
9
Total bintang
32.319
Rata-rata bintang
3.591
Porsi
0,00%

Topik yang sering muncul berdampingan dengan agent-evaluation di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda agent-evaluation.

  • awesome-evals@benchflow-ai

    Pustaka pilihan yang berisi sumber daya terbaik untuk membangun dan mengevaluasi AI agent — makalah, blog, ceramah, alat, dan tolok ukur. Dikelola oleh BenchFlow.

    864
  • iFixAi@ifixai-ai

    Audit independen untuk AI Agent. Dijalankan oleh manusia atau agen itu sendiri untuk menjawab pertanyaan paling krusial dalam Ekonomi AI Agent: Apakah agen melakukan apa yang seharusnya dilakukan? Dengan iFixAi, Anda bisa mendapatkan jawabannya dalam waktu kurang dari 120 detik.

    12.643+1.247Perubahan bintang dalam 7 hari terakhir
  • giskard-oss@Giskard-AI

    🐢 Pustaka pengujian dan evaluasi sumber terbuka untuk LLM Agent

    5.801+9Perubahan bintang dalam 7 hari terakhir
  • coze-loop@coze-dev

    Platform Optimasi AI Agent Generasi Berikutnya: Cozeloop mengatasi tantangan dalam pengembangan AI agent dengan menyediakan kemampuan manajemen siklus hidup penuh mulai dari pengembangan, debugging, evaluasi, hingga pemantauan.

    5.711+5Perubahan bintang dalam 7 hari terakhir
  • trulens@truera

    Evaluasi dan Pelacakan untuk Eksperimen LLM dan Agen AI

    3.530+2Perubahan bintang dalam 7 hari terakhir
  • any-agent@mozilla-ai

    Antarmuka tunggal untuk menggunakan dan mengevaluasi berbagai framework agen.

    1.199+2Perubahan bintang dalam 7 hari terakhir
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot: agen AI enterprise yang dapat diaudit untuk alur kerja berbasis bukti, alat yang dikelola, harness evaluasi, peninjauan manusia, dan penyampaian remediasi.

    1.166+0Perubahan bintang dalam 7 hari terakhir
  • awesome-evals@benchflow-ai

    Pustaka pilihan yang berisi sumber daya terbaik untuk membangun dan mengevaluasi AI agent — makalah, blog, ceramah, alat, dan tolok ukur. Dikelola oleh BenchFlow.

    864+17Perubahan bintang dalam 7 hari terakhir
  • pandaprobe@chirpz-ai

    Platform rekayasa agen sumber terbuka: pelacakan, evaluasi, dan metrik untuk men-debug dan meningkatkan agen AI Anda. Terintegrasi dengan LangGraph, CrewAI, Claude Agent SDK, dan lainnya.

    783+1Perubahan bintang dalam 7 hari terakhir
  • ClawBench@TIGER-AI-Lab

    Benchmark open-source untuk AI agent browser pada tugas sehari-hari.

    657+54Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik