Các kho mã nguồn mở đang theo dõi của confident-ai, sắp xếp theo số sao.
Khung đánh giá LLM (LLM Evaluation Framework)
DeepTeam là một framework để kiểm thử tấn công (red team) các LLM và tác nhân AI.