मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · ai-safety

ai-safety

ai-safety टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
18
कुल स्टार
41,106
औसत स्टार
2,284
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर ai-safety के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और ai-safety टैग वाली रिपॉजिटरी।

  • agent-safe-pipeline@decionis

    AI एजेंटों के लिए संदर्भ आर्किटेक्चर जो क्रियाओं का प्रस्ताव देते हैं लेकिन उन्हें अधिकृत नहीं कर सकते — अपरिवर्तनीय इंटेंट कैप्चर, एक स्वतंत्र निर्णय नीति निर्णय (ALLOW/ESCALATE/BLOCK), सत्यापित मानवीय अनुमोदन, और एक SafeExecutor जो एकल-उपयोग इंटेंट-बाउंड ग्रांट का उपयोग करता है।

    533
  • floe-guard@Floe-Labs

    AI वॉयस एजेंटों के लिए स्पेंड मीटर और बजट गेट। आउट-ऑफ-द-बॉक्स STT + TTS + LLM + टेलीफोनी (Pipecat, LiveKit — Python और TypeScript) को ट्रैक करता है। सीमा पार होने से पहले अगले टर्न को हार्ड-स्टॉप करता है। लोकल, कोई अकाउंट नहीं, कोई टेलीमेट्री नहीं। Floe द्वारा निर्मित — Voice AI के लिए लागत नियंत्रण।

    434
  • iFixAi@ifixai-ai

    AI एजेंटों की स्वतंत्र ऑडिटिंग। मानव या एजेंट द्वारा स्वयं संचालित, AI एजेंट अर्थव्यवस्था में सबसे महत्वपूर्ण प्रश्न का उत्तर देने के लिए। क्या एजेंट वही कर रहा है जो उसे करना चाहिए? iFixAi के साथ आप 120 सेकंड से कम समय में यह उत्तर पा सकते हैं।

    12,643+1,247पिछले 7 दिनों में स्टार का बदलाव
  • AI एजेंट गवर्नेंस टूलकिट — ऑटोनॉमस AI एजेंट्स के लिए पॉलिसी एन्फोर्समेंट, जीरो-ट्रस्ट आइडेंटिटी, एग्जीक्यूशन सैंडबॉक्सिंग और रिलायबिलिटी इंजीनियरिंग। 10/10 OWASP एजेंटिक टॉप 10 को कवर करता है।

    6,180+32पिछले 7 दिनों में स्टार का बदलाव
  • AI-Infra-Guard@Tencent

    Agent Scan, Skills Scan, MCP scan, AI Infra scan और LLM jailbreak evaluation के माध्यम से AI इकोसिस्टम को सुरक्षित करने वाला एक फुल-स्टैक AI रेड टीमिंग प्लेटफॉर्म।

    6,117+59पिछले 7 दिनों में स्टार का बदलाव
  • शानदार जिम्मेदार मशीन लर्निंग संसाधनों की एक क्यूरेटेड सूची।

    4,065+2पिछले 7 दिनों में स्टार का बदलाव
  • valqore@valqore

    AI-संचालित क्लाउड और Kubernetes संचालन के लिए सुरक्षा-प्रथम गार्डरेल्स

    1,921+48पिछले 7 दिनों में स्टार का बदलाव
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Safe Reinforcement Learning from Human Feedback के माध्यम से प्रतिबंधित वैल्यू एलाइनमेंट

    1,613+1पिछले 7 दिनों में स्टार का बदलाव
  • cc-safety-net@kenryu42

    एक AI कोडिंग एजेंट गार्डरेल — एक CLI हुक जो निष्पादित होने से पहले विनाशकारी git और फ़ाइल सिस्टम कमांड और गुप्त फ़ाइल तक पहुँच को ब्लॉक करता है। Amp Code, Antigravity CLI, Claude Code, Codex, Copilot CLI, Cursor, Gemini CLI, Hermes Agent, Kimi Code, OpenClaw, OpenCode, और Pi का समर्थन करता है।

    1,521+9पिछले 7 दिनों में स्टार का बदलाव
  • MOSS-RLHF@OpenLMLab

    लार्ज लैंग्वेज मॉडल में RLHF के रहस्य भाग I: PPO

    1,430+0पिछले 7 दिनों में स्टार का बदलाव
  • uqlm@cvs-health

    [JMLR 2026] "UQLM: लार्ज लैंग्वेज मॉडल में अनिश्चितता मात्रा निर्धारण के लिए एक Python पैकेज"

    1,194+1पिछले 7 दिनों में स्टार का बदलाव
  • muapi.ai के लिए आधिकारिक CLI — टर्मिनल से इमेज, वीडियो और ऑडियो जनरेट करें। MCP सर्वर, 14 AI मॉडल, npm और pip के माध्यम से इंस्टॉल करने योग्य।

    1,061+19पिछले 7 दिनों में स्टार का बदलाव
  • AgentLens@ZhangJinHaHaHa

    Agentlens एक विश्वसनीय एजेंट ट्रेडिंग प्लेटफॉर्म है। यहाँ आप अपनी ज़रूरतों के अनुसार एजेंट ढूंढ सकते हैं और अपने एजेंट को डिजिटल संपत्ति में बदलने के लिए प्रकाशित भी कर सकते हैं। हम सभी को अपनी विशेषज्ञता को एजेंटों में बदलने और उन्हें डिजिटल संपत्ति बनाने के लिए प्रोत्साहित करते हैं।

    1,034-1पिछले 7 दिनों में स्टार का बदलाव
  • h5i@h5i-dev

    मल्टी-एजेंट टीमों के लिए सैंडबॉक्स्ड सहयोग: Git-समर्थित संदेश फ़ोरम जहाँ प्रत्येक एजेंट अपने स्वयं के डिस्पोजेबल सैंडबॉक्स में अलग-थलग होता है। Git रिपॉजिटरी को AI एजेंटों के लिए एक सुरक्षित संदेश फ़ोरम में बदलें।

    628+53पिछले 7 दिनों में स्टार का बदलाव
  • Large Language Models में मशीन अनलर्निंग के लिए एक संसाधन रिपॉजिटरी

    623+0पिछले 7 दिनों में स्टार का बदलाव
  • langtest@PacificAI

    सुरक्षित और प्रभावी language models डिलीवर करें

    559+0पिछले 7 दिनों में स्टार का बदलाव
  • PostTrainBench@aisa-group

    यह मापना कि Claude Code या Codex CLI जैसे CLI एजेंट 10 घंटों में एक H100 GPU पर बेस LLMs को कितनी अच्छी तरह पोस्ट-ट्रेन कर सकते हैं

    548+11पिछले 7 दिनों में स्टार का बदलाव
  • agent-safe-pipeline@decionis

    AI एजेंटों के लिए संदर्भ आर्किटेक्चर जो क्रियाओं का प्रस्ताव देते हैं लेकिन उन्हें अधिकृत नहीं कर सकते — अपरिवर्तनीय इंटेंट कैप्चर, एक स्वतंत्र निर्णय नीति निर्णय (ALLOW/ESCALATE/BLOCK), सत्यापित मानवीय अनुमोदन, और एक SafeExecutor जो एकल-उपयोग इंटेंट-बाउंड ग्रांट का उपयोग करता है।

    533+3पिछले 7 दिनों में स्टार का बदलाव
  • PromptInject@agencyenterprise

    PromptInject एक ऐसा फ्रेमवर्क है जो एडवरसेरियल प्रॉम्प्ट हमलों के लिए LLMs की मजबूती का मात्रात्मक विश्लेषण प्रदान करने के लिए मॉड्यूलर तरीके से प्रॉम्प्ट को इकट्ठा करता है। 🏆 बेस्ट पेपर अवार्ड्स @ NeurIPS ML सेफ्टी वर्कशॉप 2022

    522+2पिछले 7 दिनों में स्टार का बदलाव
  • cordum@cordum-io

    The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.

    502पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस