Pular para o conteúdo principal
buildradar
Sign in
Tópico · ai-safety

ai-safety

Repositórios de código aberto acompanhados marcados com ai-safety, ordenados por estrelas.

Repositórios
18
Total de estrelas
41.106
Média de estrelas
2.284
Participação
0,00%

Tópicos que aparecem com frequência ao lado de ai-safety no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com ai-safety.

  • agent-safe-pipeline@decionis

    Arquitetura de referência para agentes de IA que propõem ações, mas não podem autorizá-las — captura de intenção imutável, um veredito de política Decionis independente (ALLOW/ESCALATE/BLOCK), aprovação humana verificada e um SafeExecutor que consome uma concessão de uso único vinculada à intenção.

    533
  • floe-guard@Floe-Labs

    O medidor de gastos e controle de orçamento para agentes de voz de IA. Mede STT + TTS + LLM + telefonia por chamada, pronto para uso (Pipecat, LiveKit — Python & TypeScript). Interrompe bruscamente o próximo turno antes que ultrapasse o limite. Local, sem conta, sem telemetria. Construído por Floe — controles de custo para Voice AI.

    434
  • iFixAi@ifixai-ai

    Auditoria independente de agentes de IA. Executada por humanos ou pelo próprio agente para responder à pergunta mais crucial na economia de agentes de IA: o agente está fazendo o que deveria fazer? Com o iFixAi, você obtém essa resposta em menos de 120 segundos.

    12.643+1.459Variação de estrelas nos últimos 7 dias
  • Toolkit de governança para agentes de IA — aplicação de políticas, identidade zero-trust, sandbox de execução e engenharia de confiabilidade para agentes de IA autônomos. Cobre 10/10 do OWASP Agentic Top 10.

    6.180+51Variação de estrelas nos últimos 7 dias
  • AI-Infra-Guard@Tencent

    Uma plataforma full-stack de Red Teaming para IA que protege ecossistemas de IA por meio de varredura de agentes, habilidades, MCP, infraestrutura de IA e avaliação de jailbreak de LLM.

    6.117+128Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis sobre aprendizado de máquina responsável.

    4.065+5Variação de estrelas nos últimos 7 dias
  • valqore@valqore

    Guardrails focados em segurança para operações de nuvem e Kubernetes impulsionadas por IA

    1.921+85Variação de estrelas nos últimos 7 dias
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Alinhamento de valor restrito via Aprendizado por Reforço Seguro a partir de Feedback Humano

    1.613+2Variação de estrelas nos últimos 7 dias
  • cc-safety-net@kenryu42

    Um guardrail para agentes de codificação de IA — um hook de CLI que bloqueia comandos destrutivos de git e sistema de arquivos, além de acesso a arquivos secretos antes da execução. Suporta Amp Code, Antigravity CLI, Claude Code, Codex, Copilot CLI, Cursor, Gemini CLI, Hermes Agent, Kimi Code, OpenClaw, OpenCode e Pi.

    1.521+13Variação de estrelas nos últimos 7 dias
  • MOSS-RLHF@OpenLMLab

    Segredos do RLHF em Large Language Models Parte I: PPO.

    1.430+1Variação de estrelas nos últimos 7 dias
  • uqlm@cvs-health

    [JMLR 2026] "UQLM: Um pacote Python para quantificação de incerteza em grandes modelos de linguagem"

    1.194+2Variação de estrelas nos últimos 7 dias
  • CLI oficial para muapi.ai — gere imagens, vídeos e áudio a partir do terminal. Servidor MCP, 14 modelos de IA, instalável via npm e pip.

    1.049+0Variação de estrelas nos últimos 7 dias
  • AgentLens@ZhangJinHaHaHa

    O Agentlens é uma plataforma de negociação de agentes confiável. Aqui, você pode encontrar rapidamente o Agente que atende às suas necessidades e também publicar seu próprio Agente para transformá-lo em seu ativo digital. Encorajamos todos a transformar suas áreas de expertise em Agentes e convertê-los em ativos digitais, permitindo que outros vejam seus pontos fortes exclusivos.

    1.035+0Variação de estrelas nos últimos 7 dias
  • Um repositório de recursos para machine unlearning em grandes modelos de linguagem

    623+0Variação de estrelas nos últimos 7 dias
  • h5i@h5i-dev

    Colaboração em sandbox para equipes multiagentes: um fórum de mensagens baseado em Git, onde cada agente é isolado em sua própria sandbox descartável. Transforme um repositório Git em um fórum de mensagens seguro para agentes de IA.

    623+60Variação de estrelas nos últimos 7 dias
  • langtest@PacificAI

    Forneça modelos de linguagem seguros e eficazes

    559+0Variação de estrelas nos últimos 7 dias
  • PostTrainBench@aisa-group

    Mede quão bem agentes de CLI como Claude Code ou Codex CLI conseguem pós-treinar LLMs base em uma única GPU H100 em 10 horas

    546+12Variação de estrelas nos últimos 7 dias
  • agent-safe-pipeline@decionis

    Arquitetura de referência para agentes de IA que propõem ações, mas não podem autorizá-las — captura de intenção imutável, um veredito de política Decionis independente (ALLOW/ESCALATE/BLOCK), aprovação humana verificada e um SafeExecutor que consome uma concessão de uso único vinculada à intenção.

    533+2Variação de estrelas nos últimos 7 dias
  • PromptInject@agencyenterprise

    PromptInject é um framework que monta prompts de forma modular para fornecer uma análise quantitativa da robustez de LLMs contra ataques de prompt adversarial. 🏆 Prêmio de Melhor Artigo no NeurIPS ML Safety Workshop 2022

    522+1Variação de estrelas nos últimos 7 dias
  • cordum@cordum-io

    The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.

    501Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos