ai-safety
标记 ai-safety 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 ai-safety 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 ai-safety 主题的项目。
- #1
AI 代理参考架构,仅能提议行动而无法授权:包含不可变意图撷取、独立决策策略判定(允许/升级/封锁)、验证过的人工审核,以及消耗单次意图绑定授权的 SafeExecutor。
★ 532 - #2
AI 语音代理的支出计量与预算网关。开箱即用,可针对每次通话计量 STT、TTS、LLM 与电话费用(支持 Pipecat、LiveKit — Python 与 TypeScript)。在费用超出上限前强制停止下一次对话。本地执行、无需账号、无遥测。由 Floe 打造 — 语音 AI 的成本控制方案。
★ 434
- #1★ 12,643+0近 7 天星标变化
- #2
AI Agent Governance Toolkit — 政策执行、零信任身份、执行沙盒和可靠性工程,适用于自主 AI 代理。覆盖 OWASP Agentic Top 10 全部项目。
★ 6,180+0近 7 天星标变化 - #3
全栈 AI Red Teaming 平台,通过 Agent Scan、Skills Scan、MCP Scan、AI Infra Scan 以及 LLM jailbreak 评估来保护 AI 生态系统。
★ 6,117+0近 7 天星标变化 - #4
精选负责任机器学习资源列表
★ 4,065+0近 7 天星标变化 - #5★ 1,921+0近 7 天星标变化
- #6★ 1,613+0近 7 天星标变化
- #7
AI 程式码代理防护网 — 一个 CLI 拦截勾点 (hook),可在执行前封锁具破坏性的 git 与档案系统指令以及机密档案存取。支援 Amp Code、Antigravity CLI、Claude Code、Codex、Copilot CLI、Cursor、Gemini CLI、Hermes Agent、Kimi Code、OpenClaw、OpenCode 与 Pi。
★ 1,521+0近 7 天星标变化 - #8★ 1,430+0近 7 天星标变化
- #9★ 1,194+0近 7 天星标变化
- #10
muapi.ai 官方 CLI —— 从终端生成图像、视频与音频。具备 MCP 服务器,包含 14 种 AI 模型,可通过 npm 与 pip 安装。
★ 1,077+34近 7 天星标变化 - #11
Agentlens 是一个受信任的 Agent 交易平台。在这里,你可以快速找到符合需求的 Agent,也可以发布自己的 Agent 并将其转化为数字资产。我们鼓励每个人将自己的专业领域转化为 Agent 与数字资产,让其他人看见你的独特优势。
★ 1,034-1近 7 天星标变化 - #12★ 633+27近 7 天星标变化
- #13
大型语言模型机器遗忘(machine unlearning)资源库
★ 624+1近 7 天星标变化 - #14★ 559+0近 7 天星标变化
- #15
评估 Claude Code 或 Codex CLI 等 CLI 代理在 10 小时内于单张 H100 GPU 上对基础 LLM 进行后训练的成效
★ 550+5近 7 天星标变化 - #16
AI 代理参考架构,仅能提议行动而无法授权:包含不可变意图撷取、独立决策策略判定(允许/升级/封锁)、验证过的人工审核,以及消耗单次意图绑定授权的 SafeExecutor。
★ 532-1近 7 天星标变化 - #17
PromptInject 是一个以模块化方式组合提示词的框架,用于对 LLM 对抗性提示攻击的稳健性进行定量分析。荣获 NeurIPS ML Safety Workshop 2022 最佳论文奖。
★ 523+2近 7 天星标变化 - #18
The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.
★ 503—近 7 天星标变化