ai-safety
ai-safety がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
ai-safety と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、ai-safety がタグ付けされたリポジトリ。
- #1
アクションを提案するが承認はできない AI エージェントのリファレンスアーキテクチャ — イミュータブルなインテントのキャプチャ、独立した Decionis ポリシー判定(ALLOW/ESCALATE/BLOCK)、検証済みの人間の承認、および使い捨てのインテントバウンド付与を消費する SafeExecutor。
★ 533 - #2
AI音声エージェント用の利用メーターと予算制限ゲート。通話ごとのSTT + TTS + LLM + テレフォニーを標準で計測(Pipecat、LiveKit — Python & TypeScript)。予算上限を超える前に次回のターンをハードストップ。ローカル動作、アカウント不要、テレメトリーなし。FloeによるVoice AI向けコスト管理。
★ 434
- #1
AIエージェントの独立監査。人間またはエージェント自身が実行し、AIエージェント経済における最も重要な問いに答えます。エージェントは意図した通りに動作しているか?iFixAiを使えば、120秒未満でこの答えを得られます。
★ 12,643+1,247直近 7 日のスター増減 - #2
AIエージェントガバナンスツールキット — 自律型AIエージェントのためのポリシー適用、ゼロトラストID、実行サンドボックス化、信頼性エンジニアリング。OWASP Agentic Top 10の10/10を網羅。
★ 6,180+32直近 7 日のスター増減 - #3
Agent Scan、Skills Scan、MCP scan、AI Infra scan、LLM jailbreak評価を介してAIエコシステムを保護するフルスタックAIレッドチーミングプラットフォーム。
★ 6,117+59直近 7 日のスター増減 - #4
優れた責任ある機械学習リソースの厳選リスト。
★ 4,065+2直近 7 日のスター増減 - #5★ 1,921+48直近 7 日のスター増減
- #6★ 1,613+1直近 7 日のスター増減
- #7
AI コーディングエージェントのガードレール — 破壊的な git コマンド、ファイルシステムコマンド、および機密ファイルへのアクセスが実行される前にブロックする CLI フック。Amp Code、Antigravity CLI、Claude Code、Codex、Copilot CLI、Cursor、Gemini CLI、Hermes Agent、Kimi Code、OpenClaw、OpenCode、Pi をサポート。
★ 1,521+9直近 7 日のスター増減 - #8★ 1,430+0直近 7 日のスター増減
- #9★ 1,194+1直近 7 日のスター増減
- #10
muapi.ai の公式 CLI — ターミナルから画像、動画、音声を生成。MCP サーバー、14の AI モデル、npm と pip でインストール可能。
★ 1,049+7直近 7 日のスター増減 - #11
Agentlensは信頼できるエージェント取引プラットフォームです。ここでは、ニーズに合ったエージェントを素早く見つけることができ、自分のエージェントを公開してデジタル資産にすることもできます。私たちは、誰もが自分の専門分野をエージェントに変換し、デジタル資産に変えて、他の人に自分のユニークな強みを見てもらうことを推奨しています。
★ 1,035+0直近 7 日のスター増減 - #12
大規模言語モデルにおける機械アンラーニング(Machine Unlearning)のリポジトリ
★ 623+0直近 7 日のスター増減 - #13
マルチエージェントチーム向けのサンドボックス化されたコラボレーション:各エージェントを個別の使い捨てサンドボックスに隔離した、Git バックエンドのメッセージフォーラム。認証情報やホストへのアクセスを共有せずに、マシン間で連携できます。
★ 623+48直近 7 日のスター増減 - #14★ 559+0直近 7 日のスター増減
- #15
Claude Code や Codex CLI などの CLI エージェントが、1台の H100 GPU で 10 時間以内にベース LLM の事後学習をどの程度うまく行えるかを測定します
★ 548+9直近 7 日のスター増減 - #16
アクションを提案するが承認はできない AI エージェントのリファレンスアーキテクチャ — イミュータブルなインテントのキャプチャ、独立した Decionis ポリシー判定(ALLOW/ESCALATE/BLOCK)、検証済みの人間の承認、および使い捨てのインテントバウンド付与を消費する SafeExecutor。
★ 533+3直近 7 日のスター増減 - #17
PromptInject は、プロンプトをモジュール形式で組み立て、敵対的プロンプト攻撃に対する LLM のロバスト性を定量的に分析するフレームワークです。🏆 NeurIPS ML Safety Workshop 2022 Best Paper Award 受賞
★ 522+2直近 7 日のスター増減 - #18
The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.
★ 502—直近 7 日のスター増減