メインコンテンツへスキップ
buildradar
Sign in
トピック · ai-safety

ai-safety

ai-safety がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
18
総スター数
41,106
平均スター数
2,284
シェア
0.00%

ai-safety と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、ai-safety がタグ付けされたリポジトリ。

  • agent-safe-pipeline@decionis

    アクションを提案するが承認はできない AI エージェントのリファレンスアーキテクチャ — イミュータブルなインテントのキャプチャ、独立した Decionis ポリシー判定(ALLOW/ESCALATE/BLOCK)、検証済みの人間の承認、および使い捨てのインテントバウンド付与を消費する SafeExecutor。

    533
  • floe-guard@Floe-Labs

    AI音声エージェント用の利用メーターと予算制限ゲート。通話ごとのSTT + TTS + LLM + テレフォニーを標準で計測(Pipecat、LiveKit — Python & TypeScript)。予算上限を超える前に次回のターンをハードストップ。ローカル動作、アカウント不要、テレメトリーなし。FloeによるVoice AI向けコスト管理。

    434
  • iFixAi@ifixai-ai

    AIエージェントの独立監査。人間またはエージェント自身が実行し、AIエージェント経済における最も重要な問いに答えます。エージェントは意図した通りに動作しているか?iFixAiを使えば、120秒未満でこの答えを得られます。

    12,643+1,247直近 7 日のスター増減
  • AIエージェントガバナンスツールキット — 自律型AIエージェントのためのポリシー適用、ゼロトラストID、実行サンドボックス化、信頼性エンジニアリング。OWASP Agentic Top 10の10/10を網羅。

    6,180+32直近 7 日のスター増減
  • AI-Infra-Guard@Tencent

    Agent Scan、Skills Scan、MCP scan、AI Infra scan、LLM jailbreak評価を介してAIエコシステムを保護するフルスタックAIレッドチーミングプラットフォーム。

    6,117+59直近 7 日のスター増減
  • 優れた責任ある機械学習リソースの厳選リスト。

    4,065+2直近 7 日のスター増減
  • valqore@valqore

    AI 駆動型クラウドおよび Kubernetes 運用のための安全性第一のガードレール

    1,921+48直近 7 日のスター増減
  • safe-rlhf@PKU-Alignment

    Safe RLHF: 人間からのフィードバックによる安全な強化学習を通じた制約付き価値アライメント

    1,613+1直近 7 日のスター増減
  • cc-safety-net@kenryu42

    AI コーディングエージェントのガードレール — 破壊的な git コマンド、ファイルシステムコマンド、および機密ファイルへのアクセスが実行される前にブロックする CLI フック。Amp Code、Antigravity CLI、Claude Code、Codex、Copilot CLI、Cursor、Gemini CLI、Hermes Agent、Kimi Code、OpenClaw、OpenCode、Pi をサポート。

    1,521+9直近 7 日のスター増減
  • MOSS-RLHF@OpenLMLab

    大規模言語モデルにおける RLHF の秘密 パート1: PPO

    1,430+0直近 7 日のスター増減
  • uqlm@cvs-health

    [JMLR 2026] 「UQLM: 大規模言語モデルの不確実性定量化のためのPythonパッケージ」

    1,194+1直近 7 日のスター増減
  • muapi.ai の公式 CLI — ターミナルから画像、動画、音声を生成。MCP サーバー、14の AI モデル、npm と pip でインストール可能。

    1,049+7直近 7 日のスター増減
  • AgentLens@ZhangJinHaHaHa

    Agentlensは信頼できるエージェント取引プラットフォームです。ここでは、ニーズに合ったエージェントを素早く見つけることができ、自分のエージェントを公開してデジタル資産にすることもできます。私たちは、誰もが自分の専門分野をエージェントに変換し、デジタル資産に変えて、他の人に自分のユニークな強みを見てもらうことを推奨しています。

    1,035+0直近 7 日のスター増減
  • 大規模言語モデルにおける機械アンラーニング(Machine Unlearning)のリポジトリ

    623+0直近 7 日のスター増減
  • h5i@h5i-dev

    マルチエージェントチーム向けのサンドボックス化されたコラボレーション:各エージェントを個別の使い捨てサンドボックスに隔離した、Git バックエンドのメッセージフォーラム。認証情報やホストへのアクセスを共有せずに、マシン間で連携できます。

    623+48直近 7 日のスター増減
  • langtest@PacificAI

    安全かつ効果的な言語モデルを提供する

    559+0直近 7 日のスター増減
  • PostTrainBench@aisa-group

    Claude Code や Codex CLI などの CLI エージェントが、1台の H100 GPU で 10 時間以内にベース LLM の事後学習をどの程度うまく行えるかを測定します

    548+9直近 7 日のスター増減
  • agent-safe-pipeline@decionis

    アクションを提案するが承認はできない AI エージェントのリファレンスアーキテクチャ — イミュータブルなインテントのキャプチャ、独立した Decionis ポリシー判定(ALLOW/ESCALATE/BLOCK)、検証済みの人間の承認、および使い捨てのインテントバウンド付与を消費する SafeExecutor。

    533+3直近 7 日のスター増減
  • PromptInject@agencyenterprise

    PromptInject は、プロンプトをモジュール形式で組み立て、敵対的プロンプト攻撃に対する LLM のロバスト性を定量的に分析するフレームワークです。🏆 NeurIPS ML Safety Workshop 2022 Best Paper Award 受賞

    522+2直近 7 日のスター増減
  • cordum@cordum-io

    The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.

    502直近 7 日のスター増減
← トピック一覧に戻る