llm-agents
llm-agents がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
Autoharness は、Claude Code 向けの自己学習型スキルレイヤーです。実際のセッションからスキルを抽出し、作業に合わせて更新し、使用されなくなったものを削除します。デーモンやベンチマークは不要です。
★ 1,397+67直近 7 日のスター増減 - #32
自律エージェント(LLM)に関する研究論文(毎日更新)
★ 1,370-2直近 7 日のスター増減 - #33
Python による 80 以上の本番環境向け AI エージェントのサンプル — uAgents、ASI:One、MCP、A2A、LangChain、CrewAI、Gemini、Claude、OpenAI を使用した自律型エージェント、マルチエージェントシステム、エージェント型 AI の構築
★ 1,146+14直近 7 日のスター増減 - #34
Agent OS: スペシャリストエージェントをハブで管理し、タスクごとに一時的なオーケストレーターを起動します。ローカルファースト、任意のモデルに対応。
★ 1,103-12直近 7 日のスター増減 - #35★ 1,095+15直近 7 日のスター増減
- #36★ 1,089+71直近 7 日のスター増減
- #37
LLM向けのエージェントメモリ:会話バッファ、ベクトルストア、ナレッジグラフ、エピソード・セマンティックメモリ、MemGPT、Mem0、Letta、Zep、Graphiti、LoCoMoベンチマーク、本番パターンを網羅した30個の実行可能なJupyterノートブック。
★ 1,034+95直近 7 日のスター増減 - #38
自律型コーディングエージェントを活用したオープンソースの自動リサーチ。Claude Code、OpenCode、Codex を採点、共有知識、マルチエージェントの進化とともに実行します。COLM 2026 採択。
★ 957+21直近 7 日のスター増減 - #39
ナレッジマネジメント分野に関する、非常に素晴らしい記事、人物、アプリケーション、ソフトウェアライブラリ、プロジェクトのキュレーションリスト
★ 869+0直近 7 日のスター増減 - #40★ 869+0直近 7 日のスター増減
- #41
コードベース内で最適化ループを実行するためのcodexプラグイン。テストの実行時間、ビルド速度、バンドルサイズ、モデルの損失、Lighthouseのスコア、メモリ使用量、クエリのレイテンシ、またはスクリプトから出力可能なその他の指標など、測定可能なターゲットと試行すべき多くの変更がある場合に便利です。
★ 836+1直近 7 日のスター増減 - #42★ 815+3直近 7 日のスター増減
- #43
🏆 AIエージェントハーネスの厳選・ランク付けリスト(100以上)。MCPサーバー、llms.txt、JSONも備えており、エージェント自身による推薦も可能。毎週再スコアリング。
★ 800+66直近 7 日のスター増減 - #44
MobileGym: モバイル GUI エージェント研究のための検証可能かつ高度に並列化されたシミュレーションプラットフォーム · ブラウザで動作する Android シミュレータ · Browser-hosted Android Simulator · 検証可能な評価 · スケーラブルなオンライン RL トレーニング
★ 785+9直近 7 日のスター増減 - #45
プレーンなBash/JavaScript/Python関数を使用して、LLMツールとエージェントを簡単に作成できます。
★ 775+6直近 7 日のスター増減 - #46★ 773+13直近 7 日のスター増減
- #47
GoogleのPaperOrchestra論文の実装に基づき、スキル、ベンチマーク、自動評価器、任意のコーディングエージェント(Claude Code、Cursor、Antigravity、Cline、Aider)を使用して論文を自動執筆するAIライター。APIキーやLLM SDKは不要です。
★ 650+3直近 7 日のスター増減 - #48
Agently AI アプリケーション開発フレームワークを活用した、オープンソースのLLMベースの自動デイリーニュース収集ワークフローのショーケース。
★ 640+1直近 7 日のスター増減 - #49
AgentLab: 多様なタスクでWebエージェントの開発、テスト、ベンチマークを行うためのオープンソースフレームワーク。スケーラビリティと再現性を重視して設計されています。
★ 628+1直近 7 日のスター増減 - #50
ネット全体で最も包括的、継続的に更新される、最もホットな 100 以上のペルソナ蒸留スキルコレクション|マルチエージェントシステム|著名人/監督/天涯大神/古籍/二次元/職場/感情の全カテゴリ
★ 620+46直近 7 日のスター増減 - #51★ 619+3直近 7 日のスター増減
- #52★ 611+2直近 7 日のスター増減
- #53
金融分野における人工知能と機械学習の応用に焦点を当てた、クオンツ投資およびトレーディング戦略に関する厳選されたリソース集
★ 592+12直近 7 日のスター増減 - #54
EMNLP 2026 Main Conference Paper: MASCOT: Towards Multi-Agent Socio-Collaborative Companion Systems (https://arxiv.org/abs/2601.14230)
★ 566+25直近 7 日のスター増減 - #55
Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.
★ 559—直近 7 日のスター増減 - #56
A curated, battle-tested AI-coding toolkit: Claude Code plugins, subagent orchestration, quality gates, and ready-to-copy prompts, extracted from real production use.
★ 527+304直近 7 日のスター増減 - #57★ 509-1直近 7 日のスター増減
- #58
🌍 AppWorld: A Controllable World of Apps and People for Benchmarking Function Calling and Interactive Coding Agent, ACL'24 Best Resource Paper.
★ 502—直近 7 日のスター増減 - #59
The action firewall for AI agents. Enforce policy and human approval before risky tool calls, shell commands, workflows, and production changes, with auditable evidence.
★ 502—直近 7 日のスター増減