vision
vision がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
vision と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、vision がタグ付けされたリポジトリ。
- #1
テキストのみのLLM向けに設計された優れたビジュアルツールボックスとスキル。マルチ画像理解、画像Q&A、フロントエンドUI復元、GUI自動化などをサポートし、複数の主要なagentへシームレスに統合可能で、クリップボードからの画像貼り付けを直接認識します| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode
★ 1,127 - #2
テキストのみの DeepSeek Harness エージェント向けのビジョン機能:内蔵の無料ビジョンチェーン(キー不要)とピクセル単位のビジョンツール(Q&A、グラウンディング、クロップ、ピクセル差分、カラー、OCR、SVG トレース、切り抜き、スクリーンショット)。1 コマンドでインストール可能で Python は不要、画像処理を通常のツール呼び出しと同様に実行できます。
★ 1,038
- #1
高度化されたChatGPTクローン:Agents、MCP、Skills、DeepSeek、Anthropic、AWS、OpenAI、Responses API、Azure、Groq、o1、GPT-5、Mistral、OpenRouter、Vertex AI、Gemini、Artifacts、AIモデル切り替え、メッセージ検索、Code Interpreter、langchain、DALL-E-3、OpenAPI Actions、Functions、セキュアなマルチユーザー認証、プリセット、自己ホスティング対応のオープンソース。アクティブ。
★ 42,597+274直近 7 日のスター増減 - #2★ 41,282+130直近 7 日のスター増減
- #3
オープンソースのマルチモーダルAIエージェントスタック:最先端のAIモデルとエージェントインフラの接続
★ 38,742+62直近 7 日のスター増減 - #4★ 34,555-5直近 7 日のスター増減
- #5★ 22,878+52直近 7 日のスター増減
- #6★ 9,788+134直近 7 日のスター増減
- #7
📸 高性能で強力な React Native カメラライブラリ。
★ 9,586+18直近 7 日のスター増減 - #8
DeepSeek Harness 向けの最初のビジョンプラグインであり、すべてのテキスト専用コーディングエージェントのためのビジョンブリッジ。画像を貼り付けるだけで、構造化された JSON のエビデンス(OCR、レイアウト、セマンティクス)を取得できます。
★ 3,756+255直近 7 日のスター増減 - #9★ 3,726+18直近 7 日のスター増減
- #10★ 3,496+2直近 7 日のスター増減
- #11
[CVPR 2023] DepGraph:あらゆる構造的プルーニングに向けて(LLM、Vision Foundation Models など)
★ 3,348+1直近 7 日のスター増減 - #12★ 2,730+1直近 7 日のスター増減
- #13★ 2,331-1直近 7 日のスター増減
- #14
cloud.google.com で使用される Java および Kotlin コードのサンプル
★ 1,906+1直近 7 日のスター増減 - #15
自宅のためのビジュアルインテリジェンス。
★ 1,446+10直近 7 日のスター増減 - #16★ 1,270+2直近 7 日のスター増減
- #17
ディープラーニングを理解するための動画、ノート、実験
★ 1,198+1直近 7 日のスター増減 - #18
🌝 MLKitは強力で使いやすいツールキットです。ML Kitを使用することで、文字認識、バーコード認識、画像ラベリング、顔検出、オブジェクト検出などの機能を簡単に実装できます。
★ 1,169+1直近 7 日のスター増減 - #19
テキストのみのLLM向けに設計された優れたビジュアルツールボックスとスキル。マルチ画像理解、画像Q&A、フロントエンドUI復元、GUI自動化などをサポートし、複数の主要なagentへシームレスに統合可能で、クリップボードからの画像貼り付けを直接認識します| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode
★ 1,127+23直近 7 日のスター増減 - #20
Google AIによる、Vision向けのAll-MLPソリューション
★ 1,064+1直近 7 日のスター増減 - #21
テキストのみの DeepSeek Harness エージェント向けのビジョン機能:内蔵の無料ビジョンチェーン(キー不要)とピクセル単位のビジョンツール(Q&A、グラウンディング、クロップ、ピクセル差分、カラー、OCR、SVG トレース、切り抜き、スクリーンショット)。1 コマンドでインストール可能で Python は不要、画像処理を通常のツール呼び出しと同様に実行できます。
★ 1,038+85直近 7 日のスター増減 - #22★ 977+5直近 7 日のスター増減
- #23★ 953+2直近 7 日のスター増減
- #24★ 911+0直近 7 日のスター増減
- #25
3DMatch - 3D メッシュと点群の位置合わせを行う、3D ConvNet ベースの局所幾何学的記述子。
★ 905+1直近 7 日のスター増減 - #26★ 816+2直近 7 日のスター増減
- #27
🎰 機械学習リソースの厳選リスト(CoreML 優先)
★ 813+0直近 7 日のスター増減 - #28
コンピュータ上で実行されているあらゆるアプリケーションからキャプチャしたテキストを翻訳できるアプリケーション。
★ 754+12直近 7 日のスター増減 - #29
あらゆるWebデザインのスクリーンショットをクリーンなHTML/CSSコードに変換する
★ 681-1直近 7 日のスター増減 - #30★ 612+0直近 7 日のスター増減