メインコンテンツへスキップ
buildradar
Sign in
トピック · image-generation

image-generation

image-generation がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

134 件のリポジトリ
  • webui 以外で Stable Diffusion で生成された画像のプロンプトを読み込むためのシンプルなスタンドアロンビューア

    1,340+0直近 7 日のスター増減
  • Lance@bytedance

    画像と動画の理解、生成、編集を行う、アクティブパラメータ数3Bのネイティブ統合マルチモーダルモデル

    1,334+3直近 7 日のスター増減
  • WebAI2API@foxhui

    Camoufox をベースにした Web AI から API への変換ツール。LMArena や Gemini などをサポートし、マルチウィンドウの並行処理とアカウント分離を実現。

    1,315+16直近 7 日のスター増減
  • airunner@Capsize-Games

    画像、リアルタイム音声会話、LLM を活用したチャットボット、自動化ワークフローのためのオフライン推論エンジン。

    1,314+0直近 7 日のスター増減
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] データ効率の良い GAN トレーニングのための微分可能拡張

    1,308+0直近 7 日のスター増減
  • Bernini@bytedance

    Bernini は、MLLM ベースのセマンティックプランナーと DiT ベースのレンダラーを組み合わせた、動画生成および編集のための統合フレームワークです。

    1,300+10直近 7 日のスター増減
  • Segment Anything のマスクを使用し、ブラウザ UI 上で Stable Diffusion のインペインティングを実行する Inpaint Anything 拡張機能。

    1,298+0直近 7 日のスター増減
  • MV-Adapter@huanngzh

    [ICCV 2025] 「MV-Adapter: Multi-view Consistent Image Generation Made Easy」の公式実装

    1,289+1直近 7 日のスター増減
  • webkit を用いた HTML 変換により、Symfony で簡単に PDF と画像を生成する

    1,247+0直近 7 日のスター増減
  • ターミナルから OpenAI の ChatGPT や DALL-E を利用できるシンプルなシェルスクリプト。Python や JS は不要です。

    1,241+3直近 7 日のスター増減
  • 画像から画像への変換に関する素晴らしいリソースのコレクション。

    1,239+0直近 7 日のスター増減
  • cleanvision@cleanlab

    画像データセットの問題を自動的に検出し、データ中心のコンピュータビジョンを実践する

    1,199+0直近 7 日のスター増減
  • MagicDrive@cure-lab

    [ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」の公式実装

    1,167+1直近 7 日のスター増減
  • clean-fid@GaParmar

    PyTorch - 適切な画像のリサイズと量子化ステップを備えたFID計算 [CVPR 2022]

    1,167+0直近 7 日のスター増減
  • VITON-HD@shadow2496

    「VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization」 (CVPR 2021) の公式 PyTorch 実装

    1,161+0直近 7 日のスター増減
  • Uncensored-Local-Studio@techjarves

    Windows、Linux、macOS向けの検閲なしローカル AI スタジオ。画像生成、GGUF LLM、音声認識・合成のためのセットアップ不要な GUI

    1,118+87直近 7 日のスター増減
  • mlx-serve@ddalcu

    Apple Silicon向けのネイティブLLM推論サーバー。OpenAIおよびAnthropic API互換。Python不要。チャット、エージェントモード、ツール呼び出し機能を備えたMLX Core macOSアプリを同梱。

    1,115+245直近 7 日のスター増減
  • Guicang のマテリアルイラストスキル:テキスト付き説明図の生成、グラフの装飾、参考用補助イラストの作成。

    1,113+37直近 7 日のスター増減
  • CogView4@zai-org

    CogView4、CogView3-Plus、CogView3 (ECCV 2024)

    1,102+1直近 7 日のスター増減
  • image-extender@boona13

    AIを使用して、あらゆる画像をあらゆる方向にシームレスに拡張します。OpenRouter経由のGeminiを活用したオープンソースのWebアプリで、ポアソンブレンディングによる継ぎ目の処理と、ベスト3からのバリエーション選択機能を備えています。

    1,100+4直近 7 日のスター増減
  • awesome-agent-apis@Anil-matcha

    OpenClawのリソース、ツール、スキル、チュートリアル、記事の厳選リスト。OpenClaw(旧Moltbot / Clawdbot)は、WhatsApp、Telegram、Discordおよび50以上の連携に対応した、オープンソースのセルフホスト型AIエージェントです。

    1,005+8直近 7 日のスター増減
  • :fire: :fire: :fire: 最近の Computer Vision (CV) に関する論文リスト

    973+1直近 7 日のスター増減
  • story-iter@UCSC-VLAA

    [ICLR 2026] 長編ストーリーの視覚化に向けたトレーニング不要の反復型フレームワーク。

    957-2直近 7 日のスター増減
  • 🎬 3Dインタラクティブ操作で任意のカメラ視点から画像を生成。3D空間でカメラをドラッグするかスライダーで方位角/仰角/距離を設定して生成。Three.js + Gradio製、日英バイリンガルUI。

    942+218直近 7 日のスター増減
  • HR-VITON@sangyun884

    論文「High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022)」の公式PyTorch実装

    917+0直近 7 日のスター増減
  • AMC-WebUI@yeahhe365

    Gemini 向けローカルファースト AI ワークフロー WebUI。マルチモーダルチャット、Canvas、ファイル処理、リアルタイム検索、コード実行、高度な推論を統合。

    899+1直近 7 日のスター増減
  • AnyGPT@OpenMOSS

    「AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling」のコード

    881-1直近 7 日のスター増減
  • codex-slides@nexu-io

    🎨 Codex 内のオープンソース AI スライドスタジオ:画像ネイティブなデッキ、すべてのスライドが完全なビジュアルキャンバス。⚡ 約 4〜5 分で 10 以上の高品質なスライドを作成 — 高速モードではすべてのページを並列レンダリング。🔍 処理の全過程をリアルタイムで確認:リサーチ → アウトライン → スタイル → レンダリング → 編集 → プレゼンテーション → PDF/PPTX エクスポート。🖥️ ブラウザファースト・API キー不要・永続的なプロジェクト。

    878+23直近 7 日のスター増減
  • UniPic@SkyworkAI

    オープンソースのSOTAマルチ画像編集モデル

    875+1直近 7 日のスター増減
  • flatkey-cli@flatkey-ai

    画像、動画、音声、テキスト、クレジット、モデル探索のための Flatkey メディア生成 CLI

    845+191直近 7 日のスター増減
← トピック一覧に戻る