text-to-image
text-to-image がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
Camoufox をベースにした Web AI から API への変換ツール。LMArena や Gemini などをサポートし、マルチウィンドウの並行処理とアカウント分離を実現。
★ 1,315+16直近 7 日のスター増減 - #32★ 1,314+0直近 7 日のスター増減
- #33
テキストフロンティア画像拡散モデルによる制御可能な生成に関するリソースのコレクション
★ 1,110+0直近 7 日のスター増減 - #34★ 1,101+1直近 7 日のスター増減
- #35
OpenClawのリソース、ツール、スキル、チュートリアル、記事の厳選リスト。OpenClaw(旧Moltbot / Clawdbot)は、WhatsApp、Telegram、Discordおよび50以上の連携に対応した、オープンソースのセルフホスト型AIエージェントです。
★ 1,005+8直近 7 日のスター増減 - #36
Masked Generative TransformersによるText-to-Image生成モデル「Muse」のPyTorch実装
★ 918+0直近 7 日のスター増減 - #37★ 916+5直近 7 日のスター増減
- #38
AI生成研究者向けdiffusersフレームワーク内でのLoRA(Low-Rank Adaptation)利用に関する最も分かりやすいチュートリアル🔥
★ 822-1直近 7 日のスター増減 - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (公式実装)
★ 814+0直近 7 日のスター増減 - #40
視覚分野における自己回帰モデルのサーベイ論文。
★ 808+1直近 7 日のスター増減 - #41
CLIP + FFT/DWT/RGBによるテキストから画像/動画への変換
★ 789+0直近 7 日のスター増減 - #42
「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」の公式実装 (SIGGRAPH 2023)
★ 770+0直近 7 日のスター増減 - #43
テキストからの画像生成に関する素晴らしい研究のコレクション。
★ 765+0直近 7 日のスター増減 - #44
テキストから動画への生成/合成に関するサーベイ。
★ 744+3直近 7 日のスター増減 - #45
Paddle のマルチモーダル統合および探索ツールボックス。エンドツーエンドの大規模マルチモーダル事前学習モデルや拡散モデルを含む主流のマルチモーダルタスクをサポート。高性能と柔軟性を備えています。
★ 723-1直近 7 日のスター増減 - #46
最先端の Nano Banana 画像生成・編集アプリケーション。AI による画像生成と修正の中央ハブ。参照画像、画像マスクを用いた編集、バージョン履歴などの直感的な UI 機能を搭載。Gemini 2.5 Flash images API を採用。
★ 710+0直近 7 日のスター増減 - #47
HunyuanImage-2.1: 高解像度(2K)テキストから画像への生成を行う効率的な拡散モデル
★ 674+0直近 7 日のスター増減 - #48
OneDiffusion 論文 (CVPR 2025) の公式実装
★ 665+0直近 7 日のスター増減 - #49
Flash Diffusion — 条件付き拡散モデルの高速化(AAAI 2025 Oral)
★ 664+1直近 7 日のスター増減 - #50
face-to-sticker
★ 641+0直近 7 日のスター増減 - #51★ 640+0直近 7 日のスター増減
- #52
「Blended Latent Diffusion」の公式実装 [SIGGRAPH 2023]
★ 632+0直近 7 日のスター増減 - #53★ 614+0直近 7 日のスター増減
- #54
AI 画像生成向けの再利用可能な JSON プロンプトテンプレートとスタイルリファレンスの厳選コレクション。毎日更新。
★ 593+17直近 7 日のスター増減 - #55
CVPR 2025 の論文「SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models」の公式コード
★ 588-1直近 7 日のスター増減 - #56
「Blended Diffusion for Text-driven Editing of Natural Images」の公式実装 [CVPR 2022]
★ 588+0直近 7 日のスター増減 - #57
🔥🔥🔥 LLMベースのマルチモーダル生成(画像、動画、3D、音声)に関する厳選された論文リスト
★ 552+0直近 7 日のスター増減 - #58
AI Pluginは、Payload CMS向けの強力な拡張機能であり、高度なAI機能を統合してコンテンツの作成と管理を強化します。
★ 547+2直近 7 日のスター増減 - #59★ 529-1直近 7 日のスター増減
- #60
さまざまなプロジェクト向けの Google Colab ノートブック集
★ 519+5直近 7 日のスター増減