メインコンテンツへスキップ
buildradar
Sign in
トピック · text-to-image

text-to-image

text-to-image がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

62 件のリポジトリ
  • WebAI2API@foxhui

    Camoufox をベースにした Web AI から API への変換ツール。LMArena や Gemini などをサポートし、マルチウィンドウの並行処理とアカウント分離を実現。

    1,315+16直近 7 日のスター増減
  • airunner@Capsize-Games

    画像、リアルタイム音声会話、LLM を活用したチャットボット、自動化ワークフローのためのオフライン推論エンジン。

    1,314+0直近 7 日のスター増減
  • テキストフロンティア画像拡散モデルによる制御可能な生成に関するリソースのコレクション

    1,110+0直近 7 日のスター増減
  • CogView4@zai-org

    CogView4、CogView3-Plus、CogView3 (ECCV 2024)

    1,101+1直近 7 日のスター増減
  • awesome-agent-apis@Anil-matcha

    OpenClawのリソース、ツール、スキル、チュートリアル、記事の厳選リスト。OpenClaw(旧Moltbot / Clawdbot)は、WhatsApp、Telegram、Discordおよび50以上の連携に対応した、オープンソースのセルフホスト型AIエージェントです。

    1,005+8直近 7 日のスター増減
  • muse-maskgit-pytorch@lucidrains

    Masked Generative TransformersによるText-to-Image生成モデル「Muse」のPyTorch実装

    918+0直近 7 日のスター増減
  • unfake.js@jenissimo

    ブラウザ上で AI 生成のドット絵やベクター画像を直接修正

    916+5直近 7 日のスター増減
  • Lora-for-Diffusers@haofanwang

    AI生成研究者向けdiffusersフレームワーク内でのLoRA(Low-Rank Adaptation)利用に関する最も分かりやすいチュートリアル🔥

    822-1直近 7 日のスター増減
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (公式実装)

    814+0直近 7 日のスター増減
  • 視覚分野における自己回帰モデルのサーベイ論文。

    808+1直近 7 日のスター増減
  • aphantasia@eps696

    CLIP + FFT/DWT/RGBによるテキストから画像/動画への変換

    789+0直近 7 日のスター増減
  • Attend-and-Excite@yuval-alaluf

    「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」の公式実装 (SIGGRAPH 2023)

    770+0直近 7 日のスター増減
  • テキストからの画像生成に関する素晴らしい研究のコレクション。

    765+0直近 7 日のスター増減
  • テキストから動画への生成/合成に関するサーベイ。

    744+3直近 7 日のスター増減
  • PaddleMIX@PaddlePaddle

    Paddle のマルチモーダル統合および探索ツールボックス。エンドツーエンドの大規模マルチモーダル事前学習モデルや拡散モデルを含む主流のマルチモーダルタスクをサポート。高性能と柔軟性を備えています。

    723-1直近 7 日のスター増減
  • NanoBananaEditor@markfulton

    最先端の Nano Banana 画像生成・編集アプリケーション。AI による画像生成と修正の中央ハブ。参照画像、画像マスクを用いた編集、バージョン履歴などの直感的な UI 機能を搭載。Gemini 2.5 Flash images API を採用。

    710+0直近 7 日のスター増減
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: 高解像度(2K)テキストから画像への生成を行う効率的な拡散モデル

    674+0直近 7 日のスター増減
  • OneDiffusion@lehduong

    OneDiffusion 論文 (CVPR 2025) の公式実装

    665+0直近 7 日のスター増減
  • flash-diffusion@gojasper

    Flash Diffusion — 条件付き拡散モデルの高速化(AAAI 2025 Oral)

    664+1直近 7 日のスター増減
  • face-to-sticker

    641+0直近 7 日のスター増減
  • Liquid@FoundationVision

    (IJCV 採択)Liquid:スケーラブルで統合されたマルチモーダルジェネレータとしての言語モデル

    640+0直近 7 日のスター増減
  • blended-latent-diffusion@omriav

    「Blended Latent Diffusion」の公式実装 [SIGGRAPH 2023]

    632+0直近 7 日のスター増減
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC および [TPAMI 2024] MIGC++ (公式実装)

    614+0直近 7 日のスター増減
  • AI 画像生成向けの再利用可能な JSON プロンプトテンプレートとスタイルリファレンスの厳選コレクション。毎日更新。

    593+17直近 7 日のスター増減
  • semantic-draw@ironjr

    CVPR 2025 の論文「SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models」の公式コード

    588-1直近 7 日のスター増減
  • blended-diffusion@omriav

    「Blended Diffusion for Text-driven Editing of Natural Images」の公式実装 [CVPR 2022]

    588+0直近 7 日のスター増減
  • 🔥🔥🔥 LLMベースのマルチモーダル生成(画像、動画、3D、音声)に関する厳選された論文リスト

    552+0直近 7 日のスター増減
  • payload-ai@ashbuilds

    AI Pluginは、Payload CMS向けの強力な拡張機能であり、高度なAI機能を統合してコンテンツの作成と管理を強化します。

    547+2直近 7 日のスター増減
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] 視覚生成と理解のための統合トークナイザー

    529-1直近 7 日のスター増減
  • Google-Colab_Notebooks@Isi-dev

    さまざまなプロジェクト向けの Google Colab ノートブック集

    519+5直近 7 日のスター増減
← トピック一覧に戻る