Lompat ke konten utama
buildradar
Sign in
Topik · text-to-image

text-to-image

Repositori open source terpantau bertanda text-to-image, diurutkan berdasarkan bintang.

62 repositori
  • WebAI2API@foxhui

    WebAI2API: Alat konversi web AI ke API berbasis Camoufox, mendoroang LMArena/Gemini dll, konkurensi multi-jendela dan isolasi akun.

    1.315+0Perubahan bintang dalam 7 hari terakhir
  • airunner@Capsize-Games

    Mesin inferensi luring untuk seni, percakapan suara waktu nyata, chatbot bertenaga LLM, dan alur kerja otomatis

    1.314+0Perubahan bintang dalam 7 hari terakhir
  • Kumpulan sumber daya tentang pembuatan terkontrol dengan model difusi teks-ke-gambar.

    1.110+0Perubahan bintang dalam 7 hari terakhir
  • CogView4@zai-org

    CogView4, CogView3-Plus dan CogView3 (ECCV 2024)

    1.101+0Perubahan bintang dalam 7 hari terakhir
  • awesome-agent-apis@Anil-matcha

    Daftar kurasi sumber daya, alat, keahlian, tutorial & artikel OpenClaw. OpenClaw (sebelumnya Moltbot / Clawdbot) — agen AI open-source yang di-hosting sendiri untuk WhatsApp, Telegram, Discord & 50+ integrasi.

    1.005+8Perubahan bintang dalam 7 hari terakhir
  • muse-maskgit-pytorch@lucidrains

    Implementasi Muse: Text-to-Image Generation via Masked Generative Transformers, dalam Pytorch

    918+0Perubahan bintang dalam 7 hari terakhir
  • unfake.js@jenissimo

    Perbaiki seni piksel dan gambar vektor AI langsung di browser Anda.

    916+6Perubahan bintang dalam 7 hari terakhir
  • Lora-for-Diffusers@haofanwang

    Tutorial paling mudah dipahami untuk menggunakan LoRA (Low-Rank Adaptation) dalam framework diffusers bagi peneliti AI Generation.

    822+0Perubahan bintang dalam 7 hari terakhir
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementasi Resmi)

    814+0Perubahan bintang dalam 7 hari terakhir
  • [TMLR 2025🔥] Survei untuk model autoregresif dalam visi.

    808+0Perubahan bintang dalam 7 hari terakhir
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = teks ke gambar/video

    789+0Perubahan bintang dalam 7 hari terakhir
  • Attend-and-Excite@yuval-alaluf

    Implementasi resmi untuk "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Perubahan bintang dalam 7 hari terakhir
  • Kumpulan studi pembuatan teks-ke-gambar yang luar biasa.

    765+0Perubahan bintang dalam 7 hari terakhir
  • Survei tentang Pembuatan/Sintesis Teks-ke-Video.

    744+3Perubahan bintang dalam 7 hari terakhir
  • PaddleMIX@PaddlePaddle

    Integrasi dan Eksplorasi Multimodal Paddle, mendukung tugas multimodal arus utama, termasuk model pra-pelatihan multimodal skala besar end-to-end dan kotak alat model difusi. Dilengkapi dengan kinerja tinggi dan fleksibilitas.

    723-1Perubahan bintang dalam 7 hari terakhir
  • NanoBananaEditor@markfulton

    Aplikasi generator dan editor gambar Nano Banana tercanggih. Pusat kendali untuk pembuatan dan revisi gambar AI. UI intuitif dengan fitur gambar referensi, pengeditan dengan mask, riwayat versi, dan lainnya. Didukung oleh API gambar Gemini 2.5 Flash.

    710+0Perubahan bintang dalam 7 hari terakhir
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Model Difusi yang Efisien untuk Pembuatan Teks-ke-Gambar Resolusi Tinggi (2K)

    674-1Perubahan bintang dalam 7 hari terakhir
  • OneDiffusion@lehduong

    Implementasi resmi makalah OneDiffusion (CVPR 2025)

    665+0Perubahan bintang dalam 7 hari terakhir
  • flash-diffusion@gojasper

    Flash Diffusion — mempercepat model difusi bersyarat (AAAI 2025 Oral).

    664+1Perubahan bintang dalam 7 hari terakhir
  • face-to-sticker

    641+0Perubahan bintang dalam 7 hari terakhir
  • Liquid@FoundationVision

    (Diterima oleh IJCV) Liquid: Model Bahasa adalah Generator Multimodal yang Skalabel dan Terpadu

    640+0Perubahan bintang dalam 7 hari terakhir
  • blended-latent-diffusion@omriav

    Implementasi resmi untuk "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Perubahan bintang dalam 7 hari terakhir
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC dan [TPAMI 2024] MIGC++ (Implementasi Resmi)

    614+0Perubahan bintang dalam 7 hari terakhir
  • Koleksi templat prompt JSON yang dapat digunakan kembali & referensi gaya untuk pembuatan gambar AI. Diperbarui setiap hari.

    593+6Perubahan bintang dalam 7 hari terakhir
  • blended-diffusion@omriav

    Implementasi resmi untuk "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]

    588-1Perubahan bintang dalam 7 hari terakhir
  • semantic-draw@ironjr

    Kode resmi untuk makalah CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588+0Perubahan bintang dalam 7 hari terakhir
  • 🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).

    552+0Perubahan bintang dalam 7 hari terakhir
  • payload-ai@ashbuilds

    AI Plugin adalah ekstensi canggih untuk Payload CMS, mengintegrasikan kemampuan AI tingkat lanjut untuk meningkatkan pembuatan dan pengelolaan konten.

    547-1Perubahan bintang dalam 7 hari terakhir
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Tokenizer Terpadu untuk Pembuatan dan Pemahaman Visual

    529-1Perubahan bintang dalam 7 hari terakhir
  • Google-Colab_Notebooks@Isi-dev

    Kumpulan Google Colab Notebook untuk berbagai proyek

    519+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik