Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · text-to-image

text-to-image

Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-image, sắp xếp theo số sao.

62 kho mã
  • WebAI2API@foxhui

    WebAI2API: Công cụ chuyển đổi AI web thành API dựa trên Camoufox, hỗ trợ LMArena/Gemini và nhiều tính năng khác, đồng thời hỗ trợ đa cửa sổ đồng thời và cô lập tài khoản.

    1.315+0Thay đổi số sao trong 7 ngày qua
  • airunner@Capsize-Games

    Công cụ suy luận ngoại tuyến cho nghệ thuật, trò chuyện thoại thời gian thực, chatbot hỗ trợ bởi LLM và quy trình làm việc tự động

    1.314+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập tài nguyên về tạo sinh có điều khiển với các mô hình khuếch tán văn bản thành hình ảnh.

    1.110+0Thay đổi số sao trong 7 ngày qua
  • CogView4@zai-org

    CogView4, CogView3-Plus và CogView3 (ECCV 2024)

    1.101+0Thay đổi số sao trong 7 ngày qua
  • awesome-agent-apis@Anil-matcha

    Danh sách tổng hợp các tài nguyên, công cụ, kỹ năng, hướng dẫn và bài viết về OpenClaw. OpenClaw (trước đây là Moltbot / Clawdbot) — tác nhân AI tự lưu trữ mã nguồn mở cho WhatsApp, Telegram, Discord và hơn 50 tích hợp.

    1.005+8Thay đổi số sao trong 7 ngày qua
  • muse-maskgit-pytorch@lucidrains

    Triển khai Muse: Tạo văn bản thành hình ảnh thông qua Masked Generative Transformers, bằng PyTorch

    918+0Thay đổi số sao trong 7 ngày qua
  • unfake.js@jenissimo

    Sửa lỗi ảnh pixel art và ảnh vector do AI tạo ngay trong trình duyệt của bạn

    916+6Thay đổi số sao trong 7 ngày qua
  • Lora-for-Diffusers@haofanwang

    Hướng dẫn dễ hiểu nhất về cách sử dụng LoRA (Low-Rank Adaptation) trong framework diffusers dành cho các nhà nghiên cứu tạo AI.

    822+0Thay đổi số sao trong 7 ngày qua
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Triển khai chính thức)

    814+0Thay đổi số sao trong 7 ngày qua
  • [TMLR 2025🔥] Khảo sát về các mô hình tự hồi quy trong thị giác máy tính.

    808+0Thay đổi số sao trong 7 ngày qua
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = văn bản sang hình ảnh/video

    789+0Thay đổi số sao trong 7 ngày qua
  • Attend-and-Excite@yuval-alaluf

    Triển khai chính thức cho "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các nghiên cứu ấn tượng về tạo ảnh từ văn bản

    765+0Thay đổi số sao trong 7 ngày qua
  • Khảo sát về tạo/tổng hợp văn bản thành video.

    744+3Thay đổi số sao trong 7 ngày qua
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, hỗ trợ các tác vụ đa phương thức phổ biến, bao gồm các mô hình tiền huấn luyện đa phương thức quy mô lớn end-to-end và bộ công cụ mô hình khuếch tán. Hiệu suất cao và linh hoạt.

    723-1Thay đổi số sao trong 7 ngày qua
  • NanoBananaEditor@markfulton

    Ứng dụng tạo và chỉnh sửa hình ảnh Nano Banana tiên tiến nhất. Trung tâm điều khiển cho việc tạo và chỉnh sửa hình ảnh bằng AI. Giao diện trực quan hỗ trợ hình ảnh tham chiếu, chỉnh sửa bằng mặt nạ hình ảnh, lịch sử phiên bản và nhiều tính năng khác. Được vận hành bởi API hình ảnh Gemini 2.5 Flash.

    710+0Thay đổi số sao trong 7 ngày qua
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Mô hình khuếch tán hiệu quả cho việc tạo văn bản thành hình ảnh độ phân giải cao (2K)

    674-1Thay đổi số sao trong 7 ngày qua
  • OneDiffusion@lehduong

    Triển khai chính thức của bài báo OneDiffusion (CVPR 2025)

    665+0Thay đổi số sao trong 7 ngày qua
  • flash-diffusion@gojasper

    Flash Diffusion — tăng tốc các mô hình khuếch tán có điều kiện (AAAI 2025 Oral)

    665+1Thay đổi số sao trong 7 ngày qua
  • Chuyển đổi khuôn mặt thành nhãn dán (face-to-sticker).

    641+0Thay đổi số sao trong 7 ngày qua
  • Liquid@FoundationVision

    (Được chấp nhận bởi IJCV) Liquid: Các mô hình ngôn ngữ là các trình tạo đa phương thức thống nhất và có khả năng mở rộng

    640+0Thay đổi số sao trong 7 ngày qua
  • blended-latent-diffusion@omriav

    Triển khai chính thức cho "Blended Latent Diffusion" [SIGGRAPH 2023].

    632+0Thay đổi số sao trong 7 ngày qua
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC và [TPAMI 2024] MIGC++ (Triển khai chính thức).

    614+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các mẫu prompt JSON có thể tái sử dụng và tài liệu tham khảo phong cách cho tạo ảnh AI. Được cập nhật hàng ngày.

    592+6Thay đổi số sao trong 7 ngày qua
  • blended-diffusion@omriav

    Triển khai chính thức cho "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022].

    588-1Thay đổi số sao trong 7 ngày qua
  • semantic-draw@ironjr

    Mã nguồn chính thức cho bài báo CVPR 2025 "SemanticDraw: Hướng tới sáng tạo nội dung tương tác thời gian thực từ các mô hình khuếch tán hình ảnh"

    588+0Thay đổi số sao trong 7 ngày qua
  • Danh sách các bài báo được tuyển chọn về tạo nội dung đa phương thức dựa trên LLM (hình ảnh, video, 3D và âm thanh)

    552+0Thay đổi số sao trong 7 ngày qua
  • payload-ai@ashbuilds

    AI Plugin là một tiện ích mở rộng mạnh mẽ cho Payload CMS, tích hợp các khả năng AI tiên tiến để nâng cao việc tạo và quản lý nội dung.

    547-1Thay đổi số sao trong 7 ngày qua
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Bộ mã hóa token thống nhất cho việc tạo và hiểu hình ảnh

    529-1Thay đổi số sao trong 7 ngày qua
  • Google-Colab_Notebooks@Isi-dev

    Bộ sưu tập các Google Colab Notebook cho nhiều dự án khác nhau

    519+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề