text-to-image
Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-image, sắp xếp theo số sao.
- #31
WebAI2API: Công cụ chuyển đổi AI web thành API dựa trên Camoufox, hỗ trợ LMArena/Gemini và nhiều tính năng khác, đồng thời hỗ trợ đa cửa sổ đồng thời và cô lập tài khoản.
★ 1.315+0Thay đổi số sao trong 7 ngày qua - #32
Công cụ suy luận ngoại tuyến cho nghệ thuật, trò chuyện thoại thời gian thực, chatbot hỗ trợ bởi LLM và quy trình làm việc tự động
★ 1.314+0Thay đổi số sao trong 7 ngày qua - #33
Bộ sưu tập tài nguyên về tạo sinh có điều khiển với các mô hình khuếch tán văn bản thành hình ảnh.
★ 1.110+0Thay đổi số sao trong 7 ngày qua - #34★ 1.101+0Thay đổi số sao trong 7 ngày qua
- #35
Danh sách tổng hợp các tài nguyên, công cụ, kỹ năng, hướng dẫn và bài viết về OpenClaw. OpenClaw (trước đây là Moltbot / Clawdbot) — tác nhân AI tự lưu trữ mã nguồn mở cho WhatsApp, Telegram, Discord và hơn 50 tích hợp.
★ 1.005+8Thay đổi số sao trong 7 ngày qua - #36
Triển khai Muse: Tạo văn bản thành hình ảnh thông qua Masked Generative Transformers, bằng PyTorch
★ 918+0Thay đổi số sao trong 7 ngày qua - #37★ 916+6Thay đổi số sao trong 7 ngày qua
- #38
Hướng dẫn dễ hiểu nhất về cách sử dụng LoRA (Low-Rank Adaptation) trong framework diffusers dành cho các nhà nghiên cứu tạo AI.
★ 822+0Thay đổi số sao trong 7 ngày qua - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Triển khai chính thức)
★ 814+0Thay đổi số sao trong 7 ngày qua - #40
[TMLR 2025🔥] Khảo sát về các mô hình tự hồi quy trong thị giác máy tính.
★ 808+0Thay đổi số sao trong 7 ngày qua - #41
CLIP + FFT/DWT/RGB = văn bản sang hình ảnh/video
★ 789+0Thay đổi số sao trong 7 ngày qua - #42
Triển khai chính thức cho "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Thay đổi số sao trong 7 ngày qua - #43
Bộ sưu tập các nghiên cứu ấn tượng về tạo ảnh từ văn bản
★ 765+0Thay đổi số sao trong 7 ngày qua - #44
Khảo sát về tạo/tổng hợp văn bản thành video.
★ 744+3Thay đổi số sao trong 7 ngày qua - #45
Paddle Multimodal Integration and eXploration, hỗ trợ các tác vụ đa phương thức phổ biến, bao gồm các mô hình tiền huấn luyện đa phương thức quy mô lớn end-to-end và bộ công cụ mô hình khuếch tán. Hiệu suất cao và linh hoạt.
★ 723-1Thay đổi số sao trong 7 ngày qua - #46
Ứng dụng tạo và chỉnh sửa hình ảnh Nano Banana tiên tiến nhất. Trung tâm điều khiển cho việc tạo và chỉnh sửa hình ảnh bằng AI. Giao diện trực quan hỗ trợ hình ảnh tham chiếu, chỉnh sửa bằng mặt nạ hình ảnh, lịch sử phiên bản và nhiều tính năng khác. Được vận hành bởi API hình ảnh Gemini 2.5 Flash.
★ 710+0Thay đổi số sao trong 7 ngày qua - #47
HunyuanImage-2.1: Mô hình khuếch tán hiệu quả cho việc tạo văn bản thành hình ảnh độ phân giải cao (2K)
★ 674-1Thay đổi số sao trong 7 ngày qua - #48
Triển khai chính thức của bài báo OneDiffusion (CVPR 2025)
★ 665+0Thay đổi số sao trong 7 ngày qua - #49
Flash Diffusion — tăng tốc các mô hình khuếch tán có điều kiện (AAAI 2025 Oral)
★ 665+1Thay đổi số sao trong 7 ngày qua - #50
Chuyển đổi khuôn mặt thành nhãn dán (face-to-sticker).
★ 641+0Thay đổi số sao trong 7 ngày qua - #51
(Được chấp nhận bởi IJCV) Liquid: Các mô hình ngôn ngữ là các trình tạo đa phương thức thống nhất và có khả năng mở rộng
★ 640+0Thay đổi số sao trong 7 ngày qua - #52
Triển khai chính thức cho "Blended Latent Diffusion" [SIGGRAPH 2023].
★ 632+0Thay đổi số sao trong 7 ngày qua - #53★ 614+0Thay đổi số sao trong 7 ngày qua
- #54
Bộ sưu tập các mẫu prompt JSON có thể tái sử dụng và tài liệu tham khảo phong cách cho tạo ảnh AI. Được cập nhật hàng ngày.
★ 592+6Thay đổi số sao trong 7 ngày qua - #55
Triển khai chính thức cho "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022].
★ 588-1Thay đổi số sao trong 7 ngày qua - #56
Mã nguồn chính thức cho bài báo CVPR 2025 "SemanticDraw: Hướng tới sáng tạo nội dung tương tác thời gian thực từ các mô hình khuếch tán hình ảnh"
★ 588+0Thay đổi số sao trong 7 ngày qua - #57
Danh sách các bài báo được tuyển chọn về tạo nội dung đa phương thức dựa trên LLM (hình ảnh, video, 3D và âm thanh)
★ 552+0Thay đổi số sao trong 7 ngày qua - #58
AI Plugin là một tiện ích mở rộng mạnh mẽ cho Payload CMS, tích hợp các khả năng AI tiên tiến để nâng cao việc tạo và quản lý nội dung.
★ 547-1Thay đổi số sao trong 7 ngày qua - #59
[NeurIPS 2025 Spotlight] Bộ mã hóa token thống nhất cho việc tạo và hiểu hình ảnh
★ 529-1Thay đổi số sao trong 7 ngày qua - #60
Bộ sưu tập các Google Colab Notebook cho nhiều dự án khác nhau
★ 519+1Thay đổi số sao trong 7 ngày qua