diffusion-models
Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.
- #61
Huấn luyện mô hình khuếch tán có khả năng mở rộng và tối ưu hóa bộ nhớ
★ 1.359+0Thay đổi số sao trong 7 ngày qua - #62
[ICASSP 2024] 🍵 Matcha-TTS: Kiến trúc TTS nhanh với conditional flow matching
★ 1.353+3Thay đổi số sao trong 7 ngày qua - #63
[ICLR 2023 Oral] Khôi phục hình ảnh Zero-Shot sử dụng Denoising Diffusion Null-Space Model
★ 1.351+2Thay đổi số sao trong 7 ngày qua - #64
FireRed-Image-Edit là một mô hình nền tảng chỉnh sửa hình ảnh mạnh mẽ đạt hiệu suất tiên tiến mã nguồn mở với khả năng tuân theo chỉ dẫn chính xác, tạo sinh độ trung thực cao, tính nhất quán về danh tính vượt trội và sự kết hợp nhiều thành phần liền mạch.
★ 1.350+3Thay đổi số sao trong 7 ngày qua - #65
[AAAI 2025]👔IMAGDressing👔: Tạo trang phục mô-đun tương tác để mặc đồ ảo. Cho phép tạo hình ảnh con người có thể tùy chỉnh với khả năng điều khiển trang phục, tư thế và bối cảnh linh hoạt, đảm bảo độ trung thực cao và tính nhất quán của trang phục cho việc thử đồ ảo.
★ 1.343+0Thay đổi số sao trong 7 ngày qua - #66
[TPAMI 2025🔥] MagicTime: Mô hình tạo video tua nhanh thời gian như các trình mô phỏng biến hình
★ 1.337-1Thay đổi số sao trong 7 ngày qua - #67
Gói di động để chạy Hunyuan3D 2.0/2.1 trên Windows.
★ 1.326+4Thay đổi số sao trong 7 ngày qua - #68
Pruna là một framework tối ưu hóa mô hình được xây dựng cho các nhà phát triển, giúp bạn cung cấp các mô hình nhanh hơn, hiệu quả hơn với chi phí tối thiểu.
★ 1.274+1Thay đổi số sao trong 7 ngày qua - #69
[CVPR 2025 Oral & Best Paper Finalist] Difix3D+: Cải thiện việc tái tạo 3D bằng mô hình khuếch tán một bước
★ 1.267+1Thay đổi số sao trong 7 ngày qua - #70
[CVPR2024, Highlight] Mã nguồn chính thức cho DragDiffusion
★ 1.259+0Thay đổi số sao trong 7 ngày qua - #71★ 1.238-1Thay đổi số sao trong 7 ngày qua
- #72
HunyuanCustom: Kiến trúc hướng đa phương thức dành cho việc tạo video tùy chỉnh
★ 1.228-1Thay đổi số sao trong 7 ngày qua - #73
Mô hình chuyển văn bản thành giọng nói dựa trên Flow Matching với khả năng kiểm soát phong cách điều khiển bằng Emoji
★ 1.228+4Thay đổi số sao trong 7 ngày qua - #74★ 1.196-1Thay đổi số sao trong 7 ngày qua
- #75
Wunjo CE: Hoán đổi khuôn mặt, Khớp nhép môi, Xóa đối tượng & văn bản & nền điều khiển, Tái tạo phong cách, Tách âm thanh, Nhân bản giọng nói, Tạo video. Mã nguồn mở, Chạy cục bộ & Miễn phí.
★ 1.170+1Thay đổi số sao trong 7 ngày qua - #76
[ICLR24] Triển khai chính thức của bài báo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Thay đổi số sao trong 7 ngày qua - #77
Bộ sưu tập tài nguyên về tạo sinh có điều khiển với các mô hình khuếch tán văn bản thành hình ảnh.
★ 1.110+0Thay đổi số sao trong 7 ngày qua - #78★ 1.108+3Thay đổi số sao trong 7 ngày qua
- #79
Stable Diffusion được triển khai hoàn toàn từ đầu bằng PyTorch
★ 1.078+0Thay đổi số sao trong 7 ngày qua - #80
[Tiêu điểm ICLR'24] Dòng mô hình lớn đa phương thức tiếng Trung và tiếng Anh (Chat and Paint) | Dòng mô hình lớn đa phương thức song ngữ Trung-Anh dựa trên mô hình cơ sở CPM
★ 1.061-1Thay đổi số sao trong 7 ngày qua - #81
[ECCV 2024 Oral] MotionDirector: Tùy chỉnh chuyển động của các mô hình khuếch tán Văn bản sang Video.
★ 1.053+2Thay đổi số sao trong 7 ngày qua - #82
[ICLR 2025 Oral] Triển khai chính thức của "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance"
★ 1.050+4Thay đổi số sao trong 7 ngày qua - #83
[CVPR 2025 Highlight] 3DTopia-XL: Tạo tài sản PBR 3D chất lượng cao thông qua Primitive Diffusion
★ 1.046+0Thay đổi số sao trong 7 ngày qua - #84
[ICLR 2024 Spotlight] SyncDreamer: Tạo hình ảnh nhất quán đa góc nhìn từ một hình ảnh đơn góc nhìn
★ 1.044-1Thay đổi số sao trong 7 ngày qua - #85
Bản triển khai chính thức của bài báo: "FlowEdit: Chỉnh sửa dựa trên văn bản không cần đảo ngược sử dụng các mô hình Flow đã huấn luyện trước"
★ 1.013-1Thay đổi số sao trong 7 ngày qua - #86★ 986+22Thay đổi số sao trong 7 ngày qua
- #87
[CVPR 2024] PIA, Trình tạo ảnh động cá nhân hóa của bạn. Tạo ảnh động từ đoạn văn bản nhắc, kết hợp với Dreambooth, tạo ra các video tuyệt đẹp.
★ 975+0Thay đổi số sao trong 7 ngày qua - #88★ 970-1Thay đổi số sao trong 7 ngày qua
- #89★ 969+0Thay đổi số sao trong 7 ngày qua
- #90
[ICLR 2026] Khung lặp không cần huấn luyện để trực quan hóa câu chuyện dài
★ 959+0Thay đổi số sao trong 7 ngày qua