Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · diffusion

diffusion

Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion, sắp xếp theo số sao.

76 kho mã
  • Helios@PKU-YuanGroup

    Helios: Mô hình tạo video dài thời gian thực thực sự

    2.129+18Thay đổi số sao trong 7 ngày qua
  • Mô hình khuếch tán trong chẩn đoán hình ảnh y tế (Được xuất bản trên tạp chí Medical Image Analysis)

    2.110+2Thay đổi số sao trong 7 ngày qua
  • ICEdit@River-Zhang

    [NeurIPS 2025] Chỉnh sửa ảnh chỉ đáng giá một LoRA duy nhất! 0.1% dữ liệu huấn luyện cho việc chỉnh sửa ảnh tuyệt vời! Vượt qua GPT-4o về độ duy trì ID~ Đã phát hành MoE ckpt! Chỉ cần 4GB VRAM để chạy!

    2.104+1Thay đổi số sao trong 7 ngày qua
  • LlamaGen@FoundationVision

    Mô hình tự hồi quy đánh bại Diffusion: 🦙 Llama cho tạo ảnh có thể mở rộng

    1.966+0Thay đổi số sao trong 7 ngày qua
  • BrushNet@TencentARC

    [ECCV 2024] Mã nguồn chính thức của bài báo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"

    1.744-1Thay đổi số sao trong 7 ngày qua
  • REPA@sihyun-yu

    [ICLR'25 Oral] Căn chỉnh biểu diễn cho việc tạo: Huấn luyện Diffusion Transformers dễ hơn bạn nghĩ

    1.706+2Thay đổi số sao trong 7 ngày qua
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: Tạo chân dung nói chuyện chân thực thông qua tổng hợp chuyển động mạch lạc

    1.628+0Thay đổi số sao trong 7 ngày qua
  • AngelSlim@Tencent

    Bộ công cụ nén mô hình được thiết kế để nâng cao tính dễ sử dụng, tính toàn diện và hiệu quả.

    1.619+58Thay đổi số sao trong 7 ngày qua
  • Pallaidium@tin2tin

    PALLAIDIUM — một studio phim AI tạo sinh, được tích hợp liền mạch vào Blender Video Editor (VSE), cho phép sản xuất từ đầu đến cuối từ kịch bản đến màn hình và ngược lại.

    1.523+0Thay đổi số sao trong 7 ngày qua
  • UNO@bytedance

    [ICCV 2025] 🔥🔥 UNO: Phương pháp tùy chỉnh vạn năng cho điều kiện hóa cả đơn đối tượng và đa đối tượng

    1.362+0Thay đổi số sao trong 7 ngày qua
  • finetrainers@huggingface

    Huấn luyện mô hình khuếch tán có khả năng mở rộng và tối ưu hóa bộ nhớ

    1.359+0Thay đổi số sao trong 7 ngày qua
  • Tiện ích mở rộng Inpaint Anything thực hiện điền khuyết (inpainting) stable diffusion trên giao diện trình duyệt sử dụng mặt nạ từ Segment Anything.

    1.298+0Thay đổi số sao trong 7 ngày qua
  • tango@declare-lab

    Một họ mô hình khuếch tán để tạo văn bản thành âm thanh.

    1.238-1Thay đổi số sao trong 7 ngày qua
  • MixGRPO@Tencent-Hunyuan

    [ECCV 2026] MixGRPO: Mở khóa hiệu suất GRPO dựa trên Flow với Mixed ODE-SDE

    1.177+0Thay đổi số sao trong 7 ngày qua
  • mlx-serve@ddalcu

    Máy chủ suy luận LLM gốc cho Apple Silicon. Tương thích với API OpenAI và Anthropic. Không sử dụng Python. Bao gồm ứng dụng MLX Core trên macOS với tính năng trò chuyện, chế độ đại lý và gọi công cụ.

    1.115+245Thay đổi số sao trong 7 ngày qua
  • dial-mpc@LeCAR-Lab

    Triển khai chính thức cho bài báo "Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing". DIAL-MPC là khung MPC dựa trên lấy mẫu mới cho điều khiển mô-men xoắn toàn phần của robot chân, đạt độ chính xác và linh hoạt mà không cần huấn luyện.

    997+1Thay đổi số sao trong 7 ngày qua
  • Danh sách thiết kế phân tử và vật liệu sử dụng Generative AI và Deep Learning

    952+1Thay đổi số sao trong 7 ngày qua
  • Causal-Forcing@thu-ml

    Mã nguồn chính thức cho [ICML 2026] "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++

    948+10Thay đổi số sao trong 7 ngày qua
  • FireRedTTS@FireRedTeam

    Hệ thống TTS nền tảng mã nguồn mở được hỗ trợ bởi LLM

    921+2Thay đổi số sao trong 7 ngày qua
  • UniWorld@PKU-YuanGroup

    UniWorld: Bộ mã hóa ngữ nghĩa độ phân giải cao cho việc hiểu và tạo hình ảnh hợp nhất

    890+0Thay đổi số sao trong 7 ngày qua
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] Tạo video từ văn bản bảo toàn danh tính bằng phân tách tần số

    857+1Thay đổi số sao trong 7 ngày qua
  • LION@nv-tlabs

    Các mô hình khuếch tán điểm tiềm ẩn (Latent Point Diffusion Models) để tạo hình dạng 3D

    835+0Thay đổi số sao trong 7 ngày qua
  • Triển khai chính thức cho "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) và UltraImage

    827+2Thay đổi số sao trong 7 ngày qua
  • Adan@sail-sg

    Adan: Thuật toán động lượng Nesterov thích ứng giúp tối ưu hóa các mô hình học sâu nhanh hơn

    822+0Thay đổi số sao trong 7 ngày qua
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: Một dòng mô hình khuếch tán để tạo Video và Hình ảnh

    820+3Thay đổi số sao trong 7 ngày qua
  • [TMLR 2025🔥] Khảo sát về các mô hình tự hồi quy trong thị giác máy tính.

    808+1Thay đổi số sao trong 7 ngày qua
  • daam@castorini

    Bản đồ phân bổ chú ý khuếch tán (Diffusion attentive attribution maps) để giải thích Stable Diffusion.

    802+0Thay đổi số sao trong 7 ngày qua
  • rcm@NVlabs

    rCM & Causal-rCM: Các thuật toán/cơ sở hạ tầng hàng đầu và thống nhất cho việc chưng cất khuếch tán video hai chiều/tự hồi quy ở quy mô lớn.

    800+6Thay đổi số sao trong 7 ngày qua
  • smalldiffusion@yuanchenyang

    Mã nguồn đơn giản và dễ đọc để huấn luyện và lấy mẫu từ các mô hình khuếch tán (diffusion models).

    785+2Thay đổi số sao trong 7 ngày qua
  • FRESCO@williamyang1991

    [CVPR 2024] FRESCO: Tương ứng không gian-thời gian cho dịch video Zero-Shot

    782-1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề