Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · diffusion-models

diffusion-models

Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.

163 kho mã
  • Tổng hợp về xử lý ảnh dựa trên khuếch tán, bao gồm phục hồi, tăng cường, mã hóa và đánh giá chất lượng

    954-1Thay đổi số sao trong 7 ngày qua
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS: Tổng hợp cảnh đô thị 3D sống động từ hình ảnh vệ tinh

    953+4Thay đổi số sao trong 7 ngày qua
  • verl-omni@verl-project

    Khung huấn luyện RL đa phương thức cho các mô hình diffusion và omni

    949+56Thay đổi số sao trong 7 ngày qua
  • Causal-Forcing@thu-ml

    Mã nguồn chính thức cho [ICML 2026] "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++

    948+9Thay đổi số sao trong 7 ngày qua
  • ODISE@NVlabs

    Triển khai chính thức của PyTorch cho ODISE: Phân đoạn toàn cảnh mở với mô hình khuếch tán văn bản thành hình ảnh [CVPR 2023 Highlight]

    943+0Thay đổi số sao trong 7 ngày qua
  • Tóm tắt các bài báo và blog chính về diffusion models để tìm hiểu về chủ đề này. Danh sách chi tiết tất cả các bài báo nghiên cứu về diffusion robotics đã được xuất bản.

    920+1Thay đổi số sao trong 7 ngày qua
  • MindAct@candle-org

    MindSpore + 🤗Huggingface: Chạy bất kỳ mô hình Transformers/Diffusers nào trên MindSpore với độ tương thích mượt mà và tăng tốc.

    920+0Thay đổi số sao trong 7 ngày qua
  • Ứng dụng trưng bày nhiều pipeline mô hình diffusion thời gian thực với Diffusers

    916+0Thay đổi số sao trong 7 ngày qua
  • UniPic@SkyworkAI

    Mô hình chỉnh sửa đa ảnh SOTA mã nguồn mở

    874+1Thay đổi số sao trong 7 ngày qua
  • MiniGPT-5@UCSB-AI

    Triển khai chính thức của bài báo "MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens"

    869+0Thay đổi số sao trong 7 ngày qua
  • OpenWorldLib@OpenDCAI

    Cơ sở mã hợp nhất cho các mô hình thế giới nâng cao.

    866+1Thay đổi số sao trong 7 ngày qua
  • Open-DiffusionGS@caiyuanhao1998

    Tích hợp Gaussian Splatting vào Diffusion Denoiser để tạo và tái tạo hình ảnh 3D từ một ảnh đơn lẻ nhanh chóng và có khả năng mở rộng (ICCV 2025).

    861-2Thay đổi số sao trong 7 ngày qua
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] Tạo video từ văn bản bảo toàn danh tính bằng phân tách tần số

    856+1Thay đổi số sao trong 7 ngày qua
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF: Chỉnh sửa cảnh 3D thông qua hướng dẫn (ICCV 2023)

    852+0Thay đổi số sao trong 7 ngày qua
  • Danh sách các bài báo liên quan đến lượng tử hóa mạng thần kinh tại các hội nghị và tạp chí AI gần đây.

    851+5Thay đổi số sao trong 7 ngày qua
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq: Tạo văn bản từ chuỗi sang chuỗi với các mô hình khuếch tán (Diffusion Models)

    838+0Thay đổi số sao trong 7 ngày qua
  • MeshDiffusion@lzzcd001

    Triển khai chính thức của "MeshDiffusion: Score-based Generative 3D Mesh Modeling" (ICLR 2023 Spotlight).

    832+0Thay đổi số sao trong 7 ngày qua
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer: Tạo nhanh mô hình 3D Gaussians từ văn bản bằng cách kết nối các mô hình khuếch tán 2D và 3D.

    829-1Thay đổi số sao trong 7 ngày qua
  • Triển khai chính thức cho "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) và UltraImage

    827+0Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các bài báo về 3D Vision trong lĩnh vực Robotics thời đại mô hình lớn (LLMs/VLMs), lấy cảm hứng từ awesome-computer-vision, bao gồm bài báo, mã nguồn và các trang web liên quan

    820+1Thay đổi số sao trong 7 ngày qua
  • daclip-uir@Algolzw

    [ICLR 2024] Kiểm soát các mô hình ngôn ngữ thị giác (Vision-Language Models) để phục hồi hình ảnh phổ quát. Đạt giải 5 trong thử thách NTIRE 2024 Restore Any Image Model in the Wild.

    817+1Thay đổi số sao trong 7 ngày qua
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D: Paint Anything 3D với các mô hình khuếch tán kết cấu không ánh sáng, một mô hình tạo kết cấu không tích hợp ánh sáng.

    808-1Thay đổi số sao trong 7 ngày qua
  • deepinv@deepinv

    DeepInverse: thư viện PyTorch dùng deep learning để giải quyết các bài toán nghịch đảo trong xử lý ảnh.

    802+5Thay đổi số sao trong 7 ngày qua
  • audio-diffusion@teticio

    Áp dụng các mô hình khuếch tán sử dụng gói diffusers mới của Hugging Face để tổng hợp âm nhạc thay vì hình ảnh.

    795+1Thay đổi số sao trong 7 ngày qua
  • smalldiffusion@yuanchenyang

    Mã nguồn đơn giản và dễ đọc để huấn luyện và lấy mẫu từ các mô hình khuếch tán (diffusion models).

    785+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các nghiên cứu tuyệt vời về tạo video.

    782+0Thay đổi số sao trong 7 ngày qua
  • Hợp nhất mô hình trong LLM, MLLM và hơn thế nữa: Phương pháp, lý thuyết, ứng dụng và cơ hội. ACM Computing Surveys, 2026.

    779+2Thay đổi số sao trong 7 ngày qua
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (còn gọi là MagicDance): Tái tạo tư thế người và biểu cảm khuôn mặt chân thực với Diffusion nhận diện danh tính

    776+0Thay đổi số sao trong 7 ngày qua
  • dift@Tsingularity

    [NeurIPS'23] Sự tương ứng mới nổi từ Image Diffusion

    775+0Thay đổi số sao trong 7 ngày qua
  • Attend-and-Excite@yuval-alaluf

    Triển khai chính thức cho "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề