hustvl
Repositorios de código abierto monitorizados de hustvl, ordenados por estrellas.
- #1
[CVPR 2024] 4D Gaussian Splatting para renderizado de escenas dinámicas en tiempo real
★ 3908+7Variación de estrellas de los últimos 7 días - #2
[ICML 2024] Vision Mamba: Aprendizaje de representación visual eficiente con modelo de espacio de estados bidireccional
★ 3903+3Variación de estrellas de los últimos 7 días - #3
[ICLR'23 Spotlight & ECCV'24 & IJCV'24] MapTR: Modelado estructurado y aprendizaje para la construcción de mapas HD vectorizados en línea.
★ 1544+1Variación de estrellas de los últimos 7 días - #4
[CVPR 2025 Oral] Reconstrucción vs. Generación: Domando el dilema de optimización en modelos de difusión latente.
★ 1538+6Variación de estrellas de los últimos 7 días - #5
[CVPR 2025 Highlight] Modelo de difusión truncado para conducción autónoma de extremo a extremo en tiempo real.
★ 1484+3Variación de estrellas de los últimos 7 días - #6
[ICCV 2023 & ICLR 2026] VAD: Representación de escenas vectorizada para conducción autónoma eficiente
★ 1365+2Variación de estrellas de los últimos 7 días - #7
[CVPR 2024] GaussianDreamer: Generación rápida de texto a 3D Gaussians mediante la conexión de modelos de difusión 2D y 3D.
★ 829-1Variación de estrellas de los últimos 7 días - #8
[Image and Vision Computing (Vol.147 Jul. '24)] Recorte interactivo de imágenes naturales con Segment Anything Models
★ 592+2Variación de estrellas de los últimos 7 días - #9
PixelHacker: Inpainting de imágenes con consistencia estructural y semántica
★ 582+0Variación de estrellas de los últimos 7 días - #10
[IJCV 2026] Senna: Conectando modelos de lenguaje y visión a gran escala con la conducción autónoma de extremo a extremo
★ 555+1Variación de estrellas de los últimos 7 días - #11
[Information Fusion (Vol.103, Mar. '24)] Potenciando el recorte de imágenes (Image Matting) con Vision Transformers preentrenados.
★ 555+4Variación de estrellas de los últimos 7 días - #12
[ECCV 2026] Moebius: Framework ligero de inpainting de imágenes de 0.2B con rendimiento de nivel 10B
★ 532+4Variación de estrellas de los últimos 7 días - #13
Código oficial de "EVF-SAM: Fusión temprana de visión-lenguaje para el modelo Segment Anything con prompts de texto"
★ 508+1Variación de estrellas de los últimos 7 días