Saltar al contenido principal
buildradar
Sign in
Tema · image-generation

image-generation

Repositorios de código abierto monitorizados etiquetados con image-generation, ordenados por estrellas.

132 repositorios
  • Un visor independiente y sencillo para leer prompts de imágenes generadas por Stable Diffusion fuera de la webui.

    1340+0Variación de estrellas de los últimos 7 días
  • Lance@bytedance

    Un modelo multimodal unificado nativo con 3B de parámetros activos para la comprensión, generación y edición de imágenes y videos.

    1334+3Variación de estrellas de los últimos 7 días
  • WebAI2API@foxhui

    WebAI2API: Herramienta para convertir IA web a API basada en Camoufox, compatible con LMArena/Gemini, con concurrencia multiventana y aislamiento de cuentas.

    1315+16Variación de estrellas de los últimos 7 días
  • airunner@Capsize-Games

    Motor de inferencia offline para arte, conversaciones de voz en tiempo real, chatbots impulsados por LLM y flujos de trabajo automatizados

    1314+0Variación de estrellas de los últimos 7 días
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] Aumento diferenciable para el entrenamiento eficiente de datos en GAN.

    1308+0Variación de estrellas de los últimos 7 días
  • Bernini@bytedance

    Bernini es un framework unificado para la generación y edición de video que combina un planificador semántico basado en MLLM con un renderizador basado en DiT.

    1300+10Variación de estrellas de los últimos 7 días
  • Extensión Inpaint Anything que realiza inpainting de stable diffusion en una interfaz de navegador usando máscaras de Segment Anything.

    1298+0Variación de estrellas de los últimos 7 días
  • MV-Adapter@huanngzh

    [ICCV 2025] Implementación oficial de "MV-Adapter: Multi-view Consistent Image Generation Made Easy"

    1289+1Variación de estrellas de los últimos 7 días
  • Cree fácilmente archivos PDF e imágenes en Symfony convirtiendo HTML mediante webkit

    1247+0Variación de estrellas de los últimos 7 días
  • Script de shell sencillo para utilizar ChatGPT y DALL-E de OpenAI desde la terminal. No requiere Python ni JS.

    1241+3Variación de estrellas de los últimos 7 días
  • Colección de recursos increíbles sobre traducción de imagen a imagen.

    1239+0Variación de estrellas de los últimos 7 días
  • cleanvision@cleanlab

    Encuentra automáticamente problemas en conjuntos de datos de imágenes y practica la visión artificial centrada en los datos.

    1199+0Variación de estrellas de los últimos 7 días
  • clean-fid@GaParmar

    PyTorch - Cálculo de FID con pasos adecuados de redimensionamiento y cuantización de imágenes [CVPR 2022]

    1167+0Variación de estrellas de los últimos 7 días
  • MagicDrive@cure-lab

    [ICLR24] Implementación oficial del artículo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”

    1167+1Variación de estrellas de los últimos 7 días
  • VITON-HD@shadow2496

    Implementación oficial en PyTorch de "VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization" (CVPR 2021).

    1161+0Variación de estrellas de los últimos 7 días
  • Uncensored-Local-Studio@techjarves

    Estudio de IA local sin censura para Windows, Linux y macOS. Interfaz gráfica sin configuración para generación de imágenes, LLMs GGUF, conversión de texto a voz y de voz a texto.

    1118+87Variación de estrellas de los últimos 7 días
  • mlx-serve@ddalcu

    Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.

    1115+245Variación de estrellas de los últimos 7 días
  • Skill de ilustración de materiales Guizang: generación de diagramas explicativos con texto, embellecimiento de gráficos e imágenes de referencia auxiliares.

    1113+35Variación de estrellas de los últimos 7 días
  • CogView4@zai-org

    CogView4, CogView3-Plus y CogView3 (ECCV 2024)

    1102+1Variación de estrellas de los últimos 7 días
  • image-extender@boona13

    Extiende cualquier imagen de forma fluida en cualquier dirección con IA. Aplicación web de código abierto impulsada por Gemini a través de OpenRouter, con uniones mezcladas por Poisson y selector de la mejor variante de 3.

    1100+4Variación de estrellas de los últimos 7 días
  • awesome-agent-apis@Anil-matcha

    Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.

    1005+7Variación de estrellas de los últimos 7 días
  • Una lista de artículos sobre trabajos recientes de Visión Artificial (CV)

    973+1Variación de estrellas de los últimos 7 días
  • story-iter@UCSC-VLAA

    [ICLR 2026] Un marco iterativo sin entrenamiento para la visualización de historias largas.

    957+0Variación de estrellas de los últimos 7 días
  • Genera imágenes desde cualquier punto de vista de cámara mediante control interactivo 3D. Arrastra la cámara en el espacio 3D o usa deslizadores para ajustar azimut, elevación y distancia. Construido con Three.js y Gradio, con interfaz bilingüe en chino e inglés.

    942+188Variación de estrellas de los últimos 7 días
  • HR-VITON@sangyun884

    Implementación oficial en PyTorch para el artículo High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022).

    917+0Variación de estrellas de los últimos 7 días
  • AMC-WebUI@yeahhe365

    Interfaz web de flujo de trabajo de IA local-first para Gemini, que integra chat multimodal, Canvas, procesamiento de archivos, búsqueda en tiempo real, ejecución de código y razonamiento avanzado.

    895+0Variación de estrellas de los últimos 7 días
  • AnyGPT@OpenMOSS

    Código para "AnyGPT: LLM multimodal unificado con modelado de secuencia discreta"

    881+0Variación de estrellas de los últimos 7 días
  • codex-slides@nexu-io

    🎨 Estudio de diapositivas de IA de código abierto dentro de Codex: presentaciones nativas de imágenes, cada diapositiva como un lienzo visual completo. ⚡ Más de 10 diapositivas de alta calidad en ~4–5 minutos — El modo rápido renderiza cada página en paralelo. 🔍 Observa toda la cadena en vivo: investigación → esquema → estilo → renderizado → edición → presentación → exportación a PDF/PPTX. 🖥️ Centrado en el navegador · sin claves de API · proyectos duraderos.

    875+19Variación de estrellas de los últimos 7 días
  • UniPic@SkyworkAI

    Modelo de edición multi-imagen SOTA de código abierto

    874+1Variación de estrellas de los últimos 7 días
  • flatkey-cli@flatkey-ai

    CLI de generación de medios Flatkey para imágenes, videos, audio, texto, créditos y descubrimiento de modelos

    825+176Variación de estrellas de los últimos 7 días
← Volver a temas