image-generation
Repositorios de código abierto monitorizados etiquetados con image-generation, ordenados por estrellas.
- #61
Un visor independiente y sencillo para leer prompts de imágenes generadas por Stable Diffusion fuera de la webui.
★ 1340+0Variación de estrellas de los últimos 7 días - #62
Un modelo multimodal unificado nativo con 3B de parámetros activos para la comprensión, generación y edición de imágenes y videos.
★ 1334+3Variación de estrellas de los últimos 7 días - #63
WebAI2API: Herramienta para convertir IA web a API basada en Camoufox, compatible con LMArena/Gemini, con concurrencia multiventana y aislamiento de cuentas.
★ 1315+16Variación de estrellas de los últimos 7 días - #64
Motor de inferencia offline para arte, conversaciones de voz en tiempo real, chatbots impulsados por LLM y flujos de trabajo automatizados
★ 1314+0Variación de estrellas de los últimos 7 días - #65
[NeurIPS 2020] Aumento diferenciable para el entrenamiento eficiente de datos en GAN.
★ 1308+0Variación de estrellas de los últimos 7 días - #66
Bernini es un framework unificado para la generación y edición de video que combina un planificador semántico basado en MLLM con un renderizador basado en DiT.
★ 1300+10Variación de estrellas de los últimos 7 días - #67
Extensión Inpaint Anything que realiza inpainting de stable diffusion en una interfaz de navegador usando máscaras de Segment Anything.
★ 1298+0Variación de estrellas de los últimos 7 días - #68
[ICCV 2025] Implementación oficial de "MV-Adapter: Multi-view Consistent Image Generation Made Easy"
★ 1289+1Variación de estrellas de los últimos 7 días - #69
Cree fácilmente archivos PDF e imágenes en Symfony convirtiendo HTML mediante webkit
★ 1247+0Variación de estrellas de los últimos 7 días - #70
Script de shell sencillo para utilizar ChatGPT y DALL-E de OpenAI desde la terminal. No requiere Python ni JS.
★ 1241+3Variación de estrellas de los últimos 7 días - #71
Colección de recursos increíbles sobre traducción de imagen a imagen.
★ 1239+0Variación de estrellas de los últimos 7 días - #72
Encuentra automáticamente problemas en conjuntos de datos de imágenes y practica la visión artificial centrada en los datos.
★ 1199+0Variación de estrellas de los últimos 7 días - #73
PyTorch - Cálculo de FID con pasos adecuados de redimensionamiento y cuantización de imágenes [CVPR 2022]
★ 1167+0Variación de estrellas de los últimos 7 días - #74
[ICLR24] Implementación oficial del artículo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1167+1Variación de estrellas de los últimos 7 días - #75
Implementación oficial en PyTorch de "VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization" (CVPR 2021).
★ 1161+0Variación de estrellas de los últimos 7 días - #76
Estudio de IA local sin censura para Windows, Linux y macOS. Interfaz gráfica sin configuración para generación de imágenes, LLMs GGUF, conversión de texto a voz y de voz a texto.
★ 1118+87Variación de estrellas de los últimos 7 días - #77
Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.
★ 1115+245Variación de estrellas de los últimos 7 días - #78
Skill de ilustración de materiales Guizang: generación de diagramas explicativos con texto, embellecimiento de gráficos e imágenes de referencia auxiliares.
★ 1113+35Variación de estrellas de los últimos 7 días - #79★ 1102+1Variación de estrellas de los últimos 7 días
- #80
Extiende cualquier imagen de forma fluida en cualquier dirección con IA. Aplicación web de código abierto impulsada por Gemini a través de OpenRouter, con uniones mezcladas por Poisson y selector de la mejor variante de 3.
★ 1100+4Variación de estrellas de los últimos 7 días - #81
Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.
★ 1005+7Variación de estrellas de los últimos 7 días - #82
Una lista de artículos sobre trabajos recientes de Visión Artificial (CV)
★ 973+1Variación de estrellas de los últimos 7 días - #83
[ICLR 2026] Un marco iterativo sin entrenamiento para la visualización de historias largas.
★ 957+0Variación de estrellas de los últimos 7 días - #84
Genera imágenes desde cualquier punto de vista de cámara mediante control interactivo 3D. Arrastra la cámara en el espacio 3D o usa deslizadores para ajustar azimut, elevación y distancia. Construido con Three.js y Gradio, con interfaz bilingüe en chino e inglés.
★ 942+188Variación de estrellas de los últimos 7 días - #85
Implementación oficial en PyTorch para el artículo High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022).
★ 917+0Variación de estrellas de los últimos 7 días - #86
Interfaz web de flujo de trabajo de IA local-first para Gemini, que integra chat multimodal, Canvas, procesamiento de archivos, búsqueda en tiempo real, ejecución de código y razonamiento avanzado.
★ 895+0Variación de estrellas de los últimos 7 días - #87★ 881+0Variación de estrellas de los últimos 7 días
- #88
🎨 Estudio de diapositivas de IA de código abierto dentro de Codex: presentaciones nativas de imágenes, cada diapositiva como un lienzo visual completo. ⚡ Más de 10 diapositivas de alta calidad en ~4–5 minutos — El modo rápido renderiza cada página en paralelo. 🔍 Observa toda la cadena en vivo: investigación → esquema → estilo → renderizado → edición → presentación → exportación a PDF/PPTX. 🖥️ Centrado en el navegador · sin claves de API · proyectos duraderos.
★ 875+19Variación de estrellas de los últimos 7 días - #89★ 874+1Variación de estrellas de los últimos 7 días
- #90
CLI de generación de medios Flatkey para imágenes, videos, audio, texto, créditos y descubrimiento de modelos
★ 825+176Variación de estrellas de los últimos 7 días