text-to-image
Repositorios de código abierto monitorizados etiquetados con text-to-image, ordenados por estrellas.
- #31
WebAI2API: Herramienta para convertir IA web a API basada en Camoufox, compatible con LMArena/Gemini, con concurrencia multiventana y aislamiento de cuentas.
★ 1315+16Variación de estrellas de los últimos 7 días - #32
Motor de inferencia offline para arte, conversaciones de voz en tiempo real, chatbots impulsados por LLM y flujos de trabajo automatizados
★ 1314+0Variación de estrellas de los últimos 7 días - #33
Una colección de recursos sobre generación controlable con modelos de difusión de texto a imagen.
★ 1110+0Variación de estrellas de los últimos 7 días - #34★ 1101+1Variación de estrellas de los últimos 7 días
- #35
Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.
★ 1005+8Variación de estrellas de los últimos 7 días - #36
Implementación de Muse: generación de texto a imagen mediante Masked Generative Transformers, en PyTorch
★ 918+0Variación de estrellas de los últimos 7 días - #37
Corrige arte en píxeles e imágenes vectoriales generadas por IA directamente en tu navegador
★ 916+5Variación de estrellas de los últimos 7 días - #38
El tutorial más fácil de entender para usar LoRA (Low-Rank Adaptation) dentro del framework diffusers para investigadores de generación por IA 🔥
★ 822-1Variación de estrellas de los últimos 7 días - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementación oficial).
★ 814+0Variación de estrellas de los últimos 7 días - #40
[TMLR 2025🔥] Un estudio sobre modelos autorregresivos en visión artificial.
★ 808+1Variación de estrellas de los últimos 7 días - #41
CLIP + FFT/DWT/RGB = texto a imagen/video
★ 789+0Variación de estrellas de los últimos 7 días - #42
Implementación oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Variación de estrellas de los últimos 7 días - #43
Una colección de estudios asombrosos sobre la generación de texto a imagen.
★ 765+0Variación de estrellas de los últimos 7 días - #44
Un estudio sobre la generación/síntesis de texto a video.
★ 744+3Variación de estrellas de los últimos 7 días - #45
Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.
★ 723-1Variación de estrellas de los últimos 7 días - #46
La aplicación de edición y generación de imágenes Nano Banana más avanzada. Tu centro principal para la generación y revisión de imágenes mediante IA. Interfaz intuitiva con imágenes de referencia, edición con máscaras, historial de versiones y más. Impulsado por la API de imágenes Gemini 2.5 Flash.
★ 710+0Variación de estrellas de los últimos 7 días - #47
HunyuanImage-2.1: Un modelo de difusión eficiente para generación de texto a imagen en alta resolución (2K)
★ 674+0Variación de estrellas de los últimos 7 días - #48
Implementación oficial del artículo OneDiffusion (CVPR 2025).
★ 665+0Variación de estrellas de los últimos 7 días - #49
Flash Diffusion: aceleración de modelos de difusión condicional (AAAI 2025 Oral).
★ 664+1Variación de estrellas de los últimos 7 días - #50
face-to-sticker
★ 641+0Variación de estrellas de los últimos 7 días - #51
(Aceptado por IJCV) Liquid: los modelos de lenguaje son generadores multimodales escalables y unificados.
★ 640+0Variación de estrellas de los últimos 7 días - #52
Implementación oficial de "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Variación de estrellas de los últimos 7 días - #53★ 614+0Variación de estrellas de los últimos 7 días
- #54
Colección curada de plantillas de prompts JSON reutilizables y referencias de estilo para generación de imágenes por IA. Actualizado diariamente.
★ 593+17Variación de estrellas de los últimos 7 días - #55
Implementación oficial de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 588+0Variación de estrellas de los últimos 7 días - #56
Código oficial para el artículo de CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models".
★ 588-1Variación de estrellas de los últimos 7 días - #57
🔥🔥🔥 Una lista seleccionada de artículos sobre generación multimodal basada en LLMs (imagen, video, 3D y audio).
★ 552+0Variación de estrellas de los últimos 7 días - #58
AI Plugin es una potente extensión para Payload CMS que integra capacidades avanzadas de IA para mejorar la creación y gestión de contenido.
★ 547+2Variación de estrellas de los últimos 7 días - #59
[NeurIPS 2025 Spotlight] Un tokenizador unificado para la generación y comprensión visual.
★ 529-1Variación de estrellas de los últimos 7 días - #60
Una colección de notebooks de Google Colab para diversos proyectos
★ 519+5Variación de estrellas de los últimos 7 días