Saltar al contenido principal
buildradar
Sign in
Tema · text-to-image

text-to-image

Repositorios de código abierto monitorizados etiquetados con text-to-image, ordenados por estrellas.

62 repositorios
  • WebAI2API@foxhui

    WebAI2API: Herramienta para convertir IA web a API basada en Camoufox, compatible con LMArena/Gemini, con concurrencia multiventana y aislamiento de cuentas.

    1315+16Variación de estrellas de los últimos 7 días
  • airunner@Capsize-Games

    Motor de inferencia offline para arte, conversaciones de voz en tiempo real, chatbots impulsados por LLM y flujos de trabajo automatizados

    1314+0Variación de estrellas de los últimos 7 días
  • Una colección de recursos sobre generación controlable con modelos de difusión de texto a imagen.

    1110+0Variación de estrellas de los últimos 7 días
  • CogView4@zai-org

    CogView4, CogView3-Plus y CogView3 (ECCV 2024)

    1101+1Variación de estrellas de los últimos 7 días
  • awesome-agent-apis@Anil-matcha

    Una lista curada de recursos, herramientas, habilidades, tutoriales y artículos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) es un agente de IA de código abierto autohospedado para WhatsApp, Telegram, Discord y más de 50 integraciones.

    1005+8Variación de estrellas de los últimos 7 días
  • muse-maskgit-pytorch@lucidrains

    Implementación de Muse: generación de texto a imagen mediante Masked Generative Transformers, en PyTorch

    918+0Variación de estrellas de los últimos 7 días
  • unfake.js@jenissimo

    Corrige arte en píxeles e imágenes vectoriales generadas por IA directamente en tu navegador

    916+5Variación de estrellas de los últimos 7 días
  • Lora-for-Diffusers@haofanwang

    El tutorial más fácil de entender para usar LoRA (Low-Rank Adaptation) dentro del framework diffusers para investigadores de generación por IA 🔥

    822-1Variación de estrellas de los últimos 7 días
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementación oficial).

    814+0Variación de estrellas de los últimos 7 días
  • [TMLR 2025🔥] Un estudio sobre modelos autorregresivos en visión artificial.

    808+1Variación de estrellas de los últimos 7 días
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = texto a imagen/video

    789+0Variación de estrellas de los últimos 7 días
  • Attend-and-Excite@yuval-alaluf

    Implementación oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Variación de estrellas de los últimos 7 días
  • Una colección de estudios asombrosos sobre la generación de texto a imagen.

    765+0Variación de estrellas de los últimos 7 días
  • Un estudio sobre la generación/síntesis de texto a video.

    744+3Variación de estrellas de los últimos 7 días
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.

    723-1Variación de estrellas de los últimos 7 días
  • NanoBananaEditor@markfulton

    La aplicación de edición y generación de imágenes Nano Banana más avanzada. Tu centro principal para la generación y revisión de imágenes mediante IA. Interfaz intuitiva con imágenes de referencia, edición con máscaras, historial de versiones y más. Impulsado por la API de imágenes Gemini 2.5 Flash.

    710+0Variación de estrellas de los últimos 7 días
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Un modelo de difusión eficiente para generación de texto a imagen en alta resolución (2K)

    674+0Variación de estrellas de los últimos 7 días
  • OneDiffusion@lehduong

    Implementación oficial del artículo OneDiffusion (CVPR 2025).

    665+0Variación de estrellas de los últimos 7 días
  • flash-diffusion@gojasper

    Flash Diffusion: aceleración de modelos de difusión condicional (AAAI 2025 Oral).

    664+1Variación de estrellas de los últimos 7 días
  • face-to-sticker

    641+0Variación de estrellas de los últimos 7 días
  • Liquid@FoundationVision

    (Aceptado por IJCV) Liquid: los modelos de lenguaje son generadores multimodales escalables y unificados.

    640+0Variación de estrellas de los últimos 7 días
  • blended-latent-diffusion@omriav

    Implementación oficial de "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Variación de estrellas de los últimos 7 días
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC y [TPAMI 2024] MIGC++ (Implementación oficial)

    614+0Variación de estrellas de los últimos 7 días
  • Colección curada de plantillas de prompts JSON reutilizables y referencias de estilo para generación de imágenes por IA. Actualizado diariamente.

    593+17Variación de estrellas de los últimos 7 días
  • blended-diffusion@omriav

    Implementación oficial de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]

    588+0Variación de estrellas de los últimos 7 días
  • semantic-draw@ironjr

    Código oficial para el artículo de CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models".

    588-1Variación de estrellas de los últimos 7 días
  • 🔥🔥🔥 Una lista seleccionada de artículos sobre generación multimodal basada en LLMs (imagen, video, 3D y audio).

    552+0Variación de estrellas de los últimos 7 días
  • payload-ai@ashbuilds

    AI Plugin es una potente extensión para Payload CMS que integra capacidades avanzadas de IA para mejorar la creación y gestión de contenido.

    547+2Variación de estrellas de los últimos 7 días
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Un tokenizador unificado para la generación y comprensión visual.

    529-1Variación de estrellas de los últimos 7 días
  • Google-Colab_Notebooks@Isi-dev

    Una colección de notebooks de Google Colab para diversos proyectos

    519+5Variación de estrellas de los últimos 7 días
← Volver a temas