Pular para o conteúdo principal
buildradar
Sign in
Tópico · text-to-image

text-to-image

Repositórios de código aberto acompanhados marcados com text-to-image, ordenados por estrelas.

61 repositórios
  • WebAI2API@foxhui

    WebAI2API: Ferramenta baseada em Camoufox para converter IA web em API, com suporte a LMArena/Gemini, concorrência multi-janela e isolamento de contas.

    1.315+16Variação de estrelas nos últimos 7 dias
  • airunner@Capsize-Games

    Motor de inferência offline para arte, conversas de voz em tempo real, chatbots baseados em LLM e fluxos de trabalho automatizados

    1.314+0Variação de estrelas nos últimos 7 dias
  • Uma coleção de recursos sobre geração controlável com modelos de difusão text-to-image.

    1.110+0Variação de estrelas nos últimos 7 dias
  • CogView4@zai-org

    CogView4, CogView3-Plus e CogView3 (ECCV 2024)

    1.102+1Variação de estrelas nos últimos 7 dias
  • awesome-agent-apis@Anil-matcha

    Uma lista curada de recursos, ferramentas, habilidades, tutoriais e artigos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) — agente de IA open-source auto-hospedado para WhatsApp, Telegram, Discord e mais de 50 integrações.

    1.005+7Variação de estrelas nos últimos 7 dias
  • muse-maskgit-pytorch@lucidrains

    Implementação do Muse: Geração de Texto para Imagem via Transformers Generativos Mascarados, em Pytorch

    918+0Variação de estrelas nos últimos 7 dias
  • unfake.js@jenissimo

    Corrija pixel art de IA e imagens vetoriais diretamente no seu navegador

    913+4Variação de estrelas nos últimos 7 dias
  • Lora-for-Diffusers@haofanwang

    O tutorial mais fácil de entender para usar LoRA (Low-Rank Adaptation) dentro do framework diffusers para pesquisadores de geração por IA🔥

    822-1Variação de estrelas nos últimos 7 dias
  • TF-ICON@Shilin-LU

    [ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementação oficial)

    814+0Variação de estrelas nos últimos 7 dias
  • [TMLR 2025🔥] Uma pesquisa sobre modelos autorregressivos em visão.

    808+1Variação de estrelas nos últimos 7 dias
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = texto para imagem/vídeo

    789+0Variação de estrelas nos últimos 7 dias
  • Attend-and-Excite@yuval-alaluf

    Implementação oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Variação de estrelas nos últimos 7 dias
  • Uma coleção de estudos incríveis sobre geração de texto para imagem.

    765+0Variação de estrelas nos últimos 7 dias
  • Um Levantamento sobre Geração/Síntese de Texto para Vídeo.

    744+2Variação de estrelas nos últimos 7 dias
  • PaddleMIX@PaddlePaddle

    Integração e Exploração Multimodal do Paddle, dando suporte a tarefas multimodais principais, incluindo modelos de pré-treinamento multimodal em larga escala de ponta a ponta e caixa de ferramentas de modelos de difusão. Equipado com alto desempenho e flexibilidade.

    723-1Variação de estrelas nos últimos 7 dias
  • NanoBananaEditor@markfulton

    O aplicativo gerador e editor de imagens Nano Banana mais avançado. Seu hub central para geração e revisões de imagens por IA. A interface intuitiva apresenta imagens de referência, edição com máscaras de imagem, histórico de versões e muito mais. Alimentado pela API de imagens do Gemini 2.5 Flash.

    710+0Variação de estrelas nos últimos 7 dias
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Um Modelo de Difusão Eficiente para Geração de Texto para Imagem em Alta Resolução (2K)

    675+0Variação de estrelas nos últimos 7 dias
  • OneDiffusion@lehduong

    Implementação oficial do artigo OneDiffusion (CVPR 2025)

    665+0Variação de estrelas nos últimos 7 dias
  • flash-diffusion@gojasper

    Flash Diffusion — acelerando modelos de difusão condicional (AAAI 2025 Oral)

    663+1Variação de estrelas nos últimos 7 dias
  • face-to-sticker

    641+0Variação de estrelas nos últimos 7 dias
  • Liquid@FoundationVision

    (Aceito no IJCV) Liquid: Modelos de linguagem são geradores multimodais escaláveis e unificados

    640+0Variação de estrelas nos últimos 7 dias
  • blended-latent-diffusion@omriav

    Implementação oficial para "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Variação de estrelas nos últimos 7 dias
  • MIGC@limuloo

    [CVPR 2024 Highlight] MIGC e [TPAMI 2024] MIGC++ (Implementação Oficial)

    614+0Variação de estrelas nos últimos 7 dias
  • Coleção curada de modelos de prompt JSON reutilizáveis e referências de estilo para geração de imagens por IA. Atualizado diariamente.

    593+18Variação de estrelas nos últimos 7 dias
  • blended-diffusion@omriav

    Implementação oficial de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]

    589+0Variação de estrelas nos últimos 7 dias
  • semantic-draw@ironjr

    Código oficial para o artigo do CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588-1Variação de estrelas nos últimos 7 dias
  • 🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).

    552+0Variação de estrelas nos últimos 7 dias
  • payload-ai@ashbuilds

    AI Plugin é uma extensão poderosa para o Payload CMS, integrando recursos avançados de IA para aprimorar a criação e o gerenciamento de conteúdo.

    548+1Variação de estrelas nos últimos 7 dias
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] Um Tokenizador Unificado para Geração e Compreensão Visual

    529+0Variação de estrelas nos últimos 7 dias
  • Google-Colab_Notebooks@Isi-dev

    A Collection of Google Colab Notebooks for various projects

    520+6Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos