image-generation
Repositórios de código aberto acompanhados marcados com image-generation, ordenados por estrelas.
- #61
Um visualizador simples e independente para ler prompts de imagens geradas pelo Stable Diffusion fora da webui.
★ 1.340+0Variação de estrelas nos últimos 7 dias - #62
Um modelo multimodal nativo unificado com 3B de parâmetros ativos para compreensão, geração e edição de imagens e vídeos.
★ 1.334+3Variação de estrelas nos últimos 7 dias - #63
WebAI2API: Ferramenta baseada em Camoufox para converter IA web em API, com suporte a LMArena/Gemini, concorrência multi-janela e isolamento de contas.
★ 1.315+16Variação de estrelas nos últimos 7 dias - #64
Motor de inferência offline para arte, conversas de voz em tempo real, chatbots baseados em LLM e fluxos de trabalho automatizados
★ 1.314+0Variação de estrelas nos últimos 7 dias - #65
[NeurIPS 2020] Aumento diferenciável para treinamento de GAN com eficiência de dados
★ 1.308+0Variação de estrelas nos últimos 7 dias - #66
Bernini é um framework unificado para geração e edição de vídeo que combina um planejador semântico baseado em MLLM com um renderizador baseado em DiT.
★ 1.300+10Variação de estrelas nos últimos 7 dias - #67
A extensão Inpaint Anything realiza inpainting de stable diffusion em uma interface de navegador usando máscaras do Segment Anything.
★ 1.298+0Variação de estrelas nos últimos 7 dias - #68
[ICCV 2025] Implementação oficial de "MV-Adapter: Multi-view Consistent Image Generation Made Easy"
★ 1.289+1Variação de estrelas nos últimos 7 dias - #69
Crie facilmente PDFs e imagens no Symfony convertendo HTML usando webkit
★ 1.247+0Variação de estrelas nos últimos 7 dias - #70
Script de shell simples para usar o ChatGPT e DALL-E da OpenAI a partir do terminal. Não requer Python ou JS.
★ 1.241+3Variação de estrelas nos últimos 7 dias - #71
Coleção de recursos incríveis sobre tradução de imagem para imagem.
★ 1.239+0Variação de estrelas nos últimos 7 dias - #72
Encontre problemas automaticamente em conjuntos de dados de imagens e pratique visão computacional centrada em dados.
★ 1.199+0Variação de estrelas nos últimos 7 dias - #73
PyTorch - Cálculo de FID com etapas adequadas de redimensionamento e quantização de imagem [CVPR 2022]
★ 1.167+0Variação de estrelas nos últimos 7 dias - #74
[ICLR24] Implementação oficial do artigo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Variação de estrelas nos últimos 7 dias - #75
Implementação oficial em PyTorch de "VITON-HD: High-Resolution Virtual Try-On via Misalignment-Aware Normalization" (CVPR 2021)
★ 1.161+0Variação de estrelas nos últimos 7 dias - #76
Estúdio de IA local sem censura para Windows, Linux e macOS. Interface gráfica de configuração zero para geração de imagens, LLMs GGUF, conversão de texto em fala e de fala em texto
★ 1.118+87Variação de estrelas nos últimos 7 dias - #77
Servidor de inferência LLM nativo para Apple Silicon. Compatível com a API da OpenAI e Anthropic. Sem Python. Inclui o aplicativo MLX Core para macOS com chat, modo agente e chamada de ferramentas.
★ 1.115+245Variação de estrelas nos últimos 7 dias - #78
Habilidades de ilustração de materiais de Guizang: geração de diagramas explicativos com texto, embelezamento de gráficos e imagens de suporte de referência.
★ 1.113+37Variação de estrelas nos últimos 7 dias - #79★ 1.102+1Variação de estrelas nos últimos 7 dias
- #80
Expanda perfeitamente qualquer imagem em qualquer direção com IA. Aplicativo web de código aberto alimentado pelo Gemini via OpenRouter, com mesclagem de bordas via Poisson e seletor de variantes best-of-3.
★ 1.100+4Variação de estrelas nos últimos 7 dias - #81
Uma lista curada de recursos, ferramentas, habilidades, tutoriais e artigos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) — agente de IA open-source auto-hospedado para WhatsApp, Telegram, Discord e mais de 50 integrações.
★ 1.005+8Variação de estrelas nos últimos 7 dias - #82
Lista de artigos de trabalhos recentes em Visão Computacional (CV)
★ 973+1Variação de estrelas nos últimos 7 dias - #83
[ICLR 2026] Framework iterativo sem treinamento para visualização de histórias longas
★ 957-2Variação de estrelas nos últimos 7 dias - #84
🎬 Gere imagens a partir de qualquer ponto de vista da câmera via controle interativo 3D. Arraste a câmera no espaço 3D ou use os seletores para definir azimute/elevação/distância e gere a imagem. Desenvolvido com Three.js + Gradio, interface bilíngue ZH/EN.
★ 942+218Variação de estrelas nos últimos 7 dias - #85
Implementação oficial em PyTorch para o artigo High-Resolution Virtual Try-On with Misalignment and Occlusion-Handled Conditions (ECCV 2022).
★ 917+0Variação de estrelas nos últimos 7 dias - #86
WebUI de fluxo de trabalho de IA com foco em local-first para o Gemini, integrando chat multimodal, Canvas, processamento de arquivos, busca em tempo real, execução de código e raciocínio avançado.
★ 895+1Variação de estrelas nos últimos 7 dias - #87★ 881-1Variação de estrelas nos últimos 7 dias
- #88
🎨 Estúdio de slides de IA de código aberto dentro do Codex: decks nativos de imagem, cada slide é uma tela visual completa. ⚡ Mais de 10 slides de alta qualidade em ~4–5 minutos — O modo rápido renderiza cada página em paralelo. 🔍 Acompanhe toda a cadeia ao vivo: pesquisa → esboço → estilo → renderização → edição → apresentação → exportação para PDF/PPTX. 🖥️ Focado no navegador · sem chaves de API · projetos duráveis.
★ 875+23Variação de estrelas nos últimos 7 dias - #89★ 874+1Variação de estrelas nos últimos 7 dias
- #90
CLI de geração de mídia Flatkey para imagens, vídeos, áudio, texto, créditos e descoberta de modelos.
★ 825+191Variação de estrelas nos últimos 7 dias