vision
Repositórios de código aberto acompanhados marcados com vision, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de vision no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com vision.
- #1
Toolkit visual e conjunto de habilidades projetado para modelos de texto puro "verem" imagens. Suporta compreensão de múltiplas imagens, perguntas e respostas, restauração de UI front-end, automação de GUI, com integração opcional a múltiplos agentes principais e reconhecimento direto de imagens coladas.
★ 1.127 - #2
Olhos para agentes do DeepSeek Harness baseados apenas em texto: cadeia de visão gratuita integrada (sem chave) + ferramentas de visão em nível de pixel (P&D, grounding, recorte, diferença de pixels, cores, OCR, rastreamento SVG, recorte, capturas de tela). Instalação com um único comando, sem Python, os turnos de imagem funcionam como turnos normais de chamada de ferramentas.
★ 1.034
- #1
Clone aprimorado do ChatGPT: Recursos com Agents, MCP, Skills, DeepSeek, Anthropic, AWS, OpenAI, Responses API, Azure, Groq, o1, GPT-5, Mistral, OpenRouter, Vertex AI, Gemini, Artifacts, alternância de modelos de IA, busca de mensagens, Code Interpreter, langchain, DALL-E-3, OpenAPI Actions, Functions, Autenticação Multi-Usuário Segura, Presets, código aberto para auto-hospedagem. Ativo
★ 42.597+274Variação de estrelas nos últimos 7 dias - #2
Xray, penetra em tudo. Também o melhor v2ray-core. Onde a mágica acontece. Uma plataforma aberta para vários usos.
★ 41.282+130Variação de estrelas nos últimos 7 dias - #3
A pilha de agentes de IA multimodal de código aberto: Conectando modelos de IA de ponta e infraestrutura de agentes
★ 38.742+62Variação de estrelas nos últimos 7 dias - #4★ 34.555-5Variação de estrelas nos últimos 7 dias
- #5★ 22.878+52Variação de estrelas nos últimos 7 dias
- #6
O fim do parsing web. O início da busca nativa de pixels escalável. link: https://pixelrag.ai/
★ 9.788+134Variação de estrelas nos últimos 7 dias - #7
📸 Uma biblioteca de câmera poderosa e de alto desempenho para React Native.
★ 9.586+18Variação de estrelas nos últimos 7 dias - #8
O primeiro plugin de visão para o DeepSeek Harness e a ponte visual para qualquer agente de codificação baseado em texto. Cole uma imagem e obtenha evidências JSON estruturadas (OCR, layout, semântica).
★ 3.756+255Variação de estrelas nos últimos 7 dias - #9★ 3.726+18Variação de estrelas nos últimos 7 dias
- #10
Plataforma de hardware e software de código aberto para construir um carro autônomo em pequena escala.
★ 3.496+2Variação de estrelas nos últimos 7 dias - #11
[CVPR 2023] DepGraph: Rumo a qualquer poda estrutural; LLMs, modelos de base de visão, etc.
★ 3.348+1Variação de estrelas nos últimos 7 dias - #12★ 2.730+1Variação de estrelas nos últimos 7 dias
- #13★ 2.331-1Variação de estrelas nos últimos 7 dias
- #14
Exemplos de código em Java e Kotlin usados no cloud.google.com
★ 1.906+1Variação de estrelas nos últimos 7 dias - #15
Inteligência visual para sua casa.
★ 1.446+10Variação de estrelas nos últimos 7 dias - #16★ 1.270+2Variação de estrelas nos últimos 7 dias
- #17
Vídeos, notas e experimentos para entender aprendizado profundo
★ 1.198+1Variação de estrelas nos últimos 7 dias - #18
🌝 O MLKit é um kit de ferramentas poderoso e fácil de usar. Com o ML Kit, você pode implementar facilmente reconhecimento de texto, reconhecimento de código de barras, rotulagem de imagens, detecção de rostos, detecção de objetos, entre outras funções.
★ 1.169+1Variação de estrelas nos últimos 7 dias - #19
Toolkit visual e conjunto de habilidades projetado para modelos de texto puro "verem" imagens. Suporta compreensão de múltiplas imagens, perguntas e respostas, restauração de UI front-end, automação de GUI, com integração opcional a múltiplos agentes principais e reconhecimento direto de imagens coladas.
★ 1.127+23Variação de estrelas nos últimos 7 dias - #20
Uma solução baseada inteiramente em MLP para visão computacional, do Google AI
★ 1.064+1Variação de estrelas nos últimos 7 dias - #21
Olhos para agentes do DeepSeek Harness baseados apenas em texto: cadeia de visão gratuita integrada (sem chave) + ferramentas de visão em nível de pixel (P&D, grounding, recorte, diferença de pixels, cores, OCR, rastreamento SVG, recorte, capturas de tela). Instalação com um único comando, sem Python, os turnos de imagem funcionam como turnos normais de chamada de ferramentas.
★ 1.034+85Variação de estrelas nos últimos 7 dias - #22
CALVIN - Um benchmark para aprendizado de políticas condicionadas por linguagem para tarefas de manipulação robótica de longo prazo
★ 977+5Variação de estrelas nos últimos 7 dias - #23★ 953+2Variação de estrelas nos últimos 7 dias
- #24★ 911+0Variação de estrelas nos últimos 7 dias
- #25
3DMatch - um descritor geométrico local baseado em 3D ConvNet para alinhar malhas 3D e nuvens de pontos.
★ 905+1Variação de estrelas nos últimos 7 dias - #26
Biblioteca de visão de alto desempenho em Python. Escalone sua pesquisa, não o código repetitivo.
★ 816+2Variação de estrelas nos últimos 7 dias - #27
🎰 Uma lista curada de recursos de aprendizado de máquina, preferencialmente CoreML.
★ 813+0Variação de estrelas nos últimos 7 dias - #28
Este aplicativo pode traduzir texto capturado de qualquer aplicativo em execução no seu computador.
★ 754+12Variação de estrelas nos últimos 7 dias - #29
Converta qualquer captura de tela de design web em código HTML/CSS limpo
★ 681-1Variação de estrelas nos últimos 7 dias - #30
Ferramenta de geração de dados de treinamento de ML baseada em visão computacional :rocket:
★ 612+0Variação de estrelas nos últimos 7 dias