Saltar al contenido principal
buildradar
Sign in
Tema · image-to-text

image-to-text

Repositorios de código abierto monitorizados etiquetados con image-to-text, ordenados por estrellas.

Repositorios
7
Estrellas totales
11.043
Estrellas de media
1578
Proporción
0,00%

Temas que aparecen con frecuencia junto a image-to-text en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con image-to-text.

  • mac-ocr@privatenumber

    macOS CLI for OCR and searchable PDFs using Apple's Vision framework

    506
  • modlens@liustack

    El primer plugin de visión para DeepSeek Harness, y el puente de visión para cada agente de codificación de solo texto. Pega una imagen, obtén evidencia JSON estructurada (OCR, diseño, semántica). | El plugin de visión externo más potente de toda la red para DeepSeek Harness, que aporta capacidades de visión a modelos de solo texto como DeepSeek y GLM; pega una imagen para obtener evidencia JSON estructurada (OCR, diseño, semántica).

    3839+134Variación de estrellas de los últimos 7 días
  • tesseract-ocr-for-php@thiagoalessio

    Un envoltorio para trabajar con Tesseract OCR en PHP.

    3039-1Variación de estrellas de los últimos 7 días
  • MORT@kmonkeyhead

    Proyecto de traductor MORT - Traductor de juegos en tiempo real con OCR

    1739+11Variación de estrellas de los últimos 7 días
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.

    723+1Variación de estrellas de los últimos 7 días
  • RSTGameTranslation@thanhkeke97

    🎮 Herramienta de traducción de juegos en tiempo real | OCR + Traducción por IA | Juegos en Windows | Código abierto

    641+1Variación de estrellas de los últimos 7 días
  • Flame-Code-VLM@Flame-Code-VLM

    Flame es un sistema de IA multimodal de código abierto diseñado para traducir maquetas de diseño de interfaz de usuario a código React de alta calidad. Aprovecha el modelado de lenguaje visual, la síntesis de datos automatizada y flujos de trabajo de entrenamiento estructurados para cerrar la brecha entre el diseño y el desarrollo front-end.

    562+1Variación de estrellas de los últimos 7 días
  • mac-ocr@privatenumber

    macOS CLI for OCR and searchable PDFs using Apple's Vision framework

    506Variación de estrellas de los últimos 7 días
← Volver a temas