image-to-text
Repositorios de código abierto monitorizados etiquetados con image-to-text, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a image-to-text en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con image-to-text.
- #1
El primer plugin de visión para DeepSeek Harness, y el puente de visión para cada agente de codificación de solo texto. Pega una imagen, obtén evidencia JSON estructurada (OCR, diseño, semántica). | El plugin de visión externo más potente de toda la red para DeepSeek Harness, que aporta capacidades de visión a modelos de solo texto como DeepSeek y GLM; pega una imagen para obtener evidencia JSON estructurada (OCR, diseño, semántica).
★ 3839+134Variación de estrellas de los últimos 7 días - #2
Un envoltorio para trabajar con Tesseract OCR en PHP.
★ 3039-1Variación de estrellas de los últimos 7 días - #3★ 1739+11Variación de estrellas de los últimos 7 días
- #4
Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.
★ 723+1Variación de estrellas de los últimos 7 días - #5
🎮 Herramienta de traducción de juegos en tiempo real | OCR + Traducción por IA | Juegos en Windows | Código abierto
★ 641+1Variación de estrellas de los últimos 7 días - #6
Flame es un sistema de IA multimodal de código abierto diseñado para traducir maquetas de diseño de interfaz de usuario a código React de alta calidad. Aprovecha el modelado de lenguaje visual, la síntesis de datos automatizada y flujos de trabajo de entrenamiento estructurados para cerrar la brecha entre el diseño y el desarrollo front-end.
★ 562+1Variación de estrellas de los últimos 7 días - #7★ 506—Variación de estrellas de los últimos 7 días