image-captioning
Repositori open source terpantau bertanda image-captioning, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan image-captioning di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda image-captioning.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1★ 11.261-1Perubahan bintang dalam 7 hari terakhir
- #2
Model Keras untuk menghasilkan kode HTML dari mockup situs web yang digambar tangan. Mengimplementasikan arsitektur keterangan gambar untuk gambar sumber yang digambar.
★ 5.143+0Perubahan bintang dalam 7 hari terakhir - #3
InternGPT (iGPT) adalah platform demo open source untuk memamerkan model AI Anda dengan mudah. Kini mendukung DragGAN, ChatGPT, ImageBind, obrolan multimodal seperti GPT-4, SAM, penyuntingan gambar interaktif, dll. Coba di igpt.opengvlab.com.
★ 3.205+0Perubahan bintang dalam 7 hari terakhir - #4
Repositori resmi OFA (ICML 2022). Makalah: OFA: Menyatukan Arsitektur, Tugas, dan Modalitas Melalui Kerangka Kerja Pembelajaran Sequence-to-Sequence yang Sederhana
★ 2.557+0Perubahan bintang dalam 7 hari terakhir - #5
Kelas Swift sederhana untuk menyediakan semua konfigurasi yang Anda butuhkan guna membuat tampilan kamera kustom di aplikasi Anda
★ 1.395-1Perubahan bintang dalam 7 hari terakhir - #6★ 1.348+2Perubahan bintang dalam 7 hari terakhir
- #7★ 1.309+0Perubahan bintang dalam 7 hari terakhir
- #8
:fire: :fire: :fire: Daftar makalah dari beberapa karya Computer Vision (CV) terkini
★ 973+1Perubahan bintang dalam 7 hari terakhir - #9
AI VTuber dengan teknologi LLM, ASR, TTS, OCR, CV, dan lainnya untuk siaran langsung atau bermain Minecraft bersama Anda.
★ 803+5Perubahan bintang dalam 7 hari terakhir - #10
👁️ + 💬 + 🎧 = 🤖 Daftar pilihan model fondasi dan multimodal teratas! [Makalah + Kode + Contoh + Tutorial]
★ 637+0Perubahan bintang dalam 7 hari terakhir - #11
Node ComfyUI untuk model vision-language: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Ditambah deteksi open-vocabulary, segmentasi SAM2/SAM3, penalaran temporal video, GGUF melalui llama.cpp, dan API LLM/VLM yang dihost.
★ 588-1Perubahan bintang dalam 7 hari terakhir - #12★ 563+0Perubahan bintang dalam 7 hari terakhir