Lompat ke konten utama
buildradar
Sign in
Topik · vision-and-language

vision-and-language

Repositori open source terpantau bertanda vision-and-language, diurutkan berdasarkan bintang.

Repositori
23
Total bintang
63.821
Rata-rata bintang
2.775
Porsi
0,00%

Topik yang sering muncul berdampingan dengan vision-and-language di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda vision-and-language.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Repositori terpadu untuk pembaruan riset AI generatif, sumber daya wawancara, notebook, dan banyak lagi!

    29.211+213Perubahan bintang dalam 7 hari terakhir
  • LAVIS@salesforce

    LAVIS - Pustaka satu atap untuk Kecerdasan Bahasa-Visi

    11.261-1Perubahan bintang dalam 7 hari terakhir
  • maestro@roboflow

    menyederhanakan proses fine-tuning untuk model multimodal: PaliGemma 2, Florence-2, dan Qwen2.5-VL

    2.695+1Perubahan bintang dalam 7 hari terakhir
  • OmAgent@om-ai-lab

    [EMNLP-2024] Membangun agen bahasa multimodal untuk prototipe cepat dan produksi

    2.666+1Perubahan bintang dalam 7 hari terakhir
  • ViLT@dandelin

    Kode untuk makalah ICML 2021 (presentasi panjang): "ViLT: Vision-and-Language Transformer Tanpa Konvolusi atau Supervisi Wilayah"

    1.538+0Perubahan bintang dalam 7 hari terakhir
  • awesome-japanese-llm@llm-jp

    Ringkasan LLM Bahasa Jepang - Ikhtisar LLM Bahasa Jepang

    1.428+1Perubahan bintang dalam 7 hari terakhir
  • OmDet@om-ai-lab

    Deteksi objek end-to-end open-vocabulary yang akurat dan real-time

    1.393+0Perubahan bintang dalam 7 hari terakhir
  • prismer@NVlabs

    Implementasi dari "Prismer: A Vision-Language Model with Multi-Task Experts".

    1.309+0Perubahan bintang dalam 7 hari terakhir
  • Aria@rhymes-ai

    Basis kode untuk Aria - Open Multimodal Native MoE

    1.088+1Perubahan bintang dalam 7 hari terakhir
  • ONE-PEACE@OFA-Sys

    Model representasi umum lintas modalitas visi, audio, dan bahasa. Makalah: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1.060+0Perubahan bintang dalam 7 hari terakhir
  • PointLLM@InternRobotics

    [Kandidat Best Paper ECCV 2024 & TPAMI 2025] PointLLM: Memberdayakan Large Language Models untuk memahami Point Clouds.

    1.053+2Perubahan bintang dalam 7 hari terakhir
  • DoRA@NVlabs

    [ICML2024 (Oral)] Implementasi resmi PyTorch dari DoRA: Weight-Decomposed Low-Rank Adaptation

    994+4Perubahan bintang dalam 7 hari terakhir
  • calvin@mees

    CALVIN - Tolok ukur untuk Pembelajaran Kebijakan Berbasis Bahasa untuk Tugas Manipulasi Robot Berdurasi Panjang

    985+10Perubahan bintang dalam 7 hari terakhir
  • groundingLMM@mbzuai-oryx

    [CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM), model pertama yang mampu menghasilkan respons bahasa alami yang terintegrasi secara mulus dengan mask segmentasi objek.

    967+0Perubahan bintang dalam 7 hari terakhir
  • Tentang Repositori ini adalah koleksi pilihan dari makalah CVPR 2025 yang paling menarik dan berpengaruh. 🔥 [Paper + Code + Demo]

    895+1Perubahan bintang dalam 7 hari terakhir
  • AlphaCLIP@SunzeY

    [CVPR 2024] Alpha-CLIP: Model CLIP yang berfokus pada area yang Anda inginkan.

    874+0Perubahan bintang dalam 7 hari terakhir
  • Repositori ini adalah koleksi pilihan dari makalah CVPR 2024 yang paling menarik dan berpengaruh. 🔥 [Paper + Code + Demo]

    735+0Perubahan bintang dalam 7 hari terakhir
  • Matterport3DSimulator@peteanderson80

    Platform Riset AI untuk Reinforcement Learning dari Citra Panoramik Nyata.

    713+1Perubahan bintang dalam 7 hari terakhir
  • Repositori ini adalah kumpulan pilihan dari makalah CVPR 2023 yang paling menarik dan berpengaruh. 🔥 [Makalah + Kode]

    649+0Perubahan bintang dalam 7 hari terakhir
  • Proctoring-AI@vardanagarwal

    Membuat perangkat lunak untuk pemantauan otomatis dalam pengawasan ujian online

    634-1Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi untuk navigasi visi-dan-bahasa. Makalah ACL 2022 "Vision-and-Language Navigation: A Survey of Tasks, Methods, and Future Directions"

    607+3Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi sumber daya vision and language yang luar biasa (masih dalam tahap pembangunan... nantikan terus!)

    564+0Perubahan bintang dalam 7 hari terakhir
  • Repositori ini mencantumkan makalah relevan yang dirangkum dalam makalah survei kami: A Systematic Survey of Prompt Engineering on Vision-Language Foundation Models.

    513+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik