multi-modal
Repositori open source terpantau bertanda multi-modal, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan multi-modal di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda multi-modal.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Bangun dan jalankan agen yang dapat Anda lihat, pahami, dan percayai.
★ 30.463+420Perubahan bintang dalam 7 hari terakhir - #2
MLLM seukuran saku untuk pemahaman gambar dan video yang sangat efisien di ponsel Anda
★ 26.283+27Perubahan bintang dalam 7 hari terakhir - #3
Framework open-source untuk agen AI suara percakapan
★ 11.102+10Perubahan bintang dalam 7 hari terakhir - #4
[CVPR 2024 Oral] Keluarga InternVL: Alternatif Open-Source Perintis untuk GPT-4o. Model dialog multimodal open-source dengan performa mendekati GPT-4o
★ 10.150+3Perubahan bintang dalam 7 hari terakhir - #5
ModelScope: wujudkan konsep Model-sebagai-Layanan (Model-as-a-Service).
★ 9.121+4Perubahan bintang dalam 7 hari terakhir - #6
Rangkaian AI yang didukung oleh model mutakhir dan menyediakan fungsi AI/AGI tingkat lanjut. Termasuk persona AI, fungsi AGI, obrolan multi-model Beam kelas dunia, teks-ke-gambar, suara, streaming respons, penyorotan dan eksekusi kode, impor PDF, preset untuk pengembang, dan banyak lagi. Terapkan secara on-premise atau di cloud.
★ 7.108+1Perubahan bintang dalam 7 hari terakhir - #7
Pemrosesan data untuk dan dengan foundation models! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6.975+26Perubahan bintang dalam 7 hari terakhir - #8
model bahasa visual terbuka tingkat state-of-the-art | model pra-pelatihan multimodal
★ 6.744+0Perubahan bintang dalam 7 hari terakhir - #9★ 6.154+24Perubahan bintang dalam 7 hari terakhir
- #10
Versi bahasa Mandarin dari CLIP yang mencapai pengambilan lintas modal dan pembuatan representasi dalam bahasa Mandarin.
★ 6.001+1Perubahan bintang dalam 7 hari terakhir - #11
Implementasi / replikasi DALL-E, Transformer Text-to-Image OpenAI, di Pytorch
★ 5.626-2Perubahan bintang dalam 7 hari terakhir - #12★ 5.031-1Perubahan bintang dalam 7 hari terakhir
- #13★ 4.476+1Perubahan bintang dalam 7 hari terakhir
- #14
Toolkit evaluasi open-source untuk large multi-modality models (LMMs), mendukung 220+ LMM, 80+ benchmark
★ 4.375+13Perubahan bintang dalam 7 hari terakhir - #15★ 4.342+1Perubahan bintang dalam 7 hari terakhir
- #16
Model bahasa percakapan multimodal bahasa Mandarin dan Inggris.
★ 4.155+0Perubahan bintang dalam 7 hari terakhir - #17
Pustaka C#/.NET untuk menjalankan LLM (🦙LLaMA/LLaVA) di perangkat lokal Anda secara efisien.
★ 3.790+2Perubahan bintang dalam 7 hari terakhir - #18
【EMNLP 2024🔥】Video-LLaVA: Mempelajari Representasi Visual Terpadu melalui Penyelarasan Sebelum Proyeksi
★ 3.500+1Perubahan bintang dalam 7 hari terakhir - #19
Ekosistem asisten AI open-source dengan integrasi MCP, alur kerja multimodal, dukungan IoT, dan interaksi suara lintas platform.
★ 3.463+9Perubahan bintang dalam 7 hari terakhir - #20★ 3.123-1Perubahan bintang dalam 7 hari terakhir
- #21★ 2.674+0Perubahan bintang dalam 7 hari terakhir
- #22★ 2.433+0Perubahan bintang dalam 7 hari terakhir
- #23★ 2.322+0Perubahan bintang dalam 7 hari terakhir
- #24
Koleksi makalah klasik industri dan mutakhir di bidang rekomendasi/periklanan/pencarian.
★ 2.188-1Perubahan bintang dalam 7 hari terakhir - #25
[NeurIPS 2023] MotionGPT: Gerakan Manusia sebagai Bahasa Asing, model generatif gerakan-bahasa terpadu menggunakan LLM
★ 1.963+1Perubahan bintang dalam 7 hari terakhir - #26
Antarmuka GPT yang tangguh dan serbaguna untuk Discord. Percakapan ala ChatGPT, pembuatan gambar, moderasi AI, indeks/basis pengetahuan kustom, ringkasan youtube, dan banyak lagi!
★ 1.853-2Perubahan bintang dalam 7 hari terakhir - #27★ 1.521+3Perubahan bintang dalam 7 hari terakhir
- #28
[pip install medmnist] 18 Dataset Standar untuk Klasifikasi Citra Biomedis 2D dan 3D
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #29
Implementasi PyTorch dari Transfusion, "Predict the Next Token and Diffuse Images with One Multi-Modal Model", dari MetaAI
★ 1.398+3Perubahan bintang dalam 7 hari terakhir - #30
Repositori ini mengumpulkan makalah untuk "A Survey on Knowledge Distillation of Large Language Models". Kami memecah KD menjadi Knowledge Elicitation dan Algoritma Distilasi, serta mengeksplorasi Skill & Vertical Distillation dari LLM.
★ 1.306+1Perubahan bintang dalam 7 hari terakhir