Lompat ke konten utama
buildradar
Sign in
Topik · multimodal-ai

multimodal-ai

Repositori open source terpantau bertanda multimodal-ai, diurutkan berdasarkan bintang.

Repositori
13
Total bintang
38.644
Rata-rata bintang
2.973
Porsi
0,00%

Topik yang sering muncul berdampingan dengan multimodal-ai di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda multimodal-ai.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Toolkit AI avatar (manusia digital) open-source untuk pembuatan video offline dan kloning manusia digital.

    14.992+65Perubahan bintang dalam 7 hari terakhir
  • AgnesAI-Models@AgnesAI-Labs

    Gateway AI Agnes resmi dan katalog model untuk alur kerja teks, gambar, video, dan agen yang kompatibel dengan OpenAI.

    5.044+28Perubahan bintang dalam 7 hari terakhir
  • Keterampilan Media Generatif multi-modal untuk Agen AI (Claude Code, Cursor, Gemini CLI). Pembuatan gambar, video, dan audio berkualitas tinggi yang didukung oleh muapi.ai.

    4.205+19Perubahan bintang dalam 7 hari terakhir
  • Mano-P@Mininglamp-AI

    Mano-P: Agen GUI-VLA sumber terbuka untuk perangkat edge. Berjalan secara lokal di Apple M4 Mac mini/MacBook — data tidak pernah meninggalkan perangkat Anda.

    2.615+15Perubahan bintang dalam 7 hari terakhir
  • EVA-OS@AutoArk

    EVA OS — AIOS multimodal waktu nyata untuk perangkat generasi berikutnya, membuat perangkat Anda "hidup" dan secerdas otak asli.

    1.869+87Perubahan bintang dalam 7 hari terakhir
  • video-search-and-summarization@NVIDIA-AI-Blueprints

    NVIDIA AI Blueprint untuk pencarian dan peringkasan video (VSS) adalah arsitektur referensi yang dipercepat GPU untuk membangun agen analitik video dengan peringatan terverifikasi waktu nyata, tanya jawab visual, dan pelaporan otomatis. Blueprint VSS menggunakan model bahasa visi (VLM) seperti NVIDIA Cosmos, LLM seperti NVIDIA Nemotron, RAG, dan NVIDIA NIM.

    1.840+10Perubahan bintang dalam 7 hari terakhir
  • OpenGUI@Core-Mate

    OpenGUI adalah kerangka kerja agen GUI Android untuk AI penggunaan ponsel yang dapat melihat, merencanakan, dan mengoperasikan aplikasi seluler nyata melalui GUI.

    1.624+38Perubahan bintang dalam 7 hari terakhir
  • vllm-mlx@waybarrios

    Server inferensi LLM yang kompatibel dengan OpenAI dan Anthropic berkinerja tinggi untuk Apple Silicon. Dilengkapi MLX asli, continuous batching, model multimodal, pemanggilan alat MCP, dan dukungan Claude Code.

    1.557+6Perubahan bintang dalam 7 hari terakhir
  • Katalog visual pilihan dari 155+ arsitektur vision-language model (VLM/MLLM): makalah, diagram, resep pelatihan, dataset, dan lini masa rilis untuk agen AI multimodal.

    1.310+2Perubahan bintang dalam 7 hari terakhir
  • xiaoyaosearch@dtsola

    XiaoyaoSearch: Memahami kata-kata Anda, membaca gambar Anda, menemukan file lokal apa pun dengan AI. Membuat pencarian semudah mengobrol.

    1.084+1Perubahan bintang dalam 7 hari terakhir
  • opendroid@yashab-cyber

    Agen Android Otonom Terbuka Anda — Asisten AI siap produksi yang merencanakan sendiri, didukung oleh LLM lokal/jarak jauh dan otomatisasi layar berbasis aksesibilitas.

    1.022+44Perubahan bintang dalam 7 hari terakhir
  • vectordb-recipes@lancedb

    Sumber daya, contoh, dan tutorial untuk AI multimodal, RAG, dan agen menggunakan pencarian vektor serta LLM

    973-1Perubahan bintang dalam 7 hari terakhir
  • MOSS-VL@OpenMOSS

    An open-weight 11B model series for long-form and real-time video understanding

    606Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik