Lompat ke konten utama
buildradar
Sign in
Topik · audio-language-model

audio-language-model

Repositori open source terpantau bertanda audio-language-model, diurutkan berdasarkan bintang.

Repositori
4
Total bintang
3.852
Rata-rata bintang
963
Porsi
0,00%

Topik yang sering muncul berdampingan dengan audio-language-model di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda audio-language-model.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Fun-ASR@QwenAudio

    Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.

    1.512+10Perubahan bintang dalam 7 hari terakhir
  • SoundMind@xid32

    Kami memperkenalkan dataset Audio Logical Reasoning (ALR), yang terdiri dari 6.446 sampel anotasi teks-audio yang dirancang khusus untuk tugas penalaran kompleks. Berdasarkan sumber daya ini, kami mengusulkan SoundMind, sebuah algoritma reinforcement learning (RL) berbasis aturan yang dirancang untuk membekali model bahasa audio (ALM) dengan kemampuan penalaran bimodal yang mendalam.

    1.113+0Perubahan bintang dalam 7 hari terakhir
  • OmniVinci@NVlabs

    OmniVinci adalah LLM omni-modal untuk pemahaman bersama visi, audio, dan bahasa.

    677+0Perubahan bintang dalam 7 hari terakhir
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    Model dialog lisan ujung-ke-ujung waktu nyata sumber terbuka pertama di dunia dengan kloning suara yang dipersonalisasi.

    549-1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik