Pular para o conteúdo principal
buildradar
Sign in
Tópico · audio-language-model

audio-language-model

Repositórios de código aberto acompanhados marcados com audio-language-model, ordenados por estrelas.

Repositórios
4
Total de estrelas
3.852
Média de estrelas
963
Participação
0,00%

Tópicos que aparecem com frequência ao lado de audio-language-model no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com audio-language-model.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • Fun-ASR@QwenAudio

    Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.

    1.512+14Variação de estrelas nos últimos 7 dias
  • SoundMind@xid32

    Apresentamos o conjunto de dados Audio Logical Reasoning (ALR), composto por 6.446 amostras anotadas de texto-áudio projetadas especificamente para tarefas de raciocínio complexo. Com base neste recurso, propomos o SoundMind, um algoritmo de aprendizado por reforço (RL) baseado em regras, adaptado para dotar modelos de linguagem de áudio (ALMs) com habilidades profundas de raciocínio bimodal.

    1.113+0Variação de estrelas nos últimos 7 dias
  • OmniVinci@NVlabs

    OmniVinci é um LLM onimodal para compreensão conjunta de visão, áudio e linguagem.

    677+1Variação de estrelas nos últimos 7 dias
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    O primeiro modelo de diálogo falado de ponta a ponta em tempo real de código aberto do mundo com clonagem de voz personalizada.

    549-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos