メインコンテンツへスキップ
buildradar
Sign in
トピック · audio-language-model

audio-language-model

audio-language-model がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
4
総スター数
3,852
平均スター数
963
シェア
0.00%

audio-language-model と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、audio-language-model がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • Fun-ASR@QwenAudio

    中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。

    1,512+14直近 7 日のスター増減
  • SoundMind@xid32

    複雑な推論タスク向けに特別に設計された 6,446 件のテキスト・音声アノテーション済みサンプルからなる Audio Logical Reasoning (ALR) データセットを提案します。このリソースを基に、音声言語モデル (ALMs) に高度なバイモーダル推論能力を付与するために調整された、ルールベースの強化学習 (RL) アルゴリズムである SoundMind を提案します。

    1,113+0直近 7 日のスター増減
  • OmniVinci@NVlabs

    OmniVinci は、視覚、音声、言語を統合理解するためのオムニモーダル LLM です。

    677+1直近 7 日のスター増減
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    パーソナライズされた音声クローン機能を備えた、世界初のオープンソースのリアルタイムエンドツーエンド音声対話モデル

    549-1直近 7 日のスター増減
← トピック一覧に戻る