소유자 · QwenAudio
QwenAudio
QwenAudio의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
리포지토리 6개
- #1★ 23,426+359최근 7일 스타 변화
- #2
중국어, 광동어, 영어, 일본어, 한국어 ASR, 언어 식별, 감정 인식 및 오디오 이벤트 감지를 위한 오픈 소스 SenseVoiceSmall 모델입니다.
★ 9,209+37최근 7일 스타 변화 - #3
에이전트가 대화하고, 작업하고, 상주할 수 있도록 유지하는 실시간 음성 런타임. AI 에이전트를 위한 실시간 음성 런타임
★ 2,362+72최근 7일 스타 변화 - #4
FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리
★ 1,512+10최근 7일 스타 변화 - #5
[NeurIPS 2025] Chain-of-Thought(CoT) 추론을 바탕으로 모든 양식에서 오디오를 생성하는 통합 프레임워크인 [ThinkSound]의 PyTorch 구현
★ 1,378+0최근 7일 스타 변화 - #6
Fun-Audio-Chat은 자연스럽고 지연 시간이 짧은 음성 상호작용을 위해 구축된 대규모 오디오 언어 모델입니다.
★ 1,002+3최근 7일 스타 변화