OpenMOSS
OpenMOSS의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #1★ 12,234+11최근 7일 스타 변화
- #2
MOSS-TTS-Nano는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 다국어 초소형 음성 생성 모델입니다. 0.1B(1억) 개의 파라미터만으로 실시간 음성 생성을 위해 설계되었으며, GPU 없이 CPU에서 직접 실행할 수 있고 로컬 데모, 웹 서빙, 경량 제품 통합을 위해 배포 스택을 충분히 단순하게 유지합니다.
★ 4,279+51최근 7일 스타 변화 - #3
MOSS‑TTS Family는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 음성 및 사운드 생성 모델 패밀리입니다. 고충실도, 고표현력, 복잡한 실제 시나리오를 위해 설계되었으며 안정적인 장문 음성, 다화자 대화, 목소리/캐릭터 디자인, 환경 음향 효과 및 실시간 스트리밍 TTS를 지원합니다.
★ 4,056+24최근 7일 스타 변화 - #4
MOSS-Transcribe-Diarize 0.9B는 장시간 다화자 전사, 화자 분할, 타임스탬프, 음향 이벤트 인식을 지원하는 오픈소스 SOTA 엔드투엔드 오디오 이해 모델입니다.
★ 1,778+158최근 7일 스타 변화 - #5
MOSS-TTSD는 표현력이 풍부한 다중 화자 합성을 위해 설계된 음성 대화 생성 모델입니다. 긴 문맥 모델링, 유연한 화자 제어, 다국어 지원을 제공하며 짧은 오디오 레퍼런스만으로 제로샷 음성 복제를 구현합니다.
★ 1,394+0최근 7일 스타 변화 - #6
체화된 AI(Embodied AI)에서의 세계 행동 모델(WAM)을 위한 엄선되고 지속적으로 업데이트되는 읽기 목록, 논문 블로그 및 리소스
★ 1,358+47최근 7일 스타 변화 - #7★ 1,106+5최근 7일 스타 변화
- #8★ 882+0최근 7일 스타 변화
- #9
MOSS-Audio는 통합 오디오 이해를 위한 오픈 소스 파운데이션 모델로, 실제 환경에서 음성, 소리, 음악, 캡션, QA 및 추론 기능을 제공합니다.
★ 653+8최근 7일 스타 변화