본문으로 건너뛰기
buildradar
Sign in
소유자 · OpenMOSS

OpenMOSS

OpenMOSS의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 9개
  • MOSS@OpenMOSS

    푸단대학교에서 개발한 오픈소스 도구 연동 대화형 언어 모델

    12,234+11최근 7일 스타 변화
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 다국어 초소형 음성 생성 모델입니다. 0.1B(1억) 개의 파라미터만으로 실시간 음성 생성을 위해 설계되었으며, GPU 없이 CPU에서 직접 실행할 수 있고 로컬 데모, 웹 서빙, 경량 제품 통합을 위해 배포 스택을 충분히 단순하게 유지합니다.

    4,279+51최근 7일 스타 변화
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 음성 및 사운드 생성 모델 패밀리입니다. 고충실도, 고표현력, 복잡한 실제 시나리오를 위해 설계되었으며 안정적인 장문 음성, 다화자 대화, 목소리/캐릭터 디자인, 환경 음향 효과 및 실시간 스트리밍 TTS를 지원합니다.

    4,056+24최근 7일 스타 변화
  • MOSS-Transcribe-Diarize 0.9B는 장시간 다화자 전사, 화자 분할, 타임스탬프, 음향 이벤트 인식을 지원하는 오픈소스 SOTA 엔드투엔드 오디오 이해 모델입니다.

    1,778+158최근 7일 스타 변화
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD는 표현력이 풍부한 다중 화자 합성을 위해 설계된 음성 대화 생성 모델입니다. 긴 문맥 모델링, 유연한 화자 제어, 다국어 지원을 제공하며 짧은 오디오 레퍼런스만으로 제로샷 음성 복제를 구현합니다.

    1,394+0최근 7일 스타 변화
  • Awesome-WAM@OpenMOSS

    체화된 AI(Embodied AI)에서의 세계 행동 모델(WAM)을 위한 엄선되고 지속적으로 업데이트되는 읽기 목록, 논문 블로그 및 리소스

    1,358+47최근 7일 스타 변화
  • MOVA@OpenMOSS

    MOVA: 확장 가능하고 동기화된 비디오-오디오 생성을 향하여

    1,106+5최근 7일 스타 변화
  • AnyGPT@OpenMOSS

    "AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling" 논문 코드

    882+0최근 7일 스타 변화
  • MOSS-Audio@OpenMOSS

    MOSS-Audio는 통합 오디오 이해를 위한 오픈 소스 파운데이션 모델로, 실제 환경에서 음성, 소리, 음악, 캡션, QA 및 추론 기능을 제공합니다.

    653+8최근 7일 스타 변화
← 소유자 랭킹으로