Lompat ke konten utama
buildradar
Sign in
Pemilik · OpenMOSS

OpenMOSS

Repositori open source terpantau milik OpenMOSS, diurutkan berdasarkan bintang.

9 repositori
  • MOSS@OpenMOSS

    Model bahasa percakapan sumber terbuka yang dilengkapi alat dari Fudan University

    12.234+11Perubahan bintang dalam 7 hari terakhir
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano adalah model generasi ucapan mini multibahasa sumber terbuka dari MOSI.AI dan tim OpenMOSS. Dengan hanya 0,1 miliar parameter, model ini dirancang untuk pembuatan ucapan waktu nyata, dapat berjalan langsung di CPU tanpa GPU, dan menjaga tumpukan penyebaran tetap sederhana untuk demo lokal, layanan web, dan integrasi produk ringan.

    4.282+51Perubahan bintang dalam 7 hari terakhir
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family adalah keluarga model pembuatan suara dan ucapan open‑source dari MOSI.AI dan tim OpenMOSS. Dirancang untuk skenario dunia nyata yang sangat akurat, sangat ekspresif, dan kompleks, mencakup ucapan berdurasi panjang yang stabil, dialog multi-pembicara, desain suara/karakter, efek suara lingkungan, dan TTS streaming waktu nyata.

    4.058+24Perubahan bintang dalam 7 hari terakhir
  • MOSS-Transcribe-Diarize 0.9B adalah model pemahaman audio end-to-end SOTA sumber terbuka untuk transkripsi multi-pembicara berdurasi panjang, diarisasi, stempel waktu, dan kesadaran peristiwa akustik.

    1.805+158Perubahan bintang dalam 7 hari terakhir
  • MOSS-TTSD@OpenMOSS

    MOSS-TTSD adalah model pembuatan dialog lisan yang dirancang untuk sintesis multi-pembicara yang ekspresif. Model ini memiliki fitur pemodelan konteks panjang, kontrol pembicara yang fleksibel, dan dukungan multibahasa, sekaligus memungkinkan kloning suara zero-shot dari referensi audio pendek.

    1.394+0Perubahan bintang dalam 7 hari terakhir
  • Awesome-WAM@OpenMOSS

    Daftar bacaan pilihan yang terus diperbarui, blog makalah, dan sumber daya untuk World Action Models (WAMs) dalam embodied AI.

    1.369+47Perubahan bintang dalam 7 hari terakhir
  • MOVA@OpenMOSS

    MOVA: Menuju Pembuatan Video-Audio yang Dapat Diskalakan dan Disinkronkan.

    1.108+5Perubahan bintang dalam 7 hari terakhir
  • AnyGPT@OpenMOSS

    Kode untuk "AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling"

    882+0Perubahan bintang dalam 7 hari terakhir
  • MOSS-Audio@OpenMOSS

    MOSS-Audio adalah model dasar sumber terbuka untuk pemahaman audio terpadu, yang memungkinkan ucapan, suara, musik, pemberian keterangan, tanya jawab, dan penalaran dalam skenario dunia nyata.

    654+8Perubahan bintang dalam 7 hari terakhir
← Kembali ke peringkat pemilik