Chuyển tới nội dung chính
buildradar
Đăng nhập

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] Các mô hình codec âm thanh rời rạc SOTA với 40/75 token mỗi giây cho mô hình hóa ngôn ngữ âm thanh

Sao
1.317
Fork
117
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
2 năm trước
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.