Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · text-to-audio

text-to-audio

Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-audio, sắp xếp theo số sao.

Kho mã
13
Tổng số sao
27.818
Số sao trung bình
2.140
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng text-to-audio trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ text-to-audio.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) là bộ công cụ tạo Âm thanh, Âm nhạc và Tiếng nói. Mục đích của nó là hỗ trợ nghiên cứu có thể tái tạo và giúp các nhà nghiên cứu, kỹ sư trẻ bắt đầu trong lĩnh vực nghiên cứu và phát triển tạo âm thanh, âm nhạc và tiếng nói.

    10.276+1Thay đổi số sao trong 7 ngày qua
  • abogen@denizsafak

    Tạo sách nói từ EPUB, PDF và văn bản với phụ đề đồng bộ.

    5.831+45Thay đổi số sao trong 7 ngày qua
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis

    2.264+0Thay đổi số sao trong 7 ngày qua
  • ThinkSound@QwenAudio

    [NeurIPS 2025] Triển khai PyTorch của [ThinkSound], một framework thống nhất để tạo âm thanh từ bất kỳ phương thức nào, được hướng dẫn bởi suy luận Chain-of-Thought (CoT).

    1.378+0Thay đổi số sao trong 7 ngày qua
  • StreamSpeech@ictnlp

    StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.

    1.288+0Thay đổi số sao trong 7 ngày qua
  • audio-webui@gitmylo

    Giao diện web (webui) cho các mạng neural liên quan đến âm thanh khác nhau.

    1.246+0Thay đổi số sao trong 7 ngày qua
  • tango@declare-lab

    Một họ mô hình khuếch tán để tạo văn bản thành âm thanh.

    1.238-1Thay đổi số sao trong 7 ngày qua
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley: Khuếch tán đa phương thức với căn chỉnh biểu diễn để tạo âm thanh Foley độ trung thực cao.

    1.056+4Thay đổi số sao trong 7 ngày qua
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux: Tạo văn bản thành âm thanh siêu nhanh và trung thực với Flow Matching

    882+0Thay đổi số sao trong 7 ngày qua
  • Make-An-Audio@Text-to-Audio

    Triển khai PyTorch của Make-An-Audio (ICML'23) với mô hình tạo văn bản thành âm thanh (Text-to-Audio)

    668+0Thay đổi số sao trong 7 ngày qua
  • OpenMusic@ivcylc

    OpenMusic: Công nghệ tạo văn bản thành âm nhạc (TTM) hiện đại nhất (SOTA).

    631+1Thay đổi số sao trong 7 ngày qua
  • Danh sách các bài báo được tuyển chọn về tạo nội dung đa phương thức dựa trên LLM (hình ảnh, video, 3D và âm thanh)

    552+0Thay đổi số sao trong 7 ngày qua
  • unified-audio@alibaba

    Dự án mã nguồn mở nhằm hợp nhất quá trình xử lý và tạo âm thanh

    512+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề