Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · audio-generation

audio-generation

Các kho mã nguồn mở đang theo dõi được gắn thẻ audio-generation, sắp xếp theo số sao.

Kho mã
22
Tổng số sao
118.649
Số sao trung bình
5.393
Tỷ trọng
0,01%

Những chủ đề thường xuất hiện cùng audio-generation trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ audio-generation.

  • flatkey-cli@flatkey-ai

    CLI tạo phương tiện Flatkey cho hình ảnh, video, âm thanh, văn bản, thông tin ghi công và khám phá mô hình.

    634
  • LocalAI@mudler

    LocalAI là công cụ AI mã nguồn mở. Chạy mọi mô hình - LLM, thị giác, giọng nói, hình ảnh, video - trên mọi phần cứng. Không cần GPU.

    48.749+135Thay đổi số sao trong 7 ngày qua
  • CosyVoice@QwenAudio

    Mô hình tạo giọng nói lớn đa ngôn ngữ, cung cấp khả năng toàn diện từ suy luận, đào tạo đến triển khai.

    23.067+215Thay đổi số sao trong 7 ngày qua
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) là bộ công cụ tạo Âm thanh, Âm nhạc và Tiếng nói. Mục đích của nó là hỗ trợ nghiên cứu có thể tái tạo và giúp các nhà nghiên cứu, kỹ sư trẻ bắt đầu trong lĩnh vực nghiên cứu và phát triển tạo âm thanh, âm nhạc và tiếng nói.

    10.275+17Thay đổi số sao trong 7 ngày qua
  • vllm-omni@vllm-project

    Một framework để suy luận mô hình hiệu quả với các mô hình đa phương thức

    6.457+229Thay đổi số sao trong 7 ngày qua
  • YuE@multimodal-art-projection

    YuE: Mô hình nền tảng tạo nhạc toàn bài mở, tương tự như Suno.ai nhưng là mã nguồn mở

    6.408+14Thay đổi số sao trong 7 ngày qua
  • TTS-WebUI@rsxdalv

    Giao diện WebUI đơn lẻ tích hợp Gradio + React với các tiện ích mở rộng cho ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T và Bark!

    3.245+5Thay đổi số sao trong 7 ngày qua
  • AudioLDM@haoheliu

    AudioLDM: Tạo giọng nói, hiệu ứng âm thanh, âm nhạc và hơn thế nữa chỉ với văn bản.

    2.908+2Thay đổi số sao trong 7 ngày qua
  • AudioLDM2@haoheliu

    Tạo văn bản thành âm thanh/nhạc

    2.639+1Thay đổi số sao trong 7 ngày qua
  • Dòng thời gian của các mô hình AI tạo sinh âm thanh mới nhất, bắt đầu từ năm 2023!

    1.904+0Thay đổi số sao trong 7 ngày qua
  • soundstorm-pytorch@lucidrains

    Bản cài đặt SoundStorm, Tạo âm thanh song song hiệu quả từ Google Deepmind, bằng PyTorch

    1.547+1Thay đổi số sao trong 7 ngày qua
  • Tự triển khai mô hình Chatterbox TTS mạnh mẽ. Máy chủ này cung cấp Web UI thân thiện với người dùng, các điểm cuối API linh hoạt (bao gồm tương thích với OpenAI), giọng đọc có sẵn, nhân bản giọng nói và xử lý văn bản quy mô sách nói lớn. Chạy tăng tốc trên NVIDIA (CUDA), AMD (ROCm) và CPU.

    1.426+12Thay đổi số sao trong 7 ngày qua
  • tango@declare-lab

    Một họ mô hình khuếch tán để tạo văn bản thành âm thanh.

    1.238+0Thay đổi số sao trong 7 ngày qua
  • BigVGAN@NVIDIA

    Triển khai chính thức bằng PyTorch của BigVGAN (ICLR 2023)

    1.226+0Thay đổi số sao trong 7 ngày qua
  • TTS-Audio-Suite@diodiogod

    Một tích hợp node tùy chỉnh ComfyUI cho chuyển đổi văn bản thành giọng nói và chuyển đổi giọng nói đa ngôn ngữ, đa công nghệ cục bộ. Hỗ trợ: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (cổ điển và đa ngôn ngữ), F5-TTS, Higgs Audio 2, 3 và VibeVoice với độ dài văn bản không giới hạn, thời gian SRT, hỗ trợ nhân vật và nhiều công cụ âm thanh khác

    1.184+9Thay đổi số sao trong 7 ngày qua
  • muapi-cli@SamurAIGPT

    CLI chính thức cho muapi.ai — tạo hình ảnh, video và âm thanh từ terminal. Hỗ trợ máy chủ MCP, 14 mô hình AI, có thể cài đặt qua npm và pip.

    1.043+1Thay đổi số sao trong 7 ngày qua
  • sglang-omni@sgl-project

    SGLang-Omni hỗ trợ phục vụ hiệu suất cao cho TTS, ASR, các mô hình giọng nói và đa năng (omni).

    978+70Thay đổi số sao trong 7 ngày qua
  • Tập dữ liệu âm thanh AI (AI-ADS) 🎵, bao gồm Giọng nói, Âm nhạc và Hiệu ứng âm thanh, có thể cung cấp dữ liệu huấn luyện cho Generative AI, AIGC, huấn luyện mô hình AI, phát triển công cụ âm thanh thông minh và các ứng dụng âm thanh.

    961+0Thay đổi số sao trong 7 ngày qua
  • audio-ai-hub@BinWang28

    Trung tâm nghiên cứu AI âm thanh: các bài báo, mô hình mở, điểm chuẩn và tập dữ liệu trên audio LLMs, nhận dạng giọng nói, TTS, tạo nhạc và âm thanh.

    950+0Thay đổi số sao trong 7 ngày qua
  • vui@fluxions-ai

    Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.

    748+0Thay đổi số sao trong 7 ngày qua
  • flatkey-cli@flatkey-ai

    CLI tạo phương tiện Flatkey cho hình ảnh, video, âm thanh, văn bản, thông tin ghi công và khám phá mô hình.

    634+89Thay đổi số sao trong 7 ngày qua
  • genblaze@backblaze-labs

    Genblaze là một Python SDK mã nguồn mở để điều phối các đường ống truyền thông AI tạo sinh trên các nhà cung cấp video, âm thanh và hình ảnh với tính năng xác thực nguồn gốc tích hợp cho mọi đầu ra.

    559-1Thay đổi số sao trong 7 ngày qua
  • unified-audio@alibaba

    Dự án mã nguồn mở nhằm hợp nhất quá trình xử lý và tạo âm thanh

    510+3Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề