Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · audio-processing

audio-processing

Các kho mã nguồn mở đang theo dõi được gắn thẻ audio-processing, sắp xếp theo số sao.

57 kho mã
  • LanPaint@scraed

    Inpaint chất lượng cao không cần huấn luyện cho mọi mô hình stable diffusion. Hỗ trợ ComfyUI

    1.372+0Thay đổi số sao trong 7 ngày qua
  • chromaprint@acoustid

    Thư viện C để tạo dấu vân tay âm thanh được sử dụng bởi AcoustID

    1.362+0Thay đổi số sao trong 7 ngày qua
  • DawDreamer@DBraun

    Trạm làm việc âm thanh kỹ thuật số với Python; nhạc cụ/hiệu ứng VST, tự động hóa tham số, FAUST, JAX, Warp Markers và bộ xử lý JUCE

    1.289+0Thay đổi số sao trong 7 ngày qua
  • StreamSpeech@ictnlp

    StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.

    1.288+0Thay đổi số sao trong 7 ngày qua
  • ffmediaelement@unosquare

    FFME: WPF MediaElement nâng cao (dựa trên FFmpeg)

    1.274+0Thay đổi số sao trong 7 ngày qua
  • TTS-Audio-Suite@diodiogod

    Một tích hợp node tùy chỉnh ComfyUI cho chuyển đổi văn bản thành giọng nói và chuyển đổi giọng nói đa ngôn ngữ, đa công nghệ cục bộ. Hỗ trợ: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (cổ điển và đa ngôn ngữ), F5-TTS, Higgs Audio 2, 3 và VibeVoice với độ dài văn bản không giới hạn, thời gian SRT, hỗ trợ nhân vật và nhiều công cụ âm thanh khác

    1.187+0Thay đổi số sao trong 7 ngày qua
  • audino@midas-research

    Công cụ chú thích âm thanh mã nguồn mở dành cho con người

    1.146+0Thay đổi số sao trong 7 ngày qua
  • nnAudio@KinWaiCheuk

    Xử lý âm thanh bằng mạng tích chập 1D của PyTorch

    1.126+0Thay đổi số sao trong 7 ngày qua
  • SLAM-LLM@X-LANCE

    Framework xử lý Tiếng nói, Ngôn ngữ, Âm thanh, Âm nhạc với Large Language Model

    1.058+1Thay đổi số sao trong 7 ngày qua
  • Nhận dạng dấu vân tay âm thanh mã nguồn mở trong .NET. Một thuật toán hiệu quả cho việc nhận dạng vân tay âm thanh được viết hoàn toàn bằng C#.

    1.036+0Thay đổi số sao trong 7 ngày qua
  • klio@spotify

    Các đường ống dữ liệu thông minh hơn cho âm thanh.

    876+1Thay đổi số sao trong 7 ngày qua
  • react-native-audio-api@software-mansion

    Công cụ âm thanh hiệu năng cao cho react-native

    837+2Thay đổi số sao trong 7 ngày qua
  • XR3Player@goxr3plus

    Trình phát đa phương tiện JavaFX TIÊN TIẾN NHẤT.

    771+0Thay đổi số sao trong 7 ngày qua
  • APT@rnchg

    Công cụ năng suất AI miễn phí và mã nguồn mở, giúp cải thiện năng suất người dùng, bảo vệ quyền riêng tư và bảo mật dữ liệu. Bao gồm nhưng không giới hạn ở: tích hợp sẵn các mô hình cục bộ như ChatGPT, DeepSeek, Phi, Qwen, xử lý hàng loạt thông minh bằng một cú nhấp chuột cho hình ảnh, video, âm thanh, v.v.

    768-1Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập tài nguyên về ứng dụng của các Mô hình Ngôn ngữ Lớn (LLM) trong Audio AI

    738+0Thay đổi số sao trong 7 ngày qua
  • Thư viện C++ header-only dùng để lấy mẫu lại âm thanh chuyên nghiệp chất lượng cao. Tốc độ rất nhanh, dùng cho cả việc lấy mẫu lại âm thanh và nội suy chuỗi thời gian.

    736+4Thay đổi số sao trong 7 ngày qua
  • fast-music-remover@omeryusufyagci

    Công cụ loại bỏ tiếng ồn và âm nhạc nhẹ dựa trên C++ cho YouTube và các phương tiện internet khác, sử dụng DeepFilterNet để tăng cường âm thanh.

    721+1Thay đổi số sao trong 7 ngày qua
  • jumpcutter@WofWca

    ⏩ Tua nhanh các khoảng lặng giữa các câu — xem bài giảng nhanh hơn khoảng 1.5 lần (tiện ích mở rộng trình duyệt)

    663+0Thay đổi số sao trong 7 ngày qua
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Thổi hồn vào video câm bằng âm thanh sống động và đồng bộ

    663+0Thay đổi số sao trong 7 ngày qua
  • PESQ@ludlows

    Trình bao bọc PESQ (Đánh giá chất lượng giọng nói theo cảm nhận) cho người dùng Python (băng hẹp và băng rộng).

    631+1Thay đổi số sao trong 7 ngày qua
  • checkrr@aetaric

    Checkrr quét các tệp thư viện để tìm phương tiện bị hỏng và tùy chọn thay thế tệp thông qua sonarr và radarr

    578+2Thay đổi số sao trong 7 ngày qua
  • nara_wpe@fgnt

    Các triển khai khác nhau của "Weighted Prediction Error" để khử vang tiếng nói.

    571+1Thay đổi số sao trong 7 ngày qua
  • Dplug@AuburnSounds

    Tạo plug-in VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP cho Linux/macOS/Windows bằng ngôn ngữ D.

    564+0Thay đổi số sao trong 7 ngày qua
  • unified-audio@alibaba

    Dự án mã nguồn mở nhằm hợp nhất quá trình xử lý và tạo âm thanh

    520+4Thay đổi số sao trong 7 ngày qua
  • SoundFlow@LSXPrime

    Một engine âm thanh & MIDI mô-đun, hiệu năng cao cho .NET 8+. Bộ công cụ hoàn chỉnh cho toàn bộ vòng đời âm thanh: Phát lại, Ghi âm, Chỉnh sửa đa rãnh, Tổng hợp chuyên nghiệp (MPE/SF2), DSP thời gian thực và Trực quan hóa. Bao gồm bộ bảo mật độc đáo cho mã hóa AES-256, nhận dạng dấu vân tay âm thanh và đóng dấu bản quyền. Hỗ trợ SIMD và NativeAOT.

    511+5Thay đổi số sao trong 7 ngày qua
  • android-vad@gkonovalov

    Thư viện Phát hiện Hoạt động Giọng nói (VAD) cho Android. Hỗ trợ các mô hình WebRTC VAD GMM, Silero VAD DNN và Yamnet VAD DNN.

    506+0Thay đổi số sao trong 7 ngày qua
  • MediaEditor@opencodewin

    Phần mềm biên tập phi tuyến tính giúp bạn tạo ra các video chất lượng

    503+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề