Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · voice-cloning

voice-cloning

Các kho mã nguồn mở đang theo dõi được gắn thẻ voice-cloning, sắp xếp theo số sao.

41 kho mã
  • vui@fluxions-ai

    Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.

    759+7Thay đổi số sao trong 7 ngày qua
  • MimikaStudio@BoltzmannEntropy

    MimikaStudio - Ứng dụng ưu tiên cục bộ cho macOS (Apple Silicon) hỗ trợ Agentic MCP

    735+4Thay đổi số sao trong 7 ngày qua
  • chatterbox-tts-api@travisvn

    API chuyển văn bản thành giọng nói (TTS) cục bộ, tương thích với OpenAI sử dụng Chatterbox, cho phép người dùng tạo giọng nói nhân bản ở bất kỳ đâu sử dụng OpenAI API (ví dụ: Open WebUI, AnythingLLM, v.v.)

    677+1Thay đổi số sao trong 7 ngày qua
  • Pandrator@lukaszliniewicz

    Chuyển đổi PDF và EPUB thành sách nói; phụ đề hoặc video thành video lồng tiếng (bao gồm dịch thuật) và nhiều tính năng khác. Miễn phí. Pandrator sử dụng các mô hình cục bộ, bao gồm nhân bản giọng nói (tức thì, tăng cường RVC, tinh chỉnh XTTS) và xử lý LLM. Hướng tới mục tiêu là một ứng dụng thân thiện với người dùng, có giao diện đồ họa, trình cài đặt và các gói tất cả trong một.

    620+3Thay đổi số sao trong 7 ngày qua
  • YouDub@liuzhao1225

    YouDub là một công cụ mã nguồn mở được thiết kế để tự động hóa việc dịch và lồng tiếng cho các video YouTube chất lượng cao nhằm đăng tải lên internet Trung Quốc. Công cụ này sử dụng công nghệ nhận dạng giọng nói AI để chuyển đổi âm thanh thành văn bản, sau đó dịch văn bản sang tiếng Trung thông qua mô hình ngôn ngữ lớn, và cuối cùng sử dụng công nghệ sao chép giọng nói AI để chuyển đổi văn bản tiếng Trung thành âm thanh, tạo ra video lồng tiếng Trung với chất giọng gốc của YouTuber.

    615-1Thay đổi số sao trong 7 ngày qua
  • ComfyUI-VibeVoice@wildminder

    Node tùy chỉnh ComfyUI cho VibeVoice TTS. Hỗ trợ âm thanh hội thoại biểu cảm, dài và đa người nói

    596-1Thay đổi số sao trong 7 ngày qua
  • Phiên bản sửa đổi của Chatterbox chấp nhận tệp văn bản làm đầu vào và không giới hạn ký tự, được sử dụng để tạo sách nói

    575-1Thay đổi số sao trong 7 ngày qua
  • Chạy Qwen3-TTS chuyển văn bản thành giọng nói cục bộ trên Mac (M1/M2/M3/M4). Hỗ trợ nhân bản giọng nói, thiết kế giọng nói, giọng nói tùy chỉnh. Hoạt động 100% ngoại tuyến bằng MLX.

    561+2Thay đổi số sao trong 7 ngày qua
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    Mô hình đối thoại bằng giọng nói đầu cuối thời gian thực mã nguồn mở đầu tiên trên thế giới với tính năng nhân bản giọng nói cá nhân hóa

    550+0Thay đổi số sao trong 7 ngày qua
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Các node OmniVoice TTS cho ComfyUI - Chuyển văn bản thành giọng nói đa ngôn ngữ zero-shot với khả năng sao chép giọng nói, thiết kế giọng nói và hội thoại đa người nói

    545+5Thay đổi số sao trong 7 ngày qua
  • ComfyUI-VoxCPM@wildminder

    Node ComfyUI cho giọng nói biểu cảm cao và nhân bản giọng nói zero-shot thực tế.

    509-1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề