Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · speech-synthesis

speech-synthesis

Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-synthesis, sắp xếp theo số sao.

66 kho mã
  • chat-with-gpt@cogentapps

    Một ứng dụng ChatGPT mã nguồn mở có tích hợp giọng nói

    2.350-1Thay đổi số sao trong 7 ngày qua
  • IMS-Toucan@DigitalPhonetics

    Chuyển văn bản thành giọng nói có thể kiểm soát và nhanh chóng cho hơn 7000 ngôn ngữ!

    2.207-1Thay đổi số sao trong 7 ngày qua
  • RHVoice@RHVoice

    một phần mềm tổng hợp giọng nói mã nguồn mở và miễn phí cho tiếng Nga và các ngôn ngữ khác

    1.836+1Thay đổi số sao trong 7 ngày qua
  • ParallelWaveGAN@kan-bayashi

    Bản triển khai không chính thức của Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) bằng PyTorch

    1.646+1Thay đổi số sao trong 7 ngày qua
  • dsnote@mkiol

    Ứng dụng Speech Note trên Linux. Ghi chú, đọc và dịch với tính năng Chuyển giọng nói thành văn bản, Chuyển văn bản thành giọng nói và Dịch máy ngoại tuyến.

    1.622+8Thay đổi số sao trong 7 ngày qua
  • Các node tùy chỉnh mở rộng tính năng của ComfyUI

    1.525+1Thay đổi số sao trong 7 ngày qua
  • SAM@s-macke

    Software Automatic Mouth - Trình tổng hợp giọng nói nhỏ gọn

    1.498+0Thay đổi số sao trong 7 ngày qua
  • SpeechT5@microsoft

    Tiền huấn luyện giọng nói-văn bản đơn modal thống nhất cho xử lý ngôn ngữ nói

    1.449+0Thay đổi số sao trong 7 ngày qua
  • Tự triển khai mô hình Chatterbox TTS mạnh mẽ. Máy chủ này cung cấp Web UI thân thiện với người dùng, các điểm cuối API linh hoạt (bao gồm tương thích với OpenAI), giọng đọc có sẵn, nhân bản giọng nói và xử lý văn bản quy mô sách nói lớn. Chạy tăng tốc trên NVIDIA (CUDA), AMD (ROCm) và CPU.

    1.427+1Thay đổi số sao trong 7 ngày qua
  • 💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác

    1.399+0Thay đổi số sao trong 7 ngày qua
  • voicefixer@haoheliu

    Khôi phục giọng nói chung

    1.375+0Thay đổi số sao trong 7 ngày qua
  • World@mmorise

    Hệ thống phân tích, xử lý và tổng hợp giọng nói chất lượng cao

    1.339+0Thay đổi số sao trong 7 ngày qua
  • StreamSpeech@ictnlp

    StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.

    1.288+0Thay đổi số sao trong 7 ngày qua
  • Irodori-TTS@Aratako

    Mô hình chuyển văn bản thành giọng nói dựa trên Flow Matching với khả năng kiểm soát phong cách điều khiển bằng Emoji

    1.228+4Thay đổi số sao trong 7 ngày qua
  • BigVGAN@NVIDIA

    Triển khai chính thức bằng PyTorch của BigVGAN (ICLR 2023)

    1.227+1Thay đổi số sao trong 7 ngày qua
  • Irina - trợ lý giọng nói tiếng Nga hoạt động ngoại tuyến. Hỗ trợ kỹ năng thông qua các plugin.

    1.153+0Thay đổi số sao trong 7 ngày qua
  • AI-Waifu-Vtuber@ardha27

    AI Vtuber để phát trực tuyến trên Youtube/Twitch

    1.116+2Thay đổi số sao trong 7 ngày qua
  • autovc@auspicious3000

    AutoVC: Chuyển đổi phong cách giọng nói Zero-Shot chỉ với Autoencoder Loss

    1.100+0Thay đổi số sao trong 7 ngày qua
  • YourTTS@Edresson

    YourTTS: Hướng tới TTS đa người nói Zero-Shot và Chuyển đổi giọng nói Zero-Shot cho mọi người

    1.053+0Thay đổi số sao trong 7 ngày qua
  • Cognitive-Speech-TTS@Azure-Samples

    Mã nguồn mẫu Microsoft Text-to-Speech API bằng nhiều ngôn ngữ, là một phần của Cognitive Services.

    1.014+3Thay đổi số sao trong 7 ngày qua
  • alexandria-audiobook@Finrandojin

    Trình tạo sách nói đa giọng nói hỗ trợ bởi AI — chú thích kịch bản LLM, nhân bản giọng nói, thiết kế giọng nói, huấn luyện LoRA, kiểm soát phong cách theo từng dòng, và xuất ra MP3, M4B chia chương, hoặc đa rãnh Audacity. Xây dựng trên Qwen3-TTS.

    999+20Thay đổi số sao trong 7 ngày qua
  • NISQA@gabrielmittag

    NISQA - Đánh giá chất lượng giọng nói không xâm nhập và độ tự nhiên của TTS

    971+3Thay đổi số sao trong 7 ngày qua
  • Làm cho giọng nói TTS tự nhiên của Azure có thể truy cập được đối với bất kỳ ứng dụng tương thích SAPI 5 nào.

    934+13Thay đổi số sao trong 7 ngày qua
  • FireRedTTS@FireRedTeam

    Hệ thống TTS nền tảng mã nguồn mở được hỗ trợ bởi LLM

    920+1Thay đổi số sao trong 7 ngày qua
  • Một LLM có khả năng trò chuyện chạy trên máy tính cá nhân của bạn mà không cần kết nối Internet.

    891+2Thay đổi số sao trong 7 ngày qua
  • diffwave@lmnt-com

    DiffWave là một bộ tổng hợp dạng sóng và bộ tạo giọng nói neural nhanh chóng, chất lượng cao.

    885+0Thay đổi số sao trong 7 ngày qua
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Công cụ TTS Zero-Shot đa ngôn ngữ và xuyên ngôn ngữ

    794+10Thay đổi số sao trong 7 ngày qua
  • vui@fluxions-ai

    Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.

    757+10Thay đổi số sao trong 7 ngày qua
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Giọng nói TTS tiếng Đức chất lượng cao, hoạt động ngoại tuyến và miễn phí, dành cho mọi dự án mà không gặp rắc rối về giấy phép.

    729+1Thay đổi số sao trong 7 ngày qua
  • Các bài báo INTERSPEECH 2023-2024: Bộ sưu tập đầy đủ các bài nghiên cứu có ảnh hưởng và thú vị từ hội nghị INTERSPEECH 2023-24. Khám phá những tiến bộ mới nhất trong xử lý ngôn ngữ và giọng nói. Bao gồm mã nguồn. Hãy gắn sao cho kho lưu trữ để ủng hộ sự phát triển của công nghệ giọng nói!

    684+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề