speech-synthesis
Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-synthesis, sắp xếp theo số sao.
- #31
Một ứng dụng ChatGPT mã nguồn mở có tích hợp giọng nói
★ 2.350-1Thay đổi số sao trong 7 ngày qua - #32
Chuyển văn bản thành giọng nói có thể kiểm soát và nhanh chóng cho hơn 7000 ngôn ngữ!
★ 2.207-1Thay đổi số sao trong 7 ngày qua - #33
một phần mềm tổng hợp giọng nói mã nguồn mở và miễn phí cho tiếng Nga và các ngôn ngữ khác
★ 1.836+1Thay đổi số sao trong 7 ngày qua - #34
Bản triển khai không chính thức của Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) bằng PyTorch
★ 1.646+1Thay đổi số sao trong 7 ngày qua - #35
Ứng dụng Speech Note trên Linux. Ghi chú, đọc và dịch với tính năng Chuyển giọng nói thành văn bản, Chuyển văn bản thành giọng nói và Dịch máy ngoại tuyến.
★ 1.622+8Thay đổi số sao trong 7 ngày qua - #36
Các node tùy chỉnh mở rộng tính năng của ComfyUI
★ 1.525+1Thay đổi số sao trong 7 ngày qua - #37★ 1.498+0Thay đổi số sao trong 7 ngày qua
- #38★ 1.449+0Thay đổi số sao trong 7 ngày qua
- #39
Tự triển khai mô hình Chatterbox TTS mạnh mẽ. Máy chủ này cung cấp Web UI thân thiện với người dùng, các điểm cuối API linh hoạt (bao gồm tương thích với OpenAI), giọng đọc có sẵn, nhân bản giọng nói và xử lý văn bản quy mô sách nói lớn. Chạy tăng tốc trên NVIDIA (CUDA), AMD (ROCm) và CPU.
★ 1.427+1Thay đổi số sao trong 7 ngày qua - #40
💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác
★ 1.399+0Thay đổi số sao trong 7 ngày qua - #41
Khôi phục giọng nói chung
★ 1.375+0Thay đổi số sao trong 7 ngày qua - #42★ 1.339+0Thay đổi số sao trong 7 ngày qua
- #43
StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.
★ 1.288+0Thay đổi số sao trong 7 ngày qua - #44
Mô hình chuyển văn bản thành giọng nói dựa trên Flow Matching với khả năng kiểm soát phong cách điều khiển bằng Emoji
★ 1.228+4Thay đổi số sao trong 7 ngày qua - #45★ 1.227+1Thay đổi số sao trong 7 ngày qua
- #46
Irina - trợ lý giọng nói tiếng Nga hoạt động ngoại tuyến. Hỗ trợ kỹ năng thông qua các plugin.
★ 1.153+0Thay đổi số sao trong 7 ngày qua - #47
AI Vtuber để phát trực tuyến trên Youtube/Twitch
★ 1.116+2Thay đổi số sao trong 7 ngày qua - #48★ 1.100+0Thay đổi số sao trong 7 ngày qua
- #49
YourTTS: Hướng tới TTS đa người nói Zero-Shot và Chuyển đổi giọng nói Zero-Shot cho mọi người
★ 1.053+0Thay đổi số sao trong 7 ngày qua - #50
Mã nguồn mẫu Microsoft Text-to-Speech API bằng nhiều ngôn ngữ, là một phần của Cognitive Services.
★ 1.014+3Thay đổi số sao trong 7 ngày qua - #51
Trình tạo sách nói đa giọng nói hỗ trợ bởi AI — chú thích kịch bản LLM, nhân bản giọng nói, thiết kế giọng nói, huấn luyện LoRA, kiểm soát phong cách theo từng dòng, và xuất ra MP3, M4B chia chương, hoặc đa rãnh Audacity. Xây dựng trên Qwen3-TTS.
★ 999+20Thay đổi số sao trong 7 ngày qua - #52★ 971+3Thay đổi số sao trong 7 ngày qua
- #53
Làm cho giọng nói TTS tự nhiên của Azure có thể truy cập được đối với bất kỳ ứng dụng tương thích SAPI 5 nào.
★ 934+13Thay đổi số sao trong 7 ngày qua - #54
Hệ thống TTS nền tảng mã nguồn mở được hỗ trợ bởi LLM
★ 920+1Thay đổi số sao trong 7 ngày qua - #55
Một LLM có khả năng trò chuyện chạy trên máy tính cá nhân của bạn mà không cần kết nối Internet.
★ 891+2Thay đổi số sao trong 7 ngày qua - #56
DiffWave là một bộ tổng hợp dạng sóng và bộ tạo giọng nói neural nhanh chóng, chất lượng cao.
★ 885+0Thay đổi số sao trong 7 ngày qua - #57
Confucius4-TTS: Công cụ TTS Zero-Shot đa ngôn ngữ và xuyên ngôn ngữ
★ 794+10Thay đổi số sao trong 7 ngày qua - #58
Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.
★ 757+10Thay đổi số sao trong 7 ngày qua - #59
Thorsten-Voice: Giọng nói TTS tiếng Đức chất lượng cao, hoạt động ngoại tuyến và miễn phí, dành cho mọi dự án mà không gặp rắc rối về giấy phép.
★ 729+1Thay đổi số sao trong 7 ngày qua - #60
Các bài báo INTERSPEECH 2023-2024: Bộ sưu tập đầy đủ các bài nghiên cứu có ảnh hưởng và thú vị từ hội nghị INTERSPEECH 2023-24. Khám phá những tiến bộ mới nhất trong xử lý ngôn ngữ và giọng nói. Bao gồm mã nguồn. Hãy gắn sao cho kho lưu trữ để ủng hộ sự phát triển của công nghệ giọng nói!
★ 684+0Thay đổi số sao trong 7 ngày qua