speech-synthesis
Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-synthesis, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng speech-synthesis trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech-synthesis.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
🐸💬 - bộ công cụ học sâu cho chuyển văn bản thành giọng nói, đã được kiểm chứng qua thực chiến trong nghiên cứu và sản xuất
★ 45.985+18Thay đổi số sao trong 7 ngày qua - #2
VoxCPM2: TTS không cần Tokenizer để tạo giọng nói đa ngôn ngữ, thiết kế giọng nói sáng tạo và nhân bản như thật
★ 36.595+345Thay đổi số sao trong 7 ngày qua - #3
Một framework AI tạo sinh có khả năng mở rộng được xây dựng cho các nhà nghiên cứu và lập trình viên làm việc về Mô hình Ngôn ngữ Lớn, Đa phương thức và AI Giọng nói (Nhận dạng Giọng nói Tự động và Chuyển văn bản thành giọng nói)
★ 18.379+21Thay đổi số sao trong 7 ngày qua - #4★ 17.476+1Thay đổi số sao trong 7 ngày qua
- #5
Các tập lệnh Deep Learning tiên tiến được sắp xếp theo các mô hình - dễ huấn luyện và triển khai với độ chính xác và hiệu suất có thể tái tạo trên cơ sở hạ tầng cấp doanh nghiệp.
★ 14.846+4Thay đổi số sao trong 7 ngày qua - #6
TTS đa ngôn ngữ, chạy trên thiết bị, cực kỳ nhanh — chạy nguyên bản qua ONNX.
★ 13.757+20Thay đổi số sao trong 7 ngày qua - #7
Xây dựng các tác nhân giọng nói với các mô hình mã nguồn mở
★ 13.015+82Thay đổi số sao trong 7 ngày qua - #8
Gradio WebUI dành cho người sáng tạo và nhà phát triển, tích hợp các tính năng TTS chính (Edge-TTS, kokoro) và nhân bản giọng nói zero-shot (E2 & F5-TTS, CosyVoice), xử lý âm thanh Whisper, tải xuống YouTube, tách giọng hát Demucs và dịch đa ngôn ngữ.
★ 12.730+54Thay đổi số sao trong 7 ngày qua - #9
Bộ công cụ xử lý giọng nói dễ sử dụng, bao gồm mô hình tự giám sát (Self-Supervised Learning), SOTA/Streaming ASR có dấu câu, Streaming TTS tích hợp frontend văn bản, Hệ thống xác thực người nói, Dịch giọng nói đầu cuối và Nhận diện từ khóa. Đạt giải Demo xuất sắc nhất tại NAACL 2022.
★ 12.676+5Thay đổi số sao trong 7 ngày qua - #10
Sử dụng dịch vụ chuyển văn bản thành giọng nói trực tuyến của Microsoft Edge từ Python MÀ KHÔNG cần Microsoft Edge, Windows hoặc khóa API
★ 11.847+29Thay đổi số sao trong 7 ngày qua - #11
Amphion (/æmˈfaɪən/) là bộ công cụ tạo Âm thanh, Âm nhạc và Tiếng nói. Mục đích của nó là hỗ trợ nghiên cứu có thể tái tạo và giúp các nhà nghiên cứu, kỹ sư trẻ bắt đầu trong lĩnh vực nghiên cứu và phát triển tạo âm thanh, âm nhạc và tiếng nói.
★ 10.276+1Thay đổi số sao trong 7 ngày qua - #12★ 9.949+3Thay đổi số sao trong 7 ngày qua
- #13
Bản fork của so-vits-svc hỗ trợ thời gian thực, giao diện cải tiến và nhiều tính năng hơn.
★ 9.329+3Thay đổi số sao trong 7 ngày qua - #14
EmotiVoice 😊: Công cụ TTS đa giọng nói và điều khiển bằng prompt
★ 8.522-1Thay đổi số sao trong 7 ngày qua - #15
Một thư viện chuyển đổi văn bản thành giọng nói (TTS), giọng nói thành văn bản (STT) và giọng nói thành giọng nói (STS) được xây dựng trên framework MLX của Apple, cung cấp khả năng phân tích giọng nói hiệu quả trên Apple Silicon.
★ 7.826+23Thay đổi số sao trong 7 ngày qua - #16
eSpeak NG là một trình tổng hợp giọng nói mã nguồn mở hỗ trợ hơn một trăm ngôn ngữ và giọng địa phương.
★ 6.802+13Thay đổi số sao trong 7 ngày qua - #17
StyleTTS 2: Hướng tới Chuyển văn bản thành giọng nói cấp độ con người thông qua khuếch tán phong cách và huấn luyện đối kháng với các Speech Language Model lớn
★ 6.342+3Thay đổi số sao trong 7 ngày qua - #18
Silero Models: các mô hình chuyển văn bản thành giọng nói được huấn luyện trước trở nên vô cùng đơn giản
★ 6.084-1Thay đổi số sao trong 7 ngày qua - #19★ 5.831+45Thay đổi số sao trong 7 ngày qua
- #20
DiffSinger: Tổng hợp giọng hát qua cơ chế khuếch tán nông (SVS & TTS); AAAI 2022; Mã nguồn chính thức
★ 4.855+3Thay đổi số sao trong 7 ngày qua - #21
Một hệ thống chuyển đổi văn bản thành giọng nói mã nguồn mở được xây dựng bằng cách đảo ngược Whisper.
★ 4.645+3Thay đổi số sao trong 7 ngày qua - #22★ 4.258+18Thay đổi số sao trong 7 ngày qua
- #23
Mô hình nền tảng cho TTS tự nhiên, biểu cảm giống con người
★ 4.203-1Thay đổi số sao trong 7 ngày qua - #24
Chuyển đổi văn bản thành giọng nói theo thời gian thực
★ 4.021+2Thay đổi số sao trong 7 ngày qua - #25
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Tổng hợp giọng nói thời gian thực tiên tiến cho Tensorflow 2 (hỗ trợ tiếng Anh, Pháp, Hàn, Trung, Đức và dễ thích ứng cho các ngôn ngữ khác)
★ 3.996+0Thay đổi số sao trong 7 ngày qua - #26★ 2.864+0Thay đổi số sao trong 7 ngày qua
- #27★ 2.818+1Thay đổi số sao trong 7 ngày qua
- #28
MARY TTS -- một hệ thống tổng hợp văn bản thành giọng nói đa ngôn ngữ, mã nguồn mở được viết hoàn toàn bằng java
★ 2.583+0Thay đổi số sao trong 7 ngày qua - #29
TTS tiếng Việt với khả năng nhân bản giọng nói tức thì • Chạy trên thiết bị • Suy luận CPU thời gian thực • Chất lượng âm thanh 24kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2.468+21Thay đổi số sao trong 7 ngày qua - #30
HiFi-GAN: Generative Adversarial Networks cho tổng hợp giọng nói hiệu quả và độ trung thực cao
★ 2.367+0Thay đổi số sao trong 7 ngày qua