speech
Các kho mã nguồn mở đang theo dõi được gắn thẻ speech, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng speech trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
🐸💬 - bộ công cụ học sâu cho chuyển văn bản thành giọng nói, đã được kiểm chứng qua thực chiến trong nghiên cứu và sản xuất
★ 45.967+36Thay đổi số sao trong 7 ngày qua - #2
🚀 Nhân bản giọng nói trong 5 giây để tạo ra lời nói bất kỳ theo thời gian thực
★ 36.912-1Thay đổi số sao trong 7 ngày qua - #3
VoxCPM2: TTS không cần Tokenizer để tạo giọng nói đa ngôn ngữ, thiết kế giọng nói sáng tạo và nhân bản như thật
★ 36.250+293Thay đổi số sao trong 7 ngày qua - #4
WhisperX: Nhận diện giọng nói tự động với mốc thời gian cấp độ từ (và phân đoạn người nói)
★ 23.803+117Thay đổi số sao trong 7 ngày qua - #5
🤗 Trung tâm dữ liệu lớn nhất sẵn sàng sử dụng cho các mô hình AI với các công cụ xử lý dữ liệu nhanh chóng, dễ sử dụng và hiệu quả
★ 21.878+34Thay đổi số sao trong 7 ngày qua - #6
Grounded SAM: Kết hợp Grounding DINO với Segment Anything, Stable Diffusion & Recognize Anything - Tự động phát hiện, phân đoạn và tạo ra mọi thứ
★ 17.713+3Thay đổi số sao trong 7 ngày qua - #7★ 15.471+7Thay đổi số sao trong 7 ngày qua
- #8
Xây dựng các tác nhân giọng nói với các mô hình mã nguồn mở
★ 12.933+180Thay đổi số sao trong 7 ngày qua - #9★ 10.166-2Thay đổi số sao trong 7 ngày qua
- #10
Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn
★ 10.083+52Thay đổi số sao trong 7 ngày qua - #11
ModelScope: Hiện thực hóa khái niệm Model-as-a-Service.
★ 9.117+19Thay đổi số sao trong 7 ngày qua - #12
EmotiVoice 😊: Công cụ TTS đa giọng nói và điều khiển bằng prompt
★ 8.523+2Thay đổi số sao trong 7 ngày qua - #13
Được duy trì chính thức, hỗ trợ bởi PaddlePaddle, bao gồm CV, NLP, Speech, Rec, TS, mô hình lớn v.v.
★ 6.932+0Thay đổi số sao trong 7 ngày qua - #14★ 6.816+1Thay đổi số sao trong 7 ngày qua
- #15
Silero Models: các mô hình chuyển văn bản thành giọng nói được huấn luyện trước trở nên vô cùng đơn giản
★ 6.085+11Thay đổi số sao trong 7 ngày qua - #16
Lượng tử hóa, kernel, runtime và công cụ suy luận cho thiết bị di động, thiết bị đeo, nhà thông minh và robot.
★ 5.955+71Thay đổi số sao trong 7 ngày qua - #17
Nhận dạng giọng nói tự động kết hợp phân đoạn người nói dựa trên OpenAI Whisper
★ 5.633+7Thay đổi số sao trong 7 ngày qua - #18
Công cụ nhận diện giọng nói thành văn bản / Công cụ chuyển đổi âm thanh và video cục bộ chạy ngoại tuyến thành phụ kiện, hỗ trợ xuất định dạng json, phụ đề srt và văn bản thuần túy
★ 4.771+7Thay đổi số sao trong 7 ngày qua - #19
Khử nhiễu sử dụng bộ lọc sâu (deep filtering)
★ 4.636+14Thay đổi số sao trong 7 ngày qua - #20★ 4.556+7Thay đổi số sao trong 7 ngày qua
- #21
Bộ công cụ xử lý giọng nói hỗ trợ AI và các mô hình tiền huấn luyện SOTA mã nguồn mở, hỗ trợ tăng cường, tách rời giọng nói và trích xuất giọng nói mục tiêu, v.v.
★ 4.449+19Thay đổi số sao trong 7 ngày qua - #22
Mô hình nền tảng cho TTS tự nhiên, biểu cảm giống con người
★ 4.204-1Thay đổi số sao trong 7 ngày qua - #23
🚀 Bộ sưu tập các tập lệnh Python tuyệt vời từ cơ bản đến nâng cao, bao gồm cả các tập lệnh tác vụ tự động hóa.
★ 3.663+5Thay đổi số sao trong 7 ngày qua - #24
Công cụ chuyển đổi giọng nói đơn giản, chất lượng cao, tập trung vào tính dễ sử dụng và hiệu năng.
★ 3.660+39Thay đổi số sao trong 7 ngày qua - #25
API dịch vụ web ASR OpenAI Whisper
★ 3.326+2Thay đổi số sao trong 7 ngày qua - #26
Mã nguồn ví dụ cho các API mới của iOS 10.
★ 3.273-2Thay đổi số sao trong 7 ngày qua - #27★ 2.931+6Thay đổi số sao trong 7 ngày qua
- #28★ 2.864+0Thay đổi số sao trong 7 ngày qua
- #29
aeneas là một thư viện Python/C và bộ công cụ tự động đồng bộ hóa âm thanh và văn bản (còn gọi là căn chỉnh cưỡng bức)
★ 2.862-1Thay đổi số sao trong 7 ngày qua - #30
Nhận dạng Tự động Tiếng nói Đa ngôn ngữ với mốc thời gian cấp độ từ và độ tin cậy
★ 2.841+2Thay đổi số sao trong 7 ngày qua