speech-processing
Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-processing, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng speech-processing trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech-processing.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Bộ công cụ nhận diện giọng nói dựa trên PyTorch
★ 11.792+22Thay đổi số sao trong 7 ngày qua - #2
Khối xây dựng thần kinh cho việc phân đoạn người nói: phát hiện hoạt động giọng nói, phát hiện thay đổi người nói, phát hiện giọng nói chồng chéo, nhúng người nói
★ 10.484+38Thay đổi số sao trong 7 ngày qua - #3
Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn
★ 10.083+52Thay đổi số sao trong 7 ngày qua - #4
Trở thành một nhà nghiên cứu/kỹ sư AI/ML xuất sắc với cuốn sách giáo khoa phi truyền thống này bao gồm toán học, điện toán và ML bằng trực giác.
★ 7.379+33Thay đổi số sao trong 7 ngày qua - #5
Danh sách tài liệu đọc cho các chủ đề nghiên cứu về học máy đa phương thức
★ 6.925+0Thay đổi số sao trong 7 ngày qua - #6
Kiến trúc nền tảng cho (M)LLM.
★ 3.138+1Thay đổi số sao trong 7 ngày qua - #7
Nhận dạng Tự động Tiếng nói Đa ngôn ngữ với mốc thời gian cấp độ từ và độ tin cậy
★ 2.841+2Thay đổi số sao trong 7 ngày qua - #8
Khử tiếng ồn và cải thiện giọng nói hỗ trợ bởi AI
★ 2.401+6Thay đổi số sao trong 7 ngày qua - #9★ 2.250+4Thay đổi số sao trong 7 ngày qua
- #10
Chuyển văn bản thành giọng nói có thể kiểm soát và nhanh chóng cho hơn 7000 ngôn ngữ!
★ 2.208+0Thay đổi số sao trong 7 ngày qua - #11
Danh sách tổng hợp các bài báo, thư viện, tập dữ liệu và các tài nguyên tuyệt vời khác về Phân đoạn Người nói.
★ 1.893+2Thay đổi số sao trong 7 ngày qua - #12
💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác
★ 1.399+0Thay đổi số sao trong 7 ngày qua - #13
Khôi phục giọng nói chung
★ 1.376+3Thay đổi số sao trong 7 ngày qua - #14
Bản ghi âm có thể điều khiển. Nguyên văn (mọi từ đệm, khoảng dừng, lắp bắp, âm thanh phát ra), hoặc theo ý định (ý người nói muốn diễn đạt, được tối ưu hóa cho khả năng đọc) với dấu thời gian ở cấp độ từ.
★ 1.362+21Thay đổi số sao trong 7 ngày qua - #15
StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.
★ 1.288+2Thay đổi số sao trong 7 ngày qua - #16★ 1.146+0Thay đổi số sao trong 7 ngày qua
- #17★ 1.056+0Thay đổi số sao trong 7 ngày qua
- #18
Nơi bạn có thể tìm thấy các thuật toán xử lý giọng nói mong muốn
★ 878+1Thay đổi số sao trong 7 ngày qua - #19
[NeurIPS 2021] Các tiêu chuẩn đa quy mô cho học biểu diễn đa phương thức
★ 636+0Thay đổi số sao trong 7 ngày qua - #20
Danh sách các phòng thí nghiệm/công ty/tài nguyên/thực tập về lĩnh vực giọng nói, hoan nghênh đề xuất hoặc tự ứng cử.
★ 609+0Thay đổi số sao trong 7 ngày qua