speaker-recognition
Các kho mã nguồn mở đang theo dõi được gắn thẻ speaker-recognition, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng speaker-recognition trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ speaker-recognition.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Một framework AI tạo sinh có khả năng mở rộng được xây dựng cho các nhà nghiên cứu và lập trình viên làm việc về Mô hình Ngôn ngữ Lớn, Đa phương thức và AI Giọng nói (Nhận dạng Giọng nói Tự động và Chuyển văn bản thành giọng nói)
★ 18.379+42Thay đổi số sao trong 7 ngày qua - #2
Bộ công cụ nhận diện giọng nói dựa trên PyTorch
★ 11.802+17Thay đổi số sao trong 7 ngày qua - #3
Khối xây dựng thần kinh cho việc phân đoạn người nói: phát hiện hoạt động giọng nói, phát hiện thay đổi người nói, phát hiện giọng nói chồng chéo, nhúng người nói
★ 10.500+24Thay đổi số sao trong 7 ngày qua - #4
Các mô hình âm thanh CoreML tiên tiến trong ứng dụng của bạn — chuyển văn bản thành giọng nói, chuyển giọng nói thành văn bản, phát hiện hoạt động giọng nói và phân đoạn người nói. Viết bằng Swift, cung cấp bởi các mã nguồn mở SOTA.
★ 2.723+22Thay đổi số sao trong 7 ngày qua - #5
Bộ công cụ xác thực, nhận dạng và phân đoạn người nói hướng đến nghiên cứu và sản xuất
★ 1.402+10Thay đổi số sao trong 7 ngày qua - #6
Dự án này sử dụng nhiều mô hình nhận dạng giọng nói nâng cao khác nhau như EcapaTdnn, ResNetSE, ERes2Net, CAM++, v.v. Không loại trừ khả năng sẽ hỗ trợ thêm nhiều mô hình trong tương lai. Đồng thời, dự án này cũng hỗ trợ các phương pháp tiền xử lý dữ liệu MelSpectrogram, Spectrogram
★ 1.313+1Thay đổi số sao trong 7 ngày qua - #7
Bảo vệ học độ đo (metric learning) cho việc nhận dạng người nói
★ 1.176+1Thay đổi số sao trong 7 ngày qua - #8
Triển khai lại không chính thức ECAPA-TDNN cho nhận dạng người nói (EER=0.86 cho Vox1_O khi chỉ huấn luyện trên Vox2).
★ 827+0Thay đổi số sao trong 7 ngày qua