voice-recognition
Các kho mã nguồn mở đang theo dõi được gắn thẻ voice-recognition, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng voice-recognition trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ voice-recognition.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
API nhận diện giọng nói ngoại tuyến cho Android, iOS, Raspberry Pi và máy chủ với Python, Java, C# và Node
★ 15.101+17Thay đổi số sao trong 7 ngày qua - #2
Bộ công cụ xử lý giọng nói dễ sử dụng, bao gồm mô hình tự giám sát (Self-Supervised Learning), SOTA/Streaming ASR có dấu câu, Streaming TTS tích hợp frontend văn bản, Hệ thống xác thực người nói, Dịch giọng nói đầu cuối và Nhận diện từ khóa. Đạt giải Demo xuất sắc nhất tại NAACL 2022.
★ 12.676+5Thay đổi số sao trong 7 ngày qua - #3
Bộ công cụ nhận diện giọng nói dựa trên PyTorch
★ 11.802+10Thay đổi số sao trong 7 ngày qua - #4
Chuyển đổi giọng nói thành văn bản, nhận dạng ý định và chuyển đổi văn bản thành giọng nói với độ trễ rất thấp, dùng để xây dựng các agent và giao diện giọng nói
★ 10.997+33Thay đổi số sao trong 7 ngày qua - #5
Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn
★ 10.112+29Thay đổi số sao trong 7 ngày qua - #6
Một bản triển khai gần như thời gian thực của Whisper từ OpenAI.
★ 4.246+3Thay đổi số sao trong 7 ngày qua - #7
🇨🇳 Thư viện công cụ chữ Hán toàn diện (phiên âm, nét vẽ, bộ thủ, thành ngữ, giọng nói, trực quan hóa, v.v.) (Chinese character util)
★ 3.087+3Thay đổi số sao trong 7 ngày qua - #8
🐸STT - Bộ công cụ học sâu cho Speech-to-Text. Việc huấn luyện và triển khai các mô hình STT chưa bao giờ dễ dàng đến thế.
★ 2.606+1Thay đổi số sao trong 7 ngày qua - #9★ 2.256+7Thay đổi số sao trong 7 ngày qua
- #10
🔊 Danh sách toàn diện các tập dữ liệu mã nguồn mở cho điện toán giọng nói và âm thanh (hơn 95 tập dữ liệu).
★ 2.223+1Thay đổi số sao trong 7 ngày qua - #11
💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác
★ 1.399+0Thay đổi số sao trong 7 ngày qua - #12
Dự án này sử dụng nhiều mô hình nhận dạng giọng nói nâng cao khác nhau như EcapaTdnn, ResNetSE, ERes2Net, CAM++, v.v. Không loại trừ khả năng sẽ hỗ trợ thêm nhiều mô hình trong tương lai. Đồng thời, dự án này cũng hỗ trợ các phương pháp tiền xử lý dữ liệu MelSpectrogram, Spectrogram
★ 1.313+1Thay đổi số sao trong 7 ngày qua - #13
Trợ lý AI bằng Python
★ 1.014+0Thay đổi số sao trong 7 ngày qua - #14
Nhật ký thuyền trưởng và bản đồ sao 3D cho Elite Dangerous
★ 898+2Thay đổi số sao trong 7 ngày qua - #15
Công cụ chuyển đổi giọng nói thành ý định (Speech-to-Intent) trên thiết bị được hỗ trợ bởi học sâu
★ 712+2Thay đổi số sao trong 7 ngày qua - #16
Voicetypr - Công cụ chuyển giọng nói thành văn bản ngoại tuyến hỗ trợ bởi AI dành cho các nhà sáng lập, lập trình viên và người dùng chuyên nghiệp trên macOS và Windows. Giải pháp thay thế cho wispr flow và superwhisper.
★ 709+12Thay đổi số sao trong 7 ngày qua - #17
Khung đánh giá hiệu năng chuyển đổi giọng nói thành văn bản
★ 697+0Thay đổi số sao trong 7 ngày qua - #18
Nhận dạng giọng nói cho các dự án React Native Expo
★ 677+5Thay đổi số sao trong 7 ngày qua - #19
Công cụ chuyển đổi giọng nói thành văn bản trực tuyến trên thiết bị dựa trên học sâu
★ 671+0Thay đổi số sao trong 7 ngày qua - #20
:speech_balloon: /so.nus/ STT (speech to text) cho Node với tính năng phát hiện từ khóa ngoại tuyến
★ 638+0Thay đổi số sao trong 7 ngày qua - #21
Dịch âm thanh thời gian thực, thu âm thanh hệ thống và micro, chạy ASR (Whisper/SenseVoice), dịch qua API LLM với hiển thị luồng. Phù hợp cho VTuber, người livestream và xem nội dung nước ngoài.
★ 625+34Thay đổi số sao trong 7 ngày qua - #22
Chuyển đổi giọng nói thành văn bản thời gian thực sử dụng faster-whisper.
★ 614+0Thay đổi số sao trong 7 ngày qua - #23
Một lớp phủ (overlay) lấy quyền truy cập giọng nói của người dùng và chuyển đổi đầu vào thành văn bản trong giao diện tùy chỉnh
★ 557+1Thay đổi số sao trong 7 ngày qua