automatic-speech-recognition
Các kho mã nguồn mở đang theo dõi được gắn thẻ automatic-speech-recognition, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng automatic-speech-recognition trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ automatic-speech-recognition.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Chuyển đổi giọng nói thành văn bản cục bộ, thời gian thực với ASR phát trực tuyến, phân đoạn người nói, dịch thuật và các API tương thích với OpenAI/Deepgram.
★ 10.990+16Thay đổi số sao trong 7 ngày qua - #2
Bộ công cụ nhận dạng giọng nói đầu-cuối (End-to-End) ưu tiên môi trường production và sẵn sàng cho production
★ 5.229+1Thay đổi số sao trong 7 ngày qua - #3
API dịch vụ web ASR OpenAI Whisper
★ 3.328+2Thay đổi số sao trong 7 ngày qua - #4
[AutoArk] GPA (General Purpose Audio) có thể thực hiện ASR, TTS và chuyển đổi giọng nói chỉ với một mô hình nhỏ gọn!
★ 3.061+164Thay đổi số sao trong 7 ngày qua - #5
Các mô hình âm thanh CoreML tiên tiến trong ứng dụng của bạn — chuyển văn bản thành giọng nói, chuyển giọng nói thành văn bản, phát hiện hoạt động giọng nói và phân đoạn người nói. Viết bằng Swift, cung cấp bởi các mã nguồn mở SOTA.
★ 2.723+13Thay đổi số sao trong 7 ngày qua - #6
🐸STT - Bộ công cụ học sâu cho Speech-to-Text. Việc huấn luyện và triển khai các mô hình STT chưa bao giờ dễ dàng đến thế.
★ 2.606+1Thay đổi số sao trong 7 ngày qua - #7★ 2.256+7Thay đổi số sao trong 7 ngày qua
- #8
Các mô hình ASR cấp công nghiệp mã nguồn mở hỗ trợ tiếng Quan Thoại, các phương ngữ tiếng Trung và tiếng Anh, đạt SOTA mới trên các benchmark ASR tiếng Quan Thoại công khai, đồng thời cung cấp khả năng nhận dạng lời bài hát xuất sắc.
★ 1.975+2Thay đổi số sao trong 7 ngày qua - #9
:zap: TensorFlowASR: Nhận dạng giọng nói tự động gần đạt mức tiên tiến nhất trong Tensorflow 2. Hỗ trợ các ngôn ngữ có thể sử dụng ký tự hoặc từ phụ
★ 1.010+0Thay đổi số sao trong 7 ngày qua - #10
Đánh giá hệ thống chuyển đổi giọng nói thành văn bản bằng các thước đo độ tương đồng như tỷ lệ lỗi từ (WER)
★ 928+2Thay đổi số sao trong 7 ngày qua - #11
Bộ sưu tập tài nguyên về ứng dụng của các Mô hình Ngôn ngữ Lớn (LLM) trong Audio AI
★ 738+1Thay đổi số sao trong 7 ngày qua - #12
Nhận dạng giọng nói ngoại tuyến với OpenAI Whisper và TensorFlow Lite cho Android
★ 688+0Thay đổi số sao trong 7 ngày qua - #13
Hệ thống ASR tất cả trong một cấp công nghiệp SOTA với các mô-đun ASR, VAD, LID và Punc. FireRedASR2 hỗ trợ tiếng Trung (Quan thoại, 20+ phương ngữ/giọng), tiếng Anh, chuyển đổi mã, và ASR cho cả giọng nói lẫn hát. FireRedVAD hỗ trợ giọng nói/hát/nhạc bằng 100+ ngôn ngữ. FireRedLID hỗ trợ 100+ ngôn ngữ và 20+ phương ngữ tiếng Trung. FireRedPunc hỗ trợ tiếng Trung và tiếng Anh.
★ 672+13Thay đổi số sao trong 7 ngày qua - #14
Công cụ chuyển đổi giọng nói thành văn bản trực tuyến trên thiết bị dựa trên học sâu
★ 671+0Thay đổi số sao trong 7 ngày qua