Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · voice-recognition

voice-recognition

Các kho mã nguồn mở đang theo dõi được gắn thẻ voice-recognition, sắp xếp theo số sao.

Kho mã
23
Tổng số sao
85.588
Số sao trung bình
3.721
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng voice-recognition trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ voice-recognition.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • vosk-api@alphacep

    API nhận diện giọng nói ngoại tuyến cho Android, iOS, Raspberry Pi và máy chủ với Python, Java, C# và Node

    15.101+17Thay đổi số sao trong 7 ngày qua
  • PaddleSpeech@PaddlePaddle

    Bộ công cụ xử lý giọng nói dễ sử dụng, bao gồm mô hình tự giám sát (Self-Supervised Learning), SOTA/Streaming ASR có dấu câu, Streaming TTS tích hợp frontend văn bản, Hệ thống xác thực người nói, Dịch giọng nói đầu cuối và Nhận diện từ khóa. Đạt giải Demo xuất sắc nhất tại NAACL 2022.

    12.676+5Thay đổi số sao trong 7 ngày qua
  • speechbrain@speechbrain

    Bộ công cụ nhận diện giọng nói dựa trên PyTorch

    11.802+10Thay đổi số sao trong 7 ngày qua
  • moonshine@moonshine-ai

    Chuyển đổi giọng nói thành văn bản, nhận dạng ý định và chuyển đổi văn bản thành giọng nói với độ trễ rất thấp, dùng để xây dựng các agent và giao diện giọng nói

    10.997+33Thay đổi số sao trong 7 ngày qua
  • silero-vad@snakers4

    Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn

    10.112+29Thay đổi số sao trong 7 ngày qua
  • WhisperLive@collabora

    Một bản triển khai gần như thời gian thực của Whisper từ OpenAI.

    4.246+3Thay đổi số sao trong 7 ngày qua
  • cnchar@theajack

    🇨🇳 Thư viện công cụ chữ Hán toàn diện (phiên âm, nét vẽ, bộ thủ, thành ngữ, giọng nói, trực quan hóa, v.v.) (Chinese character util)

    3.087+3Thay đổi số sao trong 7 ngày qua
  • STT@coqui-ai

    🐸STT - Bộ công cụ học sâu cho Speech-to-Text. Việc huấn luyện và triển khai các mô hình STT chưa bao giờ dễ dàng đến thế.

    2.606+1Thay đổi số sao trong 7 ngày qua
  • ten-vad@TEN-framework

    Trình phát hiện hoạt động giọng nói (VAD): độ trễ thấp, hiệu suất cao và nhẹ

    2.256+7Thay đổi số sao trong 7 ngày qua
  • voice_datasets@jim-schwoebel

    🔊 Danh sách toàn diện các tập dữ liệu mã nguồn mở cho điện toán giọng nói và âm thanh (hơn 95 tập dữ liệu).

    2.223+1Thay đổi số sao trong 7 ngày qua
  • 💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác

    1.399+0Thay đổi số sao trong 7 ngày qua
  • Dự án này sử dụng nhiều mô hình nhận dạng giọng nói nâng cao khác nhau như EcapaTdnn, ResNetSE, ERes2Net, CAM++, v.v. Không loại trừ khả năng sẽ hỗ trợ thêm nhiều mô hình trong tương lai. Đồng thời, dự án này cũng hỗ trợ các phương pháp tiền xử lý dữ liệu MelSpectrogram, Spectrogram

    1.313+1Thay đổi số sao trong 7 ngày qua
  • Trợ lý AI bằng Python

    1.014+0Thay đổi số sao trong 7 ngày qua
  • EDDiscovery@EDDiscovery

    Nhật ký thuyền trưởng và bản đồ sao 3D cho Elite Dangerous

    898+2Thay đổi số sao trong 7 ngày qua
  • rhino@Picovoice

    Công cụ chuyển đổi giọng nói thành ý định (Speech-to-Intent) trên thiết bị được hỗ trợ bởi học sâu

    712+2Thay đổi số sao trong 7 ngày qua
  • voicetypr@moinulmoin

    Voicetypr - Công cụ chuyển giọng nói thành văn bản ngoại tuyến hỗ trợ bởi AI dành cho các nhà sáng lập, lập trình viên và người dùng chuyên nghiệp trên macOS và Windows. Giải pháp thay thế cho wispr flow và superwhisper.

    709+12Thay đổi số sao trong 7 ngày qua
  • Khung đánh giá hiệu năng chuyển đổi giọng nói thành văn bản

    697+0Thay đổi số sao trong 7 ngày qua
  • Nhận dạng giọng nói cho các dự án React Native Expo

    677+5Thay đổi số sao trong 7 ngày qua
  • cheetah@Picovoice

    Công cụ chuyển đổi giọng nói thành văn bản trực tuyến trên thiết bị dựa trên học sâu

    671+0Thay đổi số sao trong 7 ngày qua
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) cho Node với tính năng phát hiện từ khóa ngoại tuyến

    638+0Thay đổi số sao trong 7 ngày qua
  • LiveTranslate@TheDeathDragon

    Dịch âm thanh thời gian thực, thu âm thanh hệ thống và micro, chạy ASR (Whisper/SenseVoice), dịch qua API LLM với hiển thị luồng. Phù hợp cho VTuber, người livestream và xem nội dung nước ngoài.

    625+34Thay đổi số sao trong 7 ngày qua
  • speech-to-text@reriiasu

    Chuyển đổi giọng nói thành văn bản thời gian thực sử dụng faster-whisper.

    614+0Thay đổi số sao trong 7 ngày qua
  • Một lớp phủ (overlay) lấy quyền truy cập giọng nói của người dùng và chuyển đổi đầu vào thành văn bản trong giao diện tùy chỉnh

    557+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề