Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · speech

speech

Các kho mã nguồn mở đang theo dõi được gắn thẻ speech, sắp xếp theo số sao.

74 kho mã
  • TTS-papers@coqui-ai

    🐸 Bộ sưu tập các bài báo về TTS

    734+1Thay đổi số sao trong 7 ngày qua
  • MASR@yeyupiaoling

    Khung nhận dạng giọng nói tự động (ASR) dựa trên PyTorch, hỗ trợ cả chế độ trực tuyến và ngoại tuyến, các mô hình Conformer, Squeezeformer, DeepSpeech2 và nhiều phương pháp tăng cường dữ liệu

    727+0Thay đổi số sao trong 7 ngày qua
  • FreeVC@OlaWod

    FreeVC: Hướng tới chuyển đổi giọng nói one-shot chất lượng cao không cần văn bản.

    716+0Thay đổi số sao trong 7 ngày qua
  • openspeech@openspeech-team

    Bộ công cụ mã nguồn mở cho nhận dạng giọng nói đầu-cuối, tận dụng PyTorch-Lightning và Hydra.

    714+0Thay đổi số sao trong 7 ngày qua
  • BabelDuck@Orenoid

    Ứng dụng luyện tập hội thoại AI thân thiện với người mới bắt đầu.

    693+1Thay đổi số sao trong 7 ngày qua
  • chatterbox-tts-api@travisvn

    API chuyển văn bản thành giọng nói (TTS) cục bộ, tương thích với OpenAI sử dụng Chatterbox, cho phép người dùng tạo giọng nói nhân bản ở bất kỳ đâu sử dụng OpenAI API (ví dụ: Open WebUI, AnythingLLM, v.v.)

    677+6Thay đổi số sao trong 7 ngày qua
  • MOSS-Audio@OpenMOSS

    MOSS-Audio là mô hình nền tảng mã nguồn mở cho việc hiểu âm thanh thống nhất, hỗ trợ lời nói, âm thanh, âm nhạc, chú thích, QA và suy luận trong các tình huống thực tế.

    656+5Thay đổi số sao trong 7 ngày qua
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) cho Node với tính năng phát hiện từ khóa ngoại tuyến

    638+0Thay đổi số sao trong 7 ngày qua
  • Danh sách các phòng thí nghiệm/công ty/tài nguyên/thực tập về lĩnh vực giọng nói, hoan nghênh đề xuất hoặc tự ứng cử.

    610+1Thay đổi số sao trong 7 ngày qua
  • Danh sách các tập dữ liệu phản hồi xung phòng (room impulse response) công khai và các tập lệnh để tải xuống.

    609+3Thay đổi số sao trong 7 ngày qua
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: nền tảng đánh giá hiệu năng toàn diện, mạnh mẽ và quy mô lớn cho Nhận dạng giọng nói tự động (ASR).

    553+3Thay đổi số sao trong 7 ngày qua
  • tacotron@google

    Các mẫu âm thanh đi kèm với các ấn phẩm liên quan đến Tacotron, một mô hình tổng hợp giọng nói end-to-end.

    539+0Thay đổi số sao trong 7 ngày qua
  • knn-vc@bshall

    Chuyển đổi giọng nói chỉ với Nearest Neighbors

    524+1Thay đổi số sao trong 7 ngày qua
  • StarGANv2-VC@yl4579

    StarGANv2-VC: Một framework đa dạng, không giám sát và không song song dành cho chuyển đổi giọng nói tự nhiên.

    522+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề