Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · speech-processing

speech-processing

Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-processing, sắp xếp theo số sao.

Kho mã
20
Tổng số sao
71.137
Số sao trung bình
3.557
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng speech-processing trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech-processing.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • speechbrain@speechbrain

    Bộ công cụ nhận diện giọng nói dựa trên PyTorch

    11.792+22Thay đổi số sao trong 7 ngày qua
  • pyannote-audio@pyannote

    Khối xây dựng thần kinh cho việc phân đoạn người nói: phát hiện hoạt động giọng nói, phát hiện thay đổi người nói, phát hiện giọng nói chồng chéo, nhúng người nói

    10.484+38Thay đổi số sao trong 7 ngày qua
  • silero-vad@snakers4

    Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn

    10.083+52Thay đổi số sao trong 7 ngày qua
  • maths-cs-ai-compendium@HenryNdubuaku

    Trở thành một nhà nghiên cứu/kỹ sư AI/ML xuất sắc với cuốn sách giáo khoa phi truyền thống này bao gồm toán học, điện toán và ML bằng trực giác.

    7.379+33Thay đổi số sao trong 7 ngày qua
  • Danh sách tài liệu đọc cho các chủ đề nghiên cứu về học máy đa phương thức

    6.925+0Thay đổi số sao trong 7 ngày qua
  • torchscale@microsoft

    Kiến trúc nền tảng cho (M)LLM.

    3.138+1Thay đổi số sao trong 7 ngày qua
  • whisper-timestamped@linto-ai

    Nhận dạng Tự động Tiếng nói Đa ngôn ngữ với mốc thời gian cấp độ từ và độ tin cậy

    2.841+2Thay đổi số sao trong 7 ngày qua
  • resemble-enhance@resemble-ai

    Khử tiếng ồn và cải thiện giọng nói hỗ trợ bởi AI

    2.401+6Thay đổi số sao trong 7 ngày qua
  • ten-vad@TEN-framework

    Trình phát hiện hoạt động giọng nói (VAD): độ trễ thấp, hiệu suất cao và nhẹ

    2.250+4Thay đổi số sao trong 7 ngày qua
  • IMS-Toucan@DigitalPhonetics

    Chuyển văn bản thành giọng nói có thể kiểm soát và nhanh chóng cho hơn 7000 ngôn ngữ!

    2.208+0Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các bài báo, thư viện, tập dữ liệu và các tài nguyên tuyệt vời khác về Phân đoạn Người nói.

    1.893+2Thay đổi số sao trong 7 ngày qua
  • 💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác

    1.399+0Thay đổi số sao trong 7 ngày qua
  • voicefixer@haoheliu

    Khôi phục giọng nói chung

    1.376+3Thay đổi số sao trong 7 ngày qua
  • CrisperWhisper@nyrahealth

    Bản ghi âm có thể điều khiển. Nguyên văn (mọi từ đệm, khoảng dừng, lắp bắp, âm thanh phát ra), hoặc theo ý định (ý người nói muốn diễn đạt, được tối ưu hóa cho khả năng đọc) với dấu thời gian ở cấp độ từ.

    1.362+21Thay đổi số sao trong 7 ngày qua
  • StreamSpeech@ictnlp

    StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.

    1.288+2Thay đổi số sao trong 7 ngày qua
  • audino@midas-research

    Công cụ chú thích âm thanh mã nguồn mở dành cho con người

    1.146+0Thay đổi số sao trong 7 ngày qua
  • SLAM-LLM@X-LANCE

    Framework xử lý Tiếng nói, Ngôn ngữ, Âm thanh, Âm nhạc với Large Language Model

    1.056+0Thay đổi số sao trong 7 ngày qua
  • Nơi bạn có thể tìm thấy các thuật toán xử lý giọng nói mong muốn

    878+1Thay đổi số sao trong 7 ngày qua
  • MultiBench@pliang279

    [NeurIPS 2021] Các tiêu chuẩn đa quy mô cho học biểu diễn đa phương thức

    636+0Thay đổi số sao trong 7 ngày qua
  • Danh sách các phòng thí nghiệm/công ty/tài nguyên/thực tập về lĩnh vực giọng nói, hoan nghênh đề xuất hoặc tự ứng cử.

    609+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề