Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · speech

speech

Các kho mã nguồn mở đang theo dõi được gắn thẻ speech, sắp xếp theo số sao.

Kho mã
72
Tổng số sao
379.232
Số sao trung bình
5.267
Tỷ trọng
0,02%

Những chủ đề thường xuất hiện cùng speech trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • TTS@coqui-ai

    🐸💬 - bộ công cụ học sâu cho chuyển văn bản thành giọng nói, đã được kiểm chứng qua thực chiến trong nghiên cứu và sản xuất

    45.967+36Thay đổi số sao trong 7 ngày qua
  • MockingBird@babysor

    🚀 Nhân bản giọng nói trong 5 giây để tạo ra lời nói bất kỳ theo thời gian thực

    36.912-1Thay đổi số sao trong 7 ngày qua
  • VoxCPM@OpenBMB

    VoxCPM2: TTS không cần Tokenizer để tạo giọng nói đa ngôn ngữ, thiết kế giọng nói sáng tạo và nhân bản như thật

    36.250+293Thay đổi số sao trong 7 ngày qua
  • whisperX@m-bain

    WhisperX: Nhận diện giọng nói tự động với mốc thời gian cấp độ từ (và phân đoạn người nói)

    23.803+117Thay đổi số sao trong 7 ngày qua
  • datasets@huggingface

    🤗 Trung tâm dữ liệu lớn nhất sẵn sàng sử dụng cho các mô hình AI với các công cụ xử lý dữ liệu nhanh chóng, dễ sử dụng và hiệu quả

    21.878+34Thay đổi số sao trong 7 ngày qua
  • Grounded-Segment-Anything@IDEA-Research

    Grounded SAM: Kết hợp Grounding DINO với Segment Anything, Stable Diffusion & Recognize Anything - Tự động phát hiện, phân đoạn và tạo ra mọi thứ

    17.713+3Thay đổi số sao trong 7 ngày qua
  • kaldi@kaldi-asr

    kaldi-asr/kaldi là địa chỉ chính thức của dự án Kaldi.

    15.471+7Thay đổi số sao trong 7 ngày qua
  • speech-to-speech@huggingface

    Xây dựng các tác nhân giọng nói với các mô hình mã nguồn mở

    12.933+180Thay đổi số sao trong 7 ngày qua
  • AudioGPT@AIGC-Audio

    AudioGPT: Hiểu và tạo ra giọng nói, âm nhạc, âm thanh và chuyển động khuôn mặt

    10.166-2Thay đổi số sao trong 7 ngày qua
  • silero-vad@snakers4

    Silero VAD: Trình phát hiện hoạt động giọng nói cấp doanh nghiệp đã được huấn luyện sẵn

    10.083+52Thay đổi số sao trong 7 ngày qua
  • modelscope@modelscope

    ModelScope: Hiện thực hóa khái niệm Model-as-a-Service.

    9.117+19Thay đổi số sao trong 7 ngày qua
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Công cụ TTS đa giọng nói và điều khiển bằng prompt

    8.523+2Thay đổi số sao trong 7 ngày qua
  • models@PaddlePaddle

    Được duy trì chính thức, hỗ trợ bởi PaddlePaddle, bao gồm CV, NLP, Speech, Rec, TS, mô hình lớn v.v.

    6.932+0Thay đổi số sao trong 7 ngày qua
  • annyang@TalAter

    💬 Nhận dạng giọng nói cho trang web của bạn

    6.816+1Thay đổi số sao trong 7 ngày qua
  • silero-models@snakers4

    Silero Models: các mô hình chuyển văn bản thành giọng nói được huấn luyện trước trở nên vô cùng đơn giản

    6.085+11Thay đổi số sao trong 7 ngày qua
  • cactus@cactus-compute

    Lượng tử hóa, kernel, runtime và công cụ suy luận cho thiết bị di động, thiết bị đeo, nhà thông minh và robot.

    5.955+71Thay đổi số sao trong 7 ngày qua
  • whisper-diarization@MahmoudAshraf97

    Nhận dạng giọng nói tự động kết hợp phân đoạn người nói dựa trên OpenAI Whisper

    5.633+7Thay đổi số sao trong 7 ngày qua
  • stt@jianchang512

    Công cụ nhận diện giọng nói thành văn bản / Công cụ chuyển đổi âm thanh và video cục bộ chạy ngoại tuyến thành phụ kiện, hỗ trợ xuất định dạng json, phụ đề srt và văn bản thuần túy

    4.771+7Thay đổi số sao trong 7 ngày qua
  • DeepFilterNet@Rikorose

    Khử nhiễu sử dụng bộ lọc sâu (deep filtering)

    4.636+14Thay đổi số sao trong 7 ngày qua
  • ultravox@fixie-ai

    Một LLM đa phương thức nhanh chóng dành cho giọng nói thời gian thực

    4.556+7Thay đổi số sao trong 7 ngày qua
  • ClearerVoice-Studio@modelscope

    Bộ công cụ xử lý giọng nói hỗ trợ AI và các mô hình tiền huấn luyện SOTA mã nguồn mở, hỗ trợ tăng cường, tách rời giọng nói và trích xuất giọng nói mục tiêu, v.v.

    4.449+19Thay đổi số sao trong 7 ngày qua
  • metavoice-src@metavoiceio

    Mô hình nền tảng cho TTS tự nhiên, biểu cảm giống con người

    4.204-1Thay đổi số sao trong 7 ngày qua
  • Amazing-Python-Scripts@avinashkranjan

    🚀 Bộ sưu tập các tập lệnh Python tuyệt vời từ cơ bản đến nâng cao, bao gồm cả các tập lệnh tác vụ tự động hóa.

    3.663+5Thay đổi số sao trong 7 ngày qua
  • Applio@IAHispano

    Công cụ chuyển đổi giọng nói đơn giản, chất lượng cao, tập trung vào tính dễ sử dụng và hiệu năng.

    3.660+39Thay đổi số sao trong 7 ngày qua
  • API dịch vụ web ASR OpenAI Whisper

    3.326+2Thay đổi số sao trong 7 ngày qua
  • iOS-10-Sampler@shu223

    Mã nguồn ví dụ cho các API mới của iOS 10.

    3.273-2Thay đổi số sao trong 7 ngày qua
  • audio@pytorch

    Thao tác và biến đổi dữ liệu cho xử lý tín hiệu âm thanh, được cung cấp bởi PyTorch

    2.931+6Thay đổi số sao trong 7 ngày qua
  • lingvo@tensorflow

    Lingvo

    2.864+0Thay đổi số sao trong 7 ngày qua
  • aeneas@readbeyond

    aeneas là một thư viện Python/C và bộ công cụ tự động đồng bộ hóa âm thanh và văn bản (còn gọi là căn chỉnh cưỡng bức)

    2.862-1Thay đổi số sao trong 7 ngày qua
  • whisper-timestamped@linto-ai

    Nhận dạng Tự động Tiếng nói Đa ngôn ngữ với mốc thời gian cấp độ từ và độ tin cậy

    2.841+2Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề