Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · speech-synthesis

speech-synthesis

Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-synthesis, sắp xếp theo số sao.

Kho mã
66
Tổng số sao
348.104
Số sao trung bình
5.274
Tỷ trọng
0,02%

Những chủ đề thường xuất hiện cùng speech-synthesis trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ speech-synthesis.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • TTS@coqui-ai

    🐸💬 - bộ công cụ học sâu cho chuyển văn bản thành giọng nói, đã được kiểm chứng qua thực chiến trong nghiên cứu và sản xuất

    45.985+18Thay đổi số sao trong 7 ngày qua
  • VoxCPM@OpenBMB

    VoxCPM2: TTS không cần Tokenizer để tạo giọng nói đa ngôn ngữ, thiết kế giọng nói sáng tạo và nhân bản như thật

    36.595+345Thay đổi số sao trong 7 ngày qua
  • Speech@NVIDIA-NeMo

    Một framework AI tạo sinh có khả năng mở rộng được xây dựng cho các nhà nghiên cứu và lập trình viên làm việc về Mô hình Ngôn ngữ Lớn, Đa phương thức và AI Giọng nói (Nhận dạng Giọng nói Tự động và Chuyển văn bản thành giọng nói)

    18.379+21Thay đổi số sao trong 7 ngày qua
  • leon@leon-ai

    🧠 Leon là trợ lý cá nhân mã nguồn mở của bạn.

    17.476+1Thay đổi số sao trong 7 ngày qua
  • DeepLearningExamples@NVIDIA

    Các tập lệnh Deep Learning tiên tiến được sắp xếp theo các mô hình - dễ huấn luyện và triển khai với độ chính xác và hiệu suất có thể tái tạo trên cơ sở hạ tầng cấp doanh nghiệp.

    14.846+4Thay đổi số sao trong 7 ngày qua
  • supertonic@supertone-inc

    TTS đa ngôn ngữ, chạy trên thiết bị, cực kỳ nhanh — chạy nguyên bản qua ONNX.

    13.757+20Thay đổi số sao trong 7 ngày qua
  • speech-to-speech@huggingface

    Xây dựng các tác nhân giọng nói với các mô hình mã nguồn mở

    13.015+82Thay đổi số sao trong 7 ngày qua
  • voice-pro@abus-aikorea

    Gradio WebUI dành cho người sáng tạo và nhà phát triển, tích hợp các tính năng TTS chính (Edge-TTS, kokoro) và nhân bản giọng nói zero-shot (E2 & F5-TTS, CosyVoice), xử lý âm thanh Whisper, tải xuống YouTube, tách giọng hát Demucs và dịch đa ngôn ngữ.

    12.730+54Thay đổi số sao trong 7 ngày qua
  • PaddleSpeech@PaddlePaddle

    Bộ công cụ xử lý giọng nói dễ sử dụng, bao gồm mô hình tự giám sát (Self-Supervised Learning), SOTA/Streaming ASR có dấu câu, Streaming TTS tích hợp frontend văn bản, Hệ thống xác thực người nói, Dịch giọng nói đầu cuối và Nhận diện từ khóa. Đạt giải Demo xuất sắc nhất tại NAACL 2022.

    12.676+5Thay đổi số sao trong 7 ngày qua
  • edge-tts@rany2

    Sử dụng dịch vụ chuyển văn bản thành giọng nói trực tuyến của Microsoft Edge từ Python MÀ KHÔNG cần Microsoft Edge, Windows hoặc khóa API

    11.847+29Thay đổi số sao trong 7 ngày qua
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) là bộ công cụ tạo Âm thanh, Âm nhạc và Tiếng nói. Mục đích của nó là hỗ trợ nghiên cứu có thể tái tạo và giúp các nhà nghiên cứu, kỹ sư trẻ bắt đầu trong lĩnh vực nghiên cứu và phát triển tạo âm thanh, âm nhạc và tiếng nói.

    10.276+1Thay đổi số sao trong 7 ngày qua
  • espnet@espnet

    Bộ công cụ xử lý giọng nói đầu cuối (End-to-End)

    9.949+3Thay đổi số sao trong 7 ngày qua
  • so-vits-svc-fork@voicepaw

    Bản fork của so-vits-svc hỗ trợ thời gian thực, giao diện cải tiến và nhiều tính năng hơn.

    9.329+3Thay đổi số sao trong 7 ngày qua
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Công cụ TTS đa giọng nói và điều khiển bằng prompt

    8.522-1Thay đổi số sao trong 7 ngày qua
  • mlx-audio@Blaizzy

    Một thư viện chuyển đổi văn bản thành giọng nói (TTS), giọng nói thành văn bản (STT) và giọng nói thành giọng nói (STS) được xây dựng trên framework MLX của Apple, cung cấp khả năng phân tích giọng nói hiệu quả trên Apple Silicon.

    7.826+23Thay đổi số sao trong 7 ngày qua
  • espeak-ng@espeak-ng

    eSpeak NG là một trình tổng hợp giọng nói mã nguồn mở hỗ trợ hơn một trăm ngôn ngữ và giọng địa phương.

    6.802+13Thay đổi số sao trong 7 ngày qua
  • StyleTTS2@yl4579

    StyleTTS 2: Hướng tới Chuyển văn bản thành giọng nói cấp độ con người thông qua khuếch tán phong cách và huấn luyện đối kháng với các Speech Language Model lớn

    6.342+3Thay đổi số sao trong 7 ngày qua
  • silero-models@snakers4

    Silero Models: các mô hình chuyển văn bản thành giọng nói được huấn luyện trước trở nên vô cùng đơn giản

    6.084-1Thay đổi số sao trong 7 ngày qua
  • abogen@denizsafak

    Tạo sách nói từ EPUB, PDF và văn bản với phụ đề đồng bộ.

    5.831+45Thay đổi số sao trong 7 ngày qua
  • DiffSinger@MoonInTheRiver

    DiffSinger: Tổng hợp giọng hát qua cơ chế khuếch tán nông (SVS & TTS); AAAI 2022; Mã nguồn chính thức

    4.855+3Thay đổi số sao trong 7 ngày qua
  • WhisperSpeech@WhisperSpeech

    Một hệ thống chuyển đổi văn bản thành giọng nói mã nguồn mở được xây dựng bằng cách đảo ngược Whisper.

    4.645+3Thay đổi số sao trong 7 ngày qua
  • OpenUtau@openutau

    Nền tảng tổng hợp giọng hát mở / Kế nhiệm mã nguồn mở của UTAU

    4.258+18Thay đổi số sao trong 7 ngày qua
  • metavoice-src@metavoiceio

    Mô hình nền tảng cho TTS tự nhiên, biểu cảm giống con người

    4.203-1Thay đổi số sao trong 7 ngày qua
  • RealtimeTTS@KoljaB

    Chuyển đổi văn bản thành giọng nói theo thời gian thực

    4.021+2Thay đổi số sao trong 7 ngày qua
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Tổng hợp giọng nói thời gian thực tiên tiến cho Tensorflow 2 (hỗ trợ tiếng Anh, Pháp, Hàn, Trung, Đức và dễ thích ứng cho các ngôn ngữ khác)

    3.996+0Thay đổi số sao trong 7 ngày qua
  • lingvo@tensorflow

    Lingvo

    2.864+0Thay đổi số sao trong 7 ngày qua
  • MARS5-TTS@Camb-ai

    Mô hình giọng nói MARS5 (TTS) từ CAMB.AI

    2.818+1Thay đổi số sao trong 7 ngày qua
  • marytts@marytts

    MARY TTS -- một hệ thống tổng hợp văn bản thành giọng nói đa ngôn ngữ, mã nguồn mở được viết hoàn toàn bằng java

    2.583+0Thay đổi số sao trong 7 ngày qua
  • VieNeu-TTS@pnnbao97

    TTS tiếng Việt với khả năng nhân bản giọng nói tức thì • Chạy trên thiết bị • Suy luận CPU thời gian thực • Chất lượng âm thanh 24kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2.468+21Thay đổi số sao trong 7 ngày qua
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks cho tổng hợp giọng nói hiệu quả và độ trung thực cao

    2.367+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề