跳到主要内容
buildradar
Sign in
主题 · speech

speech

标记 speech 主题、收录中的开源项目,按星标数排序。

项目数
74
总星标数
379,927
平均星标数
5,134
占比
0.02%

常跟 speech 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 speech 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • TTS@coqui-ai

    🐸💬 - 用于文字转语音的深度学习工具包,已在研究与生产环境中验证

    45,985+18近 7 天星标变化
  • MockingBird@babysor

    🚀在 5 秒内克隆声音,实时生成任意语音

    36,912+0近 7 天星标变化
  • VoxCPM@OpenBMB

    VoxCPM2:无需分词器的多语言语音生成、创意语音设计与真实感克隆

    36,595+345近 7 天星标变化
  • whisperX@m-bain

    WhisperX:具备单字层级时间戳(及说话者分割)的自动语音识别

    23,864+61近 7 天星标变化
  • datasets@huggingface

    🤗 最大的 AI 模型即用数据集中心,提供快速、易用且高效的数据操作工具

    21,888+10近 7 天星标变化
  • Grounded-Segment-Anything@IDEA-Research

    Grounded SAM:结合 Grounding DINO、Segment Anything、Stable Diffusion 与 Recognize Anything,自动检测、分割并生成任意内容。

    17,719+6近 7 天星标变化
  • kaldi@kaldi-asr

    kaldi-asr/kaldi 是 Kaldi 项目的官方位置。

    15,474+3近 7 天星标变化
  • speech-to-speech@huggingface

    使用开源模型构建语音代理

    13,015+82近 7 天星标变化
  • AudioGPT@AIGC-Audio

    AudioGPT:理解与生成语音、音乐、声音与虚拟人物影像

    10,168+2近 7 天星标变化
  • silero-vad@snakers4

    Silero VAD:预训练的企业级语音活动检测器

    10,112+29近 7 天星标变化
  • modelscope@modelscope

    ModelScope:将模型即服务(Model-as-a-Service)的概念落地。

    9,121+4近 7 天星标变化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多语音与提示控制的文字转语音引擎

    8,522-1近 7 天星标变化
  • models@PaddlePaddle

    官方维护,由 PaddlePaddle 支持,涵盖 CV、NLP、语音、推荐、时间序列、大模型等领域

    6,933+1近 7 天星标变化
  • annyang@TalAter

    💬 你网站的语音识别

    6,815-1近 7 天星标变化
  • silero-models@snakers4

    Silero 模型:让预训练文字转语音模型变得极度简单

    6,084-1近 7 天星标变化
  • cactus@cactus-compute

    量化、核心、运行时与推理引擎,适用于移动设备、可穿戴设备、智能家居和机器人。

    5,975+20近 7 天星标变化
  • whisper-diarization@MahmoudAshraf97

    基于 OpenAI Whisper 的自动语音识别与说话者分离

    5,634+1近 7 天星标变化
  • stt@jianchang512

    语音识别转文字工具 / 一个离线运行的本地音视频转字幕工具,输出 json、srt 字幕、纯文字格式

    4,780+9近 7 天星标变化
  • DeepFilterNet@Rikorose

    使用深度过滤的噪音抑制

    4,655+19近 7 天星标变化
  • ultravox@fixie-ai

    一个快速的多模态 LLM,用于实时语音

    4,562+6近 7 天星标变化
  • ClearerVoice-Studio@modelscope

    一套 AI 驱动的语音处理工具包与开源 SOTA 预训练模型,支持语音增强、分离与目标说话人提取等功能

    4,458+9近 7 天星标变化
  • metavoice-src@metavoiceio

    面向人类般表达式TTS的基础模型

    4,203-1近 7 天星标变化
  • Applio@IAHispano

    A simple, high-quality voice conversion tool focused on ease of use and performance.

    3,674+14近 7 天星标变化
  • Amazing-Python-Scripts@avinashkranjan

    🚀 精选 Python 脚本,从基础到进阶,包含自动化任务脚本

    3,664+1近 7 天星标变化
  • OpenAI Whisper ASR 网络服务 API

    3,328+2近 7 天星标变化
  • iOS-10-Sampler@shu223

    iOS 10 新 API 的代码示例。

    3,272-1近 7 天星标变化
  • audio@pytorch

    基于 PyTorch 的音讯信号处理数据操作与转换

    2,933+2近 7 天星标变化
  • lingvo@tensorflow

    Lingvo

    2,864+0近 7 天星标变化
  • aeneas@readbeyond

    aeneas 是一个 Python/C 库和工具集,用于自动同步音频和文本(即强制对齐)

    2,862+0近 7 天星标变化
  • whisper-timestamped@linto-ai

    支持词级时间戳和置信度的多语言自动语音识别

    2,842+1近 7 天星标变化
← 返回主题列表