跳到主要内容
buildradar
登录
主题 · asr

asr

标记 asr 主题、收录中的开源项目,按星标数排序。

共 88 个项目
  • GLM-ASR@zai-org

    GLM-ASR-Nano:一个具备 15 亿参数的强大开源语音识别模型

    854+0近 7 天星标变化
  • 在原生环境与浏览器中运行的 Voxtral ASR 与 TTS。使用 Burn ML 框架实现的 Mistral Voxtral mini 实时 ASR / TTS 的 Rust 版本

    820+0近 7 天星标变化
  • voxt@hehehai

    🎙️ 一款智能语音生产力助手,可将语音转化为干净的文字、有用的动作和结构化知识。它协助用户捕捉灵感、自然沟通、自动化重复性任务,并在各种应用程序与工作流程中保持高生产力。

    811+6近 7 天星标变化
  • ZerolanLiveRobot@AkagawaTsurunaki

    结合 LLM、ASR、TTS、OCR、CV 等技术的 AI VTuber,可与你直播或游玩 Minecraft。

    803+1近 7 天星标变化
  • BiBi-Keyboard@BryceWG

    说点啥(BiBi Keyboard):一个基于 Kotlin 的 Android 平台 LLM 与 ASR 语音输入法键盘应用程序

    780+10近 7 天星标变化
  • cn2an@Ailln

    📦 快速转化「中文数字」和「阿拉伯数字」~ (最新特性:分数,日期、温度等转化)

    767+1近 7 天星标变化
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    基于 PaddlePaddle 实现的语音识别,中文语音识别。项目完善,识别效果佳。支持 Windows、Linux 下训练与预测,并支持 Nvidia Jetson 开发板预测。

    763+1近 7 天星标变化
  • 在本地机器的 Unity3d 中运行语音转文字模型 (whisper.cpp)。

    751+0近 7 天星标变化
  • MASR@yeyupiaoling

    Pytorch实现的流式与非流式的自动语音识别框架,同时兼容在线和离线识别,目前支持Conformer、Squeezeformer、DeepSpeech2模型,支持多种数据增强方法。

    727+0近 7 天星标变化
  • openspeech@openspeech-team

    基于 PyTorch-Lightning 与 Hydra 的端到端语音识别开源工具包。

    714+0近 7 天星标变化
  • 使用 OpenAI Whisper 与 TensorFlow Lite 在 Android 上进行离线语音识别

    689+1近 7 天星标变化
  • INTERSPEECH 2023-2024 论文集:收录 INTERSPEECH 2023-24 会议中具有影响力与精彩的研究论文。探索语音与语言处理的最新进展。内含代码。为此存储库点 Star 以支持语音技术的发展!

    684+0近 7 天星标变化
  • pyannote-whisper@yinruiqing
    678+1近 7 天星标变化
  • FireRedASR2S@FireRedTeam

    一个 SOTA 工业级一体化 ASR 系统,包含 ASR、VAD、LID 和 Punc 模块。FireRedASR2 支持中文(普通话、20+ 种方言/口音)、英文、中英夹杂(code-switching),以及语音和歌唱的 ASR。FireRedVAD 支持 100+ 种语言的语音/歌唱/音乐。FireRedLID 支持 100+ 种语言和 20+ 种中文方言。FireRedPunc 支持中英文。

    677+8近 7 天星标变化
  • cheetah@Picovoice

    由深度学习驱动的设备端流式语音转文字引擎

    671+0近 7 天星标变化
  • LiveTranslate@TheDeathDragon

    实时音频翻译,可撷取系统音频与麦克风,执行 ASR (Whisper/SenseVoice),并通过 LLM API 进行翻译与流式显示。适用于 VTuber、直播主与观看外语内容。

    644+21近 7 天星标变化
  • optimum-intel@huggingface

    🤗 Optimum Intel:利用 Intel 优化工具加速推理

    619+2近 7 天星标变化
  • ASR_Theory@zw76859420

    语音识别理论、论文和 PPT

    618+0近 7 天星标变化
  • RapidASR@RapidAI

    📣 商用级开源语音自动识别程序库,开箱即用,全平台支持,中英文混合识别。基于 ONNXRuntime 与 FunASR 的跨平台 ASR 推理实现。我们提供了一组更易于调用 ASR 模型的 API。

    610-1近 7 天星标变化
  • echokit_server@second-state

    开源语音代理平台

    592+1近 7 天星标变化
  • auto-caption@HiMeditator

    跨平台实时字幕显示软件

    579+2近 7 天星标变化
  • WhisperS2T@shashikg

    支持多种推理引擎的 Whisper 模型语音转文字优化流水线。

    578+0近 7 天星标变化
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard:一个大型、稳健且全面的自动语音识别基准测试平台。

    553+0近 7 天星标变化
  • vosk-browser@ccoreilly

    通过 Vosk 的 WebAssembly 构建,可在浏览器中运行的语音识别库

    528-1近 7 天星标变化
  • ICASSP-2023-24-Papers@DmitryRyumin

    ICASSP 2023-2024 论文集:收录来自 ICASSP 2023-24 会议中具影响力且令人兴奋的研究论文。探索声学、语音与信号处理的最新进展。内含代码。为此仓库加星以支持音频与信号处理领域的发展!

    526+0近 7 天星标变化
  • whisplay-ai-chatbot@PiSugar

    使用 RPI Zero 2w / 5 构建的口袋型 AI 聊天机器人

    513+2近 7 天星标变化
  • video-recap-skills@zenstory-ai

    Clip any video into a narration recap with claude code skill|用 claude code skill 把任何视频剪辑成中文解说视频,支持剪映导出

    505近 7 天星标变化
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    502+1近 7 天星标变化
← 返回主题列表