gradio
标记 gradio 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 gradio 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 gradio 主题的项目。
- #1
将任何研究论文转化为商业化报告,包含 6 个 AI 代理、TRL/MRL 评分、专利布局、市场情报与验证引用,支持 DeepSeek / OpenAI / Claude。
★ 806
- #1
Stable Diffusion 网页 UI
★ 164,776+53近 7 天星标变化 - #2★ 43,452+14近 7 天星标变化
- #3
⚡️HivisionIDPhotos:轻量且高效的 AI 证件照工具。一个轻量级的AI证件照制作算法。
★ 21,474+21近 7 天星标变化 - #4
从电子书生成有声书,支持语音克隆和 1158+ 种语言!
★ 20,097+34近 7 天星标变化 - #5
stable diffusion webui colab
★ 15,914+0近 7 天星标变化 - #6
Gradio WebUI 为创作者与开发者提供关键 TTS(Edge‑TTS、kokoro)与零样本语音克隆(E2 & F5‑TTS、CosyVoice),并支持 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译
★ 12,730+54近 7 天星标变化 - #7
Easy Docker setup for Stable Diffusion with user-friendly UI
★ 7,306-1近 7 天星标变化 - #8★ 6,210+13近 7 天星标变化
- #9
使用 LangGraph 构建的模块化 Agentic RAG — 在几分钟内学习检索增强生成(RAG)智能体。
★ 3,999+20近 7 天星标变化 - #10
[CVPR'25] 文章官方实现 - MagicQuill:一个智能互动图像编辑系统
★ 3,691+2近 7 天星标变化 - #11
[CVPR2024 Highlight][VideoChatGPT] ChatGPT 具备视频理解功能!并支持 miniGPT4、StableLM、MOSS 等多种语言模型
★ 3,347+0近 7 天星标变化 - #12
单一 Gradio + React WebUI,整合 ACE-Step、OmniVoice、Kimi Audio、Piper TTS、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、Stable Audio、MMS、StyleTTS2、MAGNet、AudioGen、MusicGen、Tortoise、RVC、Vocos、Demucs、SeamlessM4T 与 Bark 的扩展功能!
★ 3,250+5近 7 天星标变化 - #13
InternGPT (iGPT) 是一个开源演示平台,您可以轻松展示 AI 模型。现在支持 DragGAN、ChatGPT、ImageBind、多模态聊天如 GPT-4、SAM、互动图像编辑等。试试 igpt.opengvlab.com(支持 DragGAN、ChatGPT、ImageBind、SAM 的线上 Demo 系统)
★ 3,205+0近 7 天星标变化 - #14
一个使用 Whisper 模型轻松生成字幕的 Web UI
★ 2,869+2近 7 天星标变化 - #15★ 2,666+1近 7 天星标变化
- #16★ 2,147+2近 7 天星标变化
- #17
仅使用 Auto1111 webui 依赖来实作 text2video 扩散模型(如 ModelScope 或 VideoCrafter)的 Auto1111 扩展功能
★ 1,322+0近 7 天星标变化 - #18
🤗 图像配对 webui
★ 1,301+0近 7 天星标变化 - #19
Inpaint Anything 扩展使用 Segment Anything 的遮罩,在浏览器 UI 中执行 stable diffusion 图像修复。
★ 1,298+0近 7 天星标变化 - #20★ 1,150+1近 7 天星标变化
- #21
基于物理的多材料 FDM 彩色系统。通过校准的光线透射混合,将图片转换为全彩 3D 打印。支持 2-8 色系统,并可导出切片软件就绪的 3MF 格式(BambuStudio/OrcaSlicer)。
★ 1,021+14近 7 天星标变化 - #22
透明的 Python RAG 参考实现,采用 FAISS + BM25 混合检索、重新排序、Gradio UI 与 FastAPI。
★ 951+2近 7 天星标变化 - #23
🎬 通过 3D 交互控制从任何摄像机视角生成图像。在 3D 空间中拖拽摄像机或使用滑块设置方位角/仰角/距离后进行生成。基于 Three.js + Gradio 构建,支持中英双语界面。
★ 942+218近 7 天星标变化 - #24
为 Stable Diffusion 工作流程编写的模板语言。可作为 Automatic1111 WebUI 的扩展功能使用。
★ 809+0近 7 天星标变化 - #25
将任何研究论文转化为商业化报告,包含 6 个 AI 代理、TRL/MRL 评分、专利布局、市场情报与验证引用,支持 DeepSeek / OpenAI / Claude。
★ 806+181近 7 天星标变化 - #26
具备高分辨率输出的快速实时对象检测 https://x.com/_akhaliq/status/1840213012818329826 https://x.com/githubprojects/status/1891370506537910724 https://www.threads.net/@githubprojects/post/DGKdoE4zdUX
★ 699+13近 7 天星标变化 - #27
本地与多个 PDF 进行对话
★ 683+2近 7 天星标变化 - #28
Chatbot Arena 遇上多模态!Multi-Modality Arena 允许您在输入图像的同时,并排评测视觉语言模型。支持 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多种模型!
★ 566+0近 7 天星标变化 - #29
基于 DAG 的多模型并行 AI 影视生成引擎。并行加速随场景独立性扩展;同时生成影视场景而非逐一生成;将影视生成的执行图从拓扑序转为关键路径最优调度;唯一将场景叙事依赖建模为 DAG 并以 CPM 算法驱动并行调度的影视生成引擎。
★ 536+0近 7 天星标变化 - #30
AdvancedLivePortrait 的 gradio WebUI
★ 535+0近 7 天星标变化