facebookresearch
facebookresearch 收录中的开源项目,按星标数排序。
- #1segment-anything@facebookresearch
此仓库提供运行 SegmentAnything Model(SAM)推理的代码、模型检查点下载链接以及示例笔记本
★ 54,774+36近 7 天星标变化 - #2faiss@facebookresearch
用于高效相似度搜索与稠密向量聚类的库
★ 40,820+32近 7 天星标变化 - #3detectron2@facebookresearch
Detectron2 是一个用于目标检测、分割和其他视觉识别任务的平台。
★ 34,692+7近 7 天星标变化 - #4audiocraft@facebookresearch
Audiocraft 是一个使用深度学习的音频处理与生成库。它具备最先进的 EnCodec 音频压缩/分词器,并提供 MusicGen,一个简单且可控的音乐生成语言模型,支持文字与旋律条件。
★ 23,592+23近 7 天星标变化 - #5sam2@facebookresearch
此仓库提供使用 Meta Segment Anything Model 2 (SAM 2) 进行推理的代码、模型检查点下载链接,以及展示如何使用模型的示例笔记本。
★ 19,778+39近 7 天星标变化 - #6vggt@facebookresearch
[CVPR 2025 最佳论文奖] VGGT:视觉几何基础的 Transformer
★ 14,304+42近 7 天星标变化 - #7dinov2@facebookresearch
PyTorch 代码与模型,用于 DINOv2 自监督学习方法
★ 13,276+25近 7 天星标变化 - #8seamless_communication@facebookresearch
最先进语音与文字翻译的基础模型。
★ 11,845+4近 7 天星标变化 - #9sam3@facebookresearch
此仓库提供运行推理和微调 Meta Segment Anything Model 3 (SAM 3) 的代码、下载已训练模型检查点的链接,以及展示如何使用模型的示例笔记本。
★ 11,518+87近 7 天星标变化 - #10dinov3@facebookresearch
DINOv3 的 PyTorch 参考实现与模型
★ 11,264+39近 7 天星标变化 - #11xformers@facebookresearch
可黑客化且优化的 Transformers 构建模块,支持可组合式构建
★ 10,544+2近 7 天星标变化 - #12nougat@facebookresearch
Nougat 神经光学理解在学术文档中的实现
★ 10,066+5近 7 天星标变化 - #13pytorch3d@facebookresearch
PyTorch3D 是 FAIR 的 3D 数据深度学习可复用组件库。
★ 9,960+7近 7 天星标变化 - #14ImageBind@facebookresearch
ImageBind:一个将所有事物绑定于同一嵌入空间的模型
★ 9,065+0近 7 天星标变化 - #15SlowFast@facebookresearch
PySlowFast:FAIR 提供的视频理解代码库,用于复现最先进的视频模型。
★ 7,412+4近 7 天星标变化 - #16sam-3d-objects@facebookresearch
SAM 3D 对象
★ 7,330+40近 7 天星标变化 - #17Kats@facebookresearch
Kats 是一套用于分析时间序列数据的工具包,轻量、易用、可扩充的框架,能从理解关键统计与特征、检测变化点与异常,到预测未来趋势。
★ 6,466+16近 7 天星标变化 - #18mmf@facebookresearch
Facebook AI Research (FAIR) 的视觉与语言多模态研究模块化框架。
★ 5,634+1近 7 天星标变化 - #19sapiens@facebookresearch
高分辨率人类任务模型
★ 5,418+0近 7 天星标变化 - #20moco@facebookresearch
MoCo 的 PyTorch 实现:https://arxiv.org/abs/1911.05722
★ 5,136-1近 7 天星标变化 - #21AugLy@facebookresearch
音频、图像、文字与视频的数据增强库
★ 5,090+1近 7 天星标变化 - #22co-tracker@facebookresearch
CoTracker 是一个用于追踪影片中任何点(像素)的模型
★ 5,081+9近 7 天星标变化 - #23lingua@facebookresearch
Meta Lingua:一个精简、高效、易于扩充的代码库,用于研究 LLMs。
★ 4,766+1近 7 天星标变化 - #24flow_matching@facebookresearch
PyTorch 库,用于实现流匹配算法,包含连续与离散流匹配实现,并提供文字与图像示例
★ 4,713+16近 7 天星标变化 - #25vjepa2@facebookresearch
PyTorch 代码与模型,用于 VJEPA2 从视频中进行自监督学习
★ 4,540+42近 7 天星标变化 - #26vggt-omega@facebookresearch
[CVPR 2026 Oral] VGGT Omega
★ 4,208+111近 7 天星标变化 - #27nevergrad@facebookresearch
用于执行无梯度优化的 Python 工具箱
★ 4,204+1近 7 天星标变化 - #28jepa@facebookresearch
PyTorch 代码和模型,用于从视频中进行 V-JEPA 自监督学习
★ 4,112+16近 7 天星标变化 - #29dlrm@facebookresearch
深度学习推荐模型(DLRM)的一种实现
★ 4,067+2近 7 天星标变化 - #30encodec@facebookresearch
先进深度学习音频编码器,支持单声道 24 kHz 与立体声 48 kHz 音讯
★ 4,042+8近 7 天星标变化 - #31habitat-sim@facebookresearch
一个灵活且高效的 3D 模拟器,用于实体化 AI 研究
★ 3,803+7近 7 天星标变化 - #32ReAgent@facebookresearch
一个用于推理系统(强化学习、情境赛局等)的平台
★ 3,712+0近 7 天星标变化 - #33map-anything@facebookresearch
MapAnything:通用前向度量 3D 重建
★ 3,691+24近 7 天星标变化 - #34sam-audio@facebookresearch
此仓库提供使用 Meta Segment Anything Audio Model(SAM‑Audio)进行推理的代码、下载训练模型检查点的链接,以及展示如何使用模型的示例笔记本
★ 3,615+7近 7 天星标变化 - #35pytorchvideo@facebookresearch
面向视频理解研究的深度学习库
★ 3,566+1近 7 天星标变化 - #36sam-3d-body@facebookresearch
本仓库提供使用 SAM 3D Body Model (3DB) 进行推理的代码,包含下载已训练模型检查点与数据集的链接,以及示范如何使用模型的示例笔记本
★ 3,470+25近 7 天星标变化 - #37tribev2@facebookresearch
此倉庫包含用於訓練和評估 TRIBE v2 的代碼,這是一個用於大腦反應預測的多模態模型。
★ 3,178+22近 7 天星标变化 - #38habitat-lab@facebookresearch
一个模块化的高级函数库,用于在多种任务与环境中训练具身 AI 代理。
★ 3,111+6近 7 天星标变化 - #39Pearl@facebookresearch
由 Meta 应用强化学习团队推出的可投入产业的强化学习 AI 代理库
★ 3,027+5近 7 天星标变化 - #40omnilingual-asr@facebookresearch
Omnilingual ASR:支持 1600 多种语言的开源多语言语音识别
★ 2,901+6近 7 天星标变化 - #41HyperAgents@facebookresearch
可针对任何可计算任务进行优化的自我指涉、自我改进型 Agent
★ 2,702+13近 7 天星标变化 - #42large_concept_model@facebookresearch
大概念模型:在句子表示空间中的语言建模
★ 2,376+1近 7 天星标变化 - #43perception_models@facebookresearch
尖端的 Image & Video CLIP、多模态大型语言模型等!
★ 2,354+3近 7 天星标变化 - #44schedule_free@facebookresearch
PyTorch 中的无调度优化 (Schedule-Free Optimization)
★ 2,324+2近 7 天星标变化 - #45fvcore@facebookresearch
FAIR 计算机视觉团队各研究项目共用的常用代码集合。
★ 2,250+0近 7 天星标变化 - #46fairchem@facebookresearch
FAIR Chemistry 的化学机器学习方法库
★ 2,231+5近 7 天星标变化 - #47ai4animationpy@facebookresearch
使用神经网络进行 AI 驱动角色动画的 Python 框架。
★ 2,080+9近 7 天星标变化 - #48blt@facebookresearch
BLT 研究论文的代码
★ 2,060+1近 7 天星标变化 - #49theseus@facebookresearch
一个用于可微分非线性优化的库
★ 2,055+3近 7 天星标变化 - #50Detic@facebookresearch
"Detecting Twenty-thousand Classes using Image-level Supervision" 的代码发布。
★ 2,008+0近 7 天星标变化 - #51MetaCLIP@facebookresearch
NeurIPS 2025 Spotlight;ICLR 2024 Spotlight;CVPR 2024;EMNLP 2024
★ 1,854+0近 7 天星标变化 - #52multimodal@facebookresearch
TorchMultimodal 是一个 PyTorch 库,用于大规模训练先进的多模态多任务模型。
★ 1,732+1近 7 天星标变化 - #53coconut@facebookresearch
训练大型语言模型在连续潜在空间中进行推理
★ 1,690+4近 7 天星标变化 - #54MobileLLM@facebookresearch
MobileLLM:优化十亿参数以下的语言模型以用于设备端场景。发表于 ICML 2024。
★ 1,459+1近 7 天星标变化 - #55vggsfm@facebookresearch
VGGSfM:基于视觉几何基础的深度运动学重建
★ 1,423+4近 7 天星标变化 - #56uco3d@facebookresearch
3D 数据集中的罕见物件
★ 1,344+2近 7 天星标变化 - #57Replica-Dataset@facebookresearch
如 https://arxiv.org/abs/1906.05797 所发布的 Replica Dataset v1。
★ 1,317+2近 7 天星标变化 - #58home-robot@facebookresearch
专为机器人研究人员设计的移动操作研究工具
★ 1,235+4近 7 天星标变化 - #59co3d@facebookresearch
Common Objects In 3D 数据集的工具。
★ 1,173+0近 7 天星标变化 - #60shumai@facebookresearch
使用 Bun + Flashlight 在 JavaScript 与 TypeScript 中实现的快速可微分张量库
★ 1,172+1近 7 天星标变化 - #61meshrcnn@facebookresearch
Mesh R-CNN 的代码,ICCV 2019
★ 1,161+0近 7 天星标变化 - #62fairseq2@facebookresearch
FAIR 序列建模工具包 2
★ 1,144+1近 7 天星标变化 - #63hiera@facebookresearch
Hiera:一个快速、强大且简单的分层 Vision Transformer
★ 1,075+2近 7 天星标变化 - #64CutLER@facebookresearch
“Cut and Learn for Unsupervised Object Detection and Instance Segmentation”与“VideoCutLER: Surprisingly Simple Unsupervised Video Instance Segmentation”的代码发布
★ 1,072+0近 7 天星标变化 - #65EdgeTAM@facebookresearch
[CVPR 2025] “EdgeTAM: On-Device Track Anything Model”的官方 PyTorch 实现。
★ 973+7近 7 天星标变化 - #66spiritlm@facebookresearch
论文“Spirit-LM Interleaved Spoken and Written Language Model”的推理代码。
★ 929+0近 7 天星标变化 - #67fairo@facebookresearch
用于构建具身智能代理的模块化具身代理架构与平台
★ 927+0近 7 天星标变化 - #68sapiens2@facebookresearch
使用 10 亿张人类图像预训练的 1K 分辨率 Vision Transformer
★ 923+9近 7 天星标变化 - #69mobile-vision@facebookresearch
移动端视觉模型与代码
★ 920+0近 7 天星标变化 - #70brain2qwerty@facebookresearch
使用卷积编码器、Transformer 和字符级语言模型,从 MEG 与 EEG 大脑记录中进行打字句子的非侵入式解码。
★ 917+10近 7 天星标变化 - #71ProgramBench@facebookresearch
语言模型能从头重建程序吗?
★ 911+7近 7 天星标变化 - #72SONAR@facebookresearch
SONAR 是一个全新的多语言、多模态固定大小句子嵌入空间,配备全套的语音和文字编码器与解码器。
★ 905+1近 7 天星标变化 - #73cwm@facebookresearch
代码世界模型 (CWM) 的研究代码产物,包含推理工具、可复现性与文档。
★ 894+4近 7 天星标变化 - #74ShapeR@facebookresearch
ShapeR 研究论文的代码
★ 883+3近 7 天星标变化 - #75projectaria_tools@facebookresearch
projectaria_tools 是一个 C++/Python 开源工具包,用于交互 Project Aria 数据。
★ 835+1近 7 天星标变化 - #76MHR@facebookresearch
Momentum Human Rig 是 Meta 开发的具备解剖学灵感的参数化全身数字人模型。它包含:参数化身体骨骼模型;绑定至骨骼且具备不同细节层次的逼真 3D 网格;身体变形与姿势修正模型;面部变形模型。其设计对 CG 与 CV 社区皆十分友好。
★ 823+9近 7 天星标变化 - #77madgrad@facebookresearch
MADGRAD 优化方法
★ 801+0近 7 天星标变化 - #78ocean@facebookresearch
Ocean 是 Meta 用于计算机视觉 (CV) 与增强现实 (AR) 应用程序的内部框架。它是平台无关的,主要以 C/C++ 实现。
★ 789+0近 7 天星标变化 - #79sonata@facebookresearch
[CVPR'25 Highlight] Sonata 官方仓库:可靠点表示法的自我监督学习
★ 787+5近 7 天星标变化 - #80metamotivo@facebookresearch
第一个行为基础模型,用于控制虚拟基于物理的人形代理,以执行各种全身任务。
★ 784+2近 7 天星标变化 - #81CodeGen@facebookresearch
Facebook AI Research 代码生成项目的参考实现。将机器学习应用于代码的通用工具包,从数据集创建到模型训练与评估。附带预训练模型。
★ 777-1近 7 天星标变化 - #82audioseal@facebookresearch
针对 AI 生成语音音频的本地化水印,具备 SOTA 级别的鲁棒性与极快的检测速度
★ 776+3近 7 天星标变化 - #83balance@facebookresearch
balance python 软件包提供简单的工作流程与方法,用于处理带有偏差的数据样本,以便从中推论出某些感兴趣的目标总体。
★ 768+3近 7 天星标变化 - #84eb_jepa@facebookresearch
一个开源库,旨在提供 Joint Embedding Predictive Architectures (JEPAs) 的社区示例。包含用于从图像、视频及动作条件视频学习表征,以及使用基于 JEPA 模型进行规划的代码与示例。
★ 765+6近 7 天星标变化 - #85videoseal@facebookresearch
开放且高效的视频与图片水印工具
★ 762+4近 7 天星标变化 - #86audiobox-aesthetics@facebookresearch
针对语音、音乐和声音的统一自动化质量评估。
★ 754+3近 7 天星标变化 - #87tuna-2@facebookresearch
Tuna-2 的官方实现:Pixel Embeddings Beat Vision Encoders for Unified Understanding and Generation
★ 752+2近 7 天星标变化 - #88swe-rl@facebookresearch
[NeurIPS'25]“SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution”官方代码库
★ 719+0近 7 天星标变化 - #89EUPE@facebookresearch
高效通用感知编码器:单一设备端视觉编码器,具有多功能表示,在多个任务领域中符合或超越专门专家。
★ 707+7近 7 天星标变化 - #90silk@facebookresearch
SiLK(Simple Learned Keypoint)是一种自我监督的深度学习关键点模型。
★ 679-1近 7 天星标变化 - #91nwm@facebookresearch
CVPR 2025 论文“导航世界模型”的官方代码。
★ 676+5近 7 天星标变化 - #92BenchMARL@facebookresearch
BenchMARL 是一个用于多智能体强化学习 (MARL) 基准测试的库。BenchMARL 能够快速比较不同的 MARL 算法、任务与模型,同时坚守其两大核心原则:可重现性与标准化。
★ 654+0近 7 天星标变化 - #93pippo@facebookresearch
Pippo:从单一影像产生高解析度多视角人像
★ 650+0近 7 天星标变化 - #94Ego4d@facebookresearch
Ego4d 数据集仓库。下载数据集、可视化、提取特征与数据集示例用法
★ 639+3近 7 天星标变化 - #95MLGym@facebookresearch
MLGym:用于推进 AI 研究代理的新框架与基准测试
★ 619+0近 7 天星标变化 - #96boxer@facebookresearch
Boxer 研究论文的代码
★ 611+0近 7 天星标变化 - #97mvdust3r@facebookresearch
Meta Reality Labs 的 MV-DUSt3R+ 开源实现:在 2 秒内从稀疏视角进行单阶段场景重建。项目页面 https://mv-dust3rp.github.io/
★ 605+2近 7 天星标变化 - #98optimizers@facebookresearch
用于优化算法的研究与开发。
★ 580+0近 7 天星标变化 - #99OrienterNet@facebookresearch
论文「OrienterNet Visual Localization in 2D Public Maps with Neural Matching」源代码
★ 577+0近 7 天星标变化 - #100atlas@facebookresearch
支持论文“Atlas Few-shot Learning with Retrieval Augmented Language Models”(https//arxiv.org/abs/2208.03299) 的代码库。
★ 560+0近 7 天星标变化 - #101HolisticTraceAnalysis@facebookresearch
用于分析 PyTorch 追踪记录的库。
★ 549+3近 7 天星标变化 - #102meta-agents-research-environments@facebookresearch
Meta Agents Research Environments 是一个综合平台,旨在评估动态、真实场景中的 AI 代理。与静态基准测试不同,此平台引入了不断演进的环境,代理必须随着新信息的出现调整策略,以反映现实世界的挑战。
★ 547+3近 7 天星标变化 - #103spider@facebookresearch
一个通用的物理基础重定向框架。
★ 532+5近 7 天星标变化 - #104dadaptation@facebookresearch
适用于 SGD、Adam 与 AdaGrad 的 D-Adaptation
★ 529+0近 7 天星标变化 - #105drzero@facebookresearch
Dr. Zero:无需训练数据的自我演化搜索代理
★ 525+0近 7 天星标变化 - #106stable_signature@facebookresearch
论文「The Stable Signature Rooting Watermarks in Latent Diffusion Models」的官方实现。
★ 525+0近 7 天星标变化 - #107AudioDec@facebookresearch
开源流式高保真神经音频编解码器
★ 515+1近 7 天星标变化 - #108meshflow@facebookresearch
CVPR 2026 论文 MeshFlow: Efficient Artistic Mesh Generation via MeshVAE and Flow-based Diffusion Transformer 的仓库,作者为 Weiyu Li, Antoine Toisoul, Tom Monnier, Roman Shapovalov, Rakesh Ranjan, Ping Tan 与 Andrea Vedaldi。
★ 511+2近 7 天星标变化 - #109eai-vc@facebookresearch
用于具身智能 (EAI) 视觉基础模型最大且最全面的实证研究仓库。
★ 509+1近 7 天星标变化