🟢 NVIDIA Top 20 NVIDIA 开源项目
口径:公司公开仓库按总 Star 数排序
排名 项目名 Star 最近更新 简介
1 NVIDIA/NemoClaw 22k 2026-07-28 NemoClaw 是一个在 NVIDIA OpenShell 环境中安全运行 AI 代理的框架,支持 Hermes、LangChain Deep Agents 和 OpenClaw 等,提供托管推理以增强执行的安全性与可控性。
2 NVIDIA/Megatron-LM 17.2k 2026-07-28 NVIDIA Megatron-LM 用于大规模训练 Transformer 模型,包含参考示例和 GPU 优化库 Megatron Core。它支持张量、流水线等多种并行策略,提供混合精度训练和模块化构建块,既适合研究团队快速实验,也便于工程师构建自定义训练流水线。
3 NVIDIA/open-gpu-kernel-modules 17.2k 2026-07-07 NVIDIA Linux开源GPU内核模块源代码,版本610.43.03,需配合相应GSP固件和用户态驱动使用,支持x86_64和aarch64架构,适用于Linux内核4.15及以上版本,用于构建和安装NVIDIA GPU内核模块。
4 NVIDIA/DeepLearningExamples 14.8k 2024-08-12 提供面向NVIDIA GPU的最先进深度学习示例,涵盖计算机视觉等模型,支持混合精度、多GPU训练与TensorRT推理,易于在企业级基础设施上复现高精度和高性能。
5 NVIDIA/TensorRT-LLM 14.2k 2026-07-28 TensorRT-LLM 是 NVIDIA 推出的 LLM 推理优化库,提供易用的 Python API 用于定义大语言模型,并集成专用内核和高效运行时,可在 NVIDIA GPU 上实现高性能推理。支持模型定制、分布式部署,适用于各种 LLM 和视觉生成模型的优化。
6 NVIDIA/SkillSpector 13.9k 2026-07-27 一款面向AI代理技能的安全扫描器,可检测漏洞、恶意模式及安全风险,保障代理安全。
7 NVIDIA/TensorRT 13.2k 2026-07-07 NVIDIA TensorRT 是用于在 NVIDIA GPU 上进行高性能深度学习推理的 SDK。本仓库包含其开源组件,如插件、ONNX 解析器和示例应用,帮助开发者在 GPU 上优化和部署深度学习模型,实现低延迟、高吞吐量推理,适用于各种 AI 推理场景。
8 NVIDIA/cosmos 11.3k 2026-07-24 NVIDIA Cosmos 是一个开放平台,提供世界模型、数据集和工具,用于构建面向机器人、自动驾驶和智能基础设施的物理 AI。其最新 Cosmos 3 模型族支持图像、视频、音频和动作的统一处理,实现世界理解、生成和动作建模,助力开发者在具身智能和自主系统中进行推理与合成。
9 NVIDIA/FastPhotoStyle 11.2k 2023-06-07 该项目由NVIDIA研究团队开发,其算法被ECCV 2018接收,通过闭式解实现高效的写实图像风格迁移,能够将任意风格图的视觉效果自然融合到内容照片中,输出逼真结果。提供命令行和教程,适合研究人员和开发者进行图像风格化实验与应用。
10 NVIDIA/personaplex 10.3k 2026-03-02 PersonaPlex 是一个实时全双工语音对话模型,通过文本角色提示和音频声纹控制对话人格。它基于 Moshi 架构,支持助手、客服和闲聊等多种场景,提供低延迟自然交互,可用于语音助手或对话系统开发。
11 NVIDIA/cutlass 10.1k 2026-07-27 CUTLASS是NVIDIA开源的CUDA C++模板库,专注于高性能线性代数运算,尤其是矩阵乘法(GEMM)及相关计算。它通过层次化分解和数据移动策略,支持FP64、FP32、TF32、FP16、BF16、块缩放等多种数据类型,并针对Volta至Blackwell等GPU架构进行深度优化。4.6版新增Python DSL(CuTe DSL),允许开发者用Python编写接近硬件的CUDA内核,大幅降低学习曲线与编译时间。适用于深度学习训练、科学计算等需要极致运算性能的场景。
12 NVIDIA/cuda-samples 9.4k 2026-05-27 CUDA Samples 是NVIDIA官方提供的CUDA示例代码集,展示了CUDA Toolkit的各项功能,包括GPU编程、并行计算等。支持CUDA Toolkit 13.3,使用CMake构建,支持Linux、Windows和Tegra交叉编译。适用于CUDA开发者学习和参考GPU加速计算的实现方法。
13 NVIDIA/apex 9k 2026-07-27 Apex 是 NVIDIA 维护的 PyTorch 工具库,专注于混合精度训练和分布式训练优化。它提供融合版优化器、归一化层、自动混合精度等模块,利用 CUDA 融合内核加速计算,帮助深度学习开发者节省显存、提升训练速度。
14 NVIDIA/vid2vid 8.7k 2022-05-17 基于PyTorch的高分辨率视频到视频转换项目,能够实现2048x1024分辨率的照片级逼真视频合成。应用场景包括:将语义标签图转换为街景视频、边缘图生成人脸对话以及姿态驱动人体运动。该方法发表于NeurIPS 2018,适合视频合成研究。
15 NVIDIA/garak 8.6k 2026-07-27 garak 是一款 LLM 安全漏洞扫描工具,用于探测大语言模型的幻觉、数据泄露、提示注入、错误信息、毒性生成和越狱等弱点。它结合静态、动态和自适应探测,支持多种模型后端,类似于 nmap 和 Metasploit 在网络安全中的作用。适用于 AI 系统的红队测试与安全评估。
16 NVIDIA/OpenShell 7.8k 2026-07-28 OpenShell 是一个安全、私有的运行时环境,专为自主 AI 代理设计。它为智能代理提供受控执行空间,确保操作安全且数据隐私得到保护,适用于需要隔离运行的 AI 应用场景。
17 NVIDIA/Isaac-GR00T 7.7k 2026-07-22 NVIDIA Isaac GR00T N1.7 是一款开源视觉-语言-动作基础模型,面向通用人形机器人技能。它接收多模态输入(语言与图像),跨多种机器人形态执行操控任务,支持微调与部署,适合机器人研究与开发。
18 NVIDIA/pix2pixHD 6.9k 2024-11-04 pix2pixHD 是一个基于条件 GAN 的高分辨率图像到图像翻译框架,由 NVIDIA 提出。它能够将语义标签图转换为照片级真实感图像,或从人脸标签图合成肖像,支持高达 2048×1024 的分辨率。项目提供预训练模型和训练代码,适用于街景生成、人脸编辑等任务,允许用户自定义数据集进行训练。
19 NVIDIA/warp 6.9k 2026-07-27 NVIDIA Warp 是一个用于 GPU 加速仿真、机器人学和机器学习的 Python 框架。它将 Python 函数即时编译为高效 CPU/GPU 内核,内置物理、几何处理原语,支持可微分编程,可集成到 PyTorch、JAX 等 ML 流水线中,适用于大规模仿真与机器人研究。
20 NVIDIA/FasterTransformer 6.4k 2024-03-27 FasterTransformer是NVIDIA开源的高性能Transformer推理优化库,包含BERT、GPT等模型的编码器和解码器优化实现。它利用CUDA、cuBLAS和Tensor Cores加速,支持FP16/INT8精度,提供TensorFlow、PyTorch和Triton后端接口,适用于服务器端大规模NLP模型推理。

本次生成有 15 项数据采用了降级处理。