NVIDIA added josephine-wolf-oberholtzer to NVIDIA/cudfNVIDIA added josephine-wolf-oberholtzer to NVIDIA/cudf · August 11, 2026 07:09 评论点赞收藏4 天前
NVIDIA added csadorf to NVIDIA/cumlNVIDIA added csadorf to NVIDIA/cuml · August 10, 2026 11:06 评论点赞收藏5 天前
SkillSpector:NVIDIA开源的AI Agent技能安全扫描工具NVIDIA发布SkillSpector,用于检测AI Agent技能(如Claude Code、Gemini CLI插件)中的安全漏洞。该工具基于26.1%技能含漏洞的研究背景,提供64种漏洞模式检测,涵盖提示注入、数据泄露、权限提升等16类风险。采用静态分析与LLM语义分析两阶段架构,支持多格式输出及实时CVE查询,旨在解决AI Agent技能安装前的信任与 vetting 问题。 评论点赞收藏64 天前
NVIDIA 向 cosmos-curator 添加 jbowles-nvidiaNVIDIA 向 cosmos-curator 仓库添加了 jbowles-nvidia 用户或组件。 评论点赞收藏80 天前
NVIDIA显卡在Linux 7.0内核下挂起恢复失败:RTX 50系列及多代显卡遭遇回归BugNVIDIA开源GPU驱动在Linux 7.0内核下出现s2idle挂起恢复失败的问题。多位用户报告RTX 50系列及更早架构显卡在Ubuntu 26.04等系统上遇到此回归,关闭笔记本盖子后系统死机。初步分析指向内核变更导致的驱动侧回归,已有临时规避方案。 评论点赞收藏96 天前
Asset Harvester:从自动驾驶日志中提取仿真级3D资产NVIDIA 发布 Asset Harvester,一种端到端图像到3D管线,能从自动驾驶日志中的稀疏真实世界物体观测中生成完整的3D高斯泼溅资产。该系统结合多视角扩散模型和3D高斯提升技术,解决了神经场景重建无法生成完整3D对象资产的问题,可直接用于NVIDIA NCore和NuRec进行闭环仿真测试。 评论点赞收藏115 天前
TensorRT LLM:面向LLM与视觉生成的推理优化方案NVIDIA官方GitHub仓库页面,汇总了TensorRT LLM的功能概述、最新新闻及大量技术博客链接。内容主要为机构发布的性能基准测试、功能更新和案例研究列表,缺乏独立的技术深度分析或个人见解。 评论点赞收藏119 天前
NVIDIA 发布 NemoClaw:用于沙箱 AI 智能体的安全运行参考栈NVIDIA 发布开源项目 NemoClaw,作为在 OpenShell 沙箱中安全运行常驻 AI Agent 的参考栈。该项目提供引导式部署、加固蓝图、路由推理、网络策略及生命周期管理,目前支持 OpenClaw 和 Hermes 两种 Agent,处于 Alpha 阶段。 评论点赞收藏150 天前
OpenShell:面向自主 AI Agent 的安全私有运行时环境NVIDIA 发布 OpenShell,一个专为自主 AI Agent 设计的安全私有运行时环境。它通过沙箱隔离和声明式 YAML 策略,严格控制 Agent 的文件访问、网络出站和凭证使用,防止数据泄露。支持 Claude、Codex 等主流 Agent,提供本地及 K8s 部署方案,并内置终端 UI 和 Agent 辅助开发工作流。 评论点赞收藏151 天前
NVSentinel:NVIDIA 面向 Kubernetes 的开源 GPU 容错系统NVIDIA 发布开源项目 NVSentinel,用于在 Kubernetes 集群中自动检测、分类和修复 GPU 节点故障。支持多种 GPU 架构,具备实时监控、自动隔离故障节点、优雅驱逐负载及触发维修工作流等功能,并提供本地模拟演示环境。 评论点赞收藏157 天前
Earth2Studio:英伟达新一代AI气象预测工具包Nvidia发布Earth2Studio,一个用于快速部署AI气象和气候预测模型的Python工具包。支持FourCastNet3、Graphcast等主流模型,提供统一API、数据源接入及评估指标,旨在降低AI气象科学的研究与应用门槛。 评论点赞收藏201 天前
NVIDIA B200 使用 OpenRM 驱动运行 66 天后 nvidia-smi 无限挂起GitHub Issue 报告在 NVIDIA B200 GPU 上使用 OpenRM 驱动运行约 66 天后,nvidia-smi 命令无限挂起。用户提供了详细的系统环境、dmesg 日志和 strace 输出,NVIDIA 协作者回复请求更多调试信息。 评论点赞收藏203 天前
NVIDIA 开源 CUDA Tile IR:基于 MLIR 的 CUDA 内核优化新基础设施NVIDIA 将基于 MLIR 的 CUDA Tile IR 编译器基础设施开源,旨在通过图块化计算模式优化 NVIDIA Tensor Core 性能。该项目包含专用 Dialect、Python 绑定及字节码支持,随 CUDA Toolkit 13.1 发布,为高性能 CUDA 内核开发提供了新的抽象层和优化工具。 评论点赞收藏239 天前
NVIDIA发布Aerial Framework:用AI原生代码加速5G/6G无线信号处理NVIDIA发布Aerial Framework,旨在将Python/JAX/PyTorch原型快速编译为微秒级延迟的GPU原生代码,用于5G/6G RAN信号处理。该框架结合MLIR-TensorRT编译器和实时运行时引擎,支持零拷贝网络传输,填补了AI无线网开发中原型与高性能部署之间的鸿沟。 评论点赞收藏248 天前
Nvidia cuTile:面向基于 Tile 的 CUDA 内核的 Python DSL 与新中间表示NVIDIA 发布 cuTile Python,这是一个用于 GPU 的编程 DSL 和新的 Tile IR。文章提供了安装指南、系统要求、示例代码(如向量加法内核)以及从源码构建的步骤。这是 NVIDIA 在简化 CUDA 开发、提高 GPU 编程生产力方面的又一工具尝试。 评论点赞收藏253 天前
gdrcopy:基于Nvidia GPUDirect RDMA的高速CPU-GPU内存拷贝库NVIDIA官方开源的低延迟GPU内存拷贝库gdrcopy,基于GPUDirect RDMA技术实现CPU到GPU的高速内存映射与传输。文章介绍了其原理、性能基准测试数据、安装方法及NUMA效应优化建议,主要面向高性能计算和底层系统开发者。 评论点赞收藏279 天前
nvmath-python:面向 Python 生态的 NVIDIA 数学库NVIDIA 发布 nvmath-python 库,将底层数学库(如 cuBLASLt、cuFFTDx)的完整功能暴露给 Python 生态。支持主机端、设备端及分布式 API,允许用户在 PyTorch/CuPy 等框架中直接调用 NVIDIA 库的高级特性,如混合精度计算、自定义 FFT 前后处理及多节点分布式 FFT。 评论点赞收藏331 天前
NVIDIA NVSHMEM:面向GPU集群的高效并行通信接口NVIDIA官方开源的并行编程接口NVSHMEM的GitHub仓库页面。该工具基于OpenSHMEM,旨在通过允许在CUDA内核和流中执行单边通信,显著减少多进程通信和协调开销。页面包含项目简介、构建指南、API文档链接及版本更新记录。 评论点赞收藏340 天前