跳到正文
9月28日周一
  1. NVIDIA Newsroom40

    NVIDIA 宣布将股票回购授权增加 1500 亿美元

    NVIDIA 董事会批准将股票回购计划授权额度增加 1500 亿美元,使剩余总授权规模升至 2350 亿美元,为公司史上最大规模的回购授权上调。公司预计在 2028 财年前执行完剩余回购计划。CEO 黄仁勋称,AI 与加速计算带来的平台级转变推动公司增长,现金流足以支撑技术投入与股东回报。

  2. NVIDIA Newsroom78

    NVIDIA 发布 Open Agent Safety Platform,从测试到部署保障 AI 智能体安全

    NVIDIA 发布 NVIDIA Open Agent Safety Platform,由开源软件 NVIDIA OpenShell 与 NVIDIA Sentry 参考系统设计组成,覆盖运行智能体的软件、硬件、算力与机器人系统。

    推荐理由:NVIDIA 把智能体安全边界从模型层移到运行时与硬件层,读者可据此了解企业级智能体治理的一种新架构。

9月26日周六
9月24日周四
  1. NVIDIA Developer Blog31

    NVIDIA 推出 NV-Reason-CT Open 3D CT VLM,面向放射科医生链式推理

    NVIDIA 发布 NV-Reason-CT Open,这是一款面向 3D CT 扫描的开放视觉语言模型,支持放射科医生的链式推理(Chain-of-Thought)。现有通用前沿模型在体数据成像上表现不佳,多数开放医学 AI 模型也缺乏相关能力,而 3D CT 这一临床信息最丰富、数据最密集的模态长期被现代 VLM 忽视。

  2. NVIDIA Developer Blog18

    NVIDIA 推出 NodeWright,管理 Kubernetes 节点集群

    NVIDIA 发布 NodeWright,用于管理 Kubernetes 节点本身,覆盖内核设置、系统软件包、存储布局、安全代理以及 GPU 工作负载依赖的主机级调优。该工具针对团队目前依赖 Ansible playbook、自定义脚本和手动 runbook 的做法,这类方式在新区域新建集群或内核升级破坏 RDMA 时容易失效。

9月23日周三
  1. NVIDIA Blog12

    NVIDIA 验证工程师 Sakeena Fiza 如何让硬件大规模成功落地

    NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统工程实验室负责产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统层面被识别时,全球首次实现 Rubin GPU 系统级枚举,团队当场欢呼庆祝。她将验证工作比作破案,目标是在客户发现问题之前先找出问题,单块板卡可能含数万个元件,一个机架接近 50 万个。

9月22日周二
  1. NVIDIA Developer Blog62

    NVIDIA 发布 DLSS 5,引入 3D 引导神经渲染并更新 ACE 与 RTX Kit

    NVIDIA 发布 DLSS 5,引入 DLSS 3D-Guided Neural Rendering 和细粒度控制,帮助游戏开发者在保留艺术意图的同时加入更逼真的光照与材质细节。官方同时介绍了 NVIDIA ACE 的更新,以及 RTX Mega Geometry 2.0 和 RTX Kit 在角色 AI、高密度几何与渲染工作流方面的能力变化。

    推荐理由:NVIDIA 官方说明 DLSS 5 的 3D 引导神经渲染与细粒度控制,并同步更新 ACE 与 RTX Kit,可了解游戏渲染与角色 AI 的新工具链。

9月21日周一
  1. NVIDIA Newsroom40

    NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题

    NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、责任人和防护有效的证据,并主张在模型、harness 与运行时构成的智能体栈各层都部署管控。其开源安全运行时 NVIDIA OpenShell 在智能体触及范围之外执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。

9月19日周六
9月17日周四
  1. NVIDIA Developer Blog42

    NVIDIA TensorRT Edge-LLM 在 Jetson AGX Thor 上以 6.4 倍速度完成 MLPerf Edge Agentic Benchmark

    NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该方案面向从云端数据中心迁移到车辆、机器人等边缘设备的 AI 智能体,针对其多步骤工具调用、结果评估与长对话推理带来的边缘推理新需求,实现快速 token 生成。

  2. NVIDIA Developer Blog22

    NVIDIA 用智能体 AI 将 CUDA Tile 操作从 Python 翻译到 Rust

    NVIDIA 借助智能体 AI 把 CUDA Tile 操作从 Python 翻译为 Rust,用于 cuTile Rust(cutile-rs)这一基于 tile 的 GPU kernel 编写系统。该系统将 Rust 所有权模型扩展到 tile 级 GPU kernel,把可变输出拆分为互不重叠的分片,并在 kernel 启动间保持主机侧所有权契约,同时允许程序员在需要底层控制时局部退出。

9月16日周三
  1. NVIDIA Newsroom67

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍

    NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

    推荐理由:MLPerf v6.1 首次提交数据给出 Vera Rubin NVL72 相对 GB300 的吞吐提升与 99% 扩展效率,可据此判断推理基础设施的性价比走向。

  2. NVIDIA Newsroom58

    Emerald AI、Google 与 NVIDIA 发起 AI 能源管理联盟 AEMA

    Emerald AI、Google 和 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),推动数据中心根据电网状况动态调节用电。该联盟采用技术中立、基于性能的要求,聚焦响应速度、持续时长、可预测性和紧急情况下的行为,并计划统一技术标准与运营数据共享。AEMA 汇集 AI 平台、基础设施提供商、数据中心运营商、电力生产商、公用事业和区域电网运营商,目标是加快美国 AI 基础设施并网。