跳到正文
今天10月1日周四
9月30日周三
  1. NVIDIA Blog62

    CoreWeave 上线 NVIDIA Vera Rubin NVL72,Cognition 成首个生产客户

    CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,成为较早交付该平台的云厂商之一,Cognition 是首个在 Vera Rubin 上跑生产负载的客户。

    推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码负载的算力走向。

9月29日周二
  1. Samsung Newsroom62

    三星六家关联公司联合向 AI 基础设施公司 Helix 投资 10 亿美元

    三星电子、三星物产、三星 SDS、三星 SDI、三星生命和三星火灾海上保险宣布联合向 AI 基础设施公司 Helix Digital Infrastructure 投资 10 亿美元。

    推荐理由:三星六家关联公司联合投资 Helix,读者可借此了解 AI 数据中心竞争正从算力延伸到电力与基础设施。

9月28日周一
  1. NVIDIA Newsroom40

    NVIDIA 宣布将股票回购授权增加 1500 亿美元

    NVIDIA 董事会批准将股票回购计划授权额度增加 1500 亿美元,使剩余总授权规模升至 2350 亿美元,为公司史上最大规模的回购授权上调。公司预计在 2028 财年前执行完剩余回购计划。CEO 黄仁勋称,AI 与加速计算带来的平台级转变推动公司增长,现金流足以支撑技术投入与股东回报。

  2. Samsung Newsroom22

    三星、SK Telecom 与韩亚金融集团在韩国金融业建成首个私有 5G 智能办公网络

    三星电子作为唯一供应商,联合 SK Telecom 为韩亚金融集团仁川新总部部署私有 5G 网络,建成韩国金融业首个智能办公项目,覆盖总部 16 层、多个集团子公司及数千名员工。方案采用 4.7GHz 中频段、5G Standalone Core 与网络切片,各子公司可使用独立切片,并配备加密、防火墙、DDoS 防护和 USIM 认证等多层安全机制。

9月26日周六
9月24日周四
  1. NVIDIA Developer Blog18

    NVIDIA 推出 NodeWright,管理 Kubernetes 节点集群

    NVIDIA 发布 NodeWright,用于管理 Kubernetes 节点本身,覆盖内核设置、系统软件包、存储布局、安全代理以及 GPU 工作负载依赖的主机级调优。该工具针对团队目前依赖 Ansible playbook、自定义脚本和手动 runbook 的做法,这类方式在新区域新建集群或内核升级破坏 RDMA 时容易失效。

9月23日周三
  1. NVIDIA Blog12

    NVIDIA 验证工程师 Sakeena Fiza 如何让硬件大规模成功落地

    NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统工程实验室负责产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统层面被识别时,全球首次实现 Rubin GPU 系统级枚举,团队当场欢呼庆祝。她将验证工作比作破案,目标是在客户发现问题之前先找出问题,单块板卡可能含数万个元件,一个机架接近 50 万个。

9月22日周二
9月17日周四
  1. NVIDIA Developer Blog42

    NVIDIA TensorRT Edge-LLM 在 Jetson AGX Thor 上以 6.4 倍速度完成 MLPerf Edge Agentic Benchmark

    NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该方案面向从云端数据中心迁移到车辆、机器人等边缘设备的 AI 智能体,针对其多步骤工具调用、结果评估与长对话推理带来的边缘推理新需求,实现快速 token 生成。

  2. NVIDIA Developer Blog22

    NVIDIA 用智能体 AI 将 CUDA Tile 操作从 Python 翻译到 Rust

    NVIDIA 借助智能体 AI 把 CUDA Tile 操作从 Python 翻译为 Rust,用于 cuTile Rust(cutile-rs)这一基于 tile 的 GPU kernel 编写系统。该系统将 Rust 所有权模型扩展到 tile 级 GPU kernel,把可变输出拆分为互不重叠的分片,并在 kernel 启动间保持主机侧所有权契约,同时允许程序员在需要底层控制时局部退出。

9月16日周三
9月11日周五
9月10日周四
9月9日周三
9月8日周二
  1. Samsung Newsroom62

    三星与 ASML 扩大 High NA EUV 合作,推进 12 英寸光罩与 DRAM 制造

    三星电子与 ASML 宣布扩大长期战略合作,深化 High NA EUV 光刻与先进半导体制造技术协作。三星将加入推动下一代 12 英寸光罩技术的行业计划,取代沿用数十年的 6 英寸光罩格式,以提升晶圆厂产能、降低芯片制造成本并消除拼接限制。三星还计划在 2028 年前首次将 ASML 的 High NA EUV 引入 DRAM 大规模量产。

    推荐理由:三星与 ASML 扩大 High NA EUV 合作并推动 12 英寸光罩,可了解先进制程与 DRAM 制造路线的下一步。

  2. Mistral AI71

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。这是欧洲科技公司完成的最大规模股权融资,资金将用于扩展前沿研究、算力容量、基础设施和商业增长。Mistral 目前业务覆盖 20 个国家,服务 125 家以上全球企业,包括 Airbus、ASML 和 HSBC。

    推荐理由:Mistral 完成欧洲科技公司最大股权融资,读者可了解其主权 AI 全栈定位与投资方阵容。

9月3日周四
9月1日周二
8月27日周四
  1. NVIDIA Developer Blog62

    NVIDIA NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施

    NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。

    推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。

8月26日周三
8月25日周二
8月24日周一
  1. NVIDIA Developer Blog62

    NVIDIA Groq 3 LPX 如何在 Vera Rubin 上实现长上下文超快交互

    NVIDIA 介绍 Groq 3 LPX,这是面向 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器。平台核心是 NVIDIA Vera Rubin NVL72,覆盖从小模型到大模型、开源与闭源在内的广泛 AI 工作负载,兼顾高吞吐与交互性;Groq 3 LPX 与 Vera Rubin NVL72 搭配可扩展该平台的能力。

    推荐理由:原文说明 Groq 3 LPX 与 Vera Rubin NVL72 的搭配方式,读者可了解长上下文交互推理的硬件组合思路。

  2. NVIDIA Developer Blog42

    NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施

    NVIDIA BlueField-4 面向智能体 AI 工厂提供新型 Scale-In 网络基础设施,用于支撑每服务器多太比特带宽下的线速网络、存储与安全处理。传统云基础设施面向可预测的通用工作负载和标准接口设计,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算,因此专用 DPU 处理成为必需。