跳到正文
今天10月1日周四
  1. TechPowerUp60

    台积电据报评估在得州建厂,规模或超 265 亿美元亚利桑那计划

    据台湾《经济日报》报道,台积电计划在得州建设第二个美国制造基地,项目包含六座先进晶圆厂,最可能落地达拉斯,总投资或超过亚利桑那的 265 亿美元。路透社随后援引两名知情人士称,台积电确在评估得州投资,但计划尚未敲定,且将叠加在亚利桑那承诺之上。

9月30日周三
  1. NVIDIA Blog62

    CoreWeave 上线 NVIDIA Vera Rubin NVL72,Cognition 成首个生产客户

    CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,成为较早交付该平台的云厂商之一,Cognition 是首个在 Vera Rubin 上跑生产负载的客户。

    推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码负载的算力走向。

  2. The Decoder78

    DeepSeek 联合华为为昇腾芯片发布开源编程工具

    DeepSeek 与华为合作为昇腾芯片打造编程工具并全部开源,核心是比 CUDA 更易上手的 TileLang 语言,该语言最初由北京大学研究人员开发,DeepSeek 已使用约一年。双方还优化了由 128 颗昇腾 950 芯片组成的超级节点,华为称对该工作提供了全面支持。DeepSeek 认为,为 AI 芯片建立独立软件生态首先需要一门易编程又能发挥硬件全部性能的通用语言。

    推荐理由:DeepSeek 与华为在昇腾芯片上开源编程工具,读者可了解国产芯片软件生态补短板的路径与进展。

9月29日周二
9月28日周一
9月26日周六
9月24日周四
9月23日周三
9月22日周二
9月17日周四
  1. NVIDIA Developer Blog42

    NVIDIA TensorRT Edge-LLM 在 Jetson AGX Thor 上以 6.4 倍速度完成 MLPerf Edge Agentic Benchmark

    NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该方案面向从云端数据中心迁移到车辆、机器人等边缘设备的 AI 智能体,针对其多步骤工具调用、结果评估与长对话推理带来的边缘推理新需求,实现快速 token 生成。

9月16日周三
  1. NVIDIA Newsroom67

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍

    NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

    推荐理由:MLPerf v6.1 首次提交数据给出 Vera Rubin NVL72 相对 GB300 的吞吐提升与 99% 扩展效率,可据此判断推理基础设施的性价比走向。

9月11日周五
9月10日周四
9月8日周二
8月27日周四
  1. NVIDIA Developer Blog62

    NVIDIA NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施

    NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。

    推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。

8月26日周三
8月24日周一
  1. NVIDIA Developer Blog62

    NVIDIA Groq 3 LPX 如何在 Vera Rubin 上实现长上下文超快交互

    NVIDIA 介绍 Groq 3 LPX,这是面向 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器。平台核心是 NVIDIA Vera Rubin NVL72,覆盖从小模型到大模型、开源与闭源在内的广泛 AI 工作负载,兼顾高吞吐与交互性;Groq 3 LPX 与 Vera Rubin NVL72 搭配可扩展该平台的能力。

    推荐理由:原文说明 Groq 3 LPX 与 Vera Rubin NVL72 的搭配方式,读者可了解长上下文交互推理的硬件组合思路。

  2. NVIDIA Developer Blog42

    NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施

    NVIDIA BlueField-4 面向智能体 AI 工厂提供新型 Scale-In 网络基础设施,用于支撑每服务器多太比特带宽下的线速网络、存储与安全处理。传统云基础设施面向可预测的通用工作负载和标准接口设计,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算,因此专用 DPU 处理成为必需。