跳到正文
8月27日周四
  1. NVIDIA Developer Blog62

    NVIDIA NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施

    NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。

    推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。

8月26日周三
8月25日周二
  1. Mistral AI42

    Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发和 AI 解决方案部署,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。

8月24日周一
  1. NVIDIA Developer Blog62

    NVIDIA Groq 3 LPX 如何在 Vera Rubin 上实现长上下文超快交互

    NVIDIA 介绍 Groq 3 LPX,这是面向 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器。平台核心是 NVIDIA Vera Rubin NVL72,覆盖从小模型到大模型、开源与闭源在内的广泛 AI 工作负载,兼顾高吞吐与交互性;Groq 3 LPX 与 Vera Rubin NVL72 搭配可扩展该平台的能力。

    推荐理由:原文说明 Groq 3 LPX 与 Vera Rubin NVL72 的搭配方式,读者可了解长上下文交互推理的硬件组合思路。

  2. NVIDIA Developer Blog42

    NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施

    NVIDIA BlueField-4 面向智能体 AI 工厂提供新型 Scale-In 网络基础设施,用于支撑每服务器多太比特带宽下的线速网络、存储与安全处理。传统云基础设施面向可预测的通用工作负载和标准接口设计,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算,因此专用 DPU 处理成为必需。

8月22日周六
8月19日周三
  1. Samsung Newsroom38

    三星电子将在韩国建设 FläktGroup HVAC 生产线

    三星电子宣布投资约 2400 亿韩元(1.58 亿美元),在韩国光州建设 21500 平方米的 FläktGroup HVAC 生产线,计划 2028 年完工投产,生产面向 AI 数据中心的高级冷却解决方案等产品。该产线将成为 FläktGroup 全球第 15 个制造基地,配合其印度 Pune 新工厂,助力三星全面拓展韩国 HVAC 市场。

8月18日周二
7月30日周四
6月13日周六
  1. Google Research36

    用退役 Pixel 手机搭建低碳计算平台:加州大学圣地亚哥分校将部署 2000 台手机集群

    加州大学圣地亚哥分校在 Google 支持下,将用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名研究人员和学生提供低成本、低碳的云计算。手机主板约占整机隐含碳的 50%,SPEC 基准显示 25-50 台手机算力相当于一台现代服务器,20 台手机集群已能支撑 75 人以上课程的评分负载且延迟低于 AWS 默认后端。该系统预计 2026 年秋季上线。

5月28日周四
5月27日周三
  1. Mistral AI62

    Mistral 推出物理 AI,将 Emmi AI 并入企业平台

    Mistral 宣布将 Emmi AI 并入公司,推出面向工业工程的物理 AI 能力,作为其企业平台的一部分。该能力从几何与边界条件直接预测物理场,单次前向推理在单张 GPU 上以秒级完成,用于加速产品设计、工装工艺设计和实时数字孪生,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。

    推荐理由:Mistral 把物理仿真模型并入企业平台,读者可了解其能力边界与工业落地场景。

5月6日周三
  1. Google DeepMind75

    DeepMind 详解 AlphaEvolve 一年成果:从基因组到 TPU 设计

    Google DeepMind 发布 AlphaEvolve 一年成果汇总,这款由 Gemini 驱动的编码智能体已从试点进入 Google 基础设施核心环节,用于优化下一代 TPU 设计、缓存替换策略与 Spanner 存储。

    推荐理由:DeepMind 汇总 AlphaEvolve 一年落地案例,涵盖基因组、电网、量子与 TPU 设计,可了解编码智能体在科研与基础设施中的实际作用。

4月22日周三
  1. Google DeepMind62

    Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构

    Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构,将训练拆分为异步通信的计算孤岛,降低带宽需求并隔离硬件故障。测试中该系统在整块 learner unit 掉线后仍能继续训练并重新接入,用 Gemma 4 模型达到与传统训练相当的基准性能。

    推荐理由:原文给出跨数据中心异步训练在带宽、容错与混合硬件上的实测结果,可据此判断分布式预训练的工程取舍。

6月11日周三
  1. Mistral AI67

    Mistral AI 推出 Mistral Compute AI 基础设施服务

    Mistral AI 发布 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成栈,涵盖 GPU、编排、API 与产品服务。该服务将提供 NVIDIA 参考架构,可用 GPU 达数万块,并计划在未来数年快速扩张。Mistral 称其面向希望摆脱美国或中国云厂商依赖的欧洲、中东、亚洲及南半球国家与企业,强调数据主权与脱碳能源。

    推荐理由:Mistral 从模型厂商延伸到自有 AI 基础设施,读者可据此判断欧洲主权算力供给的另一种路径。