JERA 联合戴尔等将在千叶建设日本最大 AI 数据中心
日本电力公司 JERA 与戴尔、主权 AI 基础设施开发商 RHAELM 签署谅解备忘录,将共同制定日本 AI 基础设施建设标准化框架。首个数据中心落地千叶县,设计容量 400MW,总投资预计超过 150 亿美元,Apollo 提供投融资支持。
日本电力公司 JERA 与戴尔、主权 AI 基础设施开发商 RHAELM 签署谅解备忘录,将共同制定日本 AI 基础设施建设标准化框架。首个数据中心落地千叶县,设计容量 400MW,总投资预计超过 150 亿美元,Apollo 提供投融资支持。
Kevin O'Leary 在 Fox Business 宣称其位于犹他州 Box Elder County 的 Wonder Valley 数据中心遭中国特工攻击,并将批评者指为受中国资助,Fox News 随后道歉,O'Leary 与 Fox 被 Alliance for a Better Utah 等四方以诽谤起诉,两人于 9 月底申请驳回。
AMD 公布 EPYC 9006(代号 Venice)全系规格与定价,覆盖 8 到 256 核,价格从 700 美元到 14904 美元。旗舰 256 核 EPYC 9996 售价 14904 美元,每核约 58.21 美元,而 64 核 EPYC 9556 每核约 125.12 美元。
Synopsys 与 Amazon 宣布达成一项多年期战略协议,Amazon 成为 Synopsys 应用优化硅 IP 业务的首个客户,双方将在此基础上扩展合作。
AMD 同意以约 82 亿美元全股票收购 AI 模型研究公司 World Labs,联合创始人李飞飞将出任 AMD 执行副总裁兼首席科学家,向 CEO 苏姿丰汇报,交易需通过常规监管审批。
推荐理由:这笔全股票交易把世界模型团队并入芯片厂商,读者可了解 AMD 在模型与算力协同上的布局逻辑。
Linux 内核 7.4 将合入名为 PerfOpt 的补丁,允许 AMD 集成 GPU 绕过 IOMMU 直接访问系统内存,从而降低系统开销。据 Phoronix 测试,AMD Strix Halo APU 上的本地 LLM 性能最高可提升 18-23%。该补丁对 Valve Steam Deck 等低功耗 AMD 掌机尤为重要,CachyOS 等发行版可能更早获得支持。
美光公布截至 2026 年 9 月 3 日的 2026 财年第四季度及全年业绩,第四季度营收 54.23 亿美元,全年营收 133.19 亿美元,均创纪录。CEO Sanjay Mehrotra 表示 AI 正走向 Super Intelligence,内存提升客户平台竞争力,公司预计 2027 财年表现更强。
TrendForce 最新存储产业研究显示,4Q26 常规 DRAM 合约价预计环比上涨 10-15%,NAND Flash 整体合约价预计环比上涨 15-20%,AI 服务器需求是主要支撑。
《大空头》原型迈克尔·伯里称,为了人类的利益,市场应该狠狠跌一场,阻止 OpenAI 和 Anthropic 上市,因为两家公司会吸走数万亿美元资金并最终将其毁掉。伯里本周在 Substack 发文称,他比以往任何时候都更确信自己的 AI 看空判断会在未来一年兑现,此前预计的时间点是 2028 年,并已调整针对英伟达、Palantir、美光科技、甲骨文和纳斯达克 100 指数的看空押注。
美光科技 CEO 梅赫罗特拉在财报电话会上表示,公司已签署 26 项长协,锁定约 1500 亿美元长期订单,并称 2027 和 2028 年存储市场供需将比 2026 年更为紧缺。
受全球 AI 需求拉动半导体出口推动,韩国 9 月出口总额达 1,209 亿美元,创历史新高,剔除工作日差异后同比增幅 104.9%。其中芯片出口同比猛增 263% 至 603 亿美元,计算机产品出口飙升 435%,汽车出口下滑 5%。韩国央行已将 2026 年经济增速预期由 2.6% 上调至 3.3%,摩根大通预计基准利率最终将升至 3.75%。
据《金融时报》报道,腾讯已与甲骨文签署其最大海外租赁协议,在东南亚多个甲骨文数据中心获取约 10 万块先进 AI 芯片,交易估值约 70 亿美元,首付约 30%,腾讯和甲骨文均未回应置评请求。
AMD 与 World Labs 宣布,AMD 将在年底前收购这家世界模型公司,交易估值 82 亿美元,尚待监管批准。World Labs 由计算机视觉科学家李飞飞与 Justin Johnson、Christoph Lassner、Ben Mildenhall 于 2024 年创办,最初融资 2.3 亿美元,其中部分来自 AMD。
Cerebras Systems CEO 兼联合创始人 Andrew Feldman 将在 TechCrunch Disrupt 2026 的 Disrupt Stage 发表“Can AI Keep Scaling?
谷歌俄亥俄州和印第安纳州数据中心运营区域负责人蒂姆·查德威克称,全美有数十万个技术工种岗位空缺,高级电工、管道安装领班、项目经理需求增长快。仲量联行援引美国教育部估算,到2030年美国约210万个技术工种岗位可能招不到人;麦肯锡预计到2030年全球数据中心需投入6.7万亿美元。
车企在 AI 定义汽车(AIDV)的算力架构上押注不同路线,部分倾向大型中央处理器,部分选择分布式专用算力。Rambus 的 Paul Karazuba 称,软件定义汽车靠 OTA 更新演进,AI 定义汽车则用 AI 实时解读数据、决策并调整行为。传感器原始数据搬运正变得与处理同等重要,对内存、接口、车载网络和能效提出新要求,且需在长服务周期内验证传感器输入、AI 决策与更新。
面向数据中心设备的开源硅信任根架构 Caliptra 正获得多家云与半导体公司支持,云和数据中心运营商开始要求芯片供应商提供符合 Caliptra 商标要求的实现,供应商须通过对照集成清单的一致性评估。选定该架构只是起点,商业部署还需解决跨 SoC 信任扩展、密钥服务接口、安全启动协同、认证目标与生命周期管理等工程问题,信任根也正从孤立安全锚点演变为平台级安全编排者。
谷歌发布迄今最先进的 AI 模型 Gemini 4 Argon,重点面向长流程软件工程、企业知识工作和网络安全防御,单次输出上限约 100 万 tokens,高于此前的 64,000 tokens,目前未全面开放。
Galileo Space 正在研制在轨融合 AI 的卫星,可在轨自主运行数周并自主选择感知任务,将威胁识别与信号定位结果在数分钟内而非数小时或数天交付给操作员。其首颗演示卫星计划于 2027 年 Q4 发射,公司正处在敲定首份政府合同的最后阶段,并已入选 a16z speedrun(3 万申请者中选 80 家)。
NVIDIA 发布 cuObject 和 SCADA Server SDK,用于扩展 AI 工作负载对高容量文件与对象存储的快速安全访问。AI 训练、微调、推理上下文、工具调用、搜索和数据库查询等场景对高速数据访问需求日益增长,而这些数据大量存于本地和云端的文件与对象中。
Geekbench 7 曝光 OpenAI dots 的硬件配置:单核 1,667、多核 9,435,运行在九核 AMD EPYC 9V74 切片、9.73GB 内存的虚拟机上。
Meta 通过把 AI 数据中心归类为“pilot models”、把 Nvidia 芯片列为实验材料,利用一项联邦研究税收抵免在 2025 年节省 39 亿美元,高于前一年的 20 亿美元和 2023 年的 7 亿美元,成为该抵免额度最大的上市公司受益者。
CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,成为较早交付该平台的云厂商之一,Cognition 是首个在 Vera Rubin 上跑生产负载的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码负载的算力走向。
AI 算力需求推动先进封装走向尺寸更大与互连间距更小,KLA、ASM、ASMPT 与新加坡国立大学专家在 A*STAR Innovate Together 2026 上指出,混合键合、HBM 集成与光互连正把材料、键合、量测与检测整合为系统级难题。
Astera Labs 推出 Leo X-Series fabric-attached 内存控制器及新一代 Leo 2 E-Series、P-Series,针对 LLM 向多轮智能体系统演进时的内存性能优化。
新加坡半导体工业协会执行董事 Ang Wee Seng 在 EE Power Asia 2026 上表示,AI 已把计算从数字挑战变成物理基础设施竞赛,瓶颈不再是芯片设计,而是能否供电、连接、散热和快速部署。
AMD 宣布以约 82 亿美元全股票交易收购李飞飞创办的 World Labs,预计 2026 年底前完成交割,仍需监管审批;交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报。
推荐理由:把 AMD 收购 World Labs 与英伟达收购 Hugging Face 放在同一时间线上比较,读者可看清两家芯片公司对下一代算力需求的不同下注方式。
Anthropic 对齐科学负责人 Evan Hubinger 9 月 9 日公开确认,他个人认为 AI 在未来十年内有超过 10% 的概率导致人类灭绝。文章指出,这一风险最不抽象的场景是已嵌入核预警卫星、导弹追踪星座和指挥控制架构的 AI 系统,其边缘计算与数据融合架构可能被未来自我改进系统继承。
HPE 提出,当 AI 从试验走向生产、需求变得稳定且关键业务化时,按 token 逐次消费的模式会让支出难以预测,企业需评估自持容量的经济性。Deloitte 2026 企业 AI 状态报告显示,2025 年员工 AI 使用率上升 5%,至少 40% 的 AI 项目进入生产的公司占比预计六个月内翻倍。
新书《The AGI Chronicles》披露,Anthropic CEO Dario Amodei 与英伟达 CEO 黄仁勋 2022 年 5 月在旧金山 Eight Tables 首次会面讨论算力需求时不欢而散。
中国工信部正考虑放宽限制,要求阿里巴巴和字节跳动提交购买英伟达 RTX Pro 5500 芯片的计划,字节跳动计划下单 100 万颗。报道称黄仁勋已成为特朗普在科技议题上最具影响力的顾问,特朗普政府此前解除了 H200 芯片对华出口管制,而黄仁勋主张前沿模型蒸馏属于竞争而非窃取。有专家担忧英伟达的盈利动机正在影响美国 AI 风险监管立场,中美在最近峰会上均未就 AI 安全放缓作出任何表态。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并直接服务企业客户。该中心将与 BMW 合作碰撞仿真与工程 AI、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。Mistral 计划到 2030 年建成 1 吉瓦欧洲算力,其开放权重模型可在客户自有基础设施上运行。
OpenAI 硬件负责人 Richard Ho 表示,自研推理 ASIC Jalapeño 目前面向 OpenAI 内部算力需求,公司内部需求增长很快,短期内会优先满足自身,但芯片本身并非只能用于 OpenAI 模型。
OpenAI 硬件副总裁 Richard Ho 在采访中详解了 Jalapeño 推理 ASIC 的设计过程,该芯片在 Hot Chips 2026 上发布,从零开始到流片约九个月,主要借助 Codex 等 AI 模型辅助设计。
教会团体要求微软拿出数据中心成本的 1% 回馈所在社区,微软未作回应。微软今年一直以"好邻居"自居,承诺缴纳支持医院、学校和公园的地方房产税,但其社区联络人常无法回答具体投资金额的问题。微软承认仅匹配员工慈善捐款并不够——2024 年该项捐款为 2.29 亿美元、覆盖 2.9 万家非营利组织,而数据中心开发商在 38 个州获得的州级税收减免估计达数亿美元、往往持续十年以上。
NVIDIA 董事会批准将股票回购计划授权额度增加 1500 亿美元,使剩余总授权规模升至 2350 亿美元,为公司史上最大规模的回购授权上调。公司预计在 2028 财年前执行完剩余回购计划。CEO 黄仁勋称,AI 与加速计算带来的平台级转变推动公司增长,现金流足以支撑技术投入与股东回报。
S3 存储价格已整整十年未降,自 2016-12-01 起一直维持 $0.023/GB-month。此前它曾频繁降价:2006-03-14 为 $0.150/GB-month,历经 2010 年 $0.140、2012 年 $0.125 与 $0.095、2014 年 $0.085 与 $0.030,最终在 2016 年降至当前价位。
NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统工程实验室负责产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统层面被识别时,全球首次实现 Rubin GPU 系统级枚举,团队当场欢呼庆祝。她将验证工作比作破案,目标是在客户发现问题之前先找出问题,单块板卡可能含数万个元件,一个机架接近 50 万个。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 在埃及大埃及博物馆举办活动,展示当地 AI 生态从能力建设走向生产规模,其 Deep Learning Institute 埃及学员基数一年增长超十倍。