跳到正文
9月16日周三
9月15日周二
9月11日周五
9月10日周四
9月8日周二
  1. Mistral AI71

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。这是欧洲科技公司完成的最大规模股权融资,资金将用于扩展前沿研究、算力容量、基础设施和商业增长。Mistral 目前业务覆盖 20 个国家,服务 125 家以上全球企业,包括 Airbus、ASML 和 HSBC。

    推荐理由:Mistral 完成欧洲科技公司最大股权融资,读者可了解其主权 AI 全栈定位与投资方阵容。

9月5日周六
  1. NVIDIA Developer Blog22

    用 NVIDIA NemoClaw 构建记忆驱动的 AI 智能体

    NVIDIA 团队用 NemoClaw 构建了一个记忆驱动的"幕僚长"智能体,通过名为 self model 的人类可读知识层保存企业工作中的消息、决策、项目和待办事项等随时间变化的上下文。该智能体无需在每次启动时重建上下文,即可直接基于已有记忆参与工作。

9月4日周五
9月3日周四
9月2日周三
9月1日周二
  1. NVIDIA Developer Blog22

    在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测

    NVIDIA BioNeMo NIM 微服务现可在 Claude Science 中运行,用于蛋白质结构预测。该集成面向智能体式 AI 科研流程,让 AI 科学家能够读取论文、提出假设、调用模型并确定后续实验优先级。BioNeMo NIM 此前已在软件工程领域验证价值,如今扩展至更需迭代的科学研究场景。

8月29日周六
8月27日周四
  1. NVIDIA Developer Blog62

    NVIDIA NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施

    NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。

    推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。

  2. NVIDIA Developer Blog62

    阿里发布 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构

    阿里发布 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构预览,供开发者实验和评估。该模型是多模态 MoE 模型,主模型 125B 参数,另有 51B N-gram 嵌入向量,每 token 激活 6B 参数,原生上下文窗口 262,144 token,可扩展至 1M token。NVIDIA 开发者博客介绍了在 GB300 NVL72 上针对智能体编码的实验。

    推荐理由:阿里开放 Qwen3.8-Flash-Next 权重供开发者试用,可据此了解 Qwen4 架构预览版的 MoE 规格与长上下文能力。

8月26日周三
8月25日周二
  1. NVIDIA Developer Blog62

    NVIDIA 发布 CUDA Python 1.0,提供稳定 API 与全平台访问

    NVIDIA 发布 CUDA Python 1.0,主打稳定 API、统一基础和全平台访问。文章回顾了 Python 开发者使用 GPU 的两条路径,一是自己用 CUDA C++ 写扩展并维护绑定,二是依赖 PyTorch、CuPy、RAPIDS 等上层库,后者虽让 Python GPU 生态繁荣但存在局限。

    推荐理由:CUDA Python 1.0 把稳定 API 与全平台访问作为目标,读者可据此判断 Python 开发者接入 GPU 的路径变化。

8月24日周一
  1. NVIDIA Developer Blog62

    NVIDIA Groq 3 LPX 如何在 Vera Rubin 上实现长上下文超快交互

    NVIDIA 介绍 Groq 3 LPX,这是面向 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器。平台核心是 NVIDIA Vera Rubin NVL72,覆盖从小模型到大模型、开源与闭源在内的广泛 AI 工作负载,兼顾高吞吐与交互性;Groq 3 LPX 与 Vera Rubin NVL72 搭配可扩展该平台的能力。

    推荐理由:原文说明 Groq 3 LPX 与 Vera Rubin NVL72 的搭配方式,读者可了解长上下文交互推理的硬件组合思路。

  2. NVIDIA Developer Blog42

    NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施

    NVIDIA BlueField-4 面向智能体 AI 工厂提供新型 Scale-In 网络基础设施,用于支撑每服务器多太比特带宽下的线速网络、存储与安全处理。传统云基础设施面向可预测的通用工作负载和标准接口设计,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算,因此专用 DPU 处理成为必需。

8月22日周六
8月21日周五
  1. NVIDIA Developer Blog62

    NVIDIA AVO 在 ARC-AGI-3 上达到 100%

    NVIDIA 宣布其 AVO 在 ARC-AGI-3 上达到 100%,称其展示了面向长时程自主智能体的前沿级通用架构。文章指出前沿语言模型只是 AI 智能体的一部分,外围的 harness 决定模型如何接收上下文、使用工具、维持状态、响应反馈、从失败中恢复并在长任务中保持进展。

    推荐理由:NVIDIA 公布 AVO 在 ARC-AGI-3 上的成绩,读者可了解其面向长时程自主智能体的架构思路。

8月11日周二
8月4日周二
  1. Mistral AI62

    Mistral AI 发布 3B 开源多模态安全分类器 Shieldstral

    Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载。它把内容审核建模为推理时的二元问答任务,用户用自然语言写出策略,模型输出校准后的安全分数,无需重新训练即可适配新策略,文本安全表现可匹配最高 7 倍参数量的开放 guard 模型。模型可在单张 16GB NVIDIA GPU 上运行,统一处理文本、图像及文本加图像内容。

    推荐理由:3B 开源权重模型以推理时自然语言策略替代固定危害分类,读者可据此判断内容审核的部署方式变化。

7月27日周一
7月23日周四