跳到正文
8月28日周五
  1. Google DeepMind76

    Google DeepMind 发布 Gemini Omni 1.1 Flash

    Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向开发者的生成视频能力。

    推荐理由:原文列出场景延长、首尾帧插值与 4K 放大等具体能力及 API 入口,可据此判断生成视频工作流的可控性变化。

8月27日周四
  1. Google DeepMind58

    Google DeepMind 试点全球首个双盲 AI 评测

    Google DeepMind 宣布推出全球首个针对专有前沿级 AI 模型的双盲评测,将外部评测限制在密码学隔离环境中,避免模型提前接触测试题目。该试点与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下用保密基准测试 Gemini Flash Lite,以提升评测可信度。

  2. NVIDIA Developer Blog62

    NVIDIA NVLink Fusion 将 NVHBM 引入下一代 AI 基础设施

    NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。

    推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。

  3. Google Research32

    Google 发布 GlucoFM:面向连续血糖监测的双流基础模型

    Google 推出自监督基础模型 GlucoFM,采用双流设计分离血糖的慢速基线趋势与短期波动,并保留时间与缺失信息。模型在 109,066 小时无标注 CGM 数据上预训练,覆盖 477 条受试者/会话记录,在 4 个队列、7 项临床任务共 14 组评估中平均 PR-AUC 较最佳 GluFormer 变体高 5.8 个百分点,并在 Dexcom 与 Libre 两款设备上取得最低 MAE。

  4. NVIDIA Developer Blog62

    阿里发布 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构

    阿里发布 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构预览,供开发者实验和评估。该模型是多模态 MoE 模型,主模型 125B 参数,另有 51B N-gram 嵌入向量,每 token 激活 6B 参数,原生上下文窗口 262,144 token,可扩展至 1M token。NVIDIA 开发者博客介绍了在 GB300 NVL72 上针对智能体编码的实验。

    推荐理由:阿里开放 Qwen3.8-Flash-Next 权重供开发者试用,可据此了解 Qwen4 架构预览版的 MoE 规格与长上下文能力。

8月26日周三
  1. Google Research22

    Google 发布 AgentHands:为 XR 智能体对话生成同步手势

    Google 在 CHI 2026 发布研究原型 AgentHands,可将 LLM 的高层推理映射为 XR 中与语音同步的手势,让智能体在用户真实环境中指点、演示动作。系统通过眼动与场景重建注册物体并生成 3D 边界框,手势库覆盖指示、象形和表达三类语义。在 N=12 的对照研究中,AgentHands 相比纯语音基线在空间定位等指标上取得显著提升。

8月25日周二
  1. NVIDIA Developer Blog62

    NVIDIA 发布 CUDA Python 1.0,提供稳定 API 与全平台访问

    NVIDIA 发布 CUDA Python 1.0,主打稳定 API、统一基础和全平台访问。文章回顾了 Python 开发者使用 GPU 的两条路径,一是自己用 CUDA C++ 写扩展并维护绑定,二是依赖 PyTorch、CuPy、RAPIDS 等上层库,后者虽让 Python GPU 生态繁荣但存在局限。

    推荐理由:CUDA Python 1.0 把稳定 API 与全平台访问作为目标,读者可据此判断 Python 开发者接入 GPU 的路径变化。

  2. Mistral AI42

    Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发和 AI 解决方案部署,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。

8月24日周一
  1. NVIDIA Developer Blog62

    NVIDIA Groq 3 LPX 如何在 Vera Rubin 上实现长上下文超快交互

    NVIDIA 介绍 Groq 3 LPX,这是面向 NVIDIA Vera Rubin 平台的交互式 AI 推理加速器。平台核心是 NVIDIA Vera Rubin NVL72,覆盖从小模型到大模型、开源与闭源在内的广泛 AI 工作负载,兼顾高吞吐与交互性;Groq 3 LPX 与 Vera Rubin NVL72 搭配可扩展该平台的能力。

    推荐理由:原文说明 Groq 3 LPX 与 Vera Rubin NVL72 的搭配方式,读者可了解长上下文交互推理的硬件组合思路。

  2. NVIDIA Developer Blog42

    NVIDIA BlueField-4 为智能体 AI 工厂提供新型 Scale-In 网络基础设施

    NVIDIA BlueField-4 面向智能体 AI 工厂提供新型 Scale-In 网络基础设施,用于支撑每服务器多太比特带宽下的线速网络、存储与安全处理。传统云基础设施面向可预测的通用工作负载和标准接口设计,而智能体 AI 工厂需连接多样用户、智能体、应用、数据源与存储系统至大规模加速计算,因此专用 DPU 处理成为必需。

  3. Samsung Newsroom15

    三星 Galaxy Buds4 Pro 获 EISA 2026-2027 入耳式耳机奖

    三星 Galaxy Buds4 Pro 获得 EISA 2026-2027 入耳式耳机奖,这是 Galaxy Buds 系列首次拿下该奖项。EISA 评价其双路扬声器配独立功放带来干净的音乐细节,Sensor Fusion 技术结合 VPU 与 DNN 降噪保证通话清晰。该耳机采用加宽低音单元,有效发声面积较上代增加近 20%,支持 24-bit/96 kHz UHQ 音频与自适应 ANC。

8月22日周六
  1. Google Research40

    Google 推出 Biomarker Discovery Framework:从可穿戴传感器数据中筛选候选生物标志物

    Google 发布 Biomarker Discovery Framework,一个在人类监督下把候选生物标志物筛选组织为迭代研究循环的多智能体系统,结合假设生成、并行统计分析、模型训练、对抗验证与文献推理。该系统在三个队列共 9,279 条参与者观测中自主识别出 41 个心理健康候选数字生物标志物和 25 个代谢类候选标志物,例如睡眠时长变异性与 PHQ-8 严重度的关联(ρ = 0.252)。

8月21日周五
  1. NVIDIA Developer Blog62

    NVIDIA AVO 在 ARC-AGI-3 上达到 100%

    NVIDIA 宣布其 AVO 在 ARC-AGI-3 上达到 100%,称其展示了面向长时程自主智能体的前沿级通用架构。文章指出前沿语言模型只是 AI 智能体的一部分,外围的 harness 决定模型如何接收上下文、使用工具、维持状态、响应反馈、从失败中恢复并在长任务中保持进展。

    推荐理由:NVIDIA 公布 AVO 在 ARC-AGI-3 上的成绩,读者可了解其面向长时程自主智能体的架构思路。