NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题
NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、责任人和防护有效的证据,并主张在模型、harness 与运行时构成的智能体栈各层都部署管控。其开源安全运行时 NVIDIA OpenShell 在智能体触及范围之外执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。
NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、责任人和防护有效的证据,并主张在模型、harness 与运行时构成的智能体栈各层都部署管控。其开源安全运行时 NVIDIA OpenShell 在智能体触及范围之外执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。
Rhizomatica 开源了数字短波电台系统 HERMES,配合 Mercury 数字调制解调器在 3-30 MHz 高频段工作,用约 20 瓦小功率电台实现 400-600 公里可靠链路,可传输照片、邮件、语音备忘等任意文件。
RAND 发布报告提出美国应以“自由行动”战略应对通往超级智能的不确定路径,通过保持选项开放来确保地缘政治优势,并归纳了共存、拒止、加速三大类共七种原型策略及五项关键不确定性。研究人员还培育出脑内含有部分人脑组织的小鼠,用于相关实验。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线了新的视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
OpenAI 正与一个独立的数学与人工智能咨询小组合作,为新兴 AI 成果的评审与传播提供指导。该小组为独立性质,具体成员与运作细节未披露。
MIT Technology Review 发布对美国边境 AI 监控塔“虚拟墙”的调查,发现有人未被探测到、随后在附近死亡且尸体数周或数月无人发现,原因包括塔故障、算法未能识别人以及探员未响应警报。
MIT Technology Review 与 Times of San Diego 用 15 个月调查,绘制出首张美国边境监控塔附近移民死亡的综合地图与分析。团队梳理 2015 年以来的案例,向得州 17 个县警长办公室申请记录,共获得超 4000 页文件,其中 3 个县用 Anthropic 的 Claude(经 API)提取遗骸发现地坐标并人工核验。
NVIDIA 在纽约气候周介绍了 5 家用 AI 推进清洁能源的公司:ThinkLabs AI 用数字孪生和智能体把南加州爱迪生评估电网并网申请的时间从 30-45 天缩短到 2 分钟。
OpenAI 提出为下一阶段 AI 建立共享全球标准的路径,呼吁通过协调一致的评估、报告与治理来提升安全性。
OpenAI Academy 新增面向员工、开发者、管理者、教育工作者和学生等多类人群的学习路径,用于培养和展示实用 AI 技能。
Hugging Face 发布 tokenizers v1,输出与 v0.23 完全一致的 token ID,但速度最高提升数十倍。v1 将单个 crate 拆为工作区,引入 bitcannon 用 SIMD 位流替代正则做预分词、无分配合并工作集、线程本地词缓存和原生多线程并行,并保持对 BPE、WordPiece、Unigram 的通用支持。
V7 使用 GPT-5.6 将分散的公司文件转化为智能体可用的上下文,以完成复杂的、可溯源的工作,同时成本降低 78%、准确率提升。
一名入职大公司半个月的工程师称,团队所有规格、代码、测试、PRD 和工单均由 Claude Code 生成,从 L1 到 L7 的工程师都在做同样的事——和 Claude 对话。管理层多次表示推送代码不是瓶颈,员工每天工作 12 到 13 小时只为按回车,没人阅读任何内容,团队无人喜欢这种状态。
Jev 发布两天后,社区已出现至少 6 个复现或近似方案,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev、Qwen3.5-9B LoRA 微调的 Bespoke Nimble、Qwen3.5 骨干的 SemIf、40K byte 嵌入的 Jevlike 和 Qwen2.5-0.5B 的 Kev-0.5B。
NVIDIA 发布 AIPerf,用于大规模 LLM 推理性能基准测试。它针对 curl 命令、手写 asyncio 脚本或一次性负载生成器等传统压测方式的问题,这些方式受限于单进程性能、Python GIL 并发瓶颈,或测量基准不可靠。
Google Research 发布 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中段物流配送问题生成真实且保护隐私的基准数据,源码与文档已在 GitHub 开放。
GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成代码仍需阅读,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是可读的 Markdown 打包经验,后者提供工具与数据的标准接入;RAG 并未消亡,检索能为模型提供训练数据外的文档、内部知识与代码库上下文,减少 token 浪费并降低答案不完整的概率。
Terran Orbital 晋升 Margherita Cardi 为欧洲运营副总裁兼战略项目负责人,她将统管意大利全部本地职能,直接向总裁兼 CEO Peter Krauss 汇报。Cardi 2016 年作为 Tyvak International 第三名员工加入,此前任项目与业务发展副总裁,曾主导 ESA Hera 行星防御任务的 Milani CubeSat 项目。
Google 扩充 AI & Economy 研究项目,邀请 2025 年诺贝尔经济学奖得主 Philippe Aghion 出任学术顾问,Ajay Agrawal 加入访问学者计划。Anu Madgavkar 与 Daniel Rock 出任研究项目总监,前者负责全球 AI 扩散与中小企业生态,后者聚焦企业生产率与劳动力重构。该团队将直接为 ATLAS v1.0 的后续更新和实证研究提供支持。
Google 旗下 Envisioning Studio 与 Google Labs 合作,用 AI 创作工具 Google Flow 为设计师 Jane Wade 和 Sergio Hudson 分别打造 Styling Suite 与 Runway Visualization 两款定制工具,用于纽约时装周。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份围绕六大支柱构建的路线图,目标是让青少年在使用 AI 时获得更安全的体验,同时兼顾保护与赋能。
Anthropic 在 Claude Code 中上线 Projects,让单次对话可派生并行云端会话、在线程间传递上下文,并在用户离开后继续运行,本地工作流后续推出。
9 月 18 日,iPhone 18 Pro、iPhone 18 Pro Max、Apple Watch Series 12、Apple Watch Ultra 4 和 AirPods 5 在全球 Apple Store 门店正式开售。
Google Research 公布一项研究实验,让教师借助生成式 UI(GenUI)按课程目标动态生成可交互的教学模拟,并内置分级挑战、提示与反馈等教学脚手架。
联合国系统发布 UN System Data Commons,一个基于 Google Data Commons 构建的开源平台,把分散的全球统计数据整合为单一可搜索的 AI-ready 知识图谱。
韩国 Satrec Initiative 将与母公司 Hanwha Aerospace 合作,为 7 月公布的 SAR 星座制造并发射 4 颗 10 厘米级光学成像卫星,配合 Hanwha 的 64 颗 SAR 卫星,目标 2031 年实现 30 分钟重访。
Simera Sense 与 IDOM 达成战略合作,为下一代 MultiScape350 甚高分辨率对地观测成像仪开发并生产光学系统,IDOM 主导光学前端(OFE)的研制,Simera Sense 提供传感器子系统、电子学、热管理、标定方案及卫星接口与集成架构。
欧洲空间局(ESA)总干事 Josef Aschbacher 在巴黎 World Space Business Week 会议期间接受 SpaceNews 播客 Space Minds 采访,谈欧洲在太空及其他领域日益增强的主权诉求。他分享了欧洲在太空领域的领先之处、需要追赶的环节,以及对欧洲新一轮太空投资成果的期待。
Pawprint Studio 的 Aniimo 本周首发上线 GeForce NOW,这是一款免费开放世界捉宠 RPG,玩家可用 Aniipods 捕捉生物并 Twine 变身,无需等待 45GB 下载。
Catalyst Campus for Technology and Innovation 与 BMC3I TAP Lab 合作,选出参与 Cohort 26.A Stage 0 的 6 支 Focus Area Cohort Teams(FACTs)。
Icarus Robotics 在加拿大完成四次抛物线飞行测试,为其自由飞行机器人 Joy 累计获取 22 分钟微重力操作数据,验证了飞行控制器、传感器套件与操作能力。该公司计划 2027 年在国际空间站进行 Joy 演示,并于明年 1 月将 Joy 移交 NASA 运送至 ISS。测试选在加拿大进行,原因是美国目前没有运营商提供抛物线飞行服务。
Cooley 基于 ChatGPT Work 打造了 GO Public,把智能能力引入 IPO 流程,帮助律师更早发现问题并将判断力集中在最关键之处。
Latent Space 的 AINews 汇总 9 月 15 日至 16 日动态,Steve Yegge 关停 Gas Town,并承认每月花数千美元订阅编码智能体却只做出这一个项目。
GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体编写了大部分代码,分布在 128 个 PR 中增量合入 main。
推荐理由:GitHub 工程师复盘用 Copilot 把运行时从 TypeScript 迁到 80 万行 Rust 的全过程,含多智能体协作与提示缓存数据。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能能力,支持律所自定义工作流、接入法律数据源,并针对机密客户工作提供法律级管控。该产品归属于 OpenAI for Law。
NVIDIA 展示了一套智能体 AI 工作流,用于为物理 AI 系统准备和验证数字孪生:智能体可检查 3D 场景、在 OpenUSD 中编写仿真相关数据、添加物理属性、渲染预检视图,并按 SimReady 要求验证结果。该流程覆盖从 Blender 场景到面向 NVIDIA 的仿真就绪 OpenUSD 交付。
三星启动 One UI 9 正式推送,首批覆盖 Galaxy S26、S26+ 和 S26 Ultra,此前已在 Galaxy Z Fold8 Ultra、Fold8 和 Flip8 上首发。
NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该方案面向从云端数据中心迁移到车辆、机器人等边缘设备的 AI 智能体,针对其多步骤工具调用、结果评估与长对话推理带来的边缘推理新需求,实现快速 token 生成。
AIUC(Artificial Intelligence Underwriting Company)宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,客户包括 Cursor、Harvey、Lovable 和 ElevenLabs。
OpenAI 发布一套用于追踪、调查和披露模型失准的框架,同时给出六份关于模型意外或令人担忧行为的报告。
推荐理由:OpenAI 公开模型失准的追踪与披露框架,并附六份异常行为报告,可了解其安全披露机制。