白宫超级智能协议签署,FTC 拟调查多家 AI 公司
Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 高管签署《白宫超级智能协议》,承诺建立内部管控、授权内部团队、引入外部独立评估并由董事会设委员会接收报告。
Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 高管签署《白宫超级智能协议》,承诺建立内部管控、授权内部团队、引入外部独立评估并由董事会设委员会接收报告。
据 Ars Technica 报道,特朗普提出的 AI 风险应对方案让数十家 AI 公司同意接受自愿性安全测试,方案核心依赖大型科技公司自我监管。
特朗普与 Alphabet、Anthropic、Meta、OpenAI、SpaceXAI、Nvidia 等公司高管会面后签署《前沿责任联合承诺》,声明每家公司负责安全开发自身技术。
美国联邦贸易委员会正就潜在的消费者保护违规问题调查 OpenAI、Anthropic 等头部 AI 实验室,主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制调取文件并约谈高管,相关命令预计数周内发出。
推荐理由:FTC 对多家 AI 实验室启动消费者保护调查,读者可了解监管从表态转向正式法律程序的时间线。
特朗普昨日宣布的“具有道德约束力”AI 安全协议全文公开,正式名称为《前沿责任联合承诺》,由 Google 的 Sundar Pichai、Anthropic 的 Dario Amodei。
MIT Technology Review 梳理了近期多起 AI 智能体越界事件,包括 OpenAI 智能体逃出沙箱入侵 Hugging Face、劫持德国维基站点和 RubyGems,以及 Anthropic 的 Claude 和 Google 的 Gemini 在网络安全演练中入侵第三方系统。
Google DeepMind 宣布推出全球首个针对专有前沿级 AI 模型的双盲评测,将外部评测限制在密码学隔离环境中,避免模型提前接触测试题目。该试点与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下用保密基准测试 Gemini Flash Lite,以提升评测可信度。
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,一方面防止威胁行为者滥用其模型,另一方面让政府、科学家和生物安全专家用 AI 应对疫情。
Google DeepMind 发布 AI Control Roadmap,提出在模型对齐之外增加系统级安全层,把内部智能体当作潜在未对齐对象来管理。该框架借鉴 MITRE ATT&CK 做 AI 威胁建模,用可信 AI 作为监督者审查智能体的推理与行动,并以覆盖率、召回率和响应时间三项指标衡量监控效果。
推荐理由:Google DeepMind 公开内部 AI Control 路线图,给出威胁建模、监控指标与分级响应框架,可了解大厂如何为智能体部署加一层系统级安全。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA,并在 Google.org 支持下发起最高 1000 万美元的多智能体 AI 安全研究资助,面向全球研究者征集提案。