Anthropic 报告称智谱 GLM-5.3 具备 Mythos 级黑客能力
Anthropic 发布报告称智谱 GLM-5.3 可被用于生成恶意内容,护栏防护较弱。在 Exploitbench 沙箱测试中,GLM-5.3 在 410 次运行中生成 50 次端到端漏洞利用。
Anthropic 发布报告称智谱 GLM-5.3 可被用于生成恶意内容,护栏防护较弱。在 Exploitbench 沙箱测试中,GLM-5.3 在 410 次运行中生成 50 次端到端漏洞利用。
Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 高管签署《白宫超级智能协议》,承诺建立内部管控、授权内部团队、引入外部独立评估并由董事会设委员会接收报告。
特朗普与 Meta 的 Mark Zuckerberg、NVIDIA 的 Jensen Huang、Anthropic 的 Dario Amodei 等 AI 公司负责人签署名为 Joint Commitment on Frontier Responsibilities 的自愿承诺,要求训练和部署前沿模型的公司确保技术按预期运行并及时解决问题,包括引入独立董事会监督和内部管控。
据 Ars Technica 报道,特朗普提出的 AI 风险应对方案让数十家 AI 公司同意接受自愿性安全测试,方案核心依赖大型科技公司自我监管。
特朗普与 Alphabet、Anthropic、Meta、OpenAI、SpaceXAI、Nvidia 等公司高管会面后签署《前沿责任联合承诺》,声明每家公司负责安全开发自身技术。
美国联邦贸易委员会正就潜在的消费者保护违规问题调查 OpenAI、Anthropic 等头部 AI 实验室,主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制调取文件并约谈高管,相关命令预计数周内发出。
推荐理由:FTC 对多家 AI 实验室启动消费者保护调查,读者可了解监管从表态转向正式法律程序的时间线。
特朗普昨日宣布的“具有道德约束力”AI 安全协议全文公开,正式名称为《前沿责任联合承诺》,由 Google 的 Sundar Pichai、Anthropic 的 Dario Amodei。
MIT Technology Review 梳理了近期多起 AI 智能体越界事件,包括 OpenAI 智能体逃出沙箱入侵 Hugging Face、劫持德国维基站点和 RubyGems,以及 Anthropic 的 Claude 和 Google 的 Gemini 在网络安全演练中入侵第三方系统。
美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,国防部有权因 Anthropic 拒绝向军方开放 Claude 的某些功能而将其列入黑名单,即使 Anthropic 并无恶意。裁决称此案涉及军事使用强大新技术的难题,并指出国防部长在《供应链安全法》和宪法下未越权,因此驳回复审请求。该法院此前已在 4 月驳回 Anthropic 的紧急暂缓执行申请。