跳到正文
今天10月1日周四
  1. Wired22

    Annie Jacobsen 新书《生物战争:一种情景》警告:无需 AI,生物武器已是头号威胁

    Annie Jacobsen 在新书《生物战争:一种情景》中指出,生物武器在五角大楼大规模杀伤性威胁谱系中仅次于核武器,且因入门门槛极低而更可能被使用。她认为高安全实验室的意外泄漏比蓄意投放风险更大,并称美国目前无法防御生物战。Anthropic 本月披露的报告记录了 5 起外国科学家试图绕过 Claude 护栏查询“功能增益”信息的案例。

  2. IT之家38

    “大空头”伯里:市场应狠跌一次阻止 OpenAI 和 Anthropic 上市

    《大空头》原型迈克尔·伯里称,为了人类的利益,市场应该狠狠跌一场,阻止 OpenAI 和 Anthropic 上市,因为两家公司会吸走数万亿美元资金并最终将其毁掉。伯里本周在 Substack 发文称,他比以往任何时候都更确信自己的 AI 看空判断会在未来一年兑现,此前预计的时间点是 2028 年,并已调整针对英伟达、Palantir、美光科技、甲骨文和纳斯达克 100 指数的看空押注。

  3. IT之家12

    Anthropic 向 Claude 用户免费发放毛绒玩具与贴纸,每人限领一份

    Anthropic 开始向 Claude 用户免费赠送实体毛绒玩具和贴纸,用户在 Claude Dev 网站 Terminal 中输入 /plushies 或 /stickers 即可登记领取。活动无需购买商品,采用送完即止规则,每人限领一份且需年满 18 周岁,毛绒玩具为随机款式,配送受物流覆盖区域限制。有社区用户反馈,使用已被封禁的 Claude 账户邮箱同样可以完成登记领取。

  4. Ars Technica · AI74

    Anthropic IPO 材料警告 AI 或致人类灭绝,并披露去年亏损超 80 亿美元

    Anthropic 的 IPO 招股材料中包含 AI 可能导致人类灭绝的风险警告,其现任和前任员工公开警告失控的 AI 可能在一个十年内终结人类。材料还披露,Anthropic 去年运营亏损超过 80 亿美元,营收增长 12 倍至近 46 亿美元,运营支出接近 130 亿美元;今年第二季度营收为 115 亿美元,按调整后口径有望连续第二个季度实现运营盈利。

  5. The Verge · AI60

    Sam Altman 称 OpenAI 在模型安全达标前不会上市

    OpenAI CEO Sam Altman 在 DevDay 主题演讲后的记者问答中表示,公司不会在能够对模型安全作出可靠承诺之前上市,且没有明确时间表。他称等待太久上市对世界不利,但担心上市会带来在安全名义下让华尔街支持者失望的压力,并认为在向更强模型和新安全要求过渡期间上市并不明智。

  6. The Verge · AI82

    Google 发布 Gemini 4 Argon,初期仅向可信网络安全人员开放

    Google 发布新一代前沿模型 Gemini 4 Argon,称其在软件工程、法律金融等企业知识工作和网络安全防御等复杂工作流中具备前沿性能。该模型初期仅向一组可信网络安全人员开放,Google 表示正参与美国政府的前沿模型预发布访问流程,并将逐步扩大访问范围。

    推荐理由:Google 发布 Gemini 4 Argon 并限制访问范围,读者可了解其能力定位与分阶段开放的安全考量。

  7. The Decoder62

    Google 在 Gemini 中推出 Skills 取代 Gems

    Google 在 Gemini 聊天中全球推出 Skills,用可保存、可复用的详细提示词取代此前的 Gems。用户输入“/”加 Skill 名称即可调用,Gemini 也能从历史对话生成 Skill 并在匹配时自动运行,多个 Skill 可串联完成更大任务,现已支持文本文档、PDF 和图片作为参考材料。

  8. The Decoder78

    FTC 对 OpenAI、Anthropic 等 AI 实验室启动消费者保护调查

    美国联邦贸易委员会正就潜在的消费者保护违规问题调查 OpenAI、Anthropic 等头部 AI 实验室,主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制调取文件并约谈高管,相关命令预计数周内发出。

    推荐理由:FTC 对多家 AI 实验室启动消费者保护调查,读者可了解监管从表态转向正式法律程序的时间线。

9月30日周三
  1. Simon Willison78

    Anthropic 红队:GLM-5.3 在 4% 试验中实现完整控制流劫持

    Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称更早的 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力门槛已被跨过。

    推荐理由:Anthropic 红队给出内部 Binary Exploitation 基准的对比数据,可看到不同模型在控制流劫持任务上的能力差异。

9月29日周二
  1. SpaceNews34

    如果 AI 在教室里都不可信,凭什么让它守卫星轨道?

    Anthropic 对齐科学负责人 Evan Hubinger 9 月 9 日公开确认,他个人认为 AI 在未来十年内有超过 10% 的概率导致人类灭绝。文章指出,这一风险最不抽象的场景是已嵌入核预警卫星、导弹追踪星座和指挥控制架构的 AI 系统,其边缘计算与数据融合架构可能被未来自我改进系统继承。

  2. 极客公园83

    Anthropic 招股书里最耐人寻味的 7 个细节

    外媒披露了一份 Anthropic 尚未公开的 IPO 招股书,其上市估值目标超过 2 万亿美元,是 Anthropic 自己 5 月估算的 9650 亿美元的两倍以上。

    推荐理由:围绕一份未公开的 Anthropic 招股书,梳理了亏损口径、算力承诺与治理结构等七个细节,可对照 OpenAI 的上市路径。

  3. Simon Willison82

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 发布 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。

    推荐理由:作者用同一提示词实测 Sonnet 5.5 的免费层表现,并给出与 Opus 5.5 的对比和成本数据。

  4. AWS Machine Learning Blog70

    Claude Sonnet 5.5 上线 Amazon Bedrock 与 Claude Platform on AWS

    AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。

    推荐理由:官方给出了 Sonnet 5.5 在编码与文档任务上的能力变化、与 Opus 5.5 的分工以及 Bedrock 接入方式,便于判断适用场景。

9月28日周一
  1. NVIDIA Newsroom78

    NVIDIA 发布 Open Agent Safety Platform,从测试到部署保障 AI 智能体安全

    NVIDIA 发布 NVIDIA Open Agent Safety Platform,由开源软件 NVIDIA OpenShell 与 NVIDIA Sentry 参考系统设计组成,覆盖运行智能体的软件、硬件、算力与机器人系统。

    推荐理由:NVIDIA 把智能体安全边界从模型层移到运行时与硬件层,读者可据此了解企业级智能体治理的一种新架构。

9月27日周日