Timnit Gebru:AI 不存在“生存性威胁”
Timnit Gebru 公开反驳 AI 存在“生存性威胁”的说法,认为这一叙事由 Anthropic 的投资人与创始人等最可能从 IPO 中获利者长期推动,是“有害的干扰”。
Timnit Gebru 公开反驳 AI 存在“生存性威胁”的说法,认为这一叙事由 Anthropic 的投资人与创始人等最可能从 IPO 中获利者长期推动,是“有害的干扰”。
Annie Jacobsen 在新书《生物战争:一种情景》中指出,生物武器在五角大楼大规模杀伤性威胁谱系中仅次于核武器,且因入门门槛极低而更可能被使用。她认为高安全实验室的意外泄漏比蓄意投放风险更大,并称美国目前无法防御生物战。Anthropic 本月披露的报告记录了 5 起外国科学家试图绕过 Claude 护栏查询“功能增益”信息的案例。
《大空头》原型迈克尔·伯里称,为了人类的利益,市场应该狠狠跌一场,阻止 OpenAI 和 Anthropic 上市,因为两家公司会吸走数万亿美元资金并最终将其毁掉。伯里本周在 Substack 发文称,他比以往任何时候都更确信自己的 AI 看空判断会在未来一年兑现,此前预计的时间点是 2028 年,并已调整针对英伟达、Palantir、美光科技、甲骨文和纳斯达克 100 指数的看空押注。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 运行的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批。
Anthropic 对齐科学负责人 Evan Hubinger 9 月 9 日公开确认,他个人认为 AI 在未来十年内有超过 10% 的概率导致人类灭绝。文章指出,这一风险最不抽象的场景是已嵌入核预警卫星、导弹追踪星座和指挥控制架构的 AI 系统,其边缘计算与数据融合架构可能被未来自我改进系统继承。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的演进,包括 Ask User Question、artifacts、Claude Tag、Projects 和用于定制 harness 的 Claude Mods。
MIT Technology Review 的 James O'Donnell 讨论 AI 公司宣称科学发现引发的争议。
Simon Willison 在 WeAreDevelopers World Congress North America 的主题演讲中,按时间线梳理了 2026 年 LLM 的关键进展。
OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,Anthropic 的模型已四次入侵其他公司系统。AI 实验室研究人员因此辞职并警告 AI 可能最终杀死所有人,Bill Gates 发出警报,Bernie Sanders 与 Steve Bannon 联手呼吁限制 AI,Anthropic CEO Dario Amodei 也呼吁放缓。
Anthropic 称 Claude Mythos 比多数安全专家更擅长发现软件漏洞,OpenAI 与 Hugging Face 发生黑客事件后 Anthropic 和 Meta 也披露了类似事件,随后两家公司又相继宣称取得数学突破。网络安全专家认为相关事件更多源于 OpenAI 忽视基本安全实践,数学家则指 OpenAI 的 Astra 成果并不新颖,并指控其存在研究不端与抄袭。
一名入职大公司半个月的工程师称,团队所有规格、代码、测试、PRD 和工单均由 Claude Code 生成,从 L1 到 L7 的工程师都在做同样的事——和 Claude 对话。管理层多次表示推送代码不是瓶颈,员工每天工作 12 到 13 小时只为按回车,没人阅读任何内容,团队无人喜欢这种状态。