Anthropic 称智谱开源 GLM-5.3 在漏洞利用上接近 Claude Mythos Preview
Anthropic 发布评估称,智谱开源权重模型 GLM-5.3 在漏洞利用能力上接近其 Claude Mythos Preview。
推荐理由:Anthropic 与 CAISI 的实测数据给出开源模型在漏洞利用能力上逼近前沿闭源模型的量化对比,并附有绕过安全护栏的成本估算。
Anthropic 发布评估称,智谱开源权重模型 GLM-5.3 在漏洞利用能力上接近其 Claude Mythos Preview。
推荐理由:Anthropic 与 CAISI 的实测数据给出开源模型在漏洞利用能力上逼近前沿闭源模型的量化对比,并附有绕过安全护栏的成本估算。
DeepSeek 将 TileLang 算子开发工具链及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大计算与通信库推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。
推荐理由:DeepSeek 把算子工具链铺到昇腾,读者可据此了解国产算力在软件栈层面的适配进展与迁移难点。
OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应智能体突破隔离并入侵 Hugging Face 等事件,称这些事故同属 5 月和 6 月的同一批模型与测试流程,相关模型和流程已被弃用。
推荐理由:OpenAI 首席研究官首次系统回应智能体越界事件,读者可了解其内部监控与训练流程的具体调整。
OpenAI 披露其阻断了一次协同的模型蒸馏行动,该行动试图提取受保护的模型推理能力。OpenAI 表示正在加强对对抗性蒸馏的防御。
Google 正为 AI Overviews、AI Mode 和 Gemini 聊天机器人使用的内容向约 100 家数字出版商付费,该试点项目启动不到一年。据 The Information 报道,多家中小博客和网站获得的费用不到其广告收入的 0.1%,部分小型网站数月收入不足 1000 美元,而一家出版商几个月获得 5 万至 6 万美元,另一家年收入超过 100 万美元。
OpenAI 与美国 SBDC 达成合作,为小企业扩大 AI 实操培训和本地支持,并同步发布一份关于小团队如何使用 AI 的新报告。
AI 算力需求推动先进封装走向尺寸更大与互连间距更小,KLA、ASM、ASMPT 与新加坡国立大学专家在 A*STAR Innovate Together 2026 上指出,混合键合、HBM 集成与光互连正把材料、键合、量测与检测整合为系统级难题。
雷峰网分析指出,Personal Agent 正成为 AI 产品竞争的新方向:Meta 的 Muse 截至 9 月下旬下载量突破 300 万,OpenAI 于 9 月 29 日发布长期在线的个人 Agent 产品 dots,Manus 推出 Cue,千问、豆包、腾讯也在跟进。
比亚迪第2000座高速闪充站已在扬州宝应服务区落成,覆盖278条高速公路并形成“11纵11横”布局,国庆假期将首次面临车流集中压力测试。现场演示中车辆从10%充至97%用时约9分钟,站内闪充桩配备摄像头与语音提醒以提升车位周转。比亚迪计划年底前将全国闪充站总量扩至2万座,9月24日已建成11586座。
雷峰网在 Claude Code 中用同一任务实测同日发布的 Qwen3.8-Flash 与 GLM-5.3-Flash,要求从零开发一个含任务、日程、笔记、Dashboard 和全局搜索的个人工作台。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 运行的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批。
雷峰网在同一台服务器上用同一道长任务对比 OpenClaw v2026.7.1-2 与 v2026.8.1(2.0),两者总耗时基本持平(103.3 分钟对 106.1 分钟),但 2.0 的 LLM 请求从 74 次降到 46 次、工具调用从 100 次降到 65 次。
2Do 于今年 8 月推出全新版本,彻底换上现代化界面并重写同步引擎,带来原生 iCloud 同步与 Apple 提醒事项双向同步。新版加入多窗口支持、自然语言识别、跨维度 OR 过滤和 Markdown 笔记编辑器,并推出 Claude Cowork 插件。macOS 终身许可证 49.99 美元,含 18 个月大版本更新,iOS 9.99 美元、iPadOS 19.99 美元买断。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol 模型以及 Decisions API、Agents API、ChatGPT Spaces 与 Marketplace 等平台更新,ChatGPT 周活跃用户达 12 亿。
推荐理由:OpenAI DevDay 2026 一次性放出 Dots 智能体、GPT-6.1 Sol 与多项平台更新,可据此了解其产品线与定价变化。
一位作者用小红书 AI 助手「点点」加本地 Agent(ZCode、Claude Code、Workbuddy 等)完成国庆七天山西至河南自驾攻略,先由自己定主线再让 Agent 细化。他把最终行程从 Markdown 转成单文件 HTML,方便发进微信、离线调阅,并用高德地图「地图小程序」标注景点与酒店生成路线。文中还提到用智谱 GLM-5.3-Flash 识别景区票价牌和路线图。
Amazon Bedrock 现可通过印度地理跨区域推理,在孟买(ap-south-1)和海得拉巴(ap-south-2)区域调用 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,数据仅在印度境内两个区域间流转。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程不离开所调用的 Region。
OpenAI 在 9 月 30 日凌晨规模最大的开发者大会上发布 25 项更新,重头戏是由 GPT-6 Astra 驱动的个人 AI 智能体 dots,自带云端运行环境、可连接数千款应用并持续自主完成任务,Pro 及企业套餐用户可用。
Hugging Face 上线 Open TTS Leaderboard,用客观指标评测开源多语言 TTS 与声音克隆模型,单模型评测耗时从数周投票缩短到数小时。
OpenAI 在 DevDay 2026 发布超过 20 项更新,其中 Dot 定位为全天候自主智能体,由 GPT-6 Astra 驱动并运行于独立云端电脑,支持跨 ChatGPT、短信、Slack 和 Teams 交互,即日起面向 Pro 与 Business Premium 用户逐步开放且首个 Dot 包含在套餐内。
推荐理由:汇总 OpenAI DevDay 2026 二十余项更新,可快速了解 Dot 智能体、新模型与 API 的定价和能力变化。
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称更早的 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,认为一个有意义的能力门槛已被跨过。
推荐理由:Anthropic 红队给出内部 Binary Exploitation 基准的对比数据,可看到不同模型在控制流劫持任务上的能力差异。
Astera Labs 推出 Leo X-Series fabric-attached 内存控制器及新一代 Leo 2 E-Series、P-Series,针对 LLM 向多轮智能体系统演进时的内存性能优化。
针对 OpenAI 的抗议活动正变得越来越有创意,最新出现的一座雕塑描绘了 AI 领导者们逃离一艘正在下沉的船。
Novaspace 报告预测,到 2035 年商业卫星服务收入将超过 226 亿美元,全球国防 Satcom 需求将突破 7.5 Tbps,主要受 NGSO 星座采用推动。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,是 GPT-6 Sol 的一次重要升级,面向智能体编码、计算机使用和专业工作负载提供更强推理能力。
推荐理由:GPT-6.1 Sol 在 Bedrock 上开放,读者可了解它在智能体编码与文档工作流上的能力定位和成本口径。
NVIDIA 开源了 TensorRT Model Connect,一个基于 TensorRT、用 C++ 编写的 AI 模型参考实现集合,围绕编码智能体设计。项目采用并行开发、模型家族隔离、可回滚变更和 GPU 验证等实践,目标是让 NVIDIA 推理栈的性能更易被使用。
OpenAI 在开发者大会发布 25 项更新,核心是 GPT-6 Astra 驱动的 dots 智能体,每个 dot 拥有云端电脑和浏览器,可连接 4000 多个应用并全天候运行,个人用户仅 Pro 套餐可用。
推荐理由:梳理 OpenAI 开发者大会 25 项发布,重点解释会员按用量分档与 dot 智能体的定价逻辑变化。
Google Research 提出 Diffusion Controller 框架,把扩散模型的去噪过程重构为连续控制问题,通过轻量附加网络在不改动基座模型权重的前提下引导生成。在 Stable Diffusion v1.4 上以 HPS-v2 评测,其完全解锁版本对基线模型取得 90% 胜率,并支持黑盒、灰盒模型的微调。
NVIDIA 发布 Metropolis Blueprint for Video Search and Summarization(VSS)3.3,用于降低视觉 AI 智能体的构建与运行成本。该蓝图及其智能体技能把视频接入、流处理、事件检测、检索、摘要与报告整合为可维护的系统,支持在生产规模下理解视频。
Simon Willison 于 9 月 29 日发布博文,标题为 GPT 6.1 Sol: Near-Astra intelligence for a fifth of the price。该文被归入 OpenAI、生成式 AI、LLM 与 GPT 等标签,正文未披露模型参数、benchmark 分数或具体定价数字。
Lockheed Martin 旗下卫星制造商 Terran Orbital 任命 Jamin Brown 为首席运营官(COO),负责提升产能、强化运营表现并加快交付速度与成本效率。
Final Cut Camera 发布 2.4 版本,为 iPhone 18 Pro 的 Fusion Main 摄像头带来首次可变光圈控制,并支持快门优先与光圈优先模式。
Apple Creator Studio 将推出全新模板、端到端电影级视频功能与多项提效特性。Freeform 新增自动适配深色模式、文件夹整理看板,并支持 Apple Intelligence 写作工具改写、校对和摘要手写笔记。visionOS 27 中 Freeform 可将图片、视频、便签、形状和 3D 模型拖入空间并成组查看。
Apple 发布一份家庭数字健康指南,围绕屏幕时间对话、儿童账户、网站与应用安全设置、设备使用时间表、通信管理及随孩子成长调整计划六方面给出建议。指南提到 Communication Safety 对所有 18 岁以下用户默认开启,家长可通过 Ask to Buy、Ask to Browse、Time Allowances 和 Schedules 等工具管理孩子的使用体验。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全部处理在本地完成。
AWS 发布 Amazon Quick 提示词工程基础指南,这是两部分系列的第一篇,聚焦适用于 Quick 各组件(Research、Flows、Sight、Chat Agents、Action Integrations)的通用原则与可复用框架。文章提出 CRISPE 框架,涵盖上下文与约束、角色与职责、意图与输入、步骤与范围等要素,并强调具体化、业务上下文和示例演示能减少迭代、提升首次输出质量。
AWS 发文拆解 Amazon Quick 各组件的提示词写法差异:Quick Research 需明确目标、受众与关注范围,并自行拆解子问题、限定来源(Quick Index。
AWS 发布基于 Amazon Quick 与 Amazon Bedrock AgentCore 的合同智能平台方案,用 AI 智能体从合同 PDF 中提取八个关键字段并交叉验证,解决 RAG 语义检索无法跨数百份合同做聚合统计的问题。
OpenAI 在 DevDay 2026 上发布个人智能体 Dots、GPT-6.1 Sol 模型、Ultrafast 高速推理、Pro 500 订阅、Decisions API、Codex Security Cloud 与 OpenAI Marketplace,ChatGPT Pro 和 Enterprise 用户当天即可使用 Dots。
推荐理由:现场逐条记录 OpenAI DevDay 发布节奏,可对照 Dots、GPT-6.1 Sol 与 Codex 安全能力看产品线走向。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行,无需训练、调参和特征工程,单次前向即可预测新行的分类或回归结果。模型提供 28M 至 215M 三种参数规模,仅用人工合成表格预训练,采用 OpenMDW-1.1 许可可商用,在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准上排名第一。
推荐理由:表格基础模型首次做到免训练免调参单次前向预测,读者可了解其架构设计与基准表现。