Condé Nast 如何用 Amazon Bedrock 构建多模态视频检索
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本,将单次内容检索耗时从 250 分钟降至 2 分钟以内。
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本,将单次内容检索耗时从 250 分钟降至 2 分钟以内。
NVIDIA 发布 NeMo Relay,用于追踪 AI 智能体的执行路径,识别任务虽完成但过程低效的问题,例如失败搜索触发重复搜索、文件读取被截断后命令重复获取相同内容。这些多余步骤会增加延迟和 token 消耗,并提高失败概率。
CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,成为较早交付该平台的云厂商之一,Cognition 是首个在 Vera Rubin 上跑生产负载的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码负载的算力走向。
Amazon Bedrock 现可通过印度地理跨区域推理,在孟买(ap-south-1)和海得拉巴(ap-south-2)区域调用 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,数据仅在印度境内两个区域间流转。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程不离开所调用的 Region。
NVIDIA 发布 Metropolis Blueprint for Video Search and Summarization(VSS)3.3,用于降低视觉 AI 智能体的构建与运行成本。该蓝图及其智能体技能把视频接入、流处理、事件检测、检索、摘要与报告整合为可维护的系统,支持在生产规模下理解视频。
Final Cut Camera 发布 2.4 版本,为 iPhone 18 Pro 的 Fusion Main 摄像头带来首次可变光圈控制,并支持快门优先与光圈优先模式。
Apple Creator Studio 将推出全新模板、端到端电影级视频功能与多项提效特性。Freeform 新增自动适配深色模式、文件夹整理看板,并支持 Apple Intelligence 写作工具改写、校对和摘要手写笔记。visionOS 27 中 Freeform 可将图片、视频、便签、形状和 3D 模型拖入空间并成组查看。
OpenAI 发布 DevDay 2026 回顾,汇总超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。原文为摘要,未给出各项更新的具体细节。
推荐理由:OpenAI DevDay 2026 一次性放出 20 多项发布,可据此快速了解 GPT-6 Astra、Codex 与 API 的更新范围。
OpenAI 发布 dots,将其定位为可跨复杂项目与日常任务持续工作的主动型助手。官方说明 dots 在推进工作的同时让用户保持控制权。
推荐理由:OpenAI 官方给出 dots 的定位与可控性说明,可据此判断这类主动型助手与现有助手的分工。
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API。
推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度配置,可据此评估长任务智能体的成本与延迟取舍。
三星 Art Store 上线首个电影主题合集,收录 A24 出品的 38 幅电影剧照,面向全球支持 Art 功能的三星电视订阅用户开放。该服务已覆盖 117 个以上国家,提供 800 多位艺术家的 5000 多件作品,并首次登陆 S95H 等部分三星 OLED 电视。
NVIDIA 发布 NVIDIA Open Agent Safety Platform,由开源软件 NVIDIA OpenShell 与 NVIDIA Sentry 参考系统设计组成,覆盖运行智能体的软件、硬件、算力与机器人系统。
推荐理由:NVIDIA 把智能体安全边界从模型层移到运行时与硬件层,读者可据此了解企业级智能体治理的一种新架构。
NVIDIA 发布开放智能体安全平台,为持续在硅智能体监控提供参考方案。该平台面向智能体 AI 的安全监控需求,类比 90 年代互联网兴起带来的机遇与风险。原文未披露具体功能、版本或性能数字。
NVIDIA 发布 OpenShell,为 AI 智能体提供运行时控制能力。该工具面向需要访问工作区、计算资源、数据、凭证和外部服务的智能体,支持其持续数天或数周执行调查软件故障、运行实验等任务。
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、研究者与创作者的真实故事和项目。有意参与者可通过下方表单提交自己的经历与项目介绍,以加入该项目的下一阶段。
GPT-6 Astra 完成一份 50 个标签页的税务工作簿,速度是 GPT-5.6 Sol 的两倍。Basis 表示,GPT-6 Astra 对用户意图的理解更强,让其在真实业务场景中的使用更有信心。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理服务,销售提升 60%,节省 75+ 小时。
Datacor 将 Amazon Quick Sight 嵌入 TrackAbout,为工业气体与焊接分销商提供交互式仪表盘和自然语言查询,业务用户无需再提 IT 工单即可分析租赁数据。TrackAbout 客户合计管理 2750 万件资产、每月处理超 72.5 万张账单,方案通过跨云管道将运营数据定时刷新至 SPICE。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体便会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。
推荐理由:读者可了解开放病毒蛋白复合物数据集与配套 GPU 加速流程,及其对疫苗与药物靶点研究的可用性。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam,可无缝接入 Google Meet 和 Zoom。
Google DeepMind 公布 Private AI Compute 的新技术能力,将私密的服务端记忆引入该平台,使 AI 助手能在多设备间保留上下文。数据被密封在加密存储中,解密密钥仅保存在用户个人设备上,模型访问时通过端到端加密通道进入安全隔离区临时解密,处理完立即重新加密。
推荐理由:Google 给出云端持久记忆的隐私架构细节,可了解跨设备 AI 记忆如何在密钥留在本地的前提下实现。
Ringg 基于 GPT-5.6 构建的多语言 AI 智能体可解决最高 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页渠道。相比 GPT-4.1,其成本降低 90%。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以专注于策略。
invideo 借助 GPT-6 Astra 实现更精准的剪辑规划,调色与色彩校正效率提升 3 倍,并在一天内生成 50 个自定义特效。
ChatGPT Ads 扩展至东南亚和台湾,使符合条件的企业可在超过 60 个国家和地区触达用户。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。该消息由 OpenAI 公布,但未披露具体接入方式、覆盖团队规模或性能数据。
OpenAI 宣布为 GPT-6 改进提示词缓存,带来更高的缓存命中率、新的诊断能力、显式断点以及可降低延迟和成本的控制项。官方称这些改动用于减少延迟与费用,具体用法和参数未在摘要中给出。
推荐理由:官方说明 GPT-6 提示词缓存的变化,读者可据此了解缓存命中率与延迟成本控制的新入口。
NVIDIA 发布 DLSS 5,引入 DLSS 3D-Guided Neural Rendering 和细粒度控制,帮助游戏开发者在保留艺术意图的同时加入更逼真的光照与材质细节。官方同时介绍了 NVIDIA ACE 的更新,以及 RTX Mega Geometry 2.0 和 RTX Kit 在角色 AI、高密度几何与渲染工作流方面的能力变化。
推荐理由:NVIDIA 官方说明 DLSS 5 的 3D 引导神经渲染与细粒度控制,并同步更新 ACE 与 RTX Kit,可了解游戏渲染与角色 AI 的新工具链。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,帮助开发者更快构建、定制和部署机器人应用。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,读者可据此了解开源机器人工具链的演进方向。
Hugging Face 在 transformers 中加入 GGUF 模型支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 在本地生成,也可用 transformers serve 暴露 OpenAI 兼容 API。
推荐理由:Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的实测对比和当前限制。
NVIDIA Earth-2 面向天气敏感行业,把能源企业的风光资产测量、应急管理团队的雷达与本地传感器、卫星持续对地观测等最新观测数据,转化为更早、更本地化的天气决策依据。这些数据帮助各行业组织理解并管理实体风险。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线了新的视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
OpenAI Academy 新增面向员工、开发者、管理者、教育工作者和学生等多类人群的学习路径,用于培养和展示实用 AI 技能。
V7 使用 GPT-5.6 将分散的公司文件转化为智能体可用的上下文,以完成复杂的、可溯源的工作,同时成本降低 78%、准确率提升。
Google 旗下 Envisioning Studio 与 Google Labs 合作,用 AI 创作工具 Google Flow 为设计师 Jane Wade 和 Sergio Hudson 分别打造 Styling Suite 与 Runway Visualization 两款定制工具,用于纽约时装周。
联合国系统发布 UN System Data Commons,一个基于 Google Data Commons 构建的开源平台,把分散的全球统计数据整合为单一可搜索的 AI-ready 知识图谱。
Pawprint Studio 的 Aniimo 本周首发上线 GeForce NOW,这是一款免费开放世界捉宠 RPG,玩家可用 Aniipods 捕捉生物并 Twine 变身,无需等待 45GB 下载。