Halide 3.2 发布:支持 iPhone 18 Pro 光圈优先模式,新增两款 Halide look
Halide 3.2 为 iPhone 18 Pro 带来光圈优先模式,可在 ƒ/1.48 至 ƒ/4.0 间设定目标光圈,由 Halide 自动调整快门速度与 ISO,并支持全手动 ISO 控制。
Halide 3.2 为 iPhone 18 Pro 带来光圈优先模式,可在 ƒ/1.48 至 ƒ/4.0 间设定目标光圈,由 Halide 自动调整快门速度与 ISO,并支持全手动 ISO 控制。
Apple 为 iPhone 上的 Apple Invites 推送新版本,共享相册现支持全分辨率分享,非 Apple 设备用户也能加入并贡献内容。Image Playground 可生成包括写实风格在内的高质量背景,访客还能通过邮件链接完成邮箱验证而无需输入验证码。创建邀请仍需 iCloud+ 订阅,回复邀请则不限。
Google Photos 正在为其 AI 衣橱功能开发“Regenerate image”选项,允许用户重新生成衣服、鞋子、眼镜等物品的 AI 图像,以便在首次结果与真实商品不符时进行修正。该功能还将提升 Try on outfits 的实用性,因为这一功能依赖用户 Google Photos 衣橱中保存的物品。
Google Photos 正在准备在 Remember List 中加入“Delete all”按钮,让用户一键删除所有分享给 Ask Photos 的信息。Ask Photos 由 Gemini 驱动,提供搜索、基于提示词的编辑等功能,Remember List 会保存用户分享的信息以改进搜索和编辑。该功能适合想重新开始或不再分享敏感信息的用户。
Google Photos 的虚拟试穿功能 Wardrobe 正在测试一个加号按钮,让用户无需重置整个 Wardrobe 就能添加新服装。目前添加新服装必须先清空已有 Wardrobe。该功能此前已支持从现有照片导入服装并在中性背景下虚拟试穿。
Apple Invites 应用更新至 1.12.0,新增三项功能:共享相册支持全分辨率照片分享,Image Playground 可生成包括照片级写实在内的背景图,受邀者可通过邮件链接完成邮箱验证而无需输入验证码。该应用免费,但创建活动需订阅至少 50GB 的 iCloud+ 方案,每月 0.99 美元,收到活动链接的用户可在任意设备免费回复。更新已在 App Store 上线。
Meshy 7 为新用户提供首月订阅 60% 折扣,使用优惠码 TOMESHY60 即可享受。这款今年 8 月发布的最新 AI 模型可通过文本提示词和 2D 图像(草图、绘图或照片)在几分钟内生成可直接打印的 3D 模型,无需建模技能,几何与纹理质量较前代显著提升。
Google Research 提出 Diffusion Controller 框架,把扩散模型的去噪过程重构为连续控制问题,通过轻量附加网络在不改动基座模型权重的前提下引导生成。在 Stable Diffusion v1.4 上以 HPS-v2 评测,其完全解锁版本对基线模型取得 90% 胜率,并支持黑盒、灰盒模型的微调。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全部处理在本地完成。
在 Amazon SageMaker AI 上,同一 AWS vLLM-Omni DLC 镜像可部署两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 生成图像条件视频。
NVIDIA 发布 DLSS 5,引入 DLSS 3D-Guided Neural Rendering 和细粒度控制,帮助游戏开发者在保留艺术意图的同时加入更逼真的光照与材质细节。官方同时介绍了 NVIDIA ACE 的更新,以及 RTX Mega Geometry 2.0 和 RTX Kit 在角色 AI、高密度几何与渲染工作流方面的能力变化。
推荐理由:NVIDIA 官方说明 DLSS 5 的 3D 引导神经渲染与细粒度控制,并同步更新 ACE 与 RTX Kit,可了解游戏渲染与角色 AI 的新工具链。
Google 旗下 Envisioning Studio 与 Google Labs 合作,用 AI 创作工具 Google Flow 为设计师 Jane Wade 和 Sergio Hudson 分别打造 Styling Suite 与 Runway Visualization 两款定制工具,用于纽约时装周。
三星 Galaxy Z 系列(Galaxy Unpacked July 2026 发布)的人像视频功能通过 AI 视频处理与真实镜头光学分析,复刻大光圈镜头的景深与 Bokeh 效果,虚化程度随主体与背景距离自然变化。用户可在拍摄后切换对焦主体,并将虚化程度从 0 调至 7。该功能由三星研究院与 MX 业务部门联合开发,后者将其优化并落地到设备。
Google DeepMind 与导演 Liz Garbus、Darren Aronofsky 的 Primordial Soup 合作,在短片《Love, Rendered》中用生成模型修复 Burt 和 Ethelle Shatz 年轻时的黑白照片,并通过表演捕捉模型将两人当下的微表情与姿态映射到年轻形象上,重建他们未曾被拍摄的初遇场景。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。
推荐理由:官方给出 ChatGPT Images 2.5 的定位,读者可了解它在个性化图像生成上的能力方向。
三星在 IFA Innovation Awards 2026 上凭多款家电获奖,Bespoke AI WindFree Pro 空调拿下 Best in Design 类别优胜,并入选 Best in Home Appliances。
Google 在 Workspace 推出图像创建与编辑工具 Google Pics,基于 Nano Banana 图像生成与编辑模型,将在未来几周向所有 Google AI Pro 和 Ultra 订阅者及多数 Workspace 商业客户开放。
推荐理由:Google Pics 基于 Nano Banana 模型,把图像生成与精细编辑放进 Workspace 现有工作流,可据此判断日常制图方式的变化。
三星电子于 9 月 1 日至 6 日在首尔东大门设计广场(DDP)举办 Design Miami Seoul 2026 特展“Design Is an Act of Love”。14 位韩国艺术家以三星产品为灵感创作原创作品,每件作品经 AI 呈现于 OLED TV S95H,并配以成为作品一部分的定制画框。
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型。
推荐理由:两款新模型给出了延迟、价格与可用入口,读者可据此判断图像与视频生成工作流的成本变化。
Google DeepMind 发布 Omni 系列首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并通过自然语言对话逐轮编辑视频。
推荐理由:Gemini Omni Flash 把多模态输入与对话式视频编辑结合,读者可了解其能力边界与首批上线渠道。
Berkeley AI Research 提出一种基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,在彩色摄影、射电天文、无透镜成像和显微镜四个领域预测解码器性能。该方法用已知噪声物理直接计算 H(Y|X),仅需学习 H(Y),优化后的设计在更少内存和算力、无需任务专用解码器的情况下达到与端到端方法相当的水平。