跳到正文
9月17日周四
9月16日周三
  1. Samsung Newsroom22

    三星 Galaxy Z 系列人像视频如何复刻专业大光圈镜头虚化

    三星 Galaxy Z 系列(Galaxy Unpacked July 2026 发布)的人像视频功能通过 AI 视频处理与真实镜头光学分析,复刻大光圈镜头的景深与 Bokeh 效果,虚化程度随主体与背景距离自然变化。用户可在拍摄后切换对焦主体,并将虚化程度从 0 调至 7。该功能由三星研究院与 MX 业务部门联合开发,后者将其优化并落地到设备。

  2. Google AI Blog60

    Google 公布多语言 AI 进展:Gemini 3.5 Live Translate 支持 70 种语言实时翻译

    Google 表示其技术与产品已覆盖 300 多种语言、服务超 70 亿人,Gemini 3.5 Live Translate 支持 70 种语言、2000 多个语言对的实时口语翻译,并能处理语码转换和情绪线索。

    推荐理由:Google 集中披露多语言语音与翻译能力进展,读者可了解实时翻译、端侧模型与无障碍功能的落地范围。

9月15日周二
  1. Apple Newsroom88

    苹果发布 Siri AI 与新一代 Apple Intelligence

    苹果发布新一代 Apple Intelligence,驱动全新版本 Siri AI,具备个人语境理解、世界知识、屏幕感知和跨应用操作能力,并集成到 iPhone、iPad、Mac 与 Vision Pro。

    推荐理由:官方一次性给出 Siri AI 的能力范围、上线节奏与地区限制,可据此判断苹果 AI 助手的实际可用边界。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,73 个节点覆盖 11 条媒体管线

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张包含 73 个节点、11 条媒体管线的画布,涵盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 式标注器、背景移除、PNG Info 与图生视频。

    推荐理由:原文完整拆解了用 Gradio Workflow 重建 A1111 的十一条管线,读者可据此判断节点式画布能否替代 ComfyUI 工作流。

  2. OpenAI News67

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。

    推荐理由:OpenAI 官方给出 Agents API 的托管定位与 Codex harness 编排能力,可据此判断云端智能体的搭建方式。

9月9日周三
9月8日周二
  1. Google DeepMind80

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单碱基变异预测

    Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模为 1PB,是 AlphaFold Database 的 30 多倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。

    推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解基因组变异解读的规模化路径。

9月7日周一
9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 推出 Project HydraFusion 多模型编排研究预览

    GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 选用。

    推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三项基准的成本质量数据,可据此判断多模型编排在编码任务上的取舍。

9月4日周五
9月3日周四
  1. Google DeepMind62

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber

    Google DeepMind 推出 Fairwind Program,面向政府机构、关键基础设施运营商和网络安全合作伙伴提供受限访问,首批开放其最先进的网络安全模型 Gemini 3.8 Flash Cyber 与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:原文给出受限访问计划的能力组合与准入标准,读者可据此判断前沿模型在漏洞修复上的落地方式。

9月2日周三
  1. Google AI Blog62

    Google 推出 Fairwind Program,向政府与企业提供 Gemini 3.8 Flash Cyber 网络防御能力

    Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴提供受限访问,首批开放 Gemini 3.8 Flash Cyber 模型与 CodeMender harness,用于自主发现、验证并修复漏洞。

    推荐理由:原文给出受限访问计划的能力组合与准入标准,读者可据此判断前沿模型在漏洞修复上的落地方式。

  2. Google AI Blog72

    Google 在 Workspace 推出图像工具 Google Pics

    Google 在 Workspace 推出图像创建与编辑工具 Google Pics,基于 Nano Banana 图像生成与编辑模型,将在未来几周向所有 Google AI Pro 和 Ultra 订阅者及多数 Workspace 商业客户开放。

    推荐理由:Google Pics 基于 Nano Banana 模型,把图像生成与精细编辑放进 Workspace 现有工作流,可据此判断日常制图方式的变化。

9月1日周二