三星为冰箱和洗衣家电推送 Tizen OS 10.0 更新,引入 Google Gemini 与 Bixby
三星宣布自 9 月起向部分在售冰箱和洗衣家电推送 Tizen OS 10.0 更新,使其获得今年新品同款服务与功能。
三星宣布自 9 月起向部分在售冰箱和洗衣家电推送 Tizen OS 10.0 更新,使其获得今年新品同款服务与功能。
GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 选用。
推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三项基准的成本质量数据,可据此判断多模型编排在编码任务上的取舍。
NVIDIA 推出 PAIR 虚拟推理路由器,可将本地网络中的可用算力扩展给 AI 智能体使用。该方案面向多智能体工作流:主智能体把复杂任务拆解并分派给专用子智能体,用户也可同时运行多个智能体会话,这种广度优先方式能加快任务完成速度。
Hugging Face 发布 funes,一个为 Claude Code、Codex、pi 和 Hermes 等编码智能体提供持久记忆的本地记忆层,通过一条命令即可接入。
推荐理由:funes 把编码智能体的历史会话变成可检索的本地记忆,读者可据此判断跨智能体、跨机器的上下文延续方式。
Google DeepMind 推出 Fairwind Program,面向政府机构、关键基础设施运营商和网络安全合作伙伴提供受限访问,首批开放其最先进的网络安全模型 Gemini 3.8 Flash Cyber 与 CodeMender 工具链,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入标准,读者可据此判断前沿模型在漏洞修复上的落地方式。
Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴提供受限访问,首批开放 Gemini 3.8 Flash Cyber 模型与 CodeMender harness,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入标准,读者可据此判断前沿模型在漏洞修复上的落地方式。
Google 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体,每百万 token 价格为首发 3.6 Flash 的一半。
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体视频理解功能,通过原生视频工具动态搜索和检查视频片段,替代固定帧率的静态处理。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明在长视频场景下与静态逐帧处理的差异。
NVIDIA 开发者博客介绍用 NVIDIA Nemotron 构建自适应智能体网络安全系统,让智能体在安全运营中协调工作并追求长周期复杂目标。现有许多实现仍依赖既有告警、预定义工作流和已知攻击行为,更难的问题在于识别防御盲区并将这些缺口转化为改进。
Google 在 Workspace 推出图像创建与编辑工具 Google Pics,基于 Nano Banana 图像生成与编辑模型,将在未来几周向所有 Google AI Pro 和 Ultra 订阅者及多数 Workspace 商业客户开放。
推荐理由:Google Pics 基于 Nano Banana 模型,把图像生成与精细编辑放进 Workspace 现有工作流,可据此判断日常制图方式的变化。
三星 Galaxy Z 系列在 Galaxy Unpacked July 2026 推出 My FanCam,用户选中视频中某个人物后,该功能会自动全程跟踪其运动。
Hugging Face 发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行 WebGPU kernel 的 JavaScript 库,同时上线 207 个以独立仓库形式发布的 kernel(Apache-2.0 许可),每个都带有 manifest、正确性用例、基准用例和 WGSL 着色器模板。
推荐理由:Hugging Face 开源 207 个 WebGPU kernel 并给出与 ORT WebGPU 的逐算子对比,可据此判断浏览器端推理的优化空间。
NVIDIA BioNeMo NIM 微服务现可在 Claude Science 中运行,用于蛋白质结构预测。该集成面向智能体式 AI 科研流程,让 AI 科学家能够读取论文、提出假设、调用模型并确定后续实验优先级。BioNeMo NIM 此前已在软件工程领域验证价值,如今扩展至更需迭代的科学研究场景。
NVIDIA Omniverse NuRec 用于跨车型平台扩展自动驾驶感知,解决同一套感知软件换到新车型后感知结果变化的问题。传感器布局、标定、视场、遮挡、车身几何、时序与覆盖范围都会随车型改变,例如交通灯在画面中的位置可能不同。
Google 为 Search 的 AI Mode 加入三项旅行能力:航班价格追踪、积分或里程价格查询,以及酒店预订。
推荐理由:Google 把航班价格追踪、积分里程比价和酒店预订整合进 AI Mode,读者可据此判断搜索入口正在承接交易闭环。
NVIDIA 发布 NVLink Fusion,为下一代 AI 基础设施带来 NVHBM。原文指出,AI 工厂需支撑越来越大的模型和更复杂的推理负载,超大规模厂商与 AI 原生公司正在开发自研 AI 加速器 XPU,而规模化部署这些加速器需要高带宽内存(HBM)以及足够的封装和硅面积来支撑更多算力。
推荐理由:NVIDIA 官方介绍 NVLink Fusion 如何把 NVHBM 引入下一代 AI 基础设施,可了解其面向 XPU 的互连与内存思路。
Google Search 推出 5 种家居装饰用法:AI Mode 可上传房间照片预览沙发等家具摆放效果,Lens 拍照识别复古单品并找同款,Circle to Search 在 Pixel 和 Samsung Galaxy S26 上圈选视频或社交帖中的装饰找相似款。
NVIDIA 发布 CUDA Python 1.0,主打稳定 API、统一基础和全平台访问。文章回顾了 Python 开发者使用 GPU 的两条路径,一是自己用 CUDA C++ 写扩展并维护绑定,二是依赖 PyTorch、CuPy、RAPIDS 等上层库,后者虽让 Python GPU 生态繁荣但存在局限。
推荐理由:CUDA Python 1.0 把稳定 API 与全平台访问作为目标,读者可据此判断 Python 开发者接入 GPU 的路径变化。
三星电子于 9 月 1 日至 6 日在首尔东大门设计广场(DDP)举办 Design Miami Seoul 2026 特展“Design Is an Act of Love”。14 位韩国艺术家以三星产品为灵感创作原创作品,每件作品经 AI 呈现于 OLED TV S95H,并配以成为作品一部分的定制画框。
三星在 One UI 9 上为第八代 Galaxy Z 系列升级 Smart Switch,iOS 用户无需单独安装应用,扫描新机上的二维码即可开始传输数据,并支持无线连接。
Gradio 内置的 gr.Workflow 把多步 AI 管线描述为带类型节点的图,并直接生成可拖拽运行的画布界面。每个输出节点同时成为以标签命名的 REST 端点,可用 Gradio client 或 curl 调用,也能一键部署到 Hugging Face Spaces。
三星在 Galaxy Unpacked July 2026 伦敦活动上展示了 Samsung Health 的 Connected Care 愿景,由数字健康团队负责人 Dr. Hon Pak 与认知神经科学家 Dr. Dong-seon Chang 对谈。
Mistral 发布 Agentic Search,一个面向企业复杂文档的多步检索层,通过 search、open、navigate、read、grep 五个工具让模型在索引之上迭代查找并核对证据。
推荐理由:Mistral 给出 Agentic Search 在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可对照传统 RAG 判断检索层改造的收益。
Google 在 Search 的 AI Mode 和 AI Overviews 中推出五项学习功能:生成交互式可视化工具、定制练习测验、Lens 拍照分步讲解、AI Mode 笔记本以及根据上传文件生成学习文档。
三星为兼容的 Android 三星交互显示屏推出内置应用 Samsung AI Assistant,包含 Live Transcript、Circle to Search、AI Quiz 和 My Lessons 四项功能。
三星在 One UI 9 中为 Galaxy Z Fold8 Ultra、Galaxy Z Fold8 和 Galaxy Z Flip8 新增「Warranty and care」菜单,将保修查询、设备诊断、维修预约与客服支持整合进设置。
三星与维也纳艺术史博物馆达成合作,将 43 件馆藏名作以 4K 分辨率上线 Samsung Art Store,面向全球兼容三星电视用户开放。作品涵盖勃鲁盖尔《巴别塔》、维米尔《绘画的艺术》、克里姆特《裸体真理》以及鲁本斯、委拉斯开兹、卡拉瓦乔、提香、伦勃朗和拉斐尔等人的画作。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,可直接加载 PyLate、Stanford-NLP ColBERT 以及 colpali-engine 的视觉文档检索模型。
推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入成本与索引开销。
Mistral 宣布 Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行,同时 Mistral Priority Tier 进入公开预览,提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理端点、SLA 保障层级与第三方开源模型接入打包成一套主权 AI 方案,可据此判断企业部署时的区域与合规选项。
Baseten 正式加入 Hugging Face Hub 的 Inference Providers 生态,首批支持对话与文本生成任务,可调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开源权重模型。
Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由:Diffusers 原生接入 Nunchaku 4-bit 推理,给出显存与延迟对比数据,可据此判断消费级 GPU 跑扩散模型的门槛变化。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Tinkering Lab 教师提供 24/7 备课与培训助手。该工具基于 NotebookLM 组织 12 个核心模块内容,支持 10 个模块的项目生成,初期覆盖 8 种语言,底层采用 Gemini 3.5 Flash 模型。首批试点覆盖印度 100 所学校。
Mistral Studio 现已上线 Prompts 和 Skills 管理功能,为每个提示词和技能提供版本化、归属和可追溯的集中记录。每个版本不可篡改,支持回滚、对比、分类标签和审计日志,资产可通过 MCP server 直接在生产环境执行。该功能面向 Mistral Studio 客户开放,数据保留在企业边界内。
Hugging Face 宣布 vLLM 的 transformers 建模后端在多个 LLM 架构上已达到或超过 vLLM 手写原生实现的吞吐。在 Qwen3-4B 单卡、Qwen3-32B 张量并行、Qwen3-235B-A22B-FP8 MoE 数据加专家并行三种配置下,该后端均追平或超越原生吞吐。
推荐理由:原文给出 transformers 后端在 vLLM 中追平原生实现的具体架构与并行配置,读者可据此判断迁移成本。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者可在支持的模型页点击 Customize on SageMaker AI 或 Deploy on SageMaker AI,一键进入 SageMaker Studio 并自动预加载模型、秒级创建预配置权限的新域。
微软在 Build 2026 宣布 Foundry Managed Compute 与 Hugging Face 模型集合,提供每周刷新的开源权重模型目录,可一键部署到托管 GPU 平台。
推荐理由:原文给出模型目录、运行时与一键部署路径,读者可据此判断开源模型在企业侧的上手成本。
Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此了解开源机器人学习栈的新能力边界。
Hugging Face 与 SkyPilot 联合推出 store: hf 存储后端,用一条 hf:// URL 和现有 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多家云、Kubernetes、Slurm 和本地集群上运行。
推荐理由:原文给出跨云挂载 Hub 数据的具体配置与实测吞吐,读者可据此判断能否省下跨云读取成本。
Hugging Face 为 Kernels 项目引入 Hub 上的 "kernel" 新仓库类型,并默认只加载可信发布者的内核,其他来源需显式传入 trust_remote_code=True。
Hugging Face 与 Cerebras 联合演示了一套实时语音到语音的开源流水线,用 Cerebras 加速 Gemma 4 31B 推理。该架构采用模块化设计,依次由 NVIDIA Parakeet 做语音识别、Gemma 4 VLM 在 Cerebras 上推理、阿里 Qwen3TTS 做文本转语音,各层均可替换。
推荐理由:原文给出可复用的开源语音到语音架构与各层组件,读者可据此评估实时语音交互的搭建方式。