跳到正文
今天10月1日周四
  1. Tom's Hardware84

    AMD 以约 82 亿美元全股票收购李飞飞创办的 World Labs

    AMD 同意以约 82 亿美元全股票收购 AI 模型研究公司 World Labs,联合创始人李飞飞将出任 AMD 执行副总裁兼首席科学家,向 CEO 苏姿丰汇报,交易需通过常规监管审批。

    推荐理由:这笔全股票交易把世界模型团队并入芯片厂商,读者可了解 AMD 在模型与算力协同上的布局逻辑。

  2. IT之家38

    比尔 · 盖茨:用机器人替代人类工作的公司也应纳税

    比尔 · 盖茨提出,若 AI 大规模取代人类工作,可对机器人征收与人类劳动者相同的联邦保险缴款税,用于社会保障和医疗保险等项目,让失业者仍有收入保障。他认为对 AI Token 征税能放慢 AI 取代人类劳动的速度,并筹集资金用于职业再培训和加强社会安全网。盖茨称实体机器人发展落后于 AI 系统,但人们低估了人形机器人追赶的速度。

  3. TechCrunch · AI25

    Destro AI 获 800 万美元种子轮,用 AI 调度层让机器人与人类协同作业

    Destro 结束隐身状态并获得 800 万美元种子轮融资,其 AI 调度层让机器人在物流场景中与人类工人协同作业。该公司在 Yusen Logistics 美国西北部一处设施试点,用 3 台 Miva Robotics 搬运机器人配合 Vision 操作系统运行,现扩展至 26 台机器人部署,并在南加州启动 17 台机器人的新试点。

  4. Semiconductor Engineering22

    人形机器人边缘非易失性存储的挑战与需求

    人形机器人从研究演示走向工厂、仓库和服务场景商用,其分布式边缘控制层对非易失性存储提出耐力、确定性延迟和掉电保持等要求。标准 Flash 与 EEPROM 存在 5 至 10 ms 页写入延迟,掉电或急停会导致位置日志断裂,重启后关节控制器丢失绝对坐标。紧凑关节壳体内温度可超 +100°C,加速电荷泄漏、缩短数据保持寿命,而 F-RAM 具备零写入延迟、100 万亿次写入耐力与抗 EMI 特性。

  5. TechCrunch62

    五角大楼启动 Project Meridian,Musk 与 Luckey 共同牵头研究未来战争

    美国国防部长 Pete Hegseth 在周三的“State of the Force”讲话中宣布启动 Project Meridian,研究技术快速发展下未来战争形态,由 Elon Musk、Anduril 创始人 Palmer Luckey 和前众议院议长 Newt Gingrich 共同牵头,团队需在 120 天内提交研究结果并提出可落地的技术开发、测试与部署方案。

9月29日周二
  1. 极客公园78

    AMD 以约 82 亿美元收购 World Labs,李飞飞将出任执行副总裁兼首席科学家

    AMD 宣布以约 82 亿美元全股票交易收购李飞飞创办的 World Labs,预计 2026 年底前完成交割,仍需监管审批;交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报。

    推荐理由:把 AMD 收购 World Labs 与英伟达收购 Hugging Face 放在同一时间线上比较,读者可看清两家芯片公司对下一代算力需求的不同下注方式。

  2. Latent Space80

    AMD 以 82 亿美元收购 World Labs

    AMD 以 82 亿美元收购 World Labs。World Labs 自 2024 年成立以来构建了图像、视频和空间重建的模型训练能力,并收购 SceniX 推进机器人仿真。其近期发布的 Atlas 是首个解决空间智能中相机新视角预测问题的全模态架构,通过结合生成模型与多视角几何解决了稀疏重建难题,可用于机器人 RL 环境、场景生成和现实世界重建。

    推荐理由:AMD 以 82 亿美元收购 World Labs,读者可了解其空间智能与 Atlas 模型在机器人和设计领域的定位。

9月28日周一
9月26日周六
9月24日周四
9月22日周二
9月15日周二
8月13日周四
  1. Microsoft Research41

    MindTopo 揭示多模态大模型的空间推理短板

    微软研究院推出 MindTopo 基准,用连续性、分离、顺序、包围、绳结五类拓扑任务评测多模态大模型的推理与规划能力。结果显示,模型在静态图像识别上明显强于交互式规划,且两者均远低于人类水平;失败多发生在规划阶段而非感知阶段,模型常在多步动作中丢失结构关系或提出违反物理约束的动作。图像与视频生成仅在单帧关系可见时偶有帮助,序列场景中仍不可靠。

7月30日周四
  1. Google DeepMind71

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型

    Google DeepMind 发布面向机器人的具身推理模型 Gemini Robotics ER 2,可作为机器人的高层大脑,理解物理世界、规划多步任务并把动作执行交给底层 VLA 模型,还能原生调用 Google Search 等工具。

    推荐理由:官方给出 Gemini Robotics ER 2 在进度分类、时刻定位与多机器人协作上的具体指标,可据此判断具身推理模型的当前水位。

7月28日周二
7月1日周三
  1. Berkeley AI Research12

    Berkeley BAIR 实验室 2026 届博士毕业生展示

    Berkeley BAIR 实验室展示 2026 届博士毕业生,研究方向覆盖机器人、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for science 与医疗等领域。毕业生去向包括 OpenAI、Mistral AI、Amazon、Physical Intelligence 等机构,以及 UCLA、普林斯顿 CITP 和芝加哥大学等学术岗位。

4月20日周一
  1. Berkeley AI Research34

    GRASP:面向世界模型长时程规划的梯度规划器

    伯克利 AI 研究团队提出梯度规划器 GRASP,通过将轨迹提升到虚拟状态实现跨时间并行优化、在状态迭代中直接注入随机性以探索、并重塑梯度让动作获得清晰信号,从而让基于学习动力学(世界模型)的长时程规划变得可行。该方法针对长时程 rollout 中梯度爆炸/消失、非贪婪结构导致的局部极小值以及高维视觉模型下脆弱的“状态-输入”梯度问题。

4月13日周一
  1. Google DeepMind72

    Google DeepMind 发布 Gemini Robotics-ER 1.6,新增仪表读数能力

    Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人的推理优先模型升级版,增强了空间推理与多视角理解,并新增仪表读数能力,可读取压力表、液位计等复杂仪表。

    推荐理由:Gemini Robotics-ER 1.6 升级了空间推理与多视角理解,并新增仪表读数能力,可了解机器人在真实场景中的自主性进展。