OpenRouter 从种子轮到 Stripe:Alex Atallah 与 Anjney Midha 谈多模型路由与代币欺诈
OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 在播客中回顾了 OpenRouter 从 Llama、Alpaca、Mistral 早期浪潮中起步、成为服务超 1000 万开发者的中立路由层的过程,平台目前日均处理超 10 万亿 token。
OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 在播客中回顾了 OpenRouter 从 Llama、Alpaca、Mistral 早期浪潮中起步、成为服务超 1000 万开发者的中立路由层的过程,平台目前日均处理超 10 万亿 token。
美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,国防部有权因 Anthropic 拒绝向军方开放 Claude 的某些功能而将其列入黑名单,即使 Anthropic 并无恶意。裁决称此案涉及军事使用强大新技术的难题,并指出国防部长在《供应链安全法》和宪法下未越权,因此驳回复审请求。该法院此前已在 4 月驳回 Anthropic 的紧急暂缓执行申请。
据 The Information 报道,特斯拉在得州和加州的工厂工人被要求穿戴记录动作的特制服装为 Optimus 采集模仿学习数据,部分工人因认为机器人最终会取代自己而抵触,特斯拉已将数据采集转交给专门团队并设立训练中心。
比亚迪宣布全新旗舰纯电轿车大汉将于 10 月 13 日上市,CLTC 续航最高 1008 公里(626 英里),8 月 21 日成都车展已开启预售,起售价 249,900 元(约 37,200 美元)。
慕尼黑 CESifo 经济学家 Robert Fairlie 与 Jane Wu 的新工作论文发现,没有证据表明应届大学毕业生在绝对或相对层面上出现显著、广泛的岗位替代或招聘减少,结论与斯坦福此前关于"AI 影响职业"入门级就业落后的研究相反。
由 Plug In America、Electric Vehicle Association、EVHybridNoire、Drive Electric USA 和 Sierra Club 组织的 Drive Electric Month 已进入第 16 年,本月在全美多数州及加拿大举办超过 150 场线上和线下活动,持续至 10 月初。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理服务,销售提升 60%,节省 75+ 小时。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义的双向界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码。
Genesis GV90 配备可弹出式 24.6″ OLED 显示屏,行车时为 23.6″,驻车后一键扩展至 24.6″ 并进入 Media Home 模式,可看 Netflix、直播电视和流媒体音乐,搭配 25 扬声器 Bang & Olufsen Premier 3D 音响与 Dolby Atmos。
欧盟 TCMV 10 月 6 日会议议程只安排 25 分钟继续讨论荷兰提出的 FSD 全欧授权请求,未列入投票,而该委员会下次开会要等到 12 月,因此特斯拉 FSD 的欧盟投票最早也要到 12 月。
John Gruber 评论 Meta 的 Muse,认为它技术上具有突破性,每个用户都能在 Meta 云端获得一台持久运行的完整 Linux VM,且安装使用门槛低,被包装成可爱的吉祥物形象。
Electrek 播客本周讨论 Tesla Semi 终于进入量产、吉利 AI 快充可"修复"电池并提升 20% 循环寿命,以及 Rivian R3 将比 R2"大幅"更便宜、R4 更低。节目还涉及福特 Fathom 前备箱尾门专利、Bentley 首款电动车 Torcal(888 PS、375 英里续航)、VinFast VF Wild EREV 皮卡和大众电动小巴再度推迟入美。
AWS 在 Amazon EKS 上结合 EFA 与 DeepEP 优化 MoE 模型的强化学习后训练,实现吞吐量提升 40%。该架构针对 rollout 生成与策略训练并行的异步 RL 负载,缓解 Expert Parallelism 带来的跨节点 all-to-all 通信瓶颈,适用于 RLHF、PPO 和 GRPO 等大规模训练流程。
大众为清理库存,对 2025 款 ID.4 提供 12,500 美元客户现金折扣,2026 款折扣为 6,000 美元,但官方称库存"非常有限"。ID.4 已于 4 月在田纳西州查塔努加工厂停产,为燃油 SUV 让路,其继任车型将更名为 ID. Tiguan,预计 2026 年底正式亮相。
在 Amazon SageMaker HyperPod 上,用开源 RL 框架 SkyRL 对 Qwen3-VL-8B 视觉语言模型做 GRPO 后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
AWS 的 NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率并实时流式返回结果,服务超过 4000 名 AWS 高管。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,其中约 90% 的查询走单次快速路径,仅约 10% 走并行批处理路径。
特斯拉新专利申请描述了一款隐藏式两片主动尾翼,展开后可产生最高 700 kg 下压力,收起时与车尾齐平。该尾翼可在 3 秒内完成展开、0.25 秒内调整角度,并支持 DRS 模式将下压力降至 0 kg。专利图纸中的车型外观与新一代 Roadster 高度吻合,而特斯拉计划于 10 月 1 日在得克萨斯州发布该车。
阿里云 Qwen 团队的 Qwen3-TTS-12Hz-1.7B-Base 已上架 Amazon SageMaker JumpStart,可部署为全托管实时推理端点,仅凭几秒参考音频和对应文本即可克隆音色,无需重新训练。
Datacor 将 Amazon Quick Sight 嵌入 TrackAbout,为工业气体与焊接分销商提供交互式仪表盘和自然语言查询,业务用户无需再提 IT 工单即可分析租赁数据。TrackAbout 客户合计管理 2750 万件资产、每月处理超 72.5 万张账单,方案通过跨云管道将运营数据定时刷新至 SPICE。
美国国防部在预算申请中提出五年内投入 3030 万美元,推进名为 Polygraph+(又称 Polygraph Next)的测谎项目,重点研发 AI 与机器学习评分算法及无需接触人体的“standoff sensing”生理读取技术。该项目由国防反情报与安全局(DCSA)负责,用于人员审查和“内部威胁检测”,预算尚待国会批准。
Latent Space 计划将 AINews 升级至 v3,并把 Latent Space Discord 与 AINews 的职能合并,同时探索迁移至 Beehiiv 和新主页。
Simon Willison 表示,与编程智能体打交道越多,他越确信这些工具让软件工程变得更难。它们能做出惊人的成果,但要释放全部潜力,需要极高的纪律性和知识储备。
Simon Willison 发布 commit-rewriter 0.2。该工具与 git 相关,具体功能与更新细节原文未作说明。
GitHub Copilot 提出聊天并非与 AI 协作的最佳界面,其应用内的 canvas 是可运行完整全栈应用的交互面板,能与 Copilot 智能体双向通信并调用第三方 API、在本地执行代码。文中演示了用 canvas 构建 Connect 4 游戏、Winget 包管理界面和 SQLite 操作界面,并称工作流自动化 canvas 花了大半天才调好设计与自动化。
Google Research 发布 AI video co-director 多智能体框架,在 Gemini 和 Veo 之上规划多镜头叙事的视觉连续性,并原生继承 SynthID 水印等安全机制。
推荐理由:Google 把长视频生成拆成规划、分镜、自回归合成与闭环修正四套框架,读者可了解多智能体如何抑制角色漂移与语义漂移。
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。同时,Datasette 的所有模态对话框被重构为单一 Web Component,并已开放文档供其他插件使用。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体便会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上加入近实时视频生成,让对话模型具备能听、能看、能说的动态视觉形象,并已在 Gemini Enterprise 上线。
推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解多模态对话在企业场景中的形态变化。
随着语言模型规模扩大,稠密架构的扩展成本越来越高,因为每个 token 都要经过所有层,训练和推理算力随之上升。MoE 架构改用多个子网络(专家),每个 token 只激活其中一小部分,从而以不同方式实现扩展。
Liquid AI 发布实验性草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,端侧解码最高提速 3.13x、H100 上最高 2.66x,端到端最高提升 2.62x 和 2.27x。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。
推荐理由:读者可了解开放病毒蛋白复合物数据集与配套 GPU 加速流程,及其对疫苗与药物靶点研究的可用性。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
NVIDIA 发布 NV-Reason-CT Open,这是一款面向 3D CT 扫描的开放视觉语言模型,支持放射科医生的链式推理(Chain-of-Thought)。现有通用前沿模型在体数据成像上表现不佳,多数开放医学 AI 模型也缺乏相关能力,而 3D CT 这一临床信息最丰富、数据最密集的模态长期被现代 VLM 忽视。
三星电子与 KT、SK Telecom 签署韩国科学技术信息通信部“Hyper AI Network”计划下的 AI RAN 项目合同,分别担任 KT 的独家全球供应商和 SK Telecom 的主要供应商,是唯一同时入选两个项目的合作伙伴。
NVIDIA 指出 GPU 集群即使所有 GPU、网络链路和 pod 均报告健康,512-GPU 训练任务仍可能性能不达标或失败,原因可能是单块 GPU 变慢、链路在负载下降级或配置悄悄将流量导向更慢路径。这类问题往往要到训练运行数小时后才被发现。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 PR 做压力测试。方案是把文档高度拆成确定性的代码几何与动态评论块两套几何:代码行高提前精确算好,评论高度按块懒测量、修正幅度小且锚定在用户当前视口,避免滚动跳变。
NVIDIA 发布 NodeWright,用于管理 Kubernetes 节点本身,覆盖内核设置、系统软件包、存储布局、安全代理以及 GPU 工作负载依赖的主机级调优。该工具针对团队目前依赖 Ansible playbook、自定义脚本和手动 runbook 的做法,这类方式在新区域新建集群或内核升级破坏 RDMA 时容易失效。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam,可无缝接入 Google Meet 和 Zoom。
Simon Willison 发布 Gemini 3.8 TTS Playground,一个自带 API key 的交互界面,可合成单人或多人对话语音、预览音频并查看请求与响应细节,设置可保存为可分享的 URL。
一份可交互示例讲解 shadow roots 与 shadow DOM,演示样式封装、继承、slots、parts 以及 JavaScript 访问方式,展示 shadow root 如何创建带私有样式表和元素的隔离 DOM 树,并以特定受控方式与页面 DOM 交互。该示例由 Fable 5.1 Medium 根据提示词生成。