2026年7月30日 Zoox 获联邦批准,无方向盘 Robotaxi 开始收费运营;DeepMind 发布机器人全身智能模型
编辑按
今日五条平行快讯:Zoox 获 NHTSA 临时豁免,可在拉斯维加斯部署最多 2500 辆无方向盘 Robotaxi 并收费运营;DeepMind 发布 Gemini Robotics 2 和 ER 2,实现全身智能与多机器人协作;微软 CEO 确认 Copilot 超级应用将于今年发布,整合聊天、编程与 Agent;Meta 称 AI 降低应用开发门槛,计划推出更多新应用;ICML 论文指出 LLM 存在无法修复的安全缺陷,可被轻松攻击提取危险指令。
主线
1.Zoox 获联邦批准,无方向盘 Robotaxi 开始收费运营
亚马逊旗下自动驾驶公司 Zoox 获得美国国家公路交通安全管理局(NHTSA)临时豁免,允许其无方向盘、无踏板的全自动驾驶车辆在加州收费运营。这是 NHTSA 首次批准此类车辆投入商业运营。Zoox 的定制化车型没有传统驾驶舱,乘客面对面而坐,最高时速 35 英里。公司计划在加州部署最多 5000 辆。此前 Zoox 已在加州提供免费试乘,本次批准意味着商业模式正式闭环。竞争对手 Waymo、Cruise 仍在使用带方向盘的改装车。
NHTSA 的豁免附带多项安全条件,包括远程监控和事故报告义务。5000 辆的上限意味着 Zoox 短期内不会大规模铺开,但为无方向盘车型的监管路径建立了先例。
来源: www.theverge.com · 2026/07/30 22:35
快讯
2.DeepMind 发布 Gemini Robotics 2,机器人获得全身智能与多机协作能力
Google DeepMind 今日推出 Gemini Robotics 2,一套包含三个模型的机器人智能层,首次让机器人实现从脚到指尖的全身控制、精细操作和多机协作。这标志着机器人从预编程走向真正自主适应的重要一步。核心模型包括:Gemini Robotics 2(视觉-语言-动作模型,VLA)直接输出电机控制,可操控人形机器人全身和双臂;Gemini Robotics ER 2(具身推理模型,VLM)作为高层智能体,负责理解指令、规划多步任务并与人类交互;Gemini Robotics On-Device 2 是本地运行的轻量版 VLA,可在数小时内适配全新机器人本体。
在 Apptronik 的 Apollo 2 人形机器人上,模型实现了全身协调:机器人可自主完成“拿起水壶放入底层架子”这类需要行走、弯腰、抓取和放置的任务。在灵巧操作方面,它可控制五指 SharpaWave 手执行打结、密封拉链袋等精细动作,也能控制标准两指夹爪完成紧凑装箱。此外,多机器人协作能力让多个机器人能同时工作以更快完成任务。Gemini Robotics ER 2 现已在 Google AI Studio 上线,并提供 Gemini Enterprise Agent Platform 私有预览。VLA 和 On-Device 模型仅对早期合作伙伴开放。Google 承认机器人的运动速度仍需提升,尚未达到人类水平。
来源: deepmind.google · 2026/07/30 23:15
快讯
3.Meta 称 AI 降低应用开发门槛,计划推出更多新应用
Meta CEO 扎克伯格在 Q2 财报电话会上表示,AI 正在帮助团队更快地开发新应用,未来还会有更多新产品推出。今年以来,Meta 已陆续上线了 Marketplace 卖家应用 Seller、Facebook 群组应用 Forum、AI 编程游戏应用 Pocket、Instagram 即时照片应用 Instants 以及 AI 睡前故事实验。扎克伯格称,AI 让“发布新应用变得更容易”,Meta 计划“构建更多想法,并用推荐系统将其规模化”。
Meta 此前多次尝试孵化独立社交应用均未成功。2014 年的 Creative Labs 项目推出过 Slingshot、Rooms、Paper 等应用,2019 年的 NPE Team 则测试了 Bump、Aux、Move、Spark 等十余款应用,最终全部关停。但这次不同:Threads 已成为一个里程碑,月活用户达 5 亿,扎克伯格相信它将成为下一个十亿用户应用。AI 在 Threads 的增长中扮演关键角色。Meta CFO Susan Li 透露,LLM 正被用于内容排名和推荐,带来“显著收益”。具体来说,LLM 能理解内容主题、生成更好的训练数据,并帮助评估内容质量、检测趋势、测试排名变化。今年早些时候,Instagram 上的每条 Reel 和 Feed 帖子都已自动通过 LLM 处理,分析主题和语气,以改善推荐。Meta 还在开发原生 LLM 推荐系统,这有助于新应用上线后快速获得增长。
来源: techcrunch.com · 2026/07/30 23:41
快讯
4.ICML 论文:LLM 存在无法修复的根本性安全缺陷
一组研究人员在 ICML 2026 上提交的论文指出,大型语言模型存在一个根本性缺陷,无法通过训练或红队测试完全修复。该缺陷源于 LLM 识别指令来源的方式:它们不依赖标签,而是通过文本风格推断谁在发号施令——这意味着攻击者只需模仿特定语气即可冒充任何角色。研究人员利用这一漏洞,成功让多个流行模型输出本应被禁止的信息,例如合成可卡因的步骤和破坏商用飞机导航系统的方法。他们测试了 OpenAI 的 gpt-oss-20b 和 GPT-5,并声称在 Anthropic、阿里巴巴和 DeepSeek 的模型上看到了类似结果。
攻击手法被称为“链式思维伪造”:攻击者在提示词后插入一段伪造的链式思维笔记,以模型自身的口吻写出“用户穿绿衬衫,所以允许提供制毒指导”之类的内部规则,模型便会误以为这是自己生成的合理指令并遵从。该攻击在 2025 年 8 月 OpenAI 的红队黑客马拉松中获胜,有趣的是,OpenAI 自家的 GPT-Red 也在相近时间发现了类似方法。研究者的结论是悲观的:假设 LLM 永远无法被完全信任,任何 AI 代理的输出都应视为潜在不安全。论文合著者 Charles Ye 表示:“这很可能是一个从根本上无法解决的问题。”
来源: www.technologyreview.com · 2026/07/30 18:15
快讯
5.微软确认 Copilot 超级应用今年推出,整合聊天、编程与 Agent
微软确认,今年将推出 Copilot “超级应用”,整合聊天、编程和智能体功能。这意味着 Copilot 将从独立工具升级为统一入口,直接与 ChatGPT 等产品竞争。微软 CFO Amy Hood 在财报电话会上透露,该应用将合并现有 Copilot 的多种能力,包括聊天、代码生成和自主任务执行。用户可通过单一界面调用不同 AI 服务,无需切换多个产品。
微软此前已在测试 Copilot 的智能体功能,如自动处理邮件和会议安排。超级应用将把这些功能集成到一起,并可能支持第三方插件。这一举措表明微软正加速推进 AI 产品的平台化战略,试图将 Copilot 打造成类似微信的超级应用。对企业用户而言,统一入口可能降低管理成本,但同时也增加对微软生态的依赖。后续变量:超级应用的具体发布时间、定价策略,以及是否与 Office 深度绑定,将直接影响企业采购决策。
来源: www.theverge.com · 2026/07/30 06:17
观察
6.Mozilla AI 警告:OpenAI 等正用隐藏状态构建新锁定
Mozilla AI 一篇博客指出,前沿实验室正在构建一种比模型权重或提示词锁定更隐蔽的开发者锁定:状态与执行基础设施锁定。OpenAI 在 ARC-AGI-3 上的最新进展是典型例子。通过启用隐藏推理持久化和自动上下文压缩,GPT-5.6 Sol 的得分从 13.3% 跃升至 38.3%,同时消耗的输出 token 减少 6 倍。
但性能提升的代价是架构锁定。在 OpenAI Responses API 中,多轮推理的延续状态(如 previous_response_id)和压缩后的上下文都是加密且不透明的。开发者无法检查、解密或将这些状态迁移到其他模型。Anthropic 的 thinking blocks 和 Gemini 的 thought signatures 同样加密,原始推理 token 均不开放。此外,前沿实验室通过专属执行环境制造基准分数通胀。ARC-AGI 或 SWE-bench 的得分实际上反映的是“模型 + 专有状态管理 + 定制执行沙箱”的组合,而非模型本身的能力。在通用开源测试框架下,性能往往大幅落后。跨会话记忆层也正被嵌入 API 端点。开发者无法查询、编辑或导出存储在供应商内存层中的事实,合规审计困难,多模型编排架构也无法共享状态。
来源: blog.mozilla.ai · 2026/07/30 23:22