2026年7月31日 今日AI速览:GPT-5.6缓存折扣90%、Kimi K3开源、LinkedIn举报AI垃圾
编辑按
OpenAI发布GPT-5.6 Sol、Terra、Luna三款模型,已在Amazon Bedrock上可用,并引入显式提示缓存功能,缓存输入可享90%折扣。同时,Google DeepMind推出Gemini Robotics ER 2,Moonshot AI发布2.8万亿参数开源模型Kimi K3,Google利用AI修复Chrome安全漏洞数量激增,LinkedIn新增举报AI生成内容按钮。
主线
1.OpenAI发布GPT-5.6系列模型,缓存输入享90%折扣
AWS宣布OpenAI GPT-5.6全系模型(Sol、Terra、Luna)在Amazon Bedrock上正式可用,同时推出显式提示缓存功能。GPT-5.6分三个能力层级:Sol面向最复杂的推理和智能体编码,Terra适合日常生产负载,Luna用于分类、摘要等高频任务。模型通过Bedrock的bedrock-mantle端点提供,采用OpenAI兼容的Responses API,按token付费,并使用AWS安全与治理控制。
新引入的显式提示缓存允许开发者精确控制哪些提示部分被缓存复用。缓存输入享有90%折扣,缓存保留30分钟。在智能体工作流中——系统指令、工具定义、参考文档重复出现——收益最明显。模型ID为openai.gpt-5.6-sol、openai.gpt-5.6-terra、openai.gpt-5.6-luna。Sol目前仅在美国东部(弗吉尼亚、俄亥俄)可用,Terra和Luna额外支持美国西部(俄勒冈)。
来源: aws.amazon.com · 2026/07/31 00:02
快讯
2.Google DeepMind 新模型 Gemini Robotics 2 实现全身控制
Google DeepMind发布Gemini Robotics 2,一个能控制人形机器人全身的AI模型,覆盖从“脚趾到指尖”的完整动作。这意味着机器人可以执行更精细、更协调的任务,不再局限于单一肢体操作。该模型基于Gemini多模态能力,直接生成低层控制指令,无需中间转换。
在演示中,机器人能完成叠衣服、打开瓶盖、整理桌面等需要全身协调的动作。DeepMind强调,模型对未见过的物体和环境也有一定泛化能力,但未透露具体成功率或部署时间表。当前人形机器人控制多依赖预设程序或分层架构,Gemini Robotics 2尝试用单一模型端到端接管全身控制。如果规模化可行,将大幅降低机器人编程门槛,但也面临实时性、安全性和硬件适配的挑战。
来源: www.theverge.com · 2026/07/31 01:18
快讯
3.Google利用AI修复Chrome安全漏洞数量激增
Google宣布,借助内部AI工具,6月发布的两个Chrome版本(149和150)共修复了1072个安全漏洞,超过此前23个版本(两年内)修复的1036个。Chrome工程总监Doug Turner表示,LLM从根本上改变了网络安全的经济性,将漏洞发现转变为自动化、工业规模的行动。Google使用Gemini等模型主动修复漏洞,速度超过攻击者。
这一趋势并非孤例。微软本月早些时候也宣布,在7月的“补丁星期二”中修复了创纪录的570个安全漏洞,并归因于AI的使用。值得对比的是,苹果尚未出现类似增长。独立统计显示,苹果2026年修复了482个漏洞,与往年速度相当。
来源: techcrunch.com · 2026/07/31 02:57
快讯
4.墨西哥8500美元电动车Olinia:本土制造能否打破低价魔咒?
墨西哥政府支持的电动车项目Olinia近日公布量产计划,起售价8500美元,瞄准本土及拉美市场。这不仅是墨西哥首款国产电动车,更是一次对“低成本+本地化”路线的现实检验。Olinia由墨西哥国立自治大学(UNAM)和蒙特雷科技大学联合研发,采用模块化底盘设计,可衍生出城市通勤车、载货车和微型SUV三种车型。首款车预计2027年投产,年产能目标初期为3万辆。
核心策略是供应链本地化:电池组与墨西哥本土企业合作组装,电机和电控系统由国内供应商提供,以此规避进口关税并降低物流成本。但关键零部件如电芯仍需从亚洲采购,这给最终定价带来不确定性。项目资金来自墨西哥联邦政府和州政府补贴,首期投入约1.5亿美元。Olinia的定位并非与特斯拉或比亚迪直接竞争,而是填补拉美地区廉价微型电动车的空白——该区域目前几乎没有本土量产电动车品牌。
来源: spectrum.ieee.org · 2026/07/31 00:36
快讯
5.Moonshot AI发布2.8万亿参数开源模型Kimi K3
月之暗面(Moonshot AI)发布了Kimi K3,一个2.8万亿参数的混合专家(MoE)模型,成为首个达到3万亿参数级别的开源权重系统。AWS官方博客随后详细介绍了如何在SageMaker HyperPod和EKS上部署该模型。Kimi K3采用Kimi Delta Attention、门控多头潜在注意力和稳定潜在MoE架构,总参数2.8万亿,但每次推理只激活16个专家(共896个),活跃参数约1040亿,相比前代Kimi K2扩展效率提升2.5倍。上下文窗口达100万tokens,原生支持文本和视觉多模态。
模型权重以MXFP4格式在Hugging Face发布,标识符为moonshotai/Kimi-K3。部署需要配备8块NVIDIA B300 Blackwell Ultra GPU的p6-b300实例(ml.p6-b300.48xlarge),推荐使用vLLM推理容器(vllm/vllm-openai:kimi-k3)。AWS提供灵活训练计划和容量块两种方式获取GPU资源。Kimi K3擅长长周期编程、智能体工作流和复杂推理,支持原生工具调用、结构化输出和始终开启的思考模式。开源意味着组织可在自有基础设施上托管这一前沿模型。
来源: aws.amazon.com · 2026/07/31 01:22
观察
6.LinkedIn新增“看起来像AI垃圾”举报按钮
LinkedIn本周四宣布,正在为信息流加入一个“Seems like AI slop”(看起来像AI垃圾)举报按钮,让用户标记疑似AI生成的低质量内容。首席产品官Hari Srinivasan在LinkedIn发帖承认,“AI slop是我们所有人的头号优先事项”,用户来平台是为了与真人连接、分享真实观点与经验。具体措施包括:新的举报按钮将作为信号源帮助LinkedIn训练模型更好地识别AI垃圾;新的分类器会减少推荐中来自用户网络之外的AI低质内容;私信通知用户其帖子因过度使用AI而被他人认为不真实;同时,LinkedIn正在撤下原来用AI帮用户“润色帖子”的功能,改为仅作拼写检查,不改变用户语气。
此外,LinkedIn每天拦截“数十万”条自动化评论,过去几个月已阻止数百万次自动化操作。平台还在扩大个人资料和主页验证工具,并新增屏蔽来自企业主页评论的选项。这一动作的背景是全网对AI生成内容的反感持续升温。上周Substack上线了与Pangram合作的AI检测工具,Pangram本周刚获得900万美元融资;Cloudflare数据显示,机器人流量已超过人类请求。Digg在3月因无法应对机器人大举涌入而关闭了其Reddit竞品。
来源: techcrunch.com · 2026/07/31 02:05