
8月13日,OpenAI 和 Cerebras 推出了 Ultrafast 模式,这是由 Cerebras 晶圆级引擎(Wafer-Scale Engine)提供支持的服务层级,运行 GPT-5.6 Sol 时输出速度最高可达每秒 750 个 token。Cerebras 表示,其速度比 Fast 模式下的 Fable 5 快 11 倍,比 Opus 4.8 快 5 倍,且质量没有下降。在 Humanity's Last Exam(人类最后的考试)这一只有博士级专家才能回答的 2,500 道问题基准测试中,Ultrafast 用时 11 小时 11 分钟完成,而 Claude Fable 5 需要 78 小时 27 分钟。在 GDP-Val(一项衡量有经济价值的知识工作的基准测试)中,Ultrafast 实现了 5.6 倍的端到端加速。该服务将首先在 OpenAI API 中向一组选定客户提供。
8月13日,谷歌发布了 Gemini 3.7 Flash,面向编程和智能体用例,距离 3.6 Flash 发布仅三周。在 12 月 31 日前,该模型定价为 3.6 Flash 的一半——每百万输入 token 0.75 美元,每百万输出 token 3.75 美元。谷歌还将该模型纳入 Gemini Spark,面向 160 多个地区的 AI Pro 和 Ultra 订阅用户。
8月14日,深度求索(DeepSeek)宣布自 8 月 17 日起实行峰谷 API 定价,非高峰时段价格按高峰时段的一半计算。部分模型的价格涨幅超过 3 倍。旗舰模型 deepseek-v4-pro 在高峰时段的每百万 token 价格显著上涨。此举扭转了深度求索此前作为低成本供应商的策略。
8月13日,联想公布了 2026 财年第一季度业绩:AI 相关收入同比增长 60%,达到 85 亿美元,占总收入的 35%。董事长杨元庆对媒体表示,算力分配正从早期的“80% 训练”转向“80% 推理、20% 训练”的目标,目前比例约为 50/50。
同一批同日发布的公告——一个每秒 750 个 token 的前沿模型、一个半价 Flash 模型,以及一个在其他厂商降价时提价的中国供应商——表明竞争已从“谁最强”转向“谁最快、谁最便宜”。
8月14日,深度求索发布了 V4-Pro 正式版,这是一个 1.6 万亿参数模型,权重以 MIT 许可证发布,原生支持 OpenAI Responses API,并针对 Codex 进行了定向适配。Harness 插件生态进入公开测试。
同一天,据报道,智谱的 GLM-5.3 基础模型拥有 743B 参数,在 CyberGym 上得分 84.5,高于 GPT-5.6 Sol,面向网络防御和编程打造。美团发布了 LongCat-2.0,这是一款 1.6T 参数的混合专家(MoE) 模型,拥有 1M 上下文窗口,在 Terminal-Bench 2.1 上得分 70.8,专注于智能体编程。
8月14日,Grok 4.6 在 CursorBench 真实世界编程排行榜上排名第一,领先 Claude Opus 5 和 GPT-5.6 Sol。xAI 还开源了 Phoenix 的权重,这是它的 X 排名算法,一个基于 Grok 的 Transformer,其合成分数权重偏向传播意图和真实对话,将点赞视为最廉价的信号。
8月13日,Meta/牛津大学的一项研究发现,多模态预训练仅需 5% 的图像生成数据,最佳配比为 70% 语言、25% 图像理解和 5% 图像生成——将图像生成 token 减少了 5 倍。
来自深度求索、美团和 xAI 的开放权重举措,以及针对编程和网络防御的专门基准,标志着向能力专用型模型转变——这些模型在狭窄、可衡量的任务上竞争,而非泛泛的能力宣称。
8月13日,《财富》报道称,Anthropic 计划于 10 月进行首次公开募股(IPO),估值达 2 万亿美元,这将超过 SpaceX 于 6 月 12 日完成的 1.77 万亿美元 IPO,成为史上规模最大的一次。Anthropic 的年化收入已于 5 月超过 470 亿美元,并于 6 月向美国证券交易委员会(SEC)秘密提交了上市申请。
8月14日,《日经新闻》报道称,腾讯将收购 Meta 在 AI 开发商 Manus 的股份,成为其最大股东。Manus 由 Butterfly Effect 于 2025 年 3 月推出,在获得美国投资后,将总部迁至新加坡,并削减了中国业务。4 月,中国外商投资安全审查禁止了 Meta-Manus 收购案;8 月 11 日,Manus 宣布脱离 Meta,恢复独立运营。
8月14日,媒体报道称,Google DeepMind 正在重组,从前沿模型研究转向成本高效的 Flash 级模型,裁员规模可能达到三分之一或更多。Demis Hassabis 于 8 月 5 日卸任首席执行官(CEO),转任董事长兼 Alphabet 首席科学家。此次重组与谷歌下一代旗舰 Gemini 模型的延期以及内部在发展重点上的争议有关。
8月14日,路透社报道称,苹果与阿里巴巴共同训练了一款面向中国市场的大语言模型(LLM),结束了此前对第三方模型的依赖。Apple Intelligence 预计将在未来几个月内在中国推出,此前该公司于 7 月 15 日向监管机构提交了“Apple Intelligence”端侧生成式 AI 服务申请。
8月13日,马斯克对 SpaceX 员工表示,SpaceXAI(原 xAI)数据中心的电力容量到 2027 年底将增长约 7 倍,达到 10GW,目前孟菲斯和南海文两地合计为 1.4GW。他估计,10GW 每年可带来 3000 亿至 5000 亿美元的年收入。
同一天出现了两个 2 万亿美元规模的信号,以及两个中国市场动作:Anthropic 的 IPO 估值,以及苹果的中国模型战略——与此同时,腾讯吸纳了 Manus,谷歌则从前沿领域收缩。
8月13日,在巴尔的摩举行的 USENIX 安全研讨会上,伯明翰大学和杜伦大学的研究人员披露了“Download More RAM”攻击,它利用 DDR4/DDR5 SPD 芯片中缺少写保护这一缺陷,在无需物理接触的情况下绕过 Windows 11 防护。该缺陷允许软件重写内存配置数据,使 Windows 将 RAM 虚报为 2 倍容量,并创建内存别名以读取或修改受保护区域。它可禁用防病毒软件、攻破已锁定的企业系统,并绕过内核反作弊机制。微软将其编号为 CVE-2026-23670,并在 2026 年 4 月的安全更新中加入了缓解措施;启用安全启动(Secure Boot)的系统受到保护。Corsair、G.Skill 和 ADATA 均至少有一条受影响的产品线。
8月6日,一篇被 ACM AI 领导力峰会录用的论文发现,商业 AI 检测器无法可靠地区分 AI 编辑与全文草稿。轻度“仅润色摘要”的编辑被标记的比例为 64%–80%(Pangram/GPTZero),而未经修改的 2023–2025 年原创内容被标记的比例为 9%–15%。经过“Undetectable AI”人性化处理后,被标记为 AI 的改写内容中仍被标记的比例不足 4%。诚实的 AI 编辑比借助人性化工具规避检测面临更高的处罚风险。
同样在本周,一篇技术分析认为,文本 AI 水印始终极容易被去除;而欧盟《人工智能法案》第 50 条要求输出“可被检测为人工智能生成”,该要求自 2026 年 8 月起强制执行。SynthID 风格的 token 采样可以通过任何较弱的 LLM 进行改写来去除,Unicode 同形字水印可以通过替换字符去除。该分析指出,Claude Code 此前曾使用同形字隐写术来标记某些请求。
8月13日,OpenAI 为 ChatGPT Mac 应用推出了 Computer History,用 macOS 辅助功能事件日志(点击、输入、快捷键、应用切换)取代了 Chronicle 截图式预览。事件在本地存储最多 48 小时,随后在服务器端生成记忆后被删除。隐私模式活动除外。该功能面向 Pro、Business 和 Enterprise 用户推出,但不包括欧洲经济区(EEA)、瑞士和英国。
8月14日,ChatGPT 获得了直接编辑 Google Docs、Sheets 和 Slides 的能力,无需切换标签页,该功能向 Plus、Pro、Business 和 Enterprise 用户推出。
硬件级攻击、失效的检测器以及极易被去除的水印都有一个共同前提:用于验证 AI 内容和保障系统安全的基础设施落后于模型本身。