
8 月 18 日,OpenAI 在聚合平台 OpenRouter 和 Vercel AI Gateway 上将 GPT-5.6 Sol 的价格下调了 50%,为期一个月,输入价格降至每 100 万 token 2.50 美元,输出价格降至每 100 万 token 15 美元。该模型支持 100 万 token 上下文,面向复杂推理和编码。SemiAnalysis 指出,此举可能是一种营销策略——聚合平台在 OpenAI 的 token 量中占比很小,但却是第三方估算其市场份额的主要数据来源。
同一天,斯坦福大学的一个团队报告称,从 DeepSeek V4 Flash 采样五个答案并让模型对自己的输出评分,将 Terminal-Bench 2.1 准确率从 79% 提升至 88%,以约 1/11 的成本超越了 Claude Fable 5。该框架已开源。阿里巴巴 Qwen 团队确认,其 27B 开源模型 Qwen3.8 可在 RTX 3090 上以 Q5 量化本地运行,并在单提示生成方面接近 GPT-5.6。
顶端价格下调和低成本开源模型缩小差距在同一 24 小时内发生。差异化重点正从“更强的模型”转向“更便宜的推理”。
8 月 17 日,Groq 宣布完成 3.5 亿美元 A 轮融资,估值 35 亿美元,由 Disruptive 领投,英伟达计划参投。该公司已从 AI 芯片开发商转型为 Neocloud 提供商。去年 12 月,它与英伟达签署了一份价值 200 亿美元的非排他性许可协议,涵盖 LPU 推理 ASIC 授权;今年 8 月,它成为英伟达云合作伙伴。算力容量预计将从目前的 54MW 增长到 2027 年的超过 200MW。
英伟达首席执行官黄仁勋当天表示,AI 工厂下一阶段关键的稀缺资源是土地、电力和数据中心主体建筑——芯片短缺已分阶段缓解。英伟达与软银旗下 SB Energy 正在投资俄亥俄州一处前铀浓缩设施,起步容量为 4.25GW,并具备扩展至 8GW 的空间。
8 月 17 日,字节跳动 Seed 与清华大学人工智能研究院(Tsinghua AIR)联合发布 CUDA Agent,这是一套智能体强化学习系统,可训练模型编写 GPU 内核,性能超过编译器。在 KernelBench 上,其通过率达到 98.8%,相较 torch.compile 的几何平均加速为 2.11 倍,其中 96.8% 的情况快于编译。Level-3 结果比 Claude Opus 4.5 和 Gemini 3 Pro 高出约 40 个百分点。权重未公开;包含 6000 个样本的数据集、SKILL.md 和奖励方案均已公开。
芯片层不再是故事的全部。曾经制造芯片的公司如今开始销售云服务,瓶颈已转向电力、土地以及能够提升每瓦算力效率的软件。
8 月 17 日,Cursor 推出 Origin,这是一个代码托管平台,定位为“智能体规模级的 Git 托管”,瞄准智能体代码生成速度与现有基础设施之间的空白,直接挑战 GitHub。
8 月 18 日,企业微信在 5.0.10 版本中向所有规模的企业开放 CLI 和 MCP,允许 WorkBuddy、DeepSeek Harness 和 Minimax Code 调用文档、表格、邮件、会议、日历、通讯录等十个办公模块。访问不再受员工人数或资质门槛限制。企业微信将其现有的权限与审批体系叠加到 MCP 路径上:AI 权限与人类权限分开配置,关键操作需人工审批,AI 授权支持过期,所有调用均记录日志。
Claude Code 以研究预览版形式发布了 /design 技能,将 Claude Design 画布工作流引入 CLI 和桌面端,并通过 Bun GC 调度将 p99 CPU 使用率降低了 50%。阿里云 Qoder STAROps 通过 IDE 内的自然语言查询,在几分钟内完成从告警到修复的闭环。
8 月 18 日,昆仑万维开源音乐模型 Mureka V9.5 发布,其人声质量率为 61%,控制率为 97%,全风格保真度达到 95.7%,专注于中文国风发音与和声。
8 月 16 日,OpenAI 总裁 Greg Brockman 警告称,OpenAI 模型在 7 月的内部测试中攻破 Hugging Face,标志着网络安全领域的“分水岭时刻”。他列出了防御者的十个行动步骤,包括为安全团队配备 AI 智能体,以及将安全审查嵌入开发流水线。
同一周,一个名为 watermarks-remover 的开源工具出现在 GitHub 上,可去除 Claude 内容中的水印,并覆盖 Gemini/SynthID 和 OpenAI 出处标记。
各大平台开始清理 AI 垃圾内容。Spotify 去年下架了 7500 万条批量上传和重复的音频;谷歌在 YouTube 上清理了 13 万个低质量频道和 5 万个账号集群;TikTok 自动标注了超过 30 亿个 AI 生成视频。《韦氏词典》将“slop”评为 2025 年度词汇。
与此一致,Anthropic 8 月 15 日的风险报告披露了一款尚未发布的 Model 2,在多项任务上略优于 Claude Mythos 5,总体提升幅度有限。
另外,Responsible Statecraft 报道称,以色列通过广告公司 Piro 设立了“汉诺威公共政策研究所”,自 8 月 6 日起发布超过 100 份报告,旨在影响大语言模型(LLM)的可信度评估。GPTZero 将大多数抽样报告标记为 AI 撰写。Piro 从以色列政府获得了 90 万美元。