
8 月 18 日,OpenAI 在聚合平台 OpenRouter 和 Vercel AI Gateway 上將 GPT-5.6 Sol 的價格下調 50%,為期一個月,輸入價格降至每 100 萬個 token 2.50 美元,輸出價格降至每 100 萬個 token 15 美元。該模型支援 100 萬個 token 的上下文,主打複雜推理與程式碼編寫。SemiAnalysis 指出,此舉可能是行銷操作——聚合平台在 OpenAI token 用量中的占比很小,但它們是第三方估算其市占率的主要資料來源。
同日,史丹佛團隊報告指出,從 DeepSeek V4 Flash 取樣五個答案並讓模型自行評分後,Terminal-Bench 2.1 準確率從 79% 提升至 88%,以約 1/11 的成本超越 Claude Fable 5。該框架已開源。阿里巴巴的 Qwen 團隊證實,其 27B 開源模型 Qwen3.8 可於 RTX 3090 上以 Q5 量化在本地運行,並在單提示生成上接近 GPT-5.6。
頂級模型降價與低成本開源模型拉近差距,出現在同一個 24 小時窗口內。差異化重點正從「更強的模型」轉向「更便宜的推理」。
8 月 17 日,Groq 宣布完成 3.5 億美元 A 輪融資,估值 35 億美元,由 Disruptive 領投,輝達(NVIDIA)計劃參與。該公司已從人工智慧(AI)晶片開發商轉型為 Neocloud 服務商。它於去年 12 月與輝達簽署 200 億美元非獨家授權協議,涵蓋語言處理單元(LPU)推理特殊應用積體電路(ASIC)授權,並於今年 8 月成為輝達雲端合作夥伴。運算容量預計將從目前的 54MW 成長至 2027 年的逾 200MW。
輝達執行長黃仁勳同日表示,AI 工廠下一個關鍵稀缺資源是土地、電力和資料中心殼體——晶片短缺已階段性緩解。輝達與軟銀旗下 SB Energy 正投資於俄亥俄州一處前鈾濃縮場址,初始規模為 4.25GW,並有空間擴大至 8GW。
8 月 17 日,位元組跳動 Seed 與清華大學人工智慧研究院(AIR)發布了 CUDA Agent,這是一套代理式強化學習(RL)系統,可訓練模型撰寫圖形處理器(GPU)核心程式並勝過編譯器。在 KernelBench 上,其通過率達 98.8%,相較 torch.compile 的幾何平均加速為 2.11 倍,其中 96.8% 的案例快於編譯器。Level-3 結果比 Claude Opus 4.5 和 Gemini 3 Pro 高出約 40 個百分點。權重未公開;6,000 筆樣本資料集、SKILL.md 和獎勵配方皆已公開。
晶片層不再是故事的全部。昔日製造晶片的公司如今販售雲端服務,瓶頸已轉向電力、土地,以及能在每瓦功率中榨出更多效能的軟體。
8 月 17 日,Cursor 推出 Origin,這是一個程式碼託管平台,定位為「代理規模的 Git 託管」,瞄準代理程式碼生成速度與現有基礎設施之間的落差,直接挑戰 GitHub。
8 月 18 日,企業微信在 5.0.10 版中向各種規模的企業開放命令列介面(CLI)與模型上下文協定(MCP),讓 WorkBuddy、DeepSeek Harness 和 Minimax Code 可呼叫十個辦公模組——文件、試算表、郵件、會議、行事曆、通訊錄。使用不再受人數或資格限制。企業微信將其現有權限與審批系統疊加於 MCP 路徑上:AI 權限與人員權限分開設定、重大操作需人工審批、AI 授權支援到期,且所有呼叫均會留下紀錄。
Claude Code 以研究預覽形式發布了 /design 技能,將 Claude Design 畫布工作流程帶入 CLI 與桌面端,並透過 Bun GC 排程將 p99 中央處理器(CPU)使用率減半。阿里雲的 Qoder STAROps 可透過整合式開發環境(IDE)內的自然語言查詢,在數分鐘內完成從告警到修復的閉環。
8 月 18 日,崑崙萬維旗下開源音樂模型 Mureka V9.5 發布,其人聲品質率達 61%、控制率達 97%、全風格保真度達 95.7%,專注於中文國風咬字與和聲。
OpenAI 總裁格雷格·布羅克曼(Greg Brockman)於 8 月 16 日警告,OpenAI 的模型在 7 月內部測試中攻破 Hugging Face,標誌著網路安全的「分水嶺時刻」,他列出防禦者的十個步驟,包括為安全團隊配備 AI 代理,以及將安全審查納入開發流程。
同一週,名為 watermarks-remover 的開源工具出現在 GitHub 上,可移除 Claude 內容中的浮水印,並涵蓋 Gemini/SynthID 與 OpenAI 的來源標記。
平台開始清理 AI 垃圾內容。Spotify 去年移除 7,500 萬首大量上傳與重複的曲目;Google 在 YouTube 清理了 13 萬個低品質頻道與 5 萬個帳號群集;TikTok 自動標記了超過 30 億部 AI 生成影片。韋氏字典將「slop」選為 2025 年度詞彙。
與此相呼應,Anthropic 8 月 15 日的風險報告揭露了一款未發布的 Model 2,在數項任務上略優於 Claude Mythos 5,整體提升幅度不大。
另據 Responsible Statecraft 報導,以色列透過廣告公司 Piro 設立了「漢諾威公共政策研究所」,自 8 月 6 日起發布逾 100 份報告,旨在影響大型語言模型(LLM)可信度評估。GPTZero 將抽樣的大部分報告標記為 AI 撰寫。Piro 從以色列政府獲得 90 萬美元。