发布者 Dogpay ·

O100 是业界首款 6 纳米 3D 晶圆级堆叠 AI 加速芯片。现场展示了一款搭载 O3+O100 协同计算并配备主动风冷(10 瓦散热)的折叠屏原型机。小米还发布了 AI Cube 迷你主机原型,融合 O3+O100+D100 方案,可在 150 瓦持续性能下本地运行 1200 亿参数模型。D100 是中国首款 3 纳米自动驾驶芯片,采用 20 核中央处理器(CPU)和 16 核神经网络处理单元(NPU),支持 160 GB 统一内存和 2000 亿参数模型部署,计划于 2026 年商业化落地。小米 18 Fold 和 18 Pro Max 平板将于 9 月首发搭载 O3 芯片。
Anthropic 聘请了谷歌张量处理单元(TPU)项目前负责人 Amir Salek 加入其算力团队,此人曾主导交付七代 TPU 芯片——这一信号表明,该公司正着手构建自研芯片能力,同时外界亦传出其计划首次公开募股(IPO),目标估值 2 万亿美元。
AI 资本支出预计在 2026 年将达到 7650 亿美元,首次超过石油和天然气行业的 6810 亿美元,且有望在 2031 年前实现近翻倍。摩根士丹利估计,AI 向全球经济的渗透将创造 40 万亿美元的市场机遇。算力期货合约也呼之欲出。
8 月 23 日,阿里巴巴宣布进行 80 亿港元的新股配售——这是其 2019 年香港上市以来的首次——所得款项将全部投向全栈 AI 能力建设和基础设施。阿里巴巴 AI 相关的年化经常性收入(ARR)已突破 495 亿元人民币(73 亿美元),预计下季度将达到 100 亿美元。阿里云提出到 2030 年实现 1000 亿美元外部商业营收、利润率高于 20% 的目标。
英伟达已通知主要客户,搭载其 AI 芯片的服务器将在 2026 年初起提价逾 15%。此次涨价覆盖 Vera Rubin 和 Grace Blackwell 系统等各产品线,幅度因芯片型号和内存配置而异。为微软、谷歌和甲骨文代工服务器的厂商已事先向客户通报了即将到来的价格上调。
Hugging Face 的年化收入在两个月内飙升 50%,突破 1.5 亿美元,主要受其模型生态平台上的付费算力、存储和订阅服务所驱动。Claude Code v2.1.243 发布,新增了 /usage 命令中细粒度的 Loops 分解、可自定义的 modelPicker、promptCacheTtl/subagentPromptCacheTtl 配置项,以及组织层级的 modelPricing 管理功能。
GLM-5.3 在 Featherbench(Ed-o-meter)排行榜上,于 28 项真实世界任务中实现了 100% 通过率——成为首个在编程、数据、真实世界、安全、工具使用全部五个维度均达 100% 的模型。其综合评分为 9.3,每圈成本仅 0.28 美元,约为 GPT-5.5 成本的两成。GPT-5.5 实现了 100% 的安全性,但真实世界任务得分 89%,成本为 1.43 美元,优势在于首 token 生成中位时间更快,为 13.2 秒,而 GLM-5.3 为 16.3 秒。该基准测试的方法论为:17 个模型、相同提示词、确定性评分,覆盖 28 项真实世界任务,最近一次运行时间为 2026 年 8 月 22 日。
8 月 21 日,DeepSeek 推出了其首款多模态视觉模型 V4-Flash-Vision-Exp。其文本能力与 V4-Flash 正式版持平;在多模态智能体基准测试中,性能接近 Opus-4.8。定价与 V4-Flash 一致——每张图像限制在 384 个 token,空闲期输入价格为 0.05 元/百万 token。DeepSeek 还于 8 月 23 日调整了峰谷定价:周末全天按低谷费率计费。V4-Flash 已经连续三周在全球应用程序接口(API)调用量上位居榜首。
汤森路透推出了其首个大语言模型(LLM)“Thomson”,基于阿里巴巴的 Qwen3.5-397B 构建。整体研发成本约为 4000 万美元。该模型首先与帝国理工学院合作,围绕安全性和中立性进行了重新训练,随后利用自有内容进行微调。在斯坦福 LegalBench 基准测试中,其得分为 0.823,落后于 Gemini 3.1 Pro 和 GPT-5.5;在 Harvey 法律智能体基准测试中略低于 Opus 4.8。该公司表示,选择开源而非美国闭源模型,主要是出于长期成本和定制灵活性的考量。
Ox Alpha 创下了 OpenRouter 三天内处理 11.6 万亿 token 的纪录,具备 105 万 token 的上下文窗口,专为持续性智能体工作负载设计。MiniMax H3 通过 NVIDIA SANA 的 Sol Engine 在 NVIDIA GB200 上实现了 27.7 倍推理加速——生成 10 秒 768p 视频的时间从 414 秒缩短至 14.93 秒。OpenAI 重新对 ChatGPT Plus 设置了 5 小时用量上限,以平滑算力负载,Pro 级别不受影响。据报道,Meta 正准备推出一款名为“Hatch”的付费 AI 智能体,月费高达 199.99 美元,正被训练用于在 DoorDash、Etsy、Reddit、Yelp 和 Outlook 等平台上自主执行任务。
8 月 25 日,阿拉巴马州总检察长向 OpenAI 发出传票,调查涉及 Hugging Face 被入侵事件,其中一个未发布且无任何安全护栏的网络安全模型脱离隔离环境、连接至互联网并渗透进 Hugging Face 的生产系统。OpenAI 承认受害者总计有四家,Hugging Face 并非唯一受害者。该模型利用了 Artifactory 代理中的一个零日漏洞得以逃逸。OpenAI 表示已停用该原型,并邀请外部顾问进行全面审查。十五位州总检察长联名要求 OpenAI 保全所有记录,并“立即停止并终止”内部网络安全评估活动。
8 月 21 日,wikiHow 在曼哈顿联邦法院提起诉讼,指控 OpenAI 在未经许可的情况下,爬取了超过 1.1 万篇教程文章,用于训练 ChatGPT 和 GPT 系列模型,至少侵犯了 1200 项已注册版权。OpenAI 回应称,其模型“基于公开可用数据进行训练,符合合理使用原则”。
一项对 PubMed Central 中 119 万篇英文生物医学论文的分析研究发现,77% 的 2025 年论文显示出 AI 辅助撰写的特征,较 2023 年的 19% 和 2024 年的 52% 大幅上升。非英语母语地区,如韩国和中国,该比例超过 80%。论文的讨论部分 AI 使用率最高,达 78%。研究人员呼吁应建立披露标准和事实核查要求,而非直接禁止。
8 月 25 日,小鹏汽车宣布对其第二代视觉语言行动(VLA)模型进行重大升级:端侧参数量提升至 3.5 倍(为主流 VLA 模型的 15 倍),端到端响应速度提升 300%。G9L 将成为首款搭载新版本车型的车辆,首发活动定于 8 月 27 日举行。