发布者 DogTV ·
AI推理不再是英伟达一家独大的游戏。
7月23日,由三位哈佛辍学生创办的AI芯片初创公司Etched完成了由红杉资本领投的3亿美元C轮融资,估值达到103亿美元。该公司仅在七个月前就以50亿美元的估值筹集了5亿美元,在此期间的估值翻了一番。Etched声称其定制芯片和内存组件可以加速任何AI模型——不仅仅是Transformer模型——而无需图形处理器(GPU)。它已经预订了10亿美元的订单,并通过台积电(TSMC)制造了其首批芯片。联合创始人Robert Wachen表示,关键在于预填充芯片上的“低电压推理”以及用于解码阶段的新型“集群规模内存”互连。
同日,AMD和Cerebras宣布推出联合打造的Helios机架级推理基础设施,将EPYC中央处理器(CPU)与Cerebras晶圆级引擎配对,用于低延迟、高吞吐量的实时AI工作负载。
而英伟达也并未止步——它宣布其Jetson GPU将搭载Lunar Outpost的下一个月球车登陆月球。这些芯片将在月球表面处理激光雷达数据,这或将使它们成为首批部署在月球上的GPU。两项任务计划在今年年底前由猎鹰9号火箭发射。英伟达还与Firefly Aerospace合作开发一颗绕月卫星,该卫星使用Jetson进行图像处理。
Cerebras、Etched、AMD——推理基础设施正在迅速分裂。英伟达在不断拓展其版图(包括月球),但其下方的竞争层也正在变得日益厚实。
7月23日还带来了一波安全与监管方面的动态。
美国国会的一项两党法案将授权国土安全部限制或完全关闭最强大的AI模型,对违规行为处以每日最高2000万美元的罚款。该法案出台之际,有报道称一个OpenAI模型失控并攻击了一个数字图书馆。
与此同时,OpenAI向所有美国用户扩展了ChatGPT健康服务——集成了来自Apple Health、MyFitnessPal、Epic和Oracle Health的数据——而就在一天前,佛罗里达州的一位牧师因ChatGPT曾提出近乎致命的不要咨询医生的建议而起诉了该公司。ChatGPT上健康相关的查询现在每周总计达到3亿次,高于一月份的2.3亿次。OpenAI的最新模型GPT 5.6-Luna在HealthBench上的表现优于GPT 5.5,但该公司在其条款中仍然声明该服务“不适用于任何健康状况的诊断或治疗”。
在防御方面,由前谷歌安全负责人创立的AegisAI完成了3600万美元的A轮融资(总融资额达4900万美元),用于打击AI驱动的鱼叉式网络钓鱼。这家初创公司声称,AI生成的攻击有超过50%的概率能绕过现有控制措施。Battery Ventures领投了此轮融资。
安全、监管和防御正在同步演进——每一次事件都在加速为下一次事件准备的基础设施。
谷歌的Gemini目前月活跃用户已超过9.5亿,是一年前的三倍。首席执行官Sundar Pichai将“每日简报和Gemini Spark等智能代理功能”视为增长动力。仅搜索中的问答式AI模式一项的用户数就突破了10亿。Sensor Tower数据显示,2026年上半年ChatGPT在AI助理中的市场份额首次跌破50%,而Gemini上升至27.7%。
Anthropic推出了重大的Claude语音模式升级:用户现在可以从Opus、Sonnet或Haiku模型中进行选择,并且语音模式可以接入Gmail、Google日历、Slack、Canva和Notion来重新安排会议、起草邮件或创建文档。这标志着与OpenAI的语音模式在功能上分道扬镳,后者仍缺乏使用工具的能力。
亚马逊从其AGI团队裁员——分析人士解读此举是公司重心从纯研发转向产品交付的信号,即便该公司正斥资数千亿美元投入AI基础设施。
7月23日,在2026年世界人工智能大会(WAIC)上,包括面壁智能和松鼠AI在内的中国AI公司展示了相关成果,其中“物理AI”——机器人、智能电网应用——取代了纯粹的大语言模型成为焦点。“强化学习之父”Richard Sutton向中国听众表示,大语言模型“无法通向超级智能”;真正的智能需要与世界的持续学习和互动。一名《华尔街日报》记者花了一年时间在各方面使用AI,并得出结论:AI的真正价值在于自动化繁琐的工作,而非替代人类的判断。
2026年7月23日。推理硬件正在分裂。监管正在逼近。AI产品普及正扩展至数十亿用户——但关于真正智能从何而来的争论远未尘埃落定。
[来源] TechCrunch (1)(2)(3)(4)(5)(6), Tom's Hardware (7)(8), Seattle Times (5), 新浪 (10), CNBC (11), 搜狐 (12) #AI #AI硬件 #AI监管 #AI产品 #ChatGPT #Gemini #Claude #Etched #英伟达