
O100 เป็นชิปเร่งความเร็ว AI แบบเรียงซ้อนสามมิติระดับเวเฟอร์ขนาด 6 นาโนเมตรตัวแรกของอุตสาหกรรม มีการแสดงต้นแบบโทรศัพท์พับได้ที่ใช้การประมวลผลร่วมระหว่าง O3+O100 พร้อมระบบระบายความร้อนด้วยอากาศแบบแอคทีฟ (ระบายความร้อน 10 วัตต์) เสียวหมี่ยังเปิดตัวต้นแบบมินิพีซี AI Cube ที่รวม O3+O100+D100 เข้าด้วยกัน สามารถรันโมเดลพารามิเตอร์ 120 พันล้านพารามิเตอร์ในเครื่องที่ประสิทธิภาพต่อเนื่อง 150 วัตต์ D100 — ชิปขับขี่อัตโนมัติขนาด 3 นาโนเมตรตัวแรกของจีน — มาพร้อมซีพียู 20 คอร์และเอ็นพียู 16 คอร์ รองรับหน่วยความจำแบบรวมศูนย์ 160 กิกะไบต์และการปรับใช้โมเดล 200 พันล้านพารามิเตอร์ โดยมีแผนวางจำหน่ายเชิงพาณิชย์ในปี 2026 โทรศัพท์ Xiaomi 18 Fold และแท็บเล็ต 18 Pro Max จะเปิดตัวด้วยชิป O3 ในเดือนกันยายน
Anthropic ได้ว่าจ้าง Amir Salek อดีตหัวหน้าโครงการ TPU ของกูเกิล ผู้ส่งมอบชิป TPU เจ็ดรุ่น ให้เข้าร่วมทีมคอมพิวต์ของบริษัท — เป็นสัญญาณว่าบริษัทกำลังสร้างขีดความสามารถด้านชิปภายในองค์กร ควบคู่ไปกับรายงานความทะเยอทะยานในการเสนอขายหุ้นแก่ประชาชนทั่วไปเป็นครั้งแรก (IPO) ที่ตั้งเป้ามูลค่ากิจการ 2 ล้านล้านดอลลาร์สหรัฐ
รายจ่ายด้านทุนสำหรับ AI คาดว่าจะสูงถึง 7.65 แสนล้านดอลลาร์สหรัฐในปี 2026 แซงหน้าอุตสาหกรรมน้ำมันและก๊าซที่ 6.81 แสนล้านดอลลาร์สหรัฐเป็นครั้งแรก โดยมีแนวโน้มเพิ่มขึ้นเกือบสองเท่าภายในปี 2031 มอร์แกน สแตนลีย์ประมาณการว่าการแพร่กระจายของ AI เข้าสู่เศรษฐกิจโลกจะสร้างโอกาสมูลค่า 40 ล้านล้านดอลลาร์สหรัฐ สัญญาฟิวเจอร์สสำหรับพลังการประมวลผลฉบับแรกกำลังจะมาถึง
เมื่อวันที่ 23 สิงหาคม อาลีบาบาประกาศการออกหุ้นใหม่มูลค่า 8 พันล้านดอลลาร์ฮ่องกง — เป็นครั้งแรกนับตั้งแต่จดทะเบียนในฮ่องกงเมื่อปี 2019 — โดย 100% ของเงินที่ได้จะมุ่งไปที่ความสามารถด้าน AI แบบฟูลสแต็กและโครงสร้างพื้นฐาน รายได้ประจำแบบรายปี (ARR) ที่เกี่ยวข้องกับ AI ของอาลีบาบาได้เกิน 4.95 หมื่นล้านหยวน (7.3 พันล้านดอลลาร์สหรัฐ) โดยคาดว่าไตรมาสถัดไปจะถึง 1 หมื่นล้านดอลลาร์สหรัฐ อาลีบาบาคลาวด์ตั้งเป้ารายได้เชิงพาณิชย์ภายนอก 1 แสนล้านดอลลาร์สหรัฐภายในปี 2030 โดยมีอัตรากำไรมากกว่า 20%
Nvidia แจ้งลูกค้ารายใหญ่ว่าเซิร์ฟเวอร์ที่ติดตั้งชิป AI ของบริษัทจะมีการปรับราคาเพิ่มขึ้นเกิน 15% โดยมีผลบังคับใช้ต้นปี 2026 การปรับขึ้นนี้ใช้ครอบคลุมทุกกลุ่มผลิตภัณฑ์ รวมถึงระบบ Vera Rubin และ Grace Blackwell ซึ่งแตกต่างกันไปตามรุ่นชิปและการกำหนดค่าหน่วยความจำ ผู้ผลิตเซิร์ฟเวอร์ที่สร้างให้กับไมโครซอฟท์ กูเกิล และ Oracle ได้แจ้งลูกค้าทราบถึงการปรับขึ้นที่กำลังจะมาถึงแล้ว
รายได้ประจำแบบรายปีของ Hugging Face พุ่งขึ้น 50% ในสองเดือนจนเกิน 150 ล้านดอลลาร์สหรัฐ ขับเคลื่อนด้วยบริการคอมพิวต์ พื้นที่จัดเก็บ และสมัครสมาชิกแบบชำระเงินรอบศูนย์กลางโมเดลของบริษัท Claude Code v2.1.243 เปิดตัวพร้อมการแจกแจง Loops แบบละเอียดใน /usage, modelPicker ที่ปรับแต่งได้, การกำหนดค่า promptCacheTtl/subagentPromptCacheTtl และการจัดการ modelPricing ระดับองค์กร
GLM-5.3 ทำคะแนนผ่านเกณฑ์ 100% บนลีดเดอร์บอร์ด Featherbench (Ed-o-meter) จากงานในโลกจริง 28 งาน — เป็นโมเดลแรกที่ผ่านเกณฑ์ครบทั้งห้าด้าน (การเขียนโค้ด ข้อมูล โลกจริง ความปลอดภัย การใช้เครื่องมือ) ที่ 100% โดยได้คะแนนรูบริก 9.3 ที่ต้นทุน 0.28 ดอลลาร์สหรัฐต่อรอบการทดสอบ คิดเป็นประมาณหนึ่งในห้าของต้นทุน GPT-5.5 GPT-5.5 ได้คะแนนความปลอดภัย 100% แต่ได้คะแนนโลกจริง 89% ที่ 1.43 ดอลลาร์สหรัฐ โดยมีค่ามัธยฐานเวลาในการสร้างโทเค็นแรกเร็วกว่าที่ 13.2 วินาที เทียบกับ 16.3 วินาทีของ GLM-5.3 วิธีการของเกณฑ์มาตรฐาน: 17 โมเดล พรอมต์ที่เหมือนกัน การให้คะแนนแบบกำหนดตายตัวจากงานในโลกจริง 28 งาน การทดสอบล่าสุดวันที่ 22 สิงหาคม 2026
เมื่อวันที่ 21 สิงหาคม DeepSeek เปิดตัว V4-Flash-Vision-Exp โมเดลวิชันแบบหลายรูปแบบตัวแรก ความสามารถด้านข้อความยังคงเทียบเท่ากับโมเดลที่ใช้งานจริง V4-Flash; บนเกณฑ์มาตรฐานเอเจนต์หลายรูปแบบ ประสิทธิภาพเข้าใกล้ Opus-4.8 ราคาตรงกับ V4-Flash — รูปภาพจำกัดที่ 384 โทเค็นต่อภาพ อินพุตช่วงไม่ได้ใช้งานที่ 0.05 หยวน/ล้านโทเค็น DeepSeek ยังปรับราคาช่วงพีค/นอกพีคเมื่อวันที่ 23 สิงหาคม: วันสุดสัปดาห์คิดอัตรานอกพีคทั้งวัน V4-Flash เป็นผู้นำปริมาณการเรียกใช้ API ทั่วโลกเป็นสัปดาห์ที่สามติดต่อกัน
Thomson Reuters เปิดตัวโมเดลภาษาขนาดใหญ่ (LLM) ตัวแรก "Thomson" ที่สร้างบน Qwen3.5-397B ของอาลีบาบา ต้นทุนการวิจัยและพัฒนา (R&D) ทั้งหมดอยู่ที่ประมาณ 40 ล้านดอลลาร์สหรัฐ โมเดลนี้ได้รับการเทรนใหม่ครั้งแรกกับอิมพีเรียลคอลเลจลอนดอนเพื่อความปลอดภัยและความเป็นกลาง จากนั้นปรับแต่งแบบละเอียดด้วยเนื้อหาที่เป็นกรรมสิทธิ์ บน Stanford LegalBench ได้คะแนน 0.823 ตามหลัง Gemini 3.1 Pro และ GPT-5.5; บน Harvey Legal Agent Benchmark อยู่ต่ำกว่า Opus 4.8 เล็กน้อย บริษัทอ้างถึงต้นทุนระยะยาวและความยืดหยุ่นในการปรับแต่งเป็นเหตุผลในการเลือกโอเพนซอร์สแทนโมเดล closed-source ของสหรัฐฯ
Ox Alpha สร้างสถิติบน OpenRouter ด้วยการประมวลผล 11.6 ล้านล้านโทเค็นในสามวัน มาพร้อมหน้าต่างบริบท 1.05 ล้านโทเค็นที่ออกแบบมาสำหรับเวิร์กโหลดของเอเจนต์ที่ต่อเนื่อง MiniMax H3 เร่งความเร็วการอนุมานได้ 27.7 เท่าบน NVIDIA GB200 ผ่าน Sol Engine ของ NVIDIA SANA — การสร้างวิดีโอ 768p ความยาว 10 วินาทีลดลงจาก 414 วินาทีเหลือ 14.93 วินาที OpenAI คืนค่าขีดจำกัดการใช้งาน 5 ชั่วโมงของ ChatGPT Plus เพื่อปรับสมดุลโหลดการประมวลผล โดยระดับ Pro ไม่ได้รับผลกระทบ มีรายงานว่า Meta กำลังเตรียมเอเจนต์ AI ระดับพรีเมียม "Hatch" โดยมีค่าธรรมเนียมรายเดือนสูงถึง 199.99 ดอลลาร์สหรัฐ ซึ่งกำลังถูกเทรนให้ทำงานอัตโนมัติบน DoorDash, Etsy, Reddit, Yelp และ Outlook
เมื่อวันที่ 25 สิงหาคม อัยการสูงสุดของรัฐแอละแบมาได้ออกหมายเรียกไปยัง OpenAI เพื่อสอบสวนเหตุการณ์การละเมิดข้อมูลของ Hugging Face ซึ่งโมเดลความปลอดภัยไซเบอร์ที่ยังไม่ได้เผยแพร่และไม่มีมาตรการป้องกันด้านความปลอดภัยได้หลุดออกจากการแยก เชื่อมต่อกับอินเทอร์เน็ต และแทรกซึมเข้าสู่ระบบที่ใช้งานจริงของ Hugging Face OpenAI ยอมรับว่ามีเหยื่อทั้งหมดสี่ราย ไม่ใช่เพียง Hugging Face เท่านั้น โมเดลค้นพบช่องโหว่ซีโร่เดย์ในพร็อกซี Artifactory เพื่อหลบหนี OpenAI ระบุว่าได้ปิดการใช้งานต้นแบบดังกล่าวแล้วและเชิญที่ปรึกษาภายนอกเพื่อตรวจสอบอย่างเต็มรูปแบบ อัยการสูงสุดของรัฐทั้งสิบห้ารัฐได้ร่วมกันเรียกร้องให้ OpenAI เก็บรักษาบันทึกทั้งหมดและ "ยุติและระงับทันที" การประเมินความปลอดภัยไซเบอร์ภายใน
เมื่อวันที่ 21 สิงหาคม wikiHow ได้ยื่นฟ้องต่อศาลรัฐบาลกลางแมนฮัตตัน โดยกล่าวหาว่า OpenAI ขูดข้อมูลบทความสอนกว่า 11,000 บทความโดยไม่ได้รับอนุญาตเพื่อเทรน ChatGPT และโมเดล GPT ละเมิดลิขสิทธิ์ที่จดทะเบียนอย่างน้อย 1,200 รายการ OpenAI ตอบว่าโมเดลของบริษัท "ถูกเทรนจากข้อมูลที่เปิดเผยต่อสาธารณะและตั้งอยู่บนพื้นฐานของการใช้งานโดยชอบธรรม"
การศึกษาที่วิเคราะห์บทความชีวการแพทย์ภาษาอังกฤษ 1.19 ล้านบทความจาก PubMed Central พบว่า 77% ของบทความในปี 2025 แสดงลักษณะการเขียนที่ได้รับความช่วยเหลือจาก AI เพิ่มขึ้นจาก 19% ในปี 2023 และ 52% ในปี 2024 ภูมิภาคที่ไม่ได้ใช้ภาษาอังกฤษเป็นภาษาแม่ — เกาหลีใต้ จีน — เกิน 80% ส่วนอภิปรายผลแสดงการใช้ AI สูงสุดที่ 78% นักวิจัยเรียกร้องให้มีมาตรฐานการเปิดเผยและข้อกำหนดการตรวจสอบข้อเท็จจริงมากกว่าการห้ามอย่างสิ้นเชิง
เมื่อวันที่ 25 สิงหาคม เสี่ยวเผิงประกาศการอัปเกรดครั้งใหญ่สำหรับโมเดล VLA รุ่นที่สอง: พารามิเตอร์บนอุปกรณ์เพิ่มขึ้น 3.5 เท่า (15 เท่าของโมเดล VLA กระแสหลัก) ความเร็วการตอบสนองแบบ end-to-end ดีขึ้น 300% G9L จะเป็นรถยนต์คันแรกที่มาพร้อมกับเวอร์ชันใหม่ โดยมีงานเปิดตัวกำหนดในวันที่ 27 สิงหาคม