
เมื่อวันที่ 13 สิงหาคม OpenAI และ Cerebras เปิดตัว Ultrafast Mode ซึ่งเป็นระดับบริการที่ขับเคลื่อนด้วย Wafer-Scale Engine ของ Cerebras โดยรัน GPT-5.6 Sol ที่ความเร็วสูงสุด 750 โทเคนเอาต์พุตต่อวินาที Cerebras ระบุว่าบริการนี้เร็วกว่า Fable 5 ถึง 11 เท่า และเร็วกว่า Opus 4.8 ในโหมด Fast ถึง 5 เท่า โดยคุณภาพไม่ลดลง ในการทดสอบ Humanity's Last Exam ซึ่งเป็นเกณฑ์วัดที่มีคำถาม 2,500 ข้อและตอบได้โดยผู้เชี่ยวชาญระดับปริญญาเอกเท่านั้น Ultrafast ทำเสร็จภายใน 11 ชั่วโมง 11 นาที ขณะที่ Claude Fable 5 ต้องใช้เวลา 78 ชั่วโมง 27 นาที สำหรับ GDP-Val ซึ่งเป็นเกณฑ์วัดสำหรับงานความรู้ที่มีมูลค่าทางเศรษฐกิจ Ultrafast ให้อัตราเร่งแบบครบวงจร 5.6 เท่า บริการนี้เปิดให้ใช้งานครั้งแรกใน API ของ OpenAI สำหรับลูกค้ากลุ่มที่ได้รับการคัดเลือก
เมื่อวันที่ 13 สิงหาคม Google เปิดตัว Gemini 3.7 Flash โดยมุ่งเป้าไปที่กรณีใช้งานด้านการเขียนโค้ดและเอเจนต์ เพียงสามสัปดาห์หลังจากรุ่น 3.6 Flash โดยจนถึงวันที่ 31 ธันวาคม โมเดลนี้มีราคาครึ่งหนึ่งของ 3.6 Flash อยู่ที่ 0.75 ดอลลาร์สหรัฐต่อโทเคนอินพุตหนึ่งล้านโทเคน และ 3.75 ดอลลาร์สหรัฐต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน Google ยังรวมโมเดลดังกล่าวเข้ากับ Gemini Spark สำหรับสมาชิก AI Pro และ Ultra ในกว่า 160 ภูมิภาค
เมื่อวันที่ 14 สิงหาคม DeepSeek ประกาศราคา API แบบช่วงพีคและช่วงนอกพีค โดยมีผลตั้งแต่วันที่ 17 สิงหาคม โดยช่วงนอกพีคคิดอัตราครึ่งหนึ่งของช่วงพีค โมเดลบางตัวมีราคาเพิ่มขึ้นมากกว่า 3 เท่า โมเดลเรือธง deepseek-v4-pro มีการปรับขึ้นราคาต่อหนึ่งล้านโทเคนอย่างมีนัยสำคัญในช่วงพีค การเคลื่อนไหวครั้งนี้พลิกกลับท่าทีเดิมของ DeepSeek ในฐานะผู้ให้บริการต้นทุนต่ำ
เมื่อวันที่ 13 สิงหาคม Lenovo รายงานผลประกอบการไตรมาสแรกของปีงบประมาณ 2026: รายได้ที่เกี่ยวข้องกับ AI เติบโต 60% เมื่อเทียบปีต่อปีเป็น 8.5 พันล้านดอลลาร์สหรัฐ คิดเป็น 35% ของรายได้รวม ประธานกรรมการ Yang Yuanqing กล่าวกับสื่อว่า การจัดสรรทรัพยากรคอมพิวติงกำลังเปลี่ยนจาก "การฝึก 80%" ในช่วงแรกไปสู่เป้าหมาย "การอนุมาน 80% การฝึก 20%" โดยสัดส่วนปัจจุบันอยู่ที่ประมาณ 50/50
ชุดประกาศในวันเดียวกันนี้ ไม่ว่าจะเป็นโมเดลฟรอนเทียร์ที่ทำความเร็ว 750 โทเคนต่อวินาที โมเดล Flash ราคาครึ่งหนึ่ง และผู้ให้บริการจีนที่ปรับขึ้นราคาในขณะที่รายอื่นปรับลด แสดงให้เห็นว่าการแข่งขันได้เปลี่ยนจาก "ใครเก่งที่สุด" ไปเป็น "ใครเร็วที่สุดและถูกที่สุด"
เมื่อวันที่ 14 สิงหาคม DeepSeek เปิดตัว V4-Pro เวอร์ชันทางการ ซึ่งเป็นโมเดลพารามิเตอร์ 1.6 ล้านล้านตัว โดยปล่อยเวตภายใต้สัญญาอนุญาต MIT พร้อมรองรับ OpenAI Responses API โดยตรง และการปรับแต่งเฉพาะสำหรับ Codex ระบบนิเวศปลั๊กอิน Harness เข้าสู่การทดสอบแบบสาธารณะแล้ว
ในวันเดียวกัน มีรายงานว่า GLM-5.3 จาก Zhipu ซึ่งเป็นโมเดลพื้นฐานขนาด 743B ได้คะแนน 84.5 บน CyberGym สูงกว่า GPT-5.6 Sol โดยออกแบบมาเพื่อการป้องกันทางไซเบอร์และการเขียนโค้ด Meituan เปิดตัว LongCat-2.0 ซึ่งเป็นโมเดล MoE พารามิเตอร์ 1.6T พร้อมหน้าต่างบริบท 1M ได้คะแนน 70.8 บน Terminal-Bench 2.1 โดยเน้นการเขียนโค้ดแบบเอเจนต์
เมื่อวันที่ 14 สิงหาคม Grok 4.6 ขึ้นอันดับหนึ่งบนกระดานผู้นำการเขียนโค้ดบนสถานการณ์จริง CursorBench โดยนำหน้า Claude Opus 5 และ GPT-5.6 Sol xAI ยังได้โอเพนซอร์สเวตของ Phoenix ซึ่งเป็นอัลกอริทึมจัดอันดับ X ของบริษัท โดยเป็นทรานสฟอร์เมอร์ที่ใช้ Grok เป็นฐาน ซึ่งเวตคะแนนสังเคราะห์ให้น้ำหนักกับเจตนาการกระจายเนื้อหาและการสนทนาจริง โดยถือว่ายอดไลก์เป็นสัญญาณที่ถูกที่สุด
เมื่อวันที่ 13 สิงหาคม งานวิจัยของ Meta/Oxford พบว่า การฝึกโมเดลมัลติโหมดล่วงหน้าต้องการข้อมูลการสร้างภาพเพียง 5% โดยสัดส่วนที่เหมาะสมคือ ภาษา 70% ความเข้าใจภาพ 25% และการสร้างภาพ 5% ซึ่งช่วยลดโทเคนการสร้างภาพลง 5 เท่า
แรงผลักดันด้านโอเพนเวตจาก DeepSeek, Meituan และ xAI ควบคู่กับเกณฑ์วัดเฉพาะทางสำหรับการเขียนโค้ดและการป้องกันทางไซเบอร์ ถือเป็นการเปลี่ยนผ่านไปสู่โมเดลที่มีความเชี่ยวชาญเฉพาะด้าน โดยแข่งขันกันบนงานที่แคบและวัดผลได้ มากกว่าการอ้างความสามารถทั่วไป
เมื่อวันที่ 13 สิงหาคม Fortune รายงานว่า Anthropic มีแผนเสนอขายหุ้นต่อสาธารณะ (IPO) ในเดือนตุลาคมด้วยมูลค่ากิจการ 2 ล้านล้านดอลลาร์สหรัฐ ซึ่งจะแซง IPO ของ SpaceX ที่มูลค่า 1.77 ล้านล้านดอลลาร์สหรัฐเมื่อวันที่ 12 มิถุนายน ขึ้นเป็น IPO ที่ใหญ่ที่สุดเท่าที่เคยมีมา รายได้รายปีของ Anthropic ผ่านหลัก 47 พันล้านดอลลาร์สหรัฐในเดือนพฤษภาคม และบริษัทได้ยื่นแบบคำขอแบบไม่เปิดเผยต่อ ก.ล.ต. สหรัฐฯ (SEC) ในเดือนมิถุนายน
เมื่อวันที่ 14 สิงหาคม Nikkei รายงานว่า Tencent จะเข้าซื้อหุ้นที่ Meta ถืออยู่ใน Manus ผู้พัฒนา AI เพื่อขึ้นเป็นผู้ถือหุ้นรายใหญ่ที่สุด Manus ซึ่งเปิดตัวในเดือนมีนาคม 2025 โดย Butterfly Effect ได้ย้ายสำนักงานใหญ่ไปยังสิงคโปร์และลดการดำเนินงานในจีนหลังมีเงินลงทุนจากสหรัฐฯ ในเดือนเมษายน การทบทวนความมั่นคงด้านการลงทุนต่างชาติของจีนได้สั่งห้ามการเข้าซื้อ Manus ของ Meta และเมื่อวันที่ 11 สิงหาคม Manus ประกาศแยกตัวจาก Meta และกลับมาดำเนินการอย่างอิสระ
เมื่อวันที่ 14 สิงหาคม มีรายงานจากสื่อว่า Google DeepMind กำลังปรับโครงสร้างองค์กรออกจากงานวิจัยโมเดลฟรอนเทียร์ ไปสู่โมเดลระดับ Flash ที่คุ้มค่าต้นทุน โดยการปลดพนักงานอาจสูงถึงหนึ่งในสามหรือมากกว่า Demis Hassabis ก้าวลงจากตำแหน่งซีอีโอเมื่อวันที่ 5 สิงหาคม ไปดำรงตำแหน่งประธานกรรมการและหัวหน้านักวิทยาศาสตร์ของ Alphabet การปรับโครงสร้างครั้งนี้เกี่ยวข้องกับความล่าช้าของโมเดล Gemini เรือธงรุ่นถัดไปของ Google และข้อขัดแย้งภายในเรื่องลำดับความสำคัญในการพัฒนา
เมื่อวันที่ 14 สิงหาคม Reuters รายงานว่า Apple ได้ฝึก LLM เฉพาะสำหรับตลาดจีนร่วมกับ Alibaba ยุติการพึ่งพาโมเดลจากบุคคลที่สามก่อนหน้านี้ คาดว่า Apple Intelligence จะเปิดตัวในจีนภายในไม่กี่เดือน หลังจากการยื่นเอกสารเมื่อวันที่ 15 กรกฎาคม สำหรับบริการ AI เชิงสร้างสรรค์บนอุปกรณ์ "Apple Intelligence" ต่อหน่วยงานกำกับดูแล
เมื่อวันที่ 13 สิงหาคม Musk กล่าวกับพนักงาน SpaceX ว่า กำลังการผลิตไฟฟ้าของศูนย์ข้อมูล SpaceXAI (เดิมคือ xAI) จะเติบโตประมาณ 7 เท่าเป็น 10GW ภายในสิ้นปี 2027 จากปัจจุบันที่ 1.4GW ในพื้นที่ Memphis และ Southaven เขาประเมินว่า 10GW อาจสร้างรายได้ปีละ 300 พันล้านถึง 500 พันล้านดอลลาร์สหรัฐ
ในวันเดียวกันมีสัญญาณระดับ 2 ล้านล้านดอลลาร์สหรัฐสองรายการ และความเคลื่อนไหวในตลาดจีนสองรายการ ได้แก่ มูลค่า IPO ของ Anthropic และกลยุทธ์โมเดลจีนของ Apple ขณะที่ Tencent เข้าควบคุม Manus และ Google ถอยออกจากการพัฒนาโมเดลฟรอนเทียร์
เมื่อวันที่ 13 สิงหาคม ที่งานประชุม USENIX Security Symposium ในเมืองบอลทิมอร์ นักวิจัยจากมหาวิทยาลัยเบอร์มิงแฮมและมหาวิทยาลัยเดอรัม เปิดเผยช่องโหว่ "Download More RAM" ซึ่งเป็นการโจมตีที่ใช้ข้อบกพร่องขาดการป้องกันการเขียนในชิป SPD ของ DDR4/DDR5 เพื่อเลี่ยงการป้องกันของ Windows 11 โดยไม่ต้องเข้าถึงตัวเครื่องทางกายภาพ ข้อบกพร่องนี้ทำให้ซอฟต์แวร์เขียนข้อมูลการกำหนดค่าหน่วยความจำใหม่ได้ ส่งผลให้ Windows รายงาน RAM ผิดเป็นความจุ 2 เท่า และสร้างนามแฝงหน่วยความจำเพื่ออ่านหรือแก้ไขพื้นที่ที่ได้รับการป้องกัน การโจมตีนี้สามารถปิดใช้งานแอนติไวรัส เจาะระบบองค์กรที่ล็อกอยู่ และเลี่ยงระบบป้องกันการโกงระดับเคอร์เนล Microsoft กำหนดรหัส CVE-2026-23670 และเพิ่มมาตรการบรรเทาในอัปเดตความปลอดภัยเดือนเมษายน 2026 โดยระบบที่เปิดใช้งาน Secure Boot จะได้รับการป้องกัน ผลิตภัณฑ์สำหรับผู้บริโภคของ Corsair, G.Skill และ ADATA อย่างน้อยรายละหนึ่งสายผลิตภัณฑ์ได้รับผลกระทบ
เมื่อวันที่ 6 สิงหาคม งานวิจัยที่ได้รับการตอบรับให้นำเสนอในงาน ACM AI Leadership Summit พบว่า เครื่องมือตรวจจับ AI เชิงพาณิชย์ไม่สามารถแยกความแตกต่างระหว่างการแก้ไขด้วย AI กับการร่างทั้งหมดได้อย่างน่าเชื่อถือ การแก้ไขแบบเบา ๆ เฉพาะ "ปรับแต่งบทคัดย่อเท่านั้น" ถูกตั้งค่าสถานะ 64–80% (Pangram/GPTZero) ขณะที่ต้นฉบับปี 2023–2025 ที่ไม่ได้แก้ไขถูกตั้งค่าสถานะ 9–15% หลังผ่านการทำให้เป็นมนุษย์ด้วย "Undetectable AI" แล้ว ข้อความที่ถูกระบุว่าเขียนโดย AI และผ่านการเขียนใหม่ถูกตั้งค่าสถานะเหลือน้อยกว่า 4% การแก้ไขด้วย AI อย่างตรงไปตรงมามีความเสี่ยงที่จะถูกลงโทษสูงกว่าการหลบเลี่ยงโดยใช้เครื่องมือทำให้เป็นมนุษย์
นอกจากนี้ในสัปดาห์นี้ บทวิเคราะห์ทางเทคนิคชี้ว่า ลายน้ำข้อความจาก AI จะถูกกำจัดออกได้ง่ายเสมอ ก่อนที่ข้อกำหนดมาตรา 50 ของ พ.ร.บ. AI ของสหภาพยุโรป (EU AI Act) ที่ให้ผลลัพธ์ "ตรวจพบได้ว่าสร้างโดย AI" จะมีผลบังคับใช้ในเดือนสิงหาคม 2026 การสุ่มตัวอย่างโทเคนแบบ SynthID สามารถถูกลบออกได้โดยการถอดความผ่าน LLM ขนาดเล็กใดก็ได้ และลายน้ำแบบ Unicode homoglyph ก็ถูกลบได้ด้วยการแทนที่อักขระ บทวิเคราะห์ระบุว่า Claude Code เคยใช้การซ่อนข้อมูลแบบ homoglyph เพื่อแท็กคำขอบางรายการมาก่อน
เมื่อวันที่ 13 สิงหาคม OpenAI เปิดตัว Computer History สำหรับแอป ChatGPT บน Mac โดยแทนที่การแสดงตัวอย่างแบบภาพหน้าจอของ Chronicle ด้วยการบันทึกเหตุการณ์ด้านการช่วยการเข้าถึงของ macOS (การคลิก การพิมพ์ ปุ่มลัด การสลับแอป) เหตุการณ์จะถูกจัดเก็บในเครื่องนานสูงสุด 48 ชั่วโมง แล้วจึงถูกลบหลังการสร้างหน่วยความจำฝั่งเซิร์ฟเวอร์ กิจกรรมในโหมดความเป็นส่วนตัวจะไม่ถูกบันทึก ฟีเจอร์นี้เปิดให้ผู้ใช้ Pro, Business และ Enterprise ยกเว้นเขตเศรษฐกิจยุโรป (EEA) สวิตเซอร์แลนด์ และสหราชอาณาจักร
เมื่อวันที่ 14 สิงหาคม ChatGPT ได้รับความสามารถในการแก้ไข Google Docs, Sheets และ Slides โดยตรงโดยไม่ต้องสลับแท็บ โดยทยอยเปิดให้ผู้ใช้ Plus, Pro, Business และ Enterprise
การโจมตีระดับฮาร์ดแวร์ เครื่องมือตรวจจับที่ล้มเหลว และลายน้ำที่ลบออกได้ง่าย มีสมมติฐานร่วมกันว่า โครงสร้างพื้นฐานสำหรับการตรวจสอบเนื้อหา AI และการรักษาความปลอดภัยระบบยังตามหลังตัวโมเดลเอง