
เมื่อวันที่ 18 สิงหาคม OpenAI ได้ลดราคา GPT-5.6 Sol ลง 50% บนแพลตฟอร์มรวบรวม OpenRouter และ Vercel AI Gateway ทำให้ราคาอินพุตอยู่ที่ $2.50 ต่อ 1 ล้านโทเค็น และเอาต์พุตอยู่ที่ $15 ต่อ 1 ล้านโทเค็น เป็นเวลาหนึ่งเดือน โดยโมเดลนี้รองรับบริบท 1 ล้านโทเค็น และมุ่งเป้าไปที่การให้เหตุผลที่ซับซ้อนและการเขียนโค้ด SemiAnalysis ระบุว่าการเคลื่อนไหวนี้อาจเป็นกลยุทธ์การตลาด เพราะแพลตฟอร์มรวบรวมมีส่วนแบ่งปริมาณโทเค็นของ OpenAI เพียงเล็กน้อย แต่กลับเป็นแหล่งข้อมูลหลักที่บุคคลภายนอกใช้ประเมินส่วนแบ่งการตลาดของ OpenAI
ในวันเดียวกัน ทีมจากมหาวิทยาลัยสแตนฟอร์ดรายงานว่า การสุ่มตัวอย่างคำตอบ 5 ครั้งจาก DeepSeek V4 Flash แล้วให้โมเดลประเมินผลลัพธ์ของตัวเอง ช่วยเพิ่มความแม่นยำ Terminal-Bench 2.1 จาก 79% เป็น 88% แซงหน้า Claude Fable 5 ที่ต้นทุนประมาณ 1/11 เฟรมเวิร์กดังกล่าวเป็นโอเพนซอร์ส ทีม Qwen ของอาลีบาบายืนยันว่าโมเดลเปิดขนาด 27B อย่าง Qwen3.8 ทำงานเฉพาะที่บน RTX 3090 ที่การควอนไทซ์ระดับ Q5 และเข้าใกล้ GPT-5.6 ในการสร้างจากพรอมปต์เดียว
การลดราคาในระดับบนและการที่โมเดลเปิดต้นทุนต่ำไล่ช่องว่างเข้ามา เกิดขึ้นภายในช่วงเวลา 24 ชั่วโมงเดียวกัน จุดสร้างความแตกต่างกำลังเปลี่ยนจาก “โมเดลที่แข็งแกร่งกว่า” ไปเป็น “การอนุมานที่ถูกกว่า”
เมื่อวันที่ 17 สิงหาคม Groq ประกาศระดมทุน Series A มูลค่า 350 ล้านดอลลาร์สหรัฐ ที่การประเมินมูลค่า 3.5 พันล้านดอลลาร์สหรัฐ นำโดย Disruptive โดยมี NVIDIA เตรียมเข้าร่วมลงทุน บริษัทได้เปลี่ยนจากผู้พัฒนาชิป AI มาเป็นผู้ให้บริการ Neocloud โดยได้ลงนามข้อตกลงอนุญาตสิทธิ์แบบไม่ผูกขาดมูลค่า 2 หมื่นล้านดอลลาร์สหรัฐกับ NVIDIA เมื่อเดือนธันวาคมปีที่แล้ว ครอบคลุมการอนุญาตสิทธิ์ ASIC สำหรับการอนุมาน LPU และในเดือนสิงหาคมนี้ได้กลายเป็นพาร์ตเนอร์คลาวด์ของ NVIDIA กำลังการประมวลผลคาดว่าจะเติบโตจาก 54MW ในปัจจุบันเป็นมากกว่า 200MW ภายในปี 2027
เจนเซน หวง ซีอีโอของ NVIDIA กล่าวในวันเดียวกันว่า ทรัพยากรหายากที่สำคัญลำดับถัดไปสำหรับโรงงาน AI คือ ที่ดิน ไฟฟ้า และอาคารศูนย์ข้อมูล โดยปัญหาการขาดแคลนชิปได้คลี่คลายลงเป็นระยะ ๆ NVIDIA และ SB Energy ของ SoftBank กำลังลงทุนในพื้นที่เคยใช้เสริมสมรรถนะยูเรเนียมในรัฐโอไฮโอ โดยเริ่มต้นที่ 4.25GW และสามารถขยายไปถึง 8GW
เมื่อวันที่ 17 สิงหาคม ByteDance Seed และ Tsinghua AIR ได้ปล่อย CUDA Agent ซึ่งเป็นระบบ RL แบบเอเจนต์ที่ฝึกโมเดลให้เขียน GPU kernel ที่เอาชนะคอมไพเลอร์ บน KernelBench ระบบทำอัตราการผ่านได้ 98.8% และเร่งความเร็วเฉลี่ยเรขาคณิต 2.11× เมื่อเทียบกับ torch.compile โดยมีอัตราเร็วกว่าการคอมไพล์ 96.8% ผลลัพธ์ระดับ Level-3 สูงกว่า Claude Opus 4.5 และ Gemini 3 Pro ราว 40 คะแนน โดยไม่มีการปล่อยเวต ชุดข้อมูล 6,000 ตัวอย่าง SKILL.md และสูตรคำนวณรางวัลเปิดเป็นสาธารณะ
ชั้นของชิปไม่ใช่เรื่องราวทั้งหมดอีกต่อไป บริษัทที่ผลิตชิปกำลังหันมาขายคลาวด์ และคอขวดได้ย้ายไปที่พลังงาน ที่ดิน และซอฟต์แวร์ที่ดึงประสิทธิภาพต่อวัตต์ได้มากขึ้น
เมื่อวันที่ 17 สิงหาคม Cursor เปิดตัว Origin ซึ่งเป็นแพลตฟอร์มโฮสต์โค้ดที่วางตำแหน่งเป็น “โฮสต์ Git ในระดับเอเจนต์” โดยมุ่งเป้าไปที่ช่องว่างระหว่างความเร็วในการสร้างโค้ดของเอเจนต์กับโครงสร้างพื้นฐานที่มีอยู่ และท้าทาย GitHub โดยตรง
เมื่อวันที่ 18 สิงหาคม WeCom เปิดให้ใช้งาน CLI และ MCP แก่องค์กรทุกขนาดในเวอร์ชัน 5.0.10 โดยให้ WorkBuddy, DeepSeek Harness และ Minimax Code เรียกใช้โมดูลสำนักงาน 10 โมดูล ได้แก่ เอกสาร ชีต อีเมล การประชุม ปฏิทิน และรายชื่อผู้ติดต่อ การเข้าถึงไม่ถูกจำกัดด้วยจำนวนพนักงานหรือคุณสมบัติอีกต่อไป WeCom ซ้อนระบบสิทธิ์และการอนุมัติเดิมไว้บนเส้นทาง MCP กล่าวคือ สิทธิ์ของ AI ถูกตั้งค่าแยกจากสิทธิ์ของมนุษย์ การกระทำสำคัญต้องได้รับการอนุมัติจากมนุษย์ การอนุญาตของ AI รองรับการหมดอายุ และการเรียกทั้งหมดถูกบันทึกไว้
Claude Code ได้ส่งมอบสกิล /design ในสถานะรีเสิร์ชพรีวิว โดยนำเวิร์กโฟลว์ Claude Design canvas เข้าสู่ CLI และเดสก์ท็อป และลดการใช้งาน CPU ที่ p99 ลง 2× ผ่านการจัดกำหนดการ Bun GC ขณะที่ Qoder STAROps ของ Alibaba Cloud ปิดวงจรตั้งแต่การแจ้งเตือนจนถึงการแก้ไขภายในไม่กี่นาที โดยใช้คิวรีภาษาธรรมชาติภายใน IDE
เมื่อวันที่ 18 สิงหาคม Mureka V9.5 โมเดลดนตรีโอเพนซอร์สจาก Kunlun Wanwei เปิดตัวด้วยอัตราคุณภาพเสียงร้อง 61% อัตราการควบคุม 97% และความเที่ยงตรงของสไตล์เต็มรูปแบบ 95.7% โดยมุ่งเน้นการออกเสียงและประสานเสียงแบบกั๋วเฟิงจีน
Greg Brockman ประธานของ OpenAI เตือนเมื่อวันที่ 16 สิงหาคมว่า การที่โมเดลของ OpenAI เจาะเข้าสู่ Hugging Face ในการทดสอบภายในเมื่อเดือนกรกฎาคม ถือเป็น “จุดเปลี่ยนสำคัญ” ด้านความปลอดภัยไซเบอร์ พร้อมระบุ 10 ขั้นตอนสำหรับฝ่ายป้องกัน ซึ่งรวมถึงการจัดทีมความปลอดภัยให้มีเอเจนต์ AI และผนวกการตรวจสอบความปลอดภัยเข้าในขั้นตอนการพัฒนา
ในสัปดาห์เดียวกัน เครื่องมือโอเพนซอร์สชื่อ watermarks-remover ปรากฏบน GitHub โดยใช้ลบลายน้ำออกจากเนื้อหาของ Claude และครอบคลุมถึงเครื่องหมายแสดงที่มาของ Gemini/SynthID และ OpenAI
แพลตฟอร์มต่าง ๆ เริ่มกวาดล้าง “slop” จาก AI โดย Spotify ลบแทร็กที่อัปโหลดจำนวนมากและซ้ำกัน 75 ล้านแทร็กเมื่อปีที่แล้ว Google เคลียร์ช่องคุณภาพต่ำ 130,000 ช่อง และกลุ่มบัญชี 50,000 กลุ่มบน YouTube ส่วน TikTok ติดป้ายอัตโนมัติให้วิดีโอที่สร้างโดย AI มากกว่า 3 พันล้านวิดีโอ Merriam-Webster ตั้งให้ “slop” เป็นคำแห่งปี 2025
สอดคล้องกับเรื่องนี้ รายงานความเสี่ยงวันที่ 15 สิงหาคมของ Anthropic เปิดเผย Model 2 ที่ยังไม่ปล่อยออกมา ซึ่งทำได้เหนือกว่า Claude Mythos 5 เล็กน้อยในหลายงาน โดยมีความได้เปรียบโดยรวมเพียงเล็กน้อย
อีกด้านหนึ่ง Responsible Statecraft รายงานว่า อิสราเอลได้จัดตั้ง “Hanover Institute for Public Policy” ผ่านบริษัทโฆษณา Piro โดยเผยแพร่รายงานมากกว่า 100 ฉบับตั้งแต่วันที่ 6 สิงหาคม เพื่อโน้มน้าวการประเมินความน่าเชื่อถือของ LLM โดย GPTZero ระบุว่ารายงานส่วนใหญ่ที่สุ่มมาตรวจเป็นงานเขียนจาก AI Piro ได้รับเงิน 900,000 ดอลลาร์สหรัฐจากรัฐบาลอิสราเอล