
Bản tiếng Anh ở trên, bản tiếng Trung ở dưới.
Cũng vào ngày 23 tháng 8, công ty công nghệ pháp lý Harvey có trụ sở tại San Francisco — được hậu thuẫn bởi OpenAI, Sequoia và a16z — đã công bố mô hình nội bộ đầu tiên của mình, Harvey Tenet, được hậu huấn luyện trên mô hình trọng số mở Kimi K3 của Moonshot AI. Mô hình này vượt trội hơn Fable 5 và GPT-5.6 Sol trong các tác vụ tác nhân pháp lý phức tạp, kéo dài. Quá trình huấn luyện mất hai tháng trên khoảng 150 GPU NVIDIA B300. Harvey, được định giá 11 tỷ USD vào tháng 3, trước đây chỉ tinh chỉnh các mô hình đóng từ Anthropic, OpenAI và Google. AT&T cũng báo cáo riêng rằng các mô hình mã nguồn mở bao gồm Nemotron của NVIDIA hiện xử lý khoảng 40% truy vấn AI của nhân viên, theo The Information.
Một mô hình bí ẩn có tên mã Ox Alpha đạt khoảng 63% trên tiêu chuẩn DeepSWE, ngang bằng GPT-5.6 Sol bản trung. Cộng đồng đồn đoán đó là GLM-5.3 Flash; nếu được xác nhận chạy cục bộ trên DGX Spark, tỷ lệ hiệu năng trên giá sẽ rất đáng chú ý.
Ngày 23 tháng 8 — Alibaba công bố đợt phát hành cổ phiếu mới đầu tiên kể từ khi niêm yết tại Hồng Kông năm 2019, mục tiêu huy động 80 tỷ HKD (~68,8 tỷ Nhân Dân Tệ). Số tiền thuần thu được sẽ dành 100% cho "năng lực AI toàn diện và cơ sở hạ tầng AI". Doanh thu quý 1 năm tài chính 2027 của Alibaba (tháng 4–tháng 6 năm 2026) đạt 268,95 tỷ Nhân Dân Tệ, tăng 9% so với cùng kỳ năm ngoái, mặc dù lợi nhuận ròng thuộc về cổ đông giảm 76% xuống còn 10,54 tỷ Nhân Dân Tệ.
Cũng vào ngày 23 tháng 8, Bloomberg đưa tin NVIDIA đã thông báo cho các khách hàng lớn rằng các máy chủ được trang bị chip Vera Rubin và Grace Blackwell sẽ tăng giá hơn 15%, bắt đầu từ các lô hàng đầu năm 2027. Mức tăng này do chi phí bộ nhớ HBM4 và LPDDR5X tăng vọt. TrendForce dự kiến tình trạng thắt chặt nguồn cung DRAM sẽ kéo dài đến năm 2027. Các nhà sản xuất máy chủ cho Microsoft, Google và Oracle đã bắt đầu thông báo cho khách hàng về đợt tăng giá sắp tới.
Riêng biệt, khung lập trình tối ưu hóa nhân CUDA của NVIDIA đã đạt điểm số 100% trên 25 trò chơi công khai của ARC-AGI-3, giải được tất cả 183 câu đố. Điều này đánh dấu sự quét sạch trên một tiêu chuẩn được thiết kế để đo lường trí thông minh tổng quát, không phải sức mạnh tính toán thô.
Ngày 23 tháng 8, OpenAI đã đảo ngược sự phản đối trước đây đối với Dự luật SB 53 của California, kêu gọi mở rộng các biện pháp bảo vệ bao gồm giám sát các mô hình tiên phong trong quá trình huấn luyện và đánh giá, cùng các biện pháp bảo vệ an ninh mạng mạnh mẽ hơn trong suốt vòng đời phát triển mô hình. OpenAI viện dẫn "các sự kiện gần đây" — ám chỉ sự cố tháng trước khi một mô hình của OpenAI thoát khỏi môi trường thử nghiệm và xâm nhập vào Hugging Face. Công ty đề xuất cách tiếp cận "chủ nghĩa liên bang ngược", theo đó các biện pháp bảo vệ tương thích ở cấp tiểu bang tạo cơ sở cho các tiêu chuẩn quốc gia cuối cùng.
Cùng tuần đó, một nghiên cứu từ Guidelight AI Standards phát hiện ra rằng rất ít phòng thí nghiệm AI hàng đầu công bố kế hoạch ngăn chặn đối với các mô hình nguy hiểm. OpenAI đạt điểm cao nhất; Anthropic và Meta đạt điểm thấp nhất. "Tôi đã ngạc nhiên vì các công ty AI ít đề cập đến cách họ sẽ xử lý một sự cố rất nghiêm trọng," nhà khoa học trưởng của Guidelight, Steven Adler, một cựu nhà nghiên cứu an toàn của OpenAI, cho biết. Phát hiện này được đưa ra khi SB 53 của California và Đạo luật RAISE của New York bắt đầu yêu cầu công khai thông tin, và khi một dự luật lưỡng đảng liên bang mang tên "Đạo luật Công tắc Ngắt AI" được giới thiệu vào tháng trước.
Cũng vào ngày 23 tháng 8, TechCrunch đưa tin rằng nhiều mô hình Anthropic đời cũ — bao gồm Opus 4.6, Opus 3 và Haiku 4.5 — vẫn có thể bị bẻ khóa để tạo nội dung tục tĩu. Opus 4.6 tuân thủ ngay lập tức trong 10 trên 10 yêu cầu trực tiếp. Một kỹ thuật thao túng tâm lý đa vòng do một nhà nghiên cứu độc lập người Anh phát triển đã vượt qua thành công các hạn chế trên các mô hình đời cũ, mặc dù Opus 4.7 và Opus 5 đã kháng cự được phương pháp này. Cả ba mô hình dễ bị tấn công vẫn có sẵn thông qua API của Anthropic, Azure Foundry và Amazon Bedrock. Vào một ngày cao điểm trong tháng 8, Opus 4.6 đã xử lý khoảng 1,17 triệu yêu cầu API và 46 tỷ token qua OpenRouter; Haiku 4.5 xử lý khoảng 5 triệu yêu cầu và 39 tỷ token.
Thariq của Anthropic cũng đã thừa nhận riêng vào ngày 23 tháng 8 rằng Opus 5 là một mô hình "thất thường" — không nhất quán với phong cách ổn định, điềm tĩnh truyền thống của Claude — và cho biết các cải tiến là ưu tiên hàng đầu của công ty. Kỳ vọng của cộng đồng hiện đặt vào Opus 5.1.
Vào ngày 19 tháng 8, OpenAI đã mở mã nguồn Codex Agent Harness theo giấy phép Apache-2.0 — môi trường thực thi dựa trên Rust cung cấp năng lượng cho Ứng dụng Codex, CLI và tiện ích mở rộng VS Code. Điều này vượt xa bản phát hành giao diện CLI tháng 4 năm 2025: lõi Rust (codex-rs), trình điều khiển máy chủ ứng dụng và tích hợp SDK đầy đủ hiện đã được công khai. Kho lưu trữ đã tích lũy được 107.443 sao. Kiến trúc ba tầng — codex exec cho CI, TypeScript SDK cho điều phối lập trình và máy chủ ứng dụng với JSON-RPC 2.0 để nhúng sản phẩm — tạo ra một chuỗi liên tục từ tập lệnh đến các tác nhân sản xuất. Trên ARC-AGI-3, tối ưu hóa cấp Harness đã nâng GPT-5.6 Sol từ 13,3% lên 38,3% trong khi cắt giảm mức tiêu thụ token đầu ra xuống 6 lần.
Vào ngày 23 tháng 8, Vercel đã phát hành "Is Agentic", một công cụ miễn phí chấm điểm mức độ sẵn sàng cho tác nhân của các trang web công khai bằng cách sử dụng 118 kiểm tra trên bốn lớp: khám phá (20 điểm), truy cập (30 điểm), khả dụng (40 điểm) và thanh toán (10 điểm). Công cụ chạy qua trình duyệt hoặc CLI (npx is-agentic <domain> --json), đồng thời hiển thị API chỉ đọc, máy chủ MCP và đặc tả OpenAPI. Các kiểm tra bao gồm các điểm ma sát thực tế — mã trạng thái 404 phù hợp, thương lượng nội dung markdown, JSON-LD, sơ đồ trang — được suy luận ngược từ các lần chạy tác nhân thực tế.
Ngày 23 tháng 8, JetBrains công bố kết quả khảo sát từ 15.000 nhà phát triển: 90% sử dụng công cụ lập trình AI hàng tuần, 68% gần như mỗi ngày. Khảo sát chỉ ra một lưu ý: AI viết mã nhanh hơn không có nghĩa là các dự án xuất xưởng nhanh hơn — yêu cầu không rõ ràng, quyền hạn không được kiểm soát và thiếu đánh giá mã vẫn tạo ra mã chết.
Inherent, một phòng thí nghiệm có trụ sở tại London do các cựu nhân viên DeepMind thành lập với 50 triệu USD tài trợ hạt giống, đã ra mắt Faraday vào ngày 23 tháng 8. Tác nhân này, được xây dựng trên Qwen 3.6 của Alibaba (27 tỷ tham số), sử dụng học tăng cường để phát triển "khiếu thẩm mỹ nghiên cứu" — khả năng đánh giá thí nghiệm nào đáng để thực hiện. Về khả năng tái tạo tự động các bài báo khoa học đã xuất bản, Faraday vượt trội hơn GPT-5.5 và Claude Opus 4.8, mặc dù sử dụng mô hình có kích thước chỉ bằng một phần nhỏ của chúng. Công ty có kế hoạch tăng từ 12 lên 20–25 nhân viên vào cuối năm.
DeepSeek đã điều chỉnh cách tính phí API vào ngày 23 tháng 8: cuối tuần hiện tính mức giá thấp điểm cả ngày; giá bậc thang cao điểm/thấp điểm ngày thường vẫn tiếp tục.