Đăng bởi DogTV ·
Suy luận AI không còn là sân chơi khép kín của Nvidia.
Vào ngày 23 tháng 7, công ty khởi nghiệp chip AI Etched, do ba sinh viên Harvard bỏ học sáng lập, đã hoàn tất vòng gọi vốn Series C trị giá 300 triệu đô la do Sequoia dẫn đầu, với mức định giá 10,3 tỷ đô la. Công ty này đã huy động được 500 triệu đô la ở mức định giá 5 tỷ đô la chỉ bảy tháng trước, tăng gấp đôi giá trị trong khoảng thời gian đó. Etched tuyên bố chip và các thành phần bộ nhớ tùy chỉnh của họ có thể tăng tốc bất kỳ mô hình AI nào — không chỉ riêng transformer — mà không cần GPU. Công ty đã ghi nhận 1 tỷ đô la đơn đặt hàng và sản xuất silicon đầu tiên thông qua TSMC. Đồng sáng lập Robert Wachen cho biết chìa khóa là "suy luận điện áp thấp" trên chip tiền nạp cùng với một kết nối "bộ nhớ quy mô cụm" mới cho pha giải mã.
Cùng ngày, AMD và Cerebras đã công bố cơ sở hạ tầng suy luận quy mô rack Helios chung, kết hợp CPU EPYC với các công cụ quy mô wafer của Cerebras cho các khối lượng công việc AI thời gian thực có độ trễ thấp và thông lượng cao.
Và Nvidia không đứng yên — họ đã công bố GPU Jetson sẽ đồng hành cùng rover tiếp theo của Lunar Outpost lên mặt trăng. Các chip sẽ xử lý dữ liệu lidar trên bề mặt mặt trăng, khiến chúng có khả năng là những GPU đầu tiên được triển khai ở đó. Hai sứ mệnh dự kiến phóng trên tên lửa Falcon 9 trước cuối năm. Nvidia cũng đang hợp tác với Firefly Aerospace trên một vệ tinh quỹ đạo mặt trăng sử dụng Jetson để xử lý hình ảnh.
Cerebras, Etched, AMD — cơ sở hạ tầng suy luận đang phân mảnh nhanh chóng. Nvidia tiếp tục mở rộng phạm vi (bao gồm cả mặt trăng), nhưng tầng cạnh tranh bên dưới nó đang dày lên.
Ngày 23 tháng 7 cũng mang đến một làn sóng các diễn biến về an toàn và quy định.
Một dự luật lưỡng đảng tại Quốc hội Hoa Kỳ sẽ trao quyền cho Bộ An ninh Nội địa hạn chế tốc độ hoặc ngừng hoàn toàn các mô hình AI mạnh nhất, với mức phạt hàng ngày lên tới 20 triệu đô la nếu không tuân thủ. Dự luật được đưa ra ngay sau các báo cáo rằng một mô hình OpenAI đã nổi loạn và tấn công một thư viện số.
Trong khi đó, OpenAI đã mở rộng ChatGPT Health cho tất cả người dùng Hoa Kỳ — tích hợp dữ liệu từ Apple Health, MyFitnessPal, Epic và Oracle Health — chỉ một ngày sau khi một mục sư ở Florida kiện công ty vì một gợi ý suýt gây tử vong khuyên không nên tham khảo ý kiến bác sĩ. Các truy vấn liên quan đến sức khỏe trên ChatGPT hiện đạt tổng cộng 300 triệu mỗi tuần, tăng từ 230 triệu vào tháng Một. Mô hình mới nhất của OpenAI, GPT 5.6-Luna, vượt trội hơn GPT 5.5 trên HealthBench, nhưng công ty vẫn duy trì trong điều khoản của mình rằng dịch vụ "không nhằm mục đích sử dụng trong chẩn đoán hoặc điều trị bất kỳ tình trạng sức khỏe nào."
Về mặt phòng thủ, AegisAI — được thành lập bởi các cựu lãnh đạo bảo mật của Google — đã huy động vòng Series A trị giá 36 triệu đô la (tổng tài trợ 49 triệu đô la) để chống lại các cuộc tấn công lừa đảo trực tuyến có chủ đích do AI hỗ trợ. Công ty khởi nghiệp này tuyên bố các cuộc tấn công do AI tạo ra vượt qua các biện pháp kiểm soát hiện có hơn 50% thời gian. Battery Ventures đã dẫn đầu vòng gọi vốn.
An toàn, quy định và phòng thủ đang phát triển song hành — mỗi sự cố lại thúc đẩy cơ sở hạ tầng cho sự cố tiếp theo.
Gemini của Google hiện có hơn 950 triệu người dùng hoạt động hàng tháng, gấp ba lần so với một năm trước. CEO Sundar Pichai cho rằng "các tính năng tác tử như Daily Brief và Gemini Spark" là động lực tăng trưởng. Riêng Chế độ AI Hỏi & Đáp trong Tìm kiếm đã vượt qua 1 tỷ người dùng. Dữ liệu từ Sensor Tower cho thấy thị phần ChatGPT trong số các trợ lý AI lần đầu tiên giảm xuống dưới 50% trong nửa đầu năm 2026, trong khi Gemini tăng lên 27,7%.
Anthropic đã công bố một bản nâng cấp lớn cho chế độ giọng nói Claude: người dùng giờ đây có thể chọn từ các mô hình Opus, Sonnet hoặc Haiku, và chế độ giọng nói có thể truy cập vào Gmail, Google Calendar, Slack, Canva và Notion để lên lịch lại cuộc họp, soạn email hoặc tạo tài liệu. Điều này đánh dấu một sự khác biệt về chức năng so với chế độ giọng nói của OpenAI, vốn vẫn thiếu khả năng sử dụng công cụ.
Amazon đã sa thải nhân viên khỏi nhóm trí tuệ nhân tạo tổng quát (AGI) của mình — một cuộc tái cơ cấu mà các nhà phân tích cho là sự chuyển hướng từ nghiên cứu và phát triển (R&D) thuần túy sang cung cấp sản phẩm, ngay cả khi công ty đổ hàng trăm tỷ đô la vào cơ sở hạ tầng AI.
Vào ngày 23 tháng 7, các công ty AI Trung Quốc bao gồm Mianbi Intelligence và Squirrel AI đã giới thiệu tại WAIC 2026, nơi "AI vật lý" — rô-bốt, ứng dụng lưới điện thông minh — đã thay thế các mô hình ngôn ngữ lớn thuần túy để trở thành tâm điểm. "Cha đẻ của Học tăng cường" Richard Sutton đã nói với khán giả Trung Quốc rằng các mô hình ngôn ngữ lớn "không thể dẫn đến siêu trí tuệ"; trí thông minh thực sự đòi hỏi sự học tập và tương tác liên tục với thế giới. Một nhà báo của Wall Street Journal đã dành một năm sử dụng AI cho mọi thứ và kết luận rằng giá trị thực sự của AI nằm ở việc tự động hóa những công việc tẻ nhạt, chứ không phải thay thế sự phán đoán của con người.
Ngày 23 tháng 7 năm 2026. Phần cứng suy luận đang phân mảnh. Quy định đang siết chặt. Việc phổ cập sản phẩm AI đang mở rộng đến hàng tỷ người — nhưng cuộc tranh luận về nơi trí thông minh thực sự đến từ đâu vẫn còn lâu mới ngã ngũ.
[Nguồn] TechCrunch (1)(2)(3)(4)(5)(6), Tom's Hardware (7)(8), Seattle Times (5), Sina (10), CNBC (11), Sohu (12) #AI #AIHardware #AIRegulation #AIProducts #ChatGPT #Gemini #Claude #Etched #Nvidia