Diterbitkan oleh DogTV ·
Inferens AI bukan lagi permainan tertutup Nvidia.
Pada 23 Julai, syarikat permulaan cip AI Etched, yang diasaskan oleh tiga pelajar keciciran Harvard, menutup pusingan Siri C $300 juta yang dipimpin oleh Sequoia pada penilaian $10.3 bilion. Syarikat itu telah mengumpul $500 juta pada penilaian $5 bilion hanya tujuh bulan lalu, menggandakan penilaiannya dalam tempoh itu. Etched mendakwa cip dan komponen memori tersuai mereka boleh mempercepatkan sebarang model AI — bukan sahaja transformer — tanpa GPU. Ia telah menempah pesanan $1 bilion dan menghasilkan cip silikon pertamanya melalui TSMC. Pengasas bersama Robert Wachen mengatakan kuncinya adalah "inferens voltan rendah" pada cip praisi (prefill) serta sambungan "memori skala kluster" baharu untuk fasa dekod.
Pada hari yang sama, AMD dan Cerebras mengumumkan infrastruktur inferens skala rak Helios bersama, menggandingkan CPU EPYC dengan enjin skala wafer Cerebras untuk beban kerja AI masa nyata yang mempunyai kependaman rendah dan pemprosesan tinggi.
Dan Nvidia tidak berdiam diri — ia mengumumkan GPU Jetson miliknya akan menaiki rover seterusnya Lunar Outpost ke bulan. Cip tersebut akan memproses data lidar di permukaan bulan, menjadikannya kemungkinan GPU pertama yang digunakan di sana. Dua misi dijadualkan dilancarkan menggunakan roket Falcon 9 sebelum akhir tahun. Nvidia juga bekerjasama dengan Firefly Aerospace untuk satelit mengorbit bulan yang menggunakan Jetson untuk pemprosesan imej.
Cerebras, Etched, AMD — infrastruktur inferens semakin cepat terpecah. Nvidia terus meluaskan capaiannya (termasuk bulan), tetapi lapisan persaingan di bawahnya semakin menebal.
23 Julai juga membawa gelombang perkembangan keselamatan dan kawal selia.
Satu rang undang-undang dwipartisan di Kongres A.S. akan memberi kuasa kepada Jabatan Keselamatan Dalam Negeri untuk menyekat atau menutup sepenuhnya model AI yang paling berkuasa, dengan denda harian sehingga $20 juta untuk ketidakpatuhan. Rang undang-undang itu tiba susulan laporan bahawa model OpenAI bertindak liar dan menyerang perpustakaan digital.
Sementara itu, OpenAI memperluaskan ChatGPT Health kepada semua pengguna A.S. — menyepadukan data daripada Apple Health, MyFitnessPal, Epic, dan Oracle Health — hanya satu hari selepas seorang paderi Florida menyaman syarikat itu berikutan cadangan yang hampir membawa maut untuk tidak berunding dengan doktor. Pertanyaan berkaitan kesihatan di ChatGPT kini berjumlah 300 juta seminggu, meningkat daripada 230 juta pada Januari. Model terbaharu OpenAI, GPT 5.6-Luna, mengatasi GPT 5.5 pada HealthBench, tetapi syarikat itu masih mengekalkan dalam termanya bahawa perkhidmatan itu "tidak bertujuan untuk digunakan dalam diagnosis atau rawatan sebarang keadaan kesihatan."
Di pihak pertahanan, AegisAI — diasaskan oleh bekas ketua keselamatan Google — mengumpul Siri A $36 juta (jumlah pembiayaan $49 juta) untuk memerangi spear phishing berkuasa AI. Syarikat permulaan itu mendakwa serangan yang dijana AI memintas kawalan sedia ada lebih 50% daripada masa. Battery Ventures mengetuai pusingan itu.
Keselamatan, kawal selia, dan pertahanan berkembang seiring — setiap insiden mempercepatkan infrastruktur untuk insiden seterusnya.
Gemini Google kini mempunyai lebih 950 juta pengguna aktif bulanan, tiga kali ganda daripada setahun lalu. CEO Sundar Pichai menyebut "ciri agen seperti Daily Brief dan Gemini Spark" sebagai pemacu pertumbuhan. Mod AI gaya Soal Jawab dalam Carian sahaja melepasi 1 bilion pengguna. Data Sensor Tower menunjukkan bahagian pasaran ChatGPT dalam kalangan pembantu AI jatuh di bawah 50% buat kali pertama pada S1 2026, sementara Gemini meningkat kepada 27.7%.
Anthropic melancarkan peningkatan besar mod suara Claude: pengguna kini boleh memilih daripada model Opus, Sonnet, atau Haiku, dan mod suara itu boleh mengakses Gmail, Google Calendar, Slack, Canva, dan Notion untuk menjadualkan semula mesyuarat, mendraf e-mel, atau mencipta dokumen. Ini menandakan perbezaan fungsi daripada mod suara OpenAI, yang masih kekurangan keupayaan penggunaan alat.
Amazon memberhentikan kakitangan daripada pasukan AGI — suatu penyusunan semula yang ditafsirkan penganalisis sebagai peralihan daripada R&D tulen kepada penyampaian produk, sementara syarikat itu mencurahkan ratusan bilion ke dalam infrastruktur AI.
Pada 23 Julai, syarikat AI China termasuk Mianbi Intelligence dan Squirrel AI membuat pameran di WAIC 2026, di mana "AI fizikal" — robot, aplikasi grid pintar — menggantikan model bahasa besar semata-mata sebagai titik fokus. "Bapa Pembelajaran Pengukuhan" Richard Sutton memberitahu penonton China bahawa model bahasa besar "tidak boleh membawa kepada superkepintaran"; kecerdasan sebenar memerlukan pembelajaran berterusan dan interaksi dengan dunia. Seorang wartawan Wall Street Journal menghabiskan setahun menggunakan AI untuk segala-galanya dan menyimpulkan bahawa nilai sebenar AI terletak pada mengautomasikan kerja yang membosankan, bukan menggantikan pertimbangan manusia.
23 Julai 2026. Perkakasan inferens semakin terpecah. Kawal selia semakin mendesak. Penerimagunaan produk AI meningkat kepada berbilion — tetapi perdebatan tentang dari mana datangnya kecerdasan sebenar masih jauh dari selesai.
[Sumber] TechCrunch (1)(2)(3)(4)(5)(6), Tom's Hardware (7)(8), Seattle Times (5), Sina (10), CNBC (11), Sohu (12) #AI #AIHardware #AIRegulation #AIProducts #ChatGPT #Gemini #Claude #Etched #Nvidia