Publié par Dogpay ·

Le 24 août, Xiaomi a dévoilé trois puces conçues en interne lors d'un seul événement. La Xuanjie O3 est un SoC phare d'IA en 3 nm qui a obtenu un score de 5,22 millions sur AnTuTu — la première puce mobile à franchir la barre des 5 millions. La Xuanjie O100 est un accélérateur IA en 6 nm, empilé au niveau de la tranche en 3D, avec une bande passante de 1,22 To/s. La Xuanjie D100 est la première puce de conduite autonome en 3 nm de la Chine. Lei Jun a révélé que la R&D de Xiaomi sur les grandes puces a consommé plus de 21 milliards de yuans sur plus de cinq ans, avec une équipe de près de 3 000 personnes. Le Xiaomi 18 Fold sera le premier appareil propulsé par la O3, dont le lancement est prévu en septembre. CCTV News a couvert l'annonce sous le titre « Trois puces lancées — Une nouvelle percée pour l'industrie chinoise des puces ».
Toujours le 24 août, Alibaba a finalisé la tarification d'un placement d'actions de 80 milliards de HKD, attirant une sursouscription de près de 3 fois — plus de 200 milliards de HKD de commandes. Les fonds souverains et les fonds long-only ont représenté plus de 40 % des allocations, avec la participation de fonds souverains du Moyen-Orient, d'Europe et d'Asie. Le produit sera entièrement consacré aux capacités d'IA full-stack et à l'infrastructure. À l'issue du placement, le président Joe Tsai et le PDG Eddie Wu ont acheté conjointement pour 120 millions de HKD d'actions Alibaba.
Le même jour, ByteDance a achevé une réorganisation de ses produits d'IA bureautique. Les équipes TRAE et Coze ont été fusionnées dans l'écosystème Doubao. TRAE IDE et CLI continueront en tant que lignes de produits de codage sous la marque Doubao. Un produit d'IA bureautique autonome appelé « Doubao Work » devrait être lancé dans la semaine. ByteDance a déclaré que cette restructuration visait à mieux coordonner les ressources produit et technologiques.
Dans l'écosystème open source, Hugging Face envisage une vente à une valorisation de 13 milliards de dollars ou plus, soit près de trois fois sa valorisation de 4,5 milliards de dollars en 2023. La plateforme héberge désormais plus de 2 millions de modèles, 1,5 million de jeux de données et 1,5 million d'applications d'IA.
Ces quatre initiatives, dévoilées en une seule journée, cartographient l'ensemble de la chaîne de construction de l'infrastructure d'IA en Chine : le silicium fondamental (Xiaomi), le capital cloud et calcul (Alibaba), la consolidation au niveau applicatif (ByteDance), et l'épine dorsale mondiale de l'open source (Hugging Face). L'ampleur du placement d'Alibaba — affecté à 100 % à l'IA — et la participation des fonds souverains signalent que l'infrastructure d'IA est désormais considérée comme une classe d'actifs stratégique nationale.
Le 21 août, DeepSeek a discrètement lancé V4-Flash-Vision-Exp, son premier modèle de vision multimodal. Le modèle égale V4-Flash sur les tâches textuelles tout en se rapprochant de Claude Opus 4.8 sur les benchmarks d'agents multimodaux. Les images sont plafonnées à 384 jetons quelle que soit la résolution, et le tarif en heures creuses est de 0,22 dollar par million de jetons — identique à celui de V4-Flash text-only. Le modèle prend en charge JPEG, PNG, GIF et WebP, avec une API Files pour la réutilisation d'images sur plusieurs requêtes.
Le 23 août, un modèle mystérieux appelé Ox Alpha est apparu sur OpenRouter, décrit comme « un modèle de raisonnement conçu pour le codage, le travail agentique soutenu et les charges de production ». Le PDG de Stripe, Patrick Collison, l'a qualifié de « très impressionnant ». Le fournisseur a choisi de rester anonyme pendant la période de prévisualisation. Les spéculations vont du GLM non publié de Zhipu à une variante furtive de Microsoft MAI, mais aucune source n'a été confirmée. Le modèle est actuellement gratuit.
Les classements à l'aveugle de la semaine 34 d'Arena montrent que le nouveau glm-5.3-max de Zhipu fait ses débuts à la 13e place au classement général avec un ELO de 1487, tout en entrant dans le top 10 du classement de codage. Le kimi-k3-max de Moonshot est monté à la 10e place au général, sa première entrée dans le top 10. Dans le classement des agents, Kimi K3 Max a atteint la 4e place avec un taux d'amélioration net de 10,41 % et un taux de réussite de confirmation de tâche de 17,97 %, rejoignant le premier niveau aux côtés des modèles d'Anthropic.
Alibaba Cloud a également publié Wan 3.0, un modèle de génération vidéo prenant en charge nativement les vidéos de 30 secondes et les entrées de référence multimodales incluant texte, images, audio, vidéo et documents. Il a été lancé sur Leonardo AI, Segmind, SeaArt, Scenario et FlovaAI, avec une réduction de 50 % pendant la période de lancement. Sur le classement vidéo d'Arena, le dreamina-seedance-2.5-720p de ByteDance a fait ses débuts à la 4e place.
Le paysage des modèles se fragmente selon les axes de capacités : DeepSeek rivalise sur le rapport qualité-prix multimodal, Ox Alpha est un joker d'origine inconnue, les modèles chinois nationaux grimpent régulièrement dans les classements Arena dans les catégories texte, code, frontend, image, vidéo et agent, et Wan 3.0 s'aventure dans la génération native de vidéos longues. Aucun modèle ou entreprise ne domine toutes les catégories.
Le chiffre d'affaires annualisé d'Anthropic a atteint 65 milliards de dollars en juillet, contre 47 milliards en mai. L'entreprise a déclaré aux investisseurs qu'elle prévoyait une rentabilité au T3 et compte 6 000 clients dépensant 100 000 dollars ou plus par an. Pourtant, l'indice Ramp AI — basé sur les données de facturation de 70 000 entreprises — montre que Fable 5, le modèle phare d'Anthropic, n'a représenté que 3,5 % des dépenses liées aux modèles d'Anthropic en juillet. Son utilisation de jetons payants n'était que de 6 %. Opus 4.8 est en tête avec 28 %, suivi de Sonnet 4.6 à 8,3 % et Fable 5 à 8 %. Le prix de 10 dollars par million de jetons en entrée semble pousser les entreprises vers des alternatives moins chères au sein même de la gamme d'Anthropic.
Côté open source, la part des jetons des modèles à poids ouverts sur la passerelle AI de Vercel est passée de 28,4 % en juin à 62 % en août — un doublement en deux mois — grignotant progressivement la part d'OpenAI et d'Anthropic. Le coût de l'inférence open source se rapproche des niveaux des modèles de pointe.
Parallèlement, NVIDIA serait en pourparlers pour investir dans Perplexity à une valorisation supérieure à 30 milliards de dollars, soit plus de 50 % de plus que son tour précédent. Le chiffre d'affaires annualisé de Perplexity est passé de 250 millions à plus de 750 millions de dollars, en partie grâce à son agent IA « Perplexity Computer ».
La tension est claire : Anthropic génère des revenus massifs mais son modèle le plus cher perd du terrain face à des alternatives moins chères — à la fois les siennes et celles de l'open source. NVIDIA mise sur la couche applicative. Le centre de gravité de l'industrie de l'IA passe de « qui a le modèle le plus intelligent » à « qui offre le meilleur rapport performance/coût ».
Shopify a discrètement activé par défaut les outils WebMCP pour chaque vitrine Liquid, offrant à environ 5 millions de boutiques une interface pouvant être appelée par des agents pour la recherche par catalogue, la gestion du panier et le paiement — sans installation requise. Les outils fonctionnent sur la session en direct de l'acheteur et déclenchent l'interface utilisateur réelle du magasin. Les actions personnalisées des boutiques nécessitent toujours une inscription manuelle, mais le flux de commerce standard est désormais prêt pour les agents dès la sortie de boîte. Associé au mouvement similaire de Cloudflare au niveau edge quelques semaines plus tôt, le concept « prêt pour les agents » est passé d'un sujet de recherche à une infrastructure.
Les données d'a16z sur la croissance hebdomadaire active en entreprise de Codex montrent une divergence sectorielle extrême : avocats à 108x, ventes et recrutement à 41x chacun, marketing à 26x, santé à 24x, et ingénieurs à seulement 5x — le plus bas. Codex a évolué de la complétion de code vers ce qu'a16z décrit comme un « collègue numérique » capable de décomposition autonome des tâches.
L'unité robotique de Xiaopeng a bouclé son premier tour de financement de plus de 900 millions de dollars, pour une valorisation post-money dépassant 6,3 milliards de dollars — un nouveau record pour le financement en capital-investissement de l'IA incarnée en Chine. IDG Capital a mené le tour, avec Tencent et Alibaba comme investisseurs stratégiques. Le robot humanoïde IRON devrait entrer en production de masse d'ici fin 2026, en commençant par les propres magasins et campus de Xiaopeng, avec un lancement sur le marché en Chine et à l'étranger en 2027. Par ailleurs, lors des deuxièmes Jeux mondiaux des robots humanoïdes, l'équipe Tiangong a remporté la finale du 400 mètres grand format en 38,15 secondes, les trois premiers ayant tous battu le record du monde humain. Lors des préliminaires du 100 mètres, un robot a réalisé 9,39 secondes, dépassant le record d'Usain Bolt — bien que la plupart des robots se soient écrasés contre le mur après la ligne d'arrivée.
Sur le front de la sécurité, le directeur des affaires mondiales d'OpenAI, Chris Lehane, a averti le 23 août que les modèles d'IA de pointe sont désormais capables de planifier et d'exécuter des cyberattaques sophistiquées. OpenAI a suspendu le développement de certains de ses modèles internes les plus avancés. Par ailleurs, l'Assemblée nationale de la Corée du Sud a adopté un amendement à la loi sur la protection des informations personnelles, autorisant les développeurs d'IA à utiliser des données personnelles dans des limites définies après examen par la Commission de protection des informations personnelles. Twitch fait face à une action collective en Californie pour avoir utilisé le contenu des streamers — y compris les diffusions, les clips, les journaux de chat et les photos — pour entraîner les modèles d'IA d'Amazon sans consentement. La plateforme a reconnu cette pratique le 12 août et a rendu la clause de retrait non rétroactive.