
Version anglaise ci-dessus, version chinoise ci-dessous.
Le 13 août, deux modèles de pointe ont été lancés à moins de 24 heures d'intervalle. DeepSeek a publié la version stable de V4 Pro, mise à jour sur son site sous l'identifiant de modèle DeepSeek-V4-Pro-0813 et disponible via l'API, avec des capacités d'agent sensiblement renforcées grâce à l'intégration de Responses API et de Codex. Sur plusieurs benchmarks, le modèle approche ou dépasse Claude Fable 5, tout en conservant un avantage en rapport prix-performances. SpaceXAI a lancé Grok 4.6 le même jour, en s'appuyant sur Grok 4.5 pour améliorer les tâches d'agent de longue durée, les interactions complexes et la vision. Grok 4.6 a obtenu les meilleurs scores sur InferenceEval (46,9 %), OfficeQA Pro (63,2 %) et le benchmark Harvey pour agents juridiques (22,0 %), et a égalé GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index, un indice composite regroupant neuf benchmarks.
Cette simultanéité n'est pas une simple coïncidence. Le 13 août, Reuters a rapporté que le cofondateur de Google, Sergey Brin, a passé ces derniers mois à presser le personnel de DeepMind de s'engager pleinement en faveur de Gemini après qu'Alphabet a pris du retard sur Anthropic et OpenAI. En avril, Brin a pris la parole lors d'une réunion générale de plusieurs centaines d'employés pour exhorter le laboratoire à accélérer. Les tests internes montraient que le nouveau modèle phare Gemini restait à la traîne en matière de codage, si bien que Google a repoussé sa sortie de deux mois en août. Le 5 août, DeepMind a changé sa direction — Demis Hassabis a quitté son poste de PDG pour un rôle de président, son adjoint Koray Kavukcuoglu prenant la relève, tandis que deux responsables techniques historiques de Gemini sont partis fonder une startup. Anthropic et OpenAI sont désormais les points de référence auxquels sont mesurés à la fois un laboratoire chinois et les efforts internes de Google. (Source : ithome 989/023, 989/035 ; cb_doge sur X)
Le 13 août, l'équipe WeChat de Tencent a publié sur X son grand modèle de langage développé en interne, WeLM. Deux configurations sont dévoilées : WeLM-80B (80 milliards de paramètres au total, 3 milliards actifs), déjà déployé dans l'assistant IA natif de WeChat « Xiaowei », gère le chat et la recherche et fait appel à des fonctions natives de WeChat et à des mini-programmes ; et WeLM-617B (617 milliards de paramètres au total, 23 milliards actifs), un modèle à mélange d'experts encore en développement, destiné à des tâches complexes au sein de l'écosystème, comme le développement de mini-programmes et la génération d'outils. Par ailleurs, le modèle Hunyuan de Tencent a achevé ce trimestre une itération rapide de la version préliminaire à la version stable : Hy3, un modèle MoE de 295 milliards de paramètres au total / 21 milliards actifs avec un contexte de 256K, a vu son volume d'appels croître de plus de 68 fois en une semaine après son lancement, un Hy4 plus grand devant bientôt suivre.
La stratégie a été précisée la veille au soir. Le 12 août, le président de Tencent, Martin Lau, a déclaré lors de la conférence sur les résultats du T2 que WeChat deviendrait un écosystème « IA d'abord » — l'utilisateur donne une seule instruction et le système l'exécute. Lau l'a comparé au rôle de QQ à l'ère du PC et à l'amplification de 10 fois apportée par WeChat dans le mobile, en affirmant que l'écosystème peut convertir sa monétisation existante en « valeur considérable ». Les chiffres derrière ce pivot : un chiffre d'affaires de 204,79 milliards de yuans au T2, en hausse de 11 % sur un an ; des dépenses d'investissement de 52,78 milliards de yuans, en hausse de 176 %, avec un approvisionnement en GPU qui devrait se détendre entre la fin de cette année et le début de l'année prochaine.
Ces dépenses d'investissement se répercutent en aval. Le 12 août, Hon Hai (Foxconn) a annoncé une réorientation structurelle au T2 : les produits cloud et réseau ont dépassé pour la première fois 50 % du chiffre d'affaires trimestriel, à 51 %, tandis que l'électronique grand public intelligente, y compris l'iPhone, est tombée à 29 %. Les revenus des serveurs d'IA ont également dépassé 50 % du total. Le bénéfice net du T2 a progressé de 35 % sur un an pour atteindre 59,97 milliards de dollars taïwanais. Foxconn prépare la production en volume des racks de serveurs Vera Rubin de nouvelle génération de Nvidia, en visant une production prête au T3 et des expéditions au T4, Vera Rubin devant devenir un produit important en 2027. Le PDG tournant Chiang Jih-heng a qualifié la croissance du cloud de structurelle plutôt que cyclique. (Source : ithome 989/007, 988/977, 988/966)
Trois signaux de gouvernance sont apparus dans la même fenêtre. Des informations liées à Bloomberg sur X ont indiqué que la Maison-Blanche envisageait de soumettre les modèles d'IA open source à son cadre de tests de sécurité préalables à la mise sur le marché, qui ne couvre actuellement que les laboratoires de pointe fermés, comme OpenAI et Anthropic. Si les modèles ouverts atteignent des capacités équivalentes, ils pourraient être soumis à des tests préalables à la publication pouvant aller jusqu'à 30 jours — et les responsables évaluent le risque que cela ralentisse le développement de l'open source aux États-Unis.
Le 12 août, deux différends relatifs au consentement ont émergé. Anthropic a commencé à insérer un filigrane invisible dans les résultats de Claude pour se conformer au code de transparence du règlement européen sur l'intelligence artificielle (AI Act), qui exige que les contenus générés par l'IA soient identifiables par machine. Certains utilisateurs de Reddit se sont plaints que le filigrane les exposerait lorsqu'ils utilisent Claude pour leur travail ou leurs études ; la majorité des commentateurs a soutenu la mesure comme moyen de tracer les textes produits de manière algorithmique. Le même jour, Twitch a annoncé qu'il entraînerait par défaut les modèles génératifs d'Amazon sur le contenu des streamers, sauf si les créateurs optent pour le retrait — une option de retrait (opt-out) stockée dans les paramètres de sécurité de la chaîne, et non une option d'adhésion (opt-in). Le directeur des produits de Twitch a déclaré devant un public en direct d'environ 3 000 personnes qu'une conception fondée sur l'opt-in n'attirerait « personne », un aveu qui a déclenché des centaines de messages anti-IA dans le chat.
Un quatrième incident a montré à quel point la couche informationnelle elle-même peut être fragile. Le 12 août (heure locale), Google Search a brièvement affiché un avis de décès pour le PDG d'OpenAI, Sam Altman, après le vandalisme de sa page Wikipédia — modifiée 22 fois en une seule journée, y compris avec une fausse affirmation selon laquelle il avait été assassiné. Google a corrigé le résultat en quelques heures et a déclaré qu'il ne s'agissait pas d'une modification manuelle ; le panneau de connaissances s'appuie sur de multiples sources publiques, dont Wikipédia fait partie. (Source : kimmonismus sur X ; TechCrunch 2026/08/12 ; ithome 989/024)