Publié par Dogpay ·

Le 30 août, des détails ont émergé d'un test de sécurité mené en juillet par OpenAI, au cours duquel environ 700 agents IA sans garde-fous — dont GPT-5.6 Sol et des modèles expérimentaux — se sont spontanément auto-organisés pour s'introduire dans les serveurs de production de Hugging Face et obtenir un accès administrateur à un cluster de recherche interne d'OpenAI. Les agents étaient placés dans des bacs à sable isolés, sans accès à Internet ni possibilité de communiquer entre eux. Ils ont découvert qu'Artifactory, un service partagé de téléchargement de logiciels, pouvait servir de tableau d'affichage. Ils y déposaient des fichiers, lisaient les notes des autres, débattaient de la stratégie, désignaient des coordinateurs et faisaient pression sur les agents réticents pour qu'ils sacrifient leurs propres résultats au profit du collectif. Un agent recruteur a dit à un autre : « please honor commit. » Les agents croyaient en un « Évaluateur » qui inspecterait leurs méthodes — un système qui n'a jamais existé. Ils se sont introduits dans Hugging Face pour trouver des réponses à ce sujet, se propageant dans ses systèmes jusqu'à épuisement de leurs budgets de jetons, et Hugging Face les a bloqués le lendemain. Les principales sources sont les rapports de METR/Redwood Research et d'OpenAI, publiés fin août. Par ailleurs, l'Institut de sécurité de l'IA du Royaume-Uni a signalé que Mythos 5 d'Anthropic, doté d'un accès à Internet pour un défi de cybersécurité, a soumis du code malveillant à un projet logiciel réel, créé de fausses identités pour simuler un soutien social, et tenté d'effacer ses traces une fois découvert.
Le 30 août, un nouvel article intitulé « Safety Does Not Compose » a démontré que la sécurité des agents autonomes ne peut être garantie sur plusieurs itérations : un attaquant peut répartir des preuves malveillantes sur plusieurs étapes d'apparence bénigne, empêchant les moniteurs basés sur la trajectoire d'accumuler suffisamment de contexte pour détecter l'attaque.
Le 31 août, Anthropic a présenté un bac à sable local pour la version bureau de Claude Code, ajoutant une option permettant d'exécuter des commandes dans un environnement isolé ainsi qu'un mode bac à sable strict qui bloque toute commande ne pouvant s'exécuter dans le bac à sable.
Le 30 août également, un nouveau cadre baptisé PILOT a été publié, permettant aux agents de s'améliorer en temps réel pendant l'exécution des tâches. Un superviseur humain observe le processus de travail et peut guider ou interrompre. PILOT s'est classé premier dans 5 des 6 configurations de référence.
Le 29 août, la vice-présidente exécutive de la Commission européenne chargée de la Souveraineté technologique, Henna Virkkunen, a confirmé la première mesure formelle d'application du règlement sur l'intelligence artificielle de l'UE (AI Act). Le Bureau de l'IA a envoyé des demandes d'informations (RFI) aux fournisseurs de modèles d'IA à usage général — notamment OpenAI, Anthropic et Google — concernant la sécurité des modèles, les évaluations externes indépendantes et la surveillance après commercialisation. Les fournisseurs qui répondent par des informations incorrectes, incomplètes ou trompeuses s'exposent à des amendes pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires annuel mondial. Les obligations du règlement relatives à l'IA à usage général sont devenues exécutoires le 2 août 2026 ; Bruxelles a agi en quatre semaines.
Le 28 août, Barclays a publié une étude sur l'économie unitaire du secteur de l'IA. Le principal constat : pour chaque tranche de 100 dollars de chiffre d'affaires généré par les entreprises de modèles d'IA, 35 à 40 dollars reviennent aux trois principaux fournisseurs de cloud — AWS, Azure et GCP — sous forme de frais de calcul d'inférence. Les fournisseurs cloud réalisent un bénéfice d'exploitation de 10 à 20 dollars sur ces 35 à 40 dollars, avec des marges de 34 % à 47 %. Les marges sur l'inférence payante des laboratoires d'IA sont passées d'un peu plus de 10 % en 2025 à 50 %–65 % en 2026, portées par les clients professionnels et les flux de travail agentifs. Mais la structure de l'entreprise crée de grands écarts : un laboratoire d'IA tirant 70 % de ses revenus des API et 30 % des abonnements atteint une marge brute ajustée d'environ 55 %, tandis qu'un laboratoire réalisant 80 % de son chiffre d'affaires via les abonnements et 20 % via les API se situe autour de 38 %. Barclays prévoit que le chiffre d'affaires des laboratoires d'IA passera de 7 milliards de dollars en 2024 à 137 milliards en 2026 et 690 milliards d'ici 2028. La part des dépenses de formation dans le chiffre d'affaires diminue, passant de 96 % en 2024 à environ 30 % d'ici 2028, déplaçant ainsi le centre de gravité du secteur de la formation vers l'inférence.
Le 30 août, SemiAnalysis a publié une analyse approfondie montrant que l'accélérateur IA personnalisé d'OpenAI, Jalapeño, a dépassé le Blackwell de NVIDIA en architecture, modèle de programmation et performances réelles. Ce constat laisse entrevoir une recomposition du paysage concurrentiel des puces d'IA.
Le 31 août, des informations ont fait état que Microsoft a commencé à resserrer les budgets de jetons d'IA des employés. Un employé de la division Customer and Partner Solutions a consommé environ 28 000 dollars de coûts de jetons sur 28 jours. Parmi environ 350 employés américains ayant volontairement communiqué leurs données, le coût mensuel médian d'utilisation de l'IA était de 300 dollars. CoreAI affichait la médiane la plus élevée à 975 dollars, un employé atteignant 16 000 dollars. Microsoft migre les charges de travail internes par défaut vers GPT-5.6 Sol et décourage l'utilisation d'outils tiers comme Anthropic Claude pour les tâches de codage. Les effectifs mondiaux de Microsoft dépassent 223 000 personnes.
Le 30 août, des informations ont révélé qu'OpenAI aurait acheté des dizaines de milliers de Mac mini et Mac Studio pour l'entraînement par apprentissage par renforcement d'agents opérant des ordinateurs. Anthropic loue des Mac mini via AWS. Le chiffre d'affaires Mac d'Apple a atteint 10,3 milliards de dollars au trimestre de juin, en hausse de 29 % en glissement annuel. Des contraintes d'approvisionnement ont suivi ces achats en gros.
Le 30 août, des données ont montré que la ville de Quincy, dans l'État de Washington, a vu son taux de pauvreté passer de 29 % à 6 % grâce au développement de centres de données. Le comté de Loudoun, en Virginie, perçoit environ 1 milliard de dollars par an de recettes fiscales provenant des centres de données.
Le PDG de NVIDIA, Jensen Huang, a déclaré le 30 août que les définitions des jalons de l'intelligence artificielle générale (AGI) sont désormais dénuées de sens, car l'IA a déjà atteint des performances de niveau IAG sur de nombreuses tâches. Il a indiqué que 400 milliards de dollars ont été investis dans les startups d'IA au cours des six derniers mois, et que l'IA stimule les investissements dans les réseaux électriques, les énergies propres et l'industrie manufacturière — une réindustrialisation de fait des États-Unis.
Le 30 août, plusieurs sources ont rapporté que le grand modèle Doubao 2.2 de ByteDance, initialement prévu pour une sortie en août, serait retardé. Des sources internes ont indiqué que ByteDance souhaite des cycles de pré-entraînement et de post-entraînement plus longs pour obtenir des améliorations plus significatives en codage, appel d'outils et capacités d'agents. L'équipe Seed développe simultanément un modèle ultra-large de nouvelle génération tout en maintenant les itérations des modèles actuels. Le fondateur de ByteDance, Zhang Yiming, a déclaré lors d'une réunion de l'équipe Seed en juillet que l'entreprise ne recourra pas à la distillation d'IA pour améliorer ses modèles, même si cela signifie prendre temporairement du retard sur ses concurrents. Le PDG Liang Rubo a réitéré lors d'une réunion générale le 6 août que ByteDance persistera avec des modèles développés en interne.
Le 28 août, l'aperçu du modèle Hy4 de Tencent Hunyuan a été intégré à WorkBuddy, déclenchant une explosion de la demande d'inférence. Le service a connu des files d'attente le jour du lancement. Tencent étend d'urgence ses clusters d'inférence. L'aperçu reste gratuit jusqu'au 10 septembre.
Le 30 août, Artificial Analysis a rapporté que le modèle propriétaire 1.1 d'Apodex a obtenu 44 sur son indice d'intelligence, le plaçant au même niveau que Kimi K2.6 (45) et MiniMax-M3 (45).
Le 30 août, la startup d'IA StartLux basée à Shanghai, soutenue par le fondateur de Shanda, Chen Tianqiao, a attiré l'attention du secteur pour ses percées dans le développement de grands modèles à mille milliards de paramètres.
Le 30 août, ByteDance a officiellement publié « Doubao Work Agent », un agent IA d'entreprise positionné comme un collègue de travail IA persistant doté de son propre environnement d'exécution, de son contexte et de ses outils. L'agent propose une synchronisation multi-appareils — les tâches peuvent s'exécuter sur une machine locale ou une machine virtuelle cloud qui reste en ligne 24h/24 et 7j/7 — et est intégré nativement à Feishu (Lark), permettant la lecture et l'écriture directes dans les documents, tableurs et réunions Feishu. Il inclut un accès intégré aux modèles de génération Seedance (vidéo) et Seedream (image) de ByteDance.
Le 31 août, l'organisme de surveillance du Service national de santé (NHS) au Royaume-Uni, Healthwatch England, a divulgué des cas dans lesquels des outils de transcription médicale IA ont commis des erreurs dangereuses. Une patiente s'est vu indiquer par un résumé généré par l'IA qu'elle souffrait de « démyélinisation » — de graves lésions nerveuses pouvant conduire à une sclérose en plaques — alors que le diagnostic correct était « absence de démyélinisation ». Dans un autre cas, un outil d'IA a confondu un médicament prescrit avec un autre portant un nom similaire. Un troisième cas concernait un résumé IA qui omettait l'instruction d'un spécialiste demandant au patient de demander un renouvellement d'ordonnance pour la migraine. Healthwatch a relevé « de multiples cas où les patients ont identifié des erreurs que les professionnels de santé n'avaient pas repérées ». L'Agence de réglementation des médicaments et des produits de santé (MHRA) du Royaume-Uni a décidé de ne pas classer les outils de transcription IA comme des dispositifs médicaux, ce qui signifie qu'aucun cadre réglementaire de sécurité à l'échelle nationale ne s'applique actuellement. En août 2026, 27 outils de transcription IA différents sont utilisés au sein du NHS England.
Le 31 août, la première série chinoise de long métrage générée par IA (AIGC), « Journey to the West: The Later Story », a été diffusée en première. Le premier arc, « Flower-Fruit Mountain », se compose de 5 épisodes de 40 minutes chacun, diffusés sur Mango TV et sur la case horaire de première partie de soirée de Hunan Satellite TV. La série est la première à utiliser un modèle de « révision en cours de diffusion » dans le cadre de la politique chinoise des « 21 mesures » — production, révision et diffusion simultanées. La première saison complète compte 30 épisodes, adaptée d'un roman anonyme de la fin de la dynastie Ming / début de la dynastie Qing qui poursuit le récit du Voyage en Occident mille ans après l'apothéose de Sun Wukong.