Publié par Dogpay ·
Deux lignes d’accélération ont traversé le paysage de l’IA les 12 et 13 août : les capacités des modèles ont continué de grimper vers l’échelle du billion de paramètres et de nouvelles frontières mathématiques, tandis qu’une série de mesures parallèles renforçait la confiance et la gouvernance. Les entreprises ont également réorganisé le capital, les effectifs et la distribution des produits autour de ce même axe.
12 août, The Information, citant des participants au projet, a rapporté que NVIDIA développe la famille de modèles Nemotron 4, dont le plus grand modèle devrait contenir au moins 1 billion de paramètres. Kari Briski, vice-présidente de l’IA générative chez NVIDIA, a déclaré dans un communiqué envoyé par courriel que cet investissement reflète la conviction que « chaque entreprise et chaque pays a besoin de modèles ouverts de pointe accessibles ». Des employés ont indiqué que le modèle pourrait être prêt d’ici la fin de l’automne ; aucune date de sortie n’est fixée et l’entraînement n’est pas terminé. Le rapport situe cet effort face aux modèles chinois moins chers qui réduisent l’écart avec Anthropic et OpenAI, et face aux récentes attaques impliquant des agents d’IA autonomes, car les modèles ouverts ne comportent généralement aucune restriction d’utilisation en matière de cybersécurité. NVIDIA a également livré Nemotron 3.5 Lightning (un modèle MoE de 30 milliards de paramètres activant 3 milliards de paramètres par jeton, destiné aux tâches d’agents résidents à haute fréquence) et la bibliothèque de routage ouverte NeMo Switchyard, qui attribue les tâches au modèle le plus adapté.
13 août, des informations ont circulé selon lesquelles OpenAI avance sur un GPT-6 d’environ 10 billions de paramètres (nom de code Astra) pour une sortie ce mois-ci, malgré la pression de l’examen réglementaire.
13 août, il a été rapporté que Claude avait relevé la borne inférieure prouvée pour la proportion de zéros non triviaux de la fonction zêta situés sur la ligne critique de 41,6 % à 67,2 % — soit l’équivalent de plusieurs dizaines de fois les progrès réalisés par les mathématiciens humains au cours des 37 dernières années, relançant le débat sur le raisonnement mathématique de l’IA.
12 août, Meta a dévoilé Muse Glimmer 30B, un modèle d’agent local conçu par Superintelligence Labs, destiné aux agents locaux résidents fonctionnant sur un seul GPU grand public.
10 août (publié 8/11/8/12), OpenAI a lancé GPT-5.6-Cyber, un modèle de cybersécurité axé sur la recherche de vulnérabilités, les tests d’intrusion et la réponse aux incidents, distribué via le nouveau niveau Daybreak Red. Dans l’évaluation interne Advanced Cybersecurity Completion Rate d’OpenAI, GPT-5.6-Cyber a réalisé 95,0 % des requêtes couvrant le développement de chaînes d’exploitation, le contournement d’authentification et l’élévation de privilèges, contre 1,5 % pour GPT-5.6 Sol et 2,0 % avec l’accès Daybreak Blue. Il a découvert CVE-2026-15903 (CVSS 8,8, une lecture/écriture hors limites dans le moteur JavaScript V8), ainsi qu’au moins cinq vulnérabilités dans un système d’exploitation mobile, trois failles critiques de base de données et plus de 400 problèmes d’élévation de privilèges au niveau du noyau.
11 août, Anthropic a annoncé que tous les modèles publiés après le 2 août appliqueront automatiquement un filigrane au texte généré par ordinateur au niveau du modèle, de sorte que la marque subsiste lorsque le texte est copié-collé ; les fichiers utilisent la norme ouverte C2PA. Cette mesure s’aligne sur le code de transparence du règlement européen sur l’IA, entré en vigueur le 2 août, qui exige que les contenus générés ou modifiés par l’IA puissent être identifiés par d’autres systèmes. Les produits concernés comprennent l’API de la plateforme Claude, Claude, Claude Code, Claude Cowork et Claude Tag.
11 août, des chercheurs ont publié un article (stolen-thoughts.com) décrivant une méthode pour récupérer le raisonnement caché des API de LLM propriétaires. Anthropic, OpenAI et Google renvoient des blocs chiffrés de chaîne de pensée qui peuvent être rejoués entre sessions, utilisateurs et modèles ; en injectant la trace d’un modèle de pointe dans un modèle apparenté plus faible et en procédant à un jailbreak de ce dernier, il a été possible de récupérer en clair le raisonnement caché du modèle le plus puissant, car tous les modèles d’une même famille partageaient la même clé de chiffrement. Claude Haiku 4.5 a été la cible la plus facile. Tous les fournisseurs ont pris acte du rapport et ont ensuite bloqué les attaques.
11 août, Spotify a annoncé qu’il étiquettera les identités d’artistes générées par l’IA avec des badges « IA Persona » (arrivant à la mi-septembre) et exclura par défaut la musique des IA Personas des recommandations éditoriales et algorithmiques, sauf si un utilisateur suit explicitement l’artiste. Les artistes peuvent se déclarer eux-mêmes à partir du 11 août et peuvent contester les étiquettes appliquées à tort. Spotify a présenté le badge comme un jugement sur l’identité publique du profil, et non sur la manière dont la musique a été créée ; les détails de production musicale restent disponibles via AI Credits et SongDNA.
12 août, Gemini a atteint 1 milliard d’utilisateurs actifs mensuels, ce que le PDG de Google, Sundar Pichai, a qualifié de produit à la croissance la plus rapide de l’histoire de l’entreprise et de 14e produit de Google à franchir le cap du milliard d’utilisateurs. Il avait dépassé 900 millions en juin ; les 5 produits de l’entreprise comptant plus de 3 milliards d’utilisateurs sont Search, Gmail, Android, Chrome et YouTube.
12 août, Bradley Lightcap a annoncé sur X qu’il quittait OpenAI pour fonder une entreprise. Lightcap avait rejoint OpenAI en 2018 depuis Y Combinator, où il avait travaillé avec le PDG Sam Altman ; il est passé du poste de COO à la direction de projets spéciaux en avril. Altman a répondu en le remerciant de ses contributions.
12 août, la fortune nette du fondateur de DeepSeek, Liang Wenfeng, est passée d’environ 1 milliard de dollars en 2025 à environ 39,5 milliards de dollars en 2026, soit une hausse de 3 850 %, le plaçant parmi les 50 personnes les plus riches du monde et marquant le gain annuel le plus rapide jamais enregistré pour un milliardaire.
12 août, Oracle prépare une nouvelle vague de licenciements afin de réduire les coûts salariaux alors qu’elle porte des milliards de dette pour l’infrastructure d’IA. Un document interne cité par Business Insider fait état de réductions d’effectifs à deux chiffres dans certaines équipes ; les managers ont été invités à soumettre les listes d’employés concernés avant le début du deuxième trimestre fiscal (1er septembre). Oracle a supprimé 21 000 postes (13 %) au cours de l’exercice 2026, laissant environ 141 000 employés. Les dépenses d’infrastructure de l’exercice 2026 se sont élevées à 55,7 milliards de dollars et les sorties de trésorerie ont dépassé les entrées de 23,7 milliards de dollars ; l’entreprise a levé 43 milliards de dollars de dette et 5 milliards de dollars en fonds propres, et prévoit de lever environ 40 milliards de dollars de plus cette année. Le chiffre d’affaires a progressé de 17 %, et l’infrastructure cloud de 77 %. L’action Oracle recule de près de 26 % depuis le début de l’année.
12 août, SpaceXAI a lancé Grok Bot, un logiciel d’IA conçu pour fonctionner comme une équipe d’agents, se connectant à différentes applications et sites web, conservant des informations d’une tâche à l’autre et partageant le contexte entre les robots. SpaceXAI a déclaré utiliser déjà ce produit en interne au sein des équipes d’ingénierie, de croissance et de marketing. Ce lancement fait suite à l’accord conclu en juin par SpaceX pour acquérir la startup de codage Cursor pour 60 milliards de dollars. Le PDG Elon Musk a récemment déclaré que le prochain modèle, Grok 4.6, pourrait être livré cette semaine.
12 août, OpenAI a publié une version préliminaire de l’application de bureau ChatGPT pour Linux, incluant Chat, ChatGPT Work et Codex, avec des paquets .deb et .rpm pour x64 et arm64. Les distributions prises en charge comprennent Ubuntu 24.04 LTS et 26.04 LTS, Debian 13, ainsi que Fedora 43 et 44.
12 août, Hunyuan de Tencent a publié WorldClaw, un système agentique de génération de mondes ouverts en 3D qui produit des scènes cohérentes avec des terrains complexes, des bâtiments et des éléments interactifs à grande échelle.