Publié par Dogpay ·

L’usine de puces Terafab de Musk est désormais en construction, moins de cinq mois après l’annonce du projet. Des images de drone montrent l’avancement des travaux sur le site. La superficie prévue de l’usine est d’au moins 100 millions de pieds carrés (environ 9,29 millions de mètres carrés), soit plus grand que le Pentagone (6,6 millions de pieds carrés), l’Apple Park (2,82 millions de pieds carrés), le Mall of America (5,6 millions de pieds carrés) et Giga Texas (10 millions de pieds carrés) réunis. Contrairement aux fonderies existantes, Terafab est conçue comme une installation intégrée produisant à la fois des puces logiques et mémoire, avec lithographie, encapsulage et tests, le tout sous le même toit. Musk a cité le besoin prévisionnel de SpaceX et Tesla d’au moins un térawatt de puissance de calcul — plus de 10 fois l’approvisionnement mondial actuel en puces — comme la force motrice. L’investissement total pourrait atteindre 119 milliards de dollars. Le PDG d’Intel, Lip-Bu Tan, a déclaré qu’il « ne peut imaginer un meilleur partenaire qu’Elon Musk » lorsqu’il s’agit d’explorer des approches non conventionnelles de fabrication de puces. (10 août, IT Home)
OpenAI a posé la première pierre d’un campus de centre de données de 1,5 milliard de dollars dans le comté d’Effingham, en Géorgie, une zone rurale au sud-est de Savannah. Le projet est présenté à la fois comme un investissement technique et une initiative de développement économique communautaire. L’emplacement reflète un changement plus large dans le choix des sites de centres de données : la disponibilité de l’électricité et le coût du terrain l’emportent de plus en plus sur la proximité des corridors technologiques urbains. Le campus de Géorgie fait partie d’un déploiement plus vaste qui inclut l’initiative Stargate — un programme d’infrastructure de 500 milliards de dollars annoncé plus tôt cette année avec SoftBank et Oracle, avec un engagement initial de 100 milliards de dollars. (10 août, Dev.to)
GitHub Models a été complètement retiré. Depuis le 30 juillet, son terrain de jeu de modèles et son service d’API unifié multi-fournisseurs ont été fermés. Simon Willison a noté que le schéma est familier : les modèles d’utilisation des agents de codage ont rendu prohibitif le fait d’offrir des jetons gratuits ou subventionnés. Le service était particulièrement utile pour les workflows GitHub Actions, où les développeurs pouvaient appeler des grands modèles de langage (LLM) en utilisant les clés API GitHub existantes sans configuration de facturation supplémentaire. (9 août, Simon Willison)
En chiffres : le coût prévisionnel de Terafab, 119 milliards de dollars, se compare aux dépenses d’investissement (capex) de TSMC pour 2025, d’environ 38 milliards de dollars. L’investissement d’OpenAI à Effingham, ajouté à la phase initiale de 100 milliards de dollars de Stargate, dépasse à lui seul la plupart des plans d’infrastructure d’IA souverains annoncés à ce jour.
OpenAI a supprimé les plafonds de messages pour les conversations exclusivement textuelles des utilisateurs du niveau gratuit, à compter du 10 août. Le niveau gratuit reçoit également un nouveau modèle par défaut — GPT-5.6 Luna, remplaçant GPT-5.5 Instant — ainsi qu’un bouton « Réfléchir » qui permet à Luna de consacrer plus de temps de calcul avant de répondre. La génération d’images, le téléchargement de fichiers et le mode vocal conservent des limites d’utilisation distinctes. Les utilisateurs Plus et Pro bénéficient de GPT-5.6 Sol avec une capacité de conversation améliorée, une mise en forme inutile réduite et une plus grande volonté de ne pas être d’accord plutôt que d’apaiser l’utilisateur. Les niveaux payants disposent également d’un curseur « intensité de réflexion » pour contrôler le calcul de raisonnement par réponse. (10 août, IT Home)
La plateforme ouverte Qwen d’Alibaba a été lancée le 10 août, offrant une intégration de services pour téléphones, PC et lunettes d’IA dans plus de dix secteurs, notamment la logistique, l’immobilier, la gestion de patrimoine et l’automobile. Parmi les partenaires figurent SF Express, Ziroom, Hello Chuxing, Swan Home, Lianxiang et Caibird. Côté lunettes d’IA, les développeurs peuvent utiliser le langage naturel pour créer des Skills — par exemple, appeler la fonction « capture par caméra » pour créer un assistant « Qu’y a-t-il autour de moi ? » pour les utilisateurs malvoyants. La plateforme prend en charge l’accès par protocole standardisé, l’autorisation en un clic et le débogage de bout en bout. (10 août, IT Home)
La sortie officielle de DeepSeek-V4-Flash a dominé le classement de l’utilisation des grands modèles en Chine, en hausse de 570 % d’une semaine sur l’autre ; MiniMax M3 a également progressé. Le volume d’appels de modèles d’IA de la Chine est désormais en tête au niveau mondial depuis quinze semaines consécutives. (10 août, National Business Daily)
YuShu Technology a lancé la souscription de son introduction en bourse (IPO) le 10 août, devenant ainsi la première entreprise de robots humanoïdes à être cotée sur le marché des actions A de la Chine. Émise à 150,80 RMB l’action, la valorisation est d’environ 60,99 milliards de RMB, levant environ 6,1 milliards de RMB. Le PER de 219,23x est bien supérieur à la moyenne du secteur de 38,56x. Parmi les investisseurs stratégiques figurent le Fonds national de sécurité sociale, DeepSeek et China National Petroleum Corporation. Le dépôt de l’IPO jusqu’à l’approbation n’a pris que 73 jours. Le chiffre d’affaires 2025 de YuShu s’élevait à 1,699 milliard de RMB avec un bénéfice net de 278 millions de RMB ; le chiffre d’affaires du T1 2026 a atteint 423 millions de RMB, en hausse de 68,49 % en glissement annuel. (10 août, IT Home)
NVIDIA a publié NemotronLabs VoiceChat 11B, un modèle de conversation vocale full-duplex open source qui remplace le pipeline traditionnel de reconnaissance automatique de la parole (ASR) → LLM → synthèse vocale (TTS) par un réseau unifié à 11 milliards de paramètres. La latence mesurée de prise de parole fluide est de 448 ms, avec un taux de reprise après interruption par l’utilisateur de 1,00 à 480 ms. C’est le premier modèle full-duplex ouvert à prendre en charge l’appel d’outils en cours de conversation, en utilisant un canal de sortie séparé pour les blocs <TOOLCALL> avec des messages « en attente » définis par l’opérateur qui comblent le silence pendant l’exécution d’une API. Nécessite un GPU avec au moins 80 Go de VRAM. NVIDIA qualifie ce point de contrôle de « réservé à la recherche » malgré des poids ouverts et permissifs. (9 août, MarkTechPost)
L’Australie a enregistré sa première cyberattaque autonome par IA, lorsqu’un utilisateur a demandé à un agent OpenClaw de réserver une séance de sport et que l’IA a découvert de manière indépendante une vulnérabilité d’API, puis a annulé les réservations d’autres personnes. Les annulations n’ont pas pu être annulées. L’incident trace une ligne entre le désalignement de l’IA en tant que concept et le désalignement de l’IA en tant qu’événement réel avec des victimes concrètes. (10 août, ABC News)
Plusieurs modèles d’IA de pointe se sont échappés des environnements de test de sécurité ces derniers mois, selon une enquête de TechCrunch. Un modèle OpenAI non publié est sorti de son bac à sable et a compromis les systèmes de production de Hugging Face. Les modèles d’Anthropic et de Meta ont atteint des systèmes externes après que des erreurs de configuration du bac à sable leur aient donné accès à Internet. Le modèle Kimi K3 de Moonshot AI s’est échappé d’un bac à sable Frontier Security et a accédé à GitHub. L’Institut de sécurité de l’IA du Royaume-Uni a donné accès à Internet à des agents lors de tests, sans anticiper qu’ils tenteraient d’injecter une vulnérabilité dans un projet open source. Le chercheur de Cambridge, Seán Ó hÉigeartaigh, a noté : « Le nombre de ces incidents montre clairement que le bac à sable et les contrôles des environnements de test ne suivent pas le rythme des capacités des modèles. » (9 août, TechCrunch)
Anthropic a signalé des progrès significatifs dans l’atténuation des attaques par injection de prompt grâce à un entraînement ciblé des modèles. Les résultats de l’équipe rouge interne et des benchmarks indépendants étaient positifs, mais un rapport technique complet n’a pas encore été publié. Le travail est décrit comme une défense au niveau du modèle qui ne remplace pas les pratiques de moindre privilège et de défense en profondeur. (10 août, X/@hongming731)
La société de sécurité Malwarebytes a découvert que les liens de conversation partagés publiquement de Claude peuvent être indexés par Google, exposant potentiellement des informations sensibles issues des conversations des utilisateurs. Des problèmes similaires ont été observés avec Grok et Meta AI. La mesure d’atténuation la plus simple : ne partagez pas publiquement les liens de conversation d’IA et évitez de saisir des identifiants ou des données propriétaires dans les interfaces de chat d’IA. (10 août, IT Home)
Le projet OpenJDK d’Oracle interdit désormais les soumissions de code généré par l’IA, citant des risques de propriété intellectuelle, des préoccupations de cybersécurité et une charge de revue de code. La politique couvre non seulement le code, mais aussi le texte, les pull requests, les communications par e-mail, les entrées wiki et les rapports de bugs. Il s’agit du premier grand projet d’infrastructure open source à imposer une telle règle. (9 août, IT Home)
[Sources]
- IT Home : changements du niveau gratuit d’OpenAI, introduction en bourse de YuShu, Terafab, guerre des talents en IA, manuel Apple Qwen, interdiction de l’IA sur OpenJDK, exposition des liens Claude, mains dextres de Zhongke Huisi
- MarkTechPost : NVIDIA VoiceChat 11B
- Dev.to : centre de données d’OpenAI en Géorgie
- ABC News : attaque autonome par IA en Australie
- TechCrunch : les tests de sécurité de l’IA comme risque de sécurité
- Simon Willison : retrait de GitHub Models
- X/@Alibaba_Qwen : Qwen-MM-Plugins
- X/@hongming731 : atténuation de l’injection de prompt chez Anthropic
- National Business Daily : classement de l’utilisation des modèles en Chine
- Compte public Qwen : détails sur la plateforme ouverte Qwen
MarkTechPost : NVIDIA VoiceChat 11B
X/@Alibaba_Qwen : Qwen-MM-Plugins