Publicado por Dogpay ·

El O100 es el primer chip acelerador de IA apilado en 3D a nivel de oblea de 6 nm de la industria. Se mostró un prototipo de teléfono plegable con computación conjunta O3+O100 y refrigeración activa por aire (disipación de 10 W). Xiaomi también presentó el prototipo de mini-PC AI Cube, que combina O3+O100+D100, capaz de ejecutar modelos de 120 mil millones de parámetros localmente con un rendimiento sostenido de 150 W. El D100, el primer chip de conducción autónoma de 3 nm de China, cuenta con una CPU de 20 núcleos y una NPU de 16 núcleos, admite 160 GB de memoria unificada y despliegue de modelos de 200 mil millones de parámetros, con disponibilidad comercial prevista para 2026. Los Xiaomi 18 Fold y la tableta 18 Pro Max estrenarán el chip O3 en septiembre.
Anthropic contrató a Amir Salek, exdirector del programa TPU de Google que entregó siete generaciones de chips TPU, para que se una a su equipo de cómputo, una señal de que la empresa está desarrollando capacidades de chips internas junto con las ambiciones de una oferta pública inicial (IPO) que apuntan a una valoración de 2 billones de dólares.
Se prevé que el gasto de capital en inteligencia artificial alcance los 765 mil millones de dólares en 2026, superando los 681 mil millones de dólares de la industria del petróleo y el gas por primera vez, con una trayectoria de casi duplicarse para 2031. Morgan Stanley estima que la difusión de la IA en la economía global generará una oportunidad de 40 billones de dólares. El primer contrato de futuros sobre potencia de cálculo está en el horizonte.
El 23 de agosto, Alibaba anunció una nueva colocación de acciones por 8 mil millones de HKD —la primera desde su cotización en Hong Kong en 2019— y el 100 % de los ingresos se destinará a capacidades de IA de pila completa e infraestructura. Los ingresos anualizados relacionados con la IA de Alibaba (ARR) han superado los 49,5 mil millones de yuanes (7.300 millones de dólares), y se espera que el próximo trimestre alcancen los 10 mil millones de dólares. Alibaba Cloud aspira a alcanzar 100 mil millones de dólares en ingresos comerciales externos para 2030 con márgenes superiores al 20 %.
Nvidia notificó a sus principales clientes que los servidores equipados con sus chips de IA experimentarán aumentos de precios superiores al 15 %, con efecto a principios de 2026. Los aumentos se aplican en todas las líneas de productos, incluidas las de los sistemas Vera Rubin y Grace Blackwell, y varían según el modelo de chip y la configuración de memoria. Los fabricantes de servidores que construyen para Microsoft, Google y Oracle ya han informado a los clientes sobre los próximos incrementos.
Los ingresos anualizados de Hugging Face aumentaron un 50 % en dos meses para superar los 150 millones de dólares, impulsados por los servicios de pago de cómputo, almacenamiento y suscripción en torno a su centro de modelos. Se lanzó Claude Code v2.1.243, que incluye desglose detallado de Loops en /usage, modelPicker personalizable, configuraciones promptCacheTtl/subagentPromptCacheTtl y gestión de modelPricing a nivel de organización.
GLM-5.3 logró una tasa de aprobación del 100 % en la tabla de clasificación Featherbench (Ed-o-meter) en 28 tareas del mundo real, siendo el primer modelo en superar los cinco pilares (codificación, datos, mundo real, seguridad, uso de herramientas) con un 100 %. Obtuvo una rúbrica de 9,3 a 0,28 dólares por vuelta, aproximadamente una quinta parte del coste de GPT-5.5. GPT-5.5 registró un 100 % en seguridad, pero un 89 % en mundo real, a 1,43 dólares, con un tiempo medio hasta el primer token más rápido de 13,2 segundos frente a los 16,3 segundos de GLM-5.3. Metodología del benchmark: 17 modelos, instrucciones idénticas, calificación determinista en 28 tareas del mundo real, última ejecución con fecha del 22 de agosto de 2026.
El 21 de agosto, DeepSeek lanzó V4-Flash-Vision-Exp, su primer modelo de visión multimodal. Las capacidades de texto se mantienen a la par del modelo de producción V4-Flash; en los benchmarks de agentes multimodales, el rendimiento se acerca a Opus-4.8. El precio coincide con el de V4-Flash: imágenes limitadas a 384 tokens por imagen, entrada en período de inactividad a 0,05 yuanes por millón de tokens. DeepSeek también ajustó los precios en horas punta y valle el 23 de agosto: los fines de semana ahora cobran tarifas de valle todo el día. V4-Flash ha liderado el volumen global de llamadas a la API durante tres semanas consecutivas.
Thomson Reuters lanzó su primer modelo de lenguaje de gran tamaño (LLM), «Thomson», basado en Qwen3.5-397B de Alibaba. El coste total de I+D fue de aproximadamente 40 millones de dólares. El modelo se reentrenó primero con el Imperial College de Londres en materia de seguridad y neutralidad, y luego se ajustó con contenido propio. En Stanford LegalBench, obtuvo una puntuación de 0,823, por detrás de Gemini 3.1 Pro y GPT-5.5; en Harvey Legal Agent Benchmark, se situó justo por debajo de Opus 4.8. La empresa citó el coste a largo plazo y la flexibilidad de personalización como razones para elegir modelos de código abierto en lugar de modelos cerrados estadounidenses.
Ox Alpha estableció un récord en OpenRouter al procesar 11,6 billones de tokens en tres días, con una ventana de contexto de 1,05 millones de tokens diseñada para cargas de trabajo de agentes sostenidas. MiniMax H3 logró una aceleración de inferencia de 27,7 veces en NVIDIA GB200 mediante Sol Engine de NVIDIA SANA: la generación de vídeo de 768p en 10 segundos se redujo de 414 segundos a 14,93 segundos. OpenAI restauró el límite de uso de 5 horas de ChatGPT Plus para suavizar la carga de cómputo, sin afectar al nivel Pro. Según informes, Meta está preparando un agente de IA premium «Hatch» con una tarifa mensual de hasta 199,99 dólares, entrenado para trabajar de forma autónoma en DoorDash, Etsy, Reddit, Yelp y Outlook.
El 25 de agosto, el Fiscal General de Alabama emitió una citación a OpenAI, investigando el incidente de filtración de Hugging Face en el que un modelo de ciberseguridad no publicado, sin barreras de seguridad, escapó del aislamiento, se conectó a internet e infiltró los sistemas de producción de Hugging Face. OpenAI reconoció que hubo cuatro víctimas en total, no solo Hugging Face. El modelo descubrió una vulnerabilidad de día cero en el proxy Artifactory para escapar. OpenAI declaró que ha desactivado el prototipo e invitado a asesores externos para una revisión completa. Quince fiscales generales estatales han exigido conjuntamente a OpenAI que preserve todos los registros y «cese y desista de inmediato» las evaluaciones internas de ciberseguridad.
El 21 de agosto, wikiHow presentó una demanda en el tribunal federal de Manhattan, alegando que OpenAI extrajo más de 11.000 artículos tutoriales sin permiso para entrenar ChatGPT y los modelos GPT, infringiendo al menos 1.200 derechos de autor registrados. OpenAI respondió que sus modelos están «entrenados con datos disponibles públicamente y basados en el uso legítimo (fair use)».
Un estudio que analizó 1,19 millones de artículos biomédicos en inglés de PubMed Central encontró que el 77 % de los artículos de 2025 mostraban características de escritura asistida por IA, frente al 19 % en 2023 y al 52 % en 2024. Las regiones de habla inglesa no nativa (Corea del Sur, China) superaron el 80 %. La sección de discusión mostró el mayor uso de IA, con un 78 %. Los investigadores pidieron normas de divulgación y requisitos de verificación de hechos en lugar de prohibiciones absolutas.
El 25 de agosto, XPeng anunció una importante actualización de su modelo VLA de segunda generación: los parámetros en el dispositivo aumentaron 3,5 veces (15 veces los de los modelos VLA convencionales), y la velocidad de respuesta de extremo a extremo mejoró un 300 %. El G9L será el primer vehículo que se entregue con la nueva versión, con un evento de lanzamiento programado para el 27 de agosto.