
El 22 de agosto, OpenAI recortó el precio de GPT-5.6 Sol en más del 20%, citando mejras continuas de eficiencia que reducen los costos de inferencia manteniendo la capacidad del modelo. Este es el último de una serie de ajustes a la baja en la línea GPT-5.x.
El mismo día, DeepSeek lanzó V4-Flash-Vision, un modelo multimodal experimental ahora accesible a través de la API (interfaz de programación de aplicaciones). Acepta entradas mixtas de imagen y texto, con un rendimiento solo texto que iguala la línea base de producción V4-Flash. La capacidad del agente visual se aproxima a los niveles de Opus-4.8, y cada imagen tiene un límite de 384 tokens — una decisión de diseño consciente de los costos para cargas de trabajo multimodales de alto volumen.
En el frente de precios, Muse Spark 1.2 de Meta apareció en OpenRouter a $0.10/M de entrada y $0.20/M de salida. Para ponerlo en contexto, eso socava el precio de GPT-5.6 Luna mientras ofrece un rendimiento de nivel GPT-5.6 Terra, según puntos de referencia compartidos por TestingCatalog.
También el 22 de agosto, un modelo llamado Ox Alpha encabezó la tabla de clasificación de codificación de OpenRouter, superando tanto a Fable como a Sol. Ofrece una ventana de contexto de 1M tokens y admite entrada de texto, imagen y video. Su desarrollador sigue siendo desconocido. En el subconjunto DeepSWE, obtuvo un 80%.
En voz AI, Grok Voice Think Fast 2.0 de xAI se clasificó primero en la recién lanzada Speech Agent Arena de Artificial Analysis. El punto de referencia utiliza evaluadores humanos reales conversando con agentes de voz ocultos para medir la finalización de tareas — entendiendo solicitudes, invocando herramientas y terminando trabajos.
Estos cinco desarrollos, todos agrupados alrededor del 22 de agosto, pintan un panorama consistente: lo multimodal ya no es un diferenciador premium sino una expectativa de referencia, y la presión de precios se está intensificando en todos los frentes. La aparición de Ox Alpha — un modelo anónimo que supera a los buques insignia establacidos en codificación — añade una dimensión de factor sorpresa al paisaje competitivo.
El 22 de agosto, el CEO de Microsoft, Satya Nadella, anunció que Azure ha recibido el primer lote de sistemas de producción NVIDIA Vera Rubin. Esto marca el inicio del despliegue de unidades de procesamiento gráfico (GPU) de próxima generación en centros de datos en la nube — un hito concreto en la transición del anuncio a la entrega.
El mismo día, Anthropic reveló que Amir Salek, un ejecutivo fundador del programa de unidades de procesamiento tensorial (TPU) de Google que lideró la entrega de las primeras siet generaciones de chips TPU, se ha unido al equipo de cómputo de Anthropic. Anthropic actualmente obtiene chips de NVIDIA, Google y Amazon, pero ha comenzao a contratar para roles de silicio interno. OpenAI está en una trayectoria paralela — su chip "Jalapeño" desarrollado conjuntamente con Broadcom está programado para despliegue más adelante este año, según informó Bloomberg el 22 de agosto.
También el 22 de agosto, NVIDIA adquirió una participación en el desarrollador de centros de datos Cloverleaf, integrando su plataforma DSX en los flujos de trabajo de selección de sitios y diseño. Cloverleaf ya ha vendido más de 7 GW de terreno energizado con una cartera de proyectos superior a 10 GW. Esto siga a las inversiones anteriorses de NVIDIA en SB Energy (1.5 mil millones de dólares) y Lanciun (3 mil millones de dólares), un patrón de posicionamiento previo de capital en la capa de infraestructura.
El 21 de agosto, JP Morgan publicó una nota de investigación argumentando que el margen de beneficio del 12% de Alibaba Cloud está sistemáticamente subestimado. El modelo de añada de la firma proyecta que a medida que los activos de GPU y centros de datos actualmente al 60% de utilización maduren, el retorno sobre el capital invertido (ROIC) ponderado subirá de aproximadamente el 6% hacia el 16%, con el flujo de caja libre de infraestructura de IA cruzando el umbral de rentabilidad alrededor del tercer año. Los ingresos del primer trimestre de Alibaba Cloud alcanzaron los 48.737 mil millones de yuanes, creciendo un 41% interanual.
La capa de cómputo está transicionando de "quién puede pedir más GPU" a "quién puede desplegarlas, optimizar la utilización y construir alternativas personalizadas". La entrega de Rubin, la contratación de silicio por Anthropic y las matemáticas de utilización de Alibaba Cloud son tres facetas del mismo cambio.
El 22 de agosto, múltiples medios informaron que el equipo Doubao de ByteDance lanzará un producto de IA de oficina independiente tan pronto como la próxima semana, apuntando a WorkBuddy de Tencent. El producto se desprende del modo "Tareas de Trabajo" actualmente dentro de la aplicación Doubao. En la última semana, Doubao ha añadido control remoto de teléfono a PC, operación virtual de escritorio Windows y un panel lateral de trabajo. El 6 de agosto, el CEO de ByteDance, Liang Rubo, dijo en una reunión general que los recursus se enfocarían en "IA, plataformas de información y servicios de transación", con Doubao posicionado como la nueva columna vertebral de IA de la empresa.
El 22 de agosto, Apple confirmó despidos de aproximadamente 200 empleados en los equipos de video inmersivo de Vision Pro, juegos de Vision Pro y Siri — aproximadamente 60 de Vision Pro y el resto de Siri. Apple dijo a Bloomberg que la medida refleja una reestructuración en lugr de un abandono de visionOS, pero los recortes siguen a la adopción limitada de Vision Pro y al alto coste de producción de video inmersivo, estimado en millones de dólares por episodio.
El 22 de agosto, Leiphone informó en exclusiva que Wang Xintao, un líder técnico principal en Kling AI de Kuaishou, ha dejao la empresa. Wang, doctor por el MMLab de CUHK bajo Tang Xiaou, fue el autor principal de los proyectos de código abierto Real-ESRGAN y GFGAN y un contribuyente clave al trabajo de generación de video de Kling desde su inicio. Ni Kuaishou ni Wang han comentado públicamente.
En el frente de seguridad, TechCrunch informó el 21 de agosto que Opus 4.6 de Anthropic genera fácilmente contenido sexual explícito — 10 de 10 solicitudes directas tuvieron éxito en las pruebas. Un investigador independiente del Reino Unido desarrolló una técnica de evasión de múltiples turnos efectiva contra Opus 4.6, Opus 3 y Haiku 4.5, aunque Opus 4.7 hasta Opus 5 son resistentes. Los modelos siguen disponiblas a través de la API de Anthropic, Azure Foundry y Amazon Bedrok. Opus 4.6 registró aproximadamente 1,17 millones de solicitudes diarias a la API en OpenRouter en agosto.
Por separado, el 22 de agosto, Trend Micro informó sobre 14 paquetes nm troyanizados que distribuyen RedC2 4.0, una puerta trasera de Linux impulsada por IA. Los paquetes — disfrazados de utilidades de calendario y rachas — ejecutan cargas útils al importar sin requerir un gancho de instalación. RedC2 4.0 incluye "Red Agent", un componente respaldado por un modelo de lenguaje de gran tamaño (LLM) que traduce comandos en lenguaje natural a operaciones de baliza del framework. El framework se vende en Hack Forums por 99,99 dólares.
También el 22 de agosto, Wired informó que más de la mitad de los estadounidenses menores de 30 años ahora dicen que la IA les preocupa más de lo que les emociona, un aumento de 24 puntos porcentuales respecto a hace cinco años. Más del 70% cree que la IA reducirá los empleos. La tensión se ha desbordado en intercambios públicos: el CEO de Meta, Mark Zukerberg, publicó un ensayo optimista de 6.500 palabras sobre el futuro de la IA, mientras que el CEO de Anthropic, Dario Amodei, planteó el problema central como una "crisis de confianza" — desconfianza acumulada en corporaciones, gobierno y la industria tecnológica.
La reestructuración de Apple, la pérdida de talento de Kling, las brechas de seguridad de Opus 4.6 y el ataque a la cadena de suministro de npm comparten un hilo común: la expansión de la IA hacia productos e infraestructura reales está sacando a la superficie fricciones operativas, de seguridad y de recursos humanos que no se registraban cuando la conversación era solo sobre puntos de referencia de modelos.