Publicado por Dogpay ·
Dos líneas en aceleración recorrieron el panorama de la IA el 12 y 13 de agosto: la capacidad de los modelos siguió ascendiendo hacia una escala de billones de parámetros y nuevas fronteras matemáticas, mientras que un conjunto paralelo de medidas reforzó la confianza y la gobernanza. Las empresas también reordenaron capital, personal y distribución de productos en torno a ese mismo eje.
12 de agosto, The Information, citando a participantes del proyecto, informó de que NVIDIA está desarrollando la familia de modelos Nemotron 4, cuyo mayor modelo se espera que tenga al menos 1 billón de parámetros. La vicepresidenta de IA generativa de NVIDIA, Kari Briski, declaró en un correo electrónico que la inversión refleja la convicción de que «toda empresa y todo país necesita modelos abiertos de frontera accesibles». Los empleados dijeron que el modelo podría estar listo para finales del otoño; no hay fecha de lanzamiento fijada y el entrenamiento está sin terminar. El informe enmarca el esfuerzo frente a los modelos chinos más baratos que reducen la diferencia con Anthropic y OpenAI, y frente a los recientes ataques con agentes autónomos de IA, dado que los modelos abiertos no suelen llevar restricciones de uso en materia de ciberseguridad. NVIDIA también distribuyó Nemotron 3.5 Lightning (un modelo MoE de 30B parámetros que activa 3B por token, orientado a tareas de agentes residentes de alta frecuencia) y la biblioteca abierta de enrutamiento NeMo Switchyard, que asigna tareas al modelo más adecuado.
13 de agosto, circularon noticias de que OpenAI está impulsando un GPT-6 de ~10 billones de parámetros (nombre en clave Astra) para lanzarlo este mes pese a la presión de la revisión regulatoria.
13 de agosto, se informó de que Claude había elevado la cota inferior demostrada para la proporción de ceros no triviales de la función zeta situados sobre la línea crítica del 41.6% al 67.2%, lo que equivale a varias decenas de veces el progreso logrado por los matemáticos humanos en los últimos 37 años, y reaviva el debate sobre el razonamiento matemático de la IA.
12 de agosto, Meta presentó Muse Glimmer 30B, un modelo de agente local creado por Superintelligence Labs, diseñado para agentes locales residentes que se ejecutan en una única GPU de consumo.
10 de agosto (publicado 8/11/8/12), OpenAI lanzó GPT-5.6-Cyber, un modelo de ciberseguridad centrado en la investigación de vulnerabilidades, las pruebas de penetración y la respuesta a incidentes, distribuido mediante el nuevo nivel Daybreak Red. En la evaluación interna de Tasa de Finalización Avanzada de Ciberseguridad de OpenAI, GPT-5.6-Cyber completó el 95.0% de las solicitudes que abarcaban el desarrollo de cadenas de explotación, la omisión de autenticación y la escalada de privilegios, frente al 1.5% de GPT-5.6 Sol y el 2.0% con acceso Daybreak Blue. Descubrió CVE-2026-15903 (CVSS 8.8, una lectura/escritura fuera de los límites en el motor JavaScript V8), además de al menos cinco vulnerabilidades en un sistema operativo móvil, tres fallos críticos de bases de datos y más de 400 problemas de escalada de privilegios del kernel.
11 de agosto, Anthropic afirmó que todos los modelos lanzados después del 2 de agosto incorporarán automáticamente una marca de agua al texto generado por computadora a nivel de modelo, de modo que la marca se traslade cuando el texto se copie y pegue; los archivos utilizan el estándar abierto C2PA. La medida se ajusta al Código de Transparencia de la Ley de IA de la UE, que entró en vigor el 2 de agosto y exige que el contenido generado o editado con IA pueda ser identificado por otros sistemas. Los productos cubiertos incluyen la API de la plataforma Claude, Claude, Claude Code, Claude Cowork y Claude Tag.
11 de agosto, unos investigadores publicaron un artículo (stolen-thoughts.com) que describe una forma de recuperar el razonamiento oculto de las API de LLM propietarios. Anthropic, OpenAI y Google devuelven bloques cifrados de cadena de pensamiento que pueden reproducirse entre sesiones, usuarios y modelos; al introducir el rastro de un modelo de frontera en un modelo hermano más débil de la misma familia y aplicarle jailbreak, se recuperó en texto sin cifrar el razonamiento oculto del modelo más potente, porque todos los modelos de una familia compartían la misma clave de cifrado. Claude Haiku 4.5 fue el objetivo más fácil. Todos los proveedores reconocieron el informe y posteriormente bloquearon los ataques.
11 de agosto, Spotify dijo que etiquetará las identidades de artistas generadas por IA con distintivos de «Persona de IA» (que llegarán a mediados de septiembre) y excluirá por defecto la música de las Personas de IA de las recomendaciones editoriales y algorítmicas, salvo que un usuario siga explícitamente al artista. Los artistas pueden autodeclararse a partir del 11 de agosto y pueden apelar las etiquetas mal aplicadas. Spotify enmarcó el distintivo como un juicio sobre la identidad pública del perfil, no sobre cómo se hizo la música; los detalles de producción musical seguirán disponibles a través de AI Credits y SongDNA.
12 de agosto, Gemini alcanzó los 1.000 millones de usuarios activos mensuales, lo que el director ejecutivo de Google, Sundar Pichai, calificó como el producto de más rápido crecimiento en la historia de la empresa y el decimocuarto de Google en superar la marca de los mil millones de usuarios. Superó los 900 millones en junio; los 5 productos de la empresa con más de 3.000 millones de usuarios incluyen Search, Gmail, Android, Chrome y YouTube.
12 de agosto, Bradley Lightcap anunció en X que deja OpenAI para fundar una empresa. Lightcap se incorporó a OpenAI en 2018 procedente de Y Combinator, donde había trabajado con el director ejecutivo Sam Altman; en abril pasó de director de operaciones a liderar proyectos especiales. Altman respondió agradeciéndole sus contribuciones.
12 de agosto, el patrimonio neto del fundador de DeepSeek, Liang Wenfeng, aumentó de aproximadamente 1.000 millones de dólares en 2025 a unos 39.500 millones de dólares en 2026, un incremento del 3.850 % que lo sitúa entre las 50 mayores fortunas del mundo y marca la mayor ganancia en un año de cualquier multimillonario.
12 de agosto, Oracle está preparando otra ronda de despidos para reducir los costos de personal mientras arrastra miles de millones de deuda por la infraestructura de IA. Un documento interno citado por Business Insider muestra recortes porcentuales de dos dígitos en algunos equipos; se ha pedido a los gerentes que presenten las listas de empleados afectados antes del inicio del segundo trimestre fiscal (1 de septiembre). Oracle despidió a 21.000 empleados (13%) en el año fiscal 2026, dejando unos 141.000 empleados. El gasto en infraestructura del año fiscal 2026 fue de 55.700 millones de dólares y las salidas de caja superaron a las entradas en 23.700 millones de dólares; la empresa captó 43.000 millones de dólares en deuda y 5.000 millones de dólares en capital, y espera captar unos 40.000 millones de dólares más este año. Los ingresos crecieron un 17% y la infraestructura en la nube un 77%. Las acciones de Oracle han caído casi un 26% en lo que va de año.
12 de agosto, SpaceXAI lanzó Grok Bot, un software de IA concebido para funcionar como un equipo de agentes, que inicia sesión en distintas aplicaciones y sitios web, retiene información entre tareas y comparte contexto entre los bots. SpaceXAI afirmó que ya utiliza el producto internamente en ingeniería, crecimiento y marketing. El lanzamiento se produce tras el acuerdo de SpaceX de junio para adquirir la startup de programación Cursor por 60.000 millones de dólares. El director ejecutivo, Elon Musk, dijo recientemente que el próximo modelo, Grok 4.6, podría lanzarse esta semana.
12 de agosto, OpenAI lanzó una versión preliminar de la aplicación de escritorio de ChatGPT para Linux, que incluye Chat, ChatGPT Work y Codex, con paquetes .deb y .rpm para x64 y arm64. Las distribuciones compatibles incluyen Ubuntu 24.04 LTS y 26.04 LTS, Debian 13 y Fedora 43 y 44.
12 de agosto, Hunyuan, de Tencent, lanzó WorldClaw, un sistema agéntico de generación de mundos abiertos en 3D que produce escenas coherentes con terrenos complejos, edificios y elementos interactivos a escala.