Noticias IA agosto 2026: Nvidia sube 15% y DeepSeek aprieta

En pocas palabras: El 23 de agosto de 2026, Nvidia confirmó subas de más del 15% en sus sistemas de IA Vera Rubin y Grace Blackwell destinados a Microsoft, Google y Oracle, con envíos desde principios de 2027 por el encarecimiento de la memoria DRAM.

El 23 de agosto de 2026, Nvidia confirmó subas de más del 15% en sus sistemas de IA para hyperscalers con envíos desde principios de 2027, DeepSeek lanzó un modelo multimodal que roza a Claude Opus 4.8 en benchmarks, y la startup londinense Inherent salió de stealth asegurando que su agente replica papers científicos mejor que los modelos de Anthropic y OpenAI.

Estas noticias IA de agosto 2026 vienen del roundup diario del sector, que este domingo juntó quince movimientos de infraestructura, modelos y financiación. Para ubicarte desde ya: Vera Rubin es la próxima generación de sistemas de servidores de IA de Nvidia, y Grace Blackwell es su plataforma actual de racks para entrenamiento e inferencia. Las dos concentran la suba de precios que ordena toda la jornada.

En 30 segundos

  • Nvidia sube precios más del 15% en sistemas Vera Rubin y Grace Blackwell para Microsoft, Google y Oracle, con envíos desde principios de 2027 por el costo de la memoria DRAM.
  • DeepSeek publicó V4-Flash-Vision-Exp el 21 de agosto: 284B parámetros (13B activos), 64,3 en Chartography contra 65,0 de Opus 4.8, al precio de V4-Flash.
  • Inherent salió de stealth con USD 50 millones de seed: su agente Faraday, dicen sus creadores, replica papers mejor que Opus 4.8 y GPT-5.5.
  • Nvidia invirtió USD 7.000 millones en Poolside: USD 6.000 millones de licencia no exclusiva más USD 1.000 millones de equity a valuación pre-money de USD 12.000 millones.
  • Grok 4.6 ya está disponible desde el 12 de agosto: 500.000 tokens de contexto a USD 2 y USD 6 por millón de tokens.

¿Por qué Nvidia sube los precios de sus sistemas de IA un 15%?

Porque la memoria DRAM se encareció tanto que Nvidia ya no puede absorber el costo ni operando con márgenes brutos del 75%. Los fabricantes de servidores con contrato les avisaron a Microsoft, Google y Oracle que los precios subirán más del 15% en los envíos desde principios de 2027, golpeando las configuraciones flagship Vera Rubin y Grace Blackwell. Bloomberg rompió la noticia y Fortune la confirmó.

El origen está en Samsung, SK Hynix y Micron, los tres grandes productores de DRAM del planeta, que arrastran la escasez de DDR5 y HBM hasta el producto terminado. Ponele que sos el equipo de compras de Microsoft: cerraste tu capex 2027 con precios de mitad de año y ahora el mismo rack te cuesta 15% más, justo cuando estabas firmando los presupuestos finales.

La memoria es el cuello de botella.

¿Me sorprende? No. Venía siendo matemática pendiente: si tus insumos suben y tenés poder de mercado para trasladarlo, lo trasladás. Lo llamativo es la escala y el momento, porque llega antes de que Rubin siquiera esté desplegada en volumen. Para más detalles técnicos, mirá cuánto cuesta realmente el compute de IA.

¿Qué logró DeepSeek con su nuevo modelo Vision?

DeepSeek publicó el 21 de agosto V4-Flash-Vision-Exp, un modelo experimental multimodal que suma comprensión de imágenes a su arquitectura mixture-of-experts de 284B parámetros, con 13B activos por prompt. Según la plataforma de API de DeepSeek, donde figura como deepseek-v4-flash-vision-exp, el modelo supera a la versión base V4-Flash en seis de siete benchmarks de texto y suma más de 10 puntos en ALE y ZeroBench, dos benchmarks de visión.

Ahora, el titular de “le gana a Opus” hay que tomarlo con pinzas. En Chartography, un benchmark fuertemente visual, V4-Flash-Vision-Exp hizo 64,3 contra 65,0 de Opus 4.8. Perdió, sí (por 0,7, pero perdió). Lo que sí afirma DeepSeek es que se acerca al rendimiento de Opus 4.8 en benchmarks de agentes multimodales manteniendo el precio de V4-Flash, y ese es el dato económico importante: rendimiento casi frontier a precio de descuento.

Para comparar lo anunciado esta semana en modelos:

ModeloArquitecturaContextoDato destacadoPrecio
DeepSeek V4-Flash-Vision-ExpMoE de 284B (13B activos)No informada64,3 en ChartographyIgual a V4-Flash
Claude Opus 4.8No informadaNo informada65,0 en ChartographyNo informado
Grok 4.61,5 billones de parámetros500.000 tokensMultimodal, base Grok 4.5 + RLUSD 2/USD 6 por millón de tokens
Ox Alpha (¿GLM-5.3?)No informada1 millón de tokens80% en DeepSWEGratis hasta el 27/08
noticias ia agosto 2026 diagrama explicativo

Donde dice “no informada”, la fuente no publica el dato. No lo rellenamos.

¿Quién es Inherent y cómo supera a los laboratorios frontier?

Inherent es una startup de Londres fundada por ex integrantes de Google DeepMind, entre ellos su chief scientist Edward Hughes, que salió de stealth el 22 de agosto con una ronda seed de USD 50 millones. Son doce personas (sí, doce) trabajando en King’s Cross, con plan de llegar a 20 o 25 hacia fin de año.

Su producto es Faraday, un agente especializado en reproducir de forma independiente los hallazgos de papers científicos publicados, sin recibir las respuestas correctas de antemano. Corre sobre Qwen 3.6 de 27B parámetros y usa GPT-5.5 Codex de OpenAI para la parte de código. Según la propia empresa, Faraday “supera” a Claude Opus 4.8 y a GPT-5.5 en esa tarea de replicación.

Fijate la ironía: un equipo de doce personas, usando un modelo abierto chino y el modelo de un competidor, reclamando victoria sobre labs con miles de GPUs. ¿Alguien verificó esos resultados de forma independiente? Todavía no. La tarea es acotada y la medición es propia, así que tomalo como promesa interesante, no como hecho consumado. Tema relacionado: cómo proteger tu empresa con Microsoft Intune.

¿Para qué sirve Poolside y por qué Nvidia invierte USD 7.000 millones?

Poolside es una empresa que fabrica modelos de código especializados, conocida por su familia Laguna de pesos abiertos. Su activo central es Model Factory, una plataforma que permite adaptar modelos de programación rápido a lenguajes, frameworks y codebases empresariales específicas.

Nvidia puso USD 7.000 millones sobre la mesa: USD 6.000 millones en una licencia no exclusiva de Model Factory y USD 1.000 millones de equity a una valuación pre-money de USD 12.000 millones. Encima hizo ofertas de trabajo a 109 empleados de Poolside, aunque los tres fundadores retienen el control. La lectura estratégica es directa: Nvidia quiere dueñar la capa de software que se apoya en su silicio, un stack vertical desde el chip hasta el agente de código.

Si sos desarrollador, esto te anticipa hacia dónde va el mercado: menos modelos genéricos, más modelos afinados a tu stack concreto. (Que, dicho sea de paso, es justo lo que Model Factory vende.)

¿Qué otros anuncios clave hubo en las noticias IA de agosto 2026?

La semana dejó media docena de movimientos que merecen su línea:

  • Nvidia AVO clavó un 100 perfecto en ARC-AGI-3: el sistema Agentic Variation Operators completó los 183 niveles de 25 entornos de juego usando cerca de 12% menos acciones que VISTA, y es el primer puntaje perfecto registrado en ese benchmark de razonamiento abstracto (verificable, porque el benchmark es público).
  • Grok 4.6 ya circula en producción: xAI lo lanzó el 12 de agosto con 1,5 billones de parámetros, contexto de 500.000 tokens y precio de USD 2 y USD 6 por millón de tokens en prompts de hasta 200K; está en la API de xAI, Cursor, OpenRouter, Vercel y Cloudflare.
  • Google se aseguró silicio propio con Marvell: el acuerdo del 19 de agosto le da a Google un warrant por hasta 58,97 millones de acciones de Marvell (unos USD 12.200 millones a USD 206,58 cada una) a cambio de procesadores tensoriales personalizados para sus TPU, con potencial de unos USD 120.000 millones de ingresos para Marvell hasta el año fiscal 2033.
  • Ox Alpha, el modelo anónimo y gratis de OpenRouter: el investigador independiente Ben Davis publicó el 21 de agosto un análisis de fingerprinting que lo vincula con el GLM-5.3 de Zhipu con 99% de confianza; en pruebas tempranas hizo 80% en DeepSWE, contra 65% de Claude Fable 5 y 52% de GPT-5.6 sol, y el acceso gratuito corre hasta el 27 de agosto.
  • La infraestructura sigue levantando plata: la australiana Firmus Grid cerró el 7 de agosto una ronda de USD 2.000 millones con Nvidia, Coatue, Blackstone y Jane Street, que la valúa en más de USD 10.500 millones para financiar Project Southgate en Asia-Pacífico.
  • Los robots humanoides llenaron Beijing: los segundos World Humanoid Robot Games reunieron 2.056 robots de 16 países, el cuádruple que el año pasado, y el fundador de Unitree, Wang Xingxing, enfrió las expectativas: el “momento ChatGPT” de la industria, dijo, todavía no llegó.

¿Cómo impacta la suba de precios de Nvidia en startups y developers?

Si alquilás GPU en la nube, asumí que el aumento te llega traspasado desde principios de 2027, porque Microsoft, Google y Oracle no van a comerse el incremento ellos solos. Tenés una ventana de unos cuatro a seis meses para moverte antes de que el nuevo pricing aparezca en tu factura. Lo explicamos a fondo en aprender a usar ChatGPT desde cero.

Pensalo así: levantás ronda, reservás capacidad, armás el stack, elegís un modelo frontier porque el benchmark decía que era el mejor, lo integrás, lo probás, funciona bárbaro, lo metés en producción, y tres meses después llega la renovación anual con un 15% arriba en cómputo, tu margen ajustado y ninguna feature nueva que justifique el salto, todo por un problema de memoria DRAM en Corea y Taiwán del que nunca hablaste en el board.

  • Negociá reservas ahora: si podés comprometer capacidad con precio cerrado antes de fin de 2026, hacélo; cuando Rubin empiece a despacharse con el nuevo precio, tu poder de negociación baja.
  • Probá modelos más baratos contra tus cargas reales: DeepSeek mantiene precio de V4-Flash en su modelo vision, Grok 4.6 arranca en USD 2 por millón de tokens y los pesos abiertos tipo Laguna o Qwen corren en tu propia infraestructura.
  • Optimizá inferencia antes de escalar cómputo: papers como FlashPrefill V2 (arXiv 2608.19758) atacan el cuello de botella de prefill en contextos largos, y cada punto de eficiencia que ganás es margen que no se lleva el aumento.
  • Medí si necesitás tanto frontier: un estudio de Mark Ma (Universidad de Pittsburgh) con la Atlanta Fed, sobre millones de reseñas de Glassdoor y miles de reportes financieros, encontró que cerca del 90% de los ejecutivos cree que la IA todavía no boosteó la productividad de sus empresas; si el tuyo es el caso, el aumento de Nvidia es un buen momento para auditar el gasto.

Y un detalle local: si tu factura de infraestructura también incluye el hosting de tu web o aplicación, antes de dolarizar todo el stack vale comparar precios en pesos de proveedores regionales como donweb.com.

Tres errores comunes al leer estas noticias

Creer que DeepSeek ya le ganó a Opus. En el único benchmark donde se los compara cabeza a cabeza en la fuente (Chartography), DeepSeek hizo 64,3 y Opus 4.8 hizo 65,0. Lo que existe es un modelo mucho más barato que se acerca al rendimiento frontier, que es distinto y sigue siendo notable.

Tomar benchmarks auto-reportados como verificados. El 100 perfecto de AVO y la supuesta superioridad de Faraday son números que publicaron las propias empresas. ARC-AGI-3 es público y replicable, así que ese se valida solo; los de Inherent, por ahora, son palabra de fundadores con una ronda que levantar.

Actuar como si el aumento de Nvidia rigiera hoy. La suba aplica a envíos desde principios de 2027. Comprar hardware usado a precio de pánico en agosto de 2026, o firmar contratos largos apurado, suele salir más caro que planificar con la ventana que efectivamente tenés. Esto se conecta con lo que analizamos en cómo funcionan los modelos de razonamiento.

Preguntas Frecuentes

¿Cuánto suben los precios de Nvidia en 2027?

Más del 15% en los sistemas de IA que Nvidia vende a través de sus fabricantes contratistas, según el reporte original de Bloomberg confirmado por Fortune. El aumento golpea las configuraciones flagship Vera Rubin y Grace Blackwell, aplica a los envíos desde principios de 2027 y responde al costo de la DRAM de Samsung, SK Hynix y Micron.

¿DeepSeek Vision realmente supera a Opus 4.8?

No en todos los benchmarks: en Chartography, V4-Flash-Vision-Exp hizo 64,3 puntos contra 65,0 de Opus 4.8. Lo que sí logró el modelo de DeepSeek fue superar a su versión base en seis de siete benchmarks de texto, sumar más de 10 puntos en ALE y ZeroBench, y acercarse al rendimiento de Opus 4.8 en tareas de agentes multimodales manteniendo el precio de V4-Flash.

¿Qué es Inherent y qué hace diferente?

Inherent es una startup de Londres fundada por ex investigadores de Google DeepMind, con USD 50 millones de seed y un equipo de doce personas. Su diferencia es el foco: su agente Faraday reproduce de forma independiente los resultados de papers científicos sin conocer las respuestas, tarea en la que la empresa afirma superar a Claude Opus 4.8 y GPT-5.5 usando Qwen 3.6 de 27B más GPT-5.5 Codex para código.

¿Cuándo llega Grok 4.6 multimodal?

Ya está disponible desde el 12 de agosto de 2026. Se usa vía API de xAI, Grok Build, Cursor y Grok Bot, con distribución de socios en OpenRouter, Vercel y Cloudflare desde el primer día, contexto de 500.000 tokens y precio de USD 2 y USD 6 por millón de tokens en prompts de hasta 200K.

¿Cómo impacta el aumento de precios de GPUs en mi startup?

Si consumís cómputo alquilado, esperá que el traspaso llegue a tus tarifas desde principios de 2027. Te queda una ventana de varios meses en 2026 para cerrar reservas a precio actual, migrar cargas a modelos abiertos o más baratos, y optimizar inferencia antes de renovar contratos anuales.

Conclusión

Lo que cambió esta semana es el precio de la IA por los dos lados: subir producir la capa física (memoria DRAM que ni Nvidia puede seguir subsidiando) y bajar consumirla (modelos casi frontier a precio de descuento, equipos chicos haciendo trabajo de labs gigantes). Mientras tanto, el dinero sigue entrando a mansalva: USD 7.000 millones a Poolside, USD 12.200 millones en warrants de Marvell, USD 2.000 millones a Firmus Grid.

Mi recomendación concreta: si tu presupuesto de IA se renueva antes de marzo de 2027, sentate ahora a renegociar, y aprovechá para correr tus propias pruebas con V4-Flash-Vision-Exp, Grok 4.6 u Ox Alpha antes de que venza el acceso gratis. El que llega con data a la mesa de negociación, negocia. El que llega con urgencia, paga el 15%.

Fuentes

Desplazarse hacia arriba