¿Hablamos?
← // blog

Lo que realmente pasó en IA este verano (junio–agosto 2026)

ai

Hay un anuncio de “el modelo más grande de la historia” cada dos semanas, así que aquí va un filtro: el puñado de cosas de los últimos meses que realmente han cambiado cómo pienso sobre este sector, no solo otra captura de pantalla de un leaderboard.

Los modelos de frontera consiguieron un nivel más barato

El lanzamiento más destacado fue Claude Opus 5 el 24 de julio — mismo precio que Opus 4.8 ($5/$25 por millón de tokens de entrada/salida), una ventana de contexto de 1M de tokens, y un rendimiento cercano al modelo más potente de Anthropic, Fable, a más o menos la mitad de coste. Ahora es el modelo por defecto en Claude Max y el más potente disponible en Pro.

Ese patrón de “casi-frontera por menos” apareció por todas partes este verano, no solo en Anthropic: la serie GPT-5.6 de OpenAI se lanzó en tres niveles (Sol, Terra, Luna — capacidad, equilibrio, coste), Google sacó Gemini 3.6 Flash y dos variantes Flash-Lite, y DeepSeek, Meta y Thinking Machines lanzaron también sus propios modelos de nivel eficiente. El modelo insignia de nadie se volvió dramáticamente más inteligente este trimestre — lo que cambió es que ejecutar un modelo casi-frontera de forma constante, en lugar de ocasional, se volvió mucho más asequible. Eso no es casualidad; apunta directamente a la siguiente sección.

La IA agente es la verdadera historia

El cambio más importante, al menos en cómo trabajo yo día a día, no es el lanzamiento de un modelo — es que los agentes de código cruzaron el umbral del “úsalo sin más”. Ahora se espera que Cursor, Claude Code, Codex, Copilot y Cline lean un repositorio entero, ejecuten los tests, persigan un fallo hasta encontrarlo y abran una PR con poca supervisión, no que solo autocompleten una función.

Dos datos me llamaron la atención:

  • Los propios datos de uso de Anthropic muestran que los ingenieros que usan herramientas agentes dedican menos tiempo por tarea pero entregan muchísimo más output total — las herramientas no solo escriben más rápido, cambian lo que un solo ingeniero se plantea abordar en un día.
  • MCP (Model Context Protocol) ha pasado de ser “una especificación que propuso Anthropic” a ser la forma de facto en que todas estas herramientas hablan con sistemas externos — bases de datos, gestores de tickets, APIs internas. Si estás construyendo herramientas internas y todavía no exponen un servidor MCP, probablemente sea el próximo punto de integración que te pidan.

La regulación apareció por primera vez de forma real

La que de verdad me sorprendió: el Departamento de Comercio de EE. UU. estableció controles de revisión de seguridad nacional para modelos de frontera por encima de ciertos umbrales de capacidad — lo que significa que lanzamientos como GPT-5.6 y Claude Fable ahora necesitan una revisión gubernamental antes de salir, no solo una evaluación interna de seguridad. Los lanzamientos de modelos han funcionado básicamente con autorregulación hasta ahora; esta es la primera vez que un organismo externo tiene un control formal en el proceso de lanzamiento de un gran laboratorio estadounidense. Habrá que ver si ralentiza el tiempo entre anuncio y disponibilidad, o si se convierte en otra casilla más que marcar.

Cosas más pequeñas que merece la pena conocer

  • El dinero siguió fluyendo hacia la infraestructura, no solo hacia los modelos — las startups de agentes de IA recaudaron cerca de 1.800 millones de dólares en una docena de rondas solo en julio, y la startup de chips de inferencia Etched se lanzó con una valoración de 5.000 millones de dólares y 1.000 millones en contratos firmados.
  • Los asistentes se reconstruyeron, no solo se actualizaron — Google sustituyó Google Assistant por Gemini en Android, y Apple relanzó Siri en la WWDC con acceso real a internet y acciones a nivel de sistema en todas las apps, ambos apoyándose en el mismo patrón agente que las herramientas de código de arriba en lugar de en una ventana de chat más grande.
  • Una genuinamente rara: Adobe Research y Johns Hopkins publicaron Wonder, un modelo de mundo en vídeo que convierte una sola imagen o clip de vídeo en una escena persistente y explorable que puedes recorrer moviendo la cámara, a 16 fps durante hasta un minuto de interacción en tiempo real. No es algo que tenga uso todavía, pero es un buen recordatorio de que “noticias de IA” no son solo chatbots y agentes de código.

Conclusión

Si tuviera que resumir el verano en una frase: el progreso interesante pasó de “cuán inteligente es el modelo insignia” a “con qué barato y fiable puede funcionar un agente sin supervisión” — niveles casi-frontera más baratos, agentes de código que terminan tareas en lugar de sugerir líneas, y el primer control regulatorio real para frenarlo todo un poco. Esa es la tendencia que seguiré rastreando aquí.