Tarjeta de anuncio del modelo Gemini 3.5 Flash de Google

Imagen: Google

9 min de lectura

Noticias de IA: mayo de 2026

Google lanza Gemini 3.5 Flash en el I/O, Anthropic responde con Claude Opus 4.8 y los workflows dinámicos, y Mistral relanza Le Chat como Vibe. Mayo de 2026.


Mayo de 2026 tuvo dos focos: el Google I/O, donde Gemini 3.5 Flash pasó a ser el modelo por defecto de todo el stack de Google, y la última semana del mes, en la que Anthropic lanzó Claude Opus 4.8 con selector de esfuerzo y los workflows dinámicos de Claude Code, y Mistral relanzó Le Chat como Vibe. GPT-5.5 Instant, mientras tanto, se convirtió en el modelo que ven todos los usuarios de ChatGPT.

Gemini 3.5 Flash, nuevo modelo por defecto de Google

Google presentó Gemini 3.5 Flash el 19 de mayo en el I/O, con disponibilidad general inmediata: gratis como modelo por defecto en la app de Gemini y en AI Mode del buscador, y en API a 1,50 dólares por millón de tokens de entrada y 9 por millón de salida. Google cita 76,2% en Terminal-Bench 2.1, 83,6% en MCP Atlas y una generación de salida 4 veces más rápida que otros modelos de frontera, con Shopify, Salesforce o Databricks como primeros socios. Gemini 3.5 Pro se anunció “para el mes siguiente”, pero fuentes independientes reportan su retraso hasta mediados de julio por una reconstrucción arquitectónica; el agente personal Gemini Spark quedó en beta para suscriptores Ultra en EE. UU.

Que el buque insignia efectivo de Google sea un Flash barato y rápido, y no el Pro retrasado, dice hacia dónde apunta la competición: coste y velocidad para agentes, no puntuación máxima. Los benchmarks son del propio Google.

Fuente: Google DeepMind · también en TestingCatalog y TechCrunch

Claude Opus 4.8 llega con selector de esfuerzo

Anthropic lanzó Claude Opus 4.8 el 28 de mayo, 41 días después de Opus 4.7, disponible desde el primer día en Claude.ai, Claude Code y la API en todos los planes, sin subida de precio (5 dólares por millón de entrada y 25 por millón de salida; el modo rápido, 2,5 veces más veloz, baja a un tercio de su coste anterior). La novedad de interfaz es el selector de esfuerzo junto al de modelo, con niveles alto, extra y max. Anthropic cita 92,4% en Terminal-Bench 2.1 y 82,3% en OSWorld-Verified, y afirma que pasa por alto fallos de código unas 4 veces menos que Opus 4.7; Scott Wu, CEO de Cognition, confirma que corrige los problemas de verbosidad y uso de herramientas de la versión anterior.

El selector de esfuerzo convierte una decisión de prompt en una decisión de producto: mismo modelo, coste y latencia ajustados por tarea. Los equipos con Claude en producción tendrán que decidir qué nivel de esfuerzo asignan a cada tipo de tarea.

Fuente: Anthropic · también en TestingCatalog

GPT-5.5 Instant: el nuevo modelo por defecto de ChatGPT

OpenAI desplegó GPT-5.5 Instant el 5 de mayo como modelo por defecto de ChatGPT para todos los usuarios. Según OpenAI, produce un 52,5% menos de afirmaciones alucinadas que GPT-5.3 Instant en prompts de alto riesgo (medicina, derecho, finanzas) y respuestas un 30% más cortas. Estrena además personalización con memoria: la búsqueda puede consultar conversaciones pasadas, archivos y Gmail, mostrando qué fuentes de memoria usó, de inicio solo en web para Plus y Pro. La system card lo clasifica como el primer modelo Instant con capacidad “alta” en biología/química y ciberseguridad, y documenta regresiones en los benchmarks internos de contenido sexual y gore. En API es el nuevo chat-latest; GPT-5.3 sigue disponible solo tres meses más.

Dos avisos operativos: cualquier producto sobre el alias chat-latest cambió de modelo el 5 de mayo, y la ventana de tres meses para GPT-5.3 pone fecha límite a las migraciones pendientes.

Fuente: OpenAI · también en system card y TechCrunch

Gemini Omni: vídeo generado y editado por conversación

También en el I/O, Google anunció Gemini Omni Flash, primer modelo de la familia Omni: acepta texto, imagen, audio y vídeo combinados en un mismo prompt y genera o edita vídeo manteniendo la coherencia de personajes e iluminación a lo largo de ediciones conversacionales sucesivas, con comprensión de física para efectos más realistas y una función de avatar con la voz y apariencia del usuario. Todo lleva marca de agua SynthID. Disponible de inmediato para suscriptores de Google AI vía la app y Flow, y gratis en YouTube Shorts; los clips quedan limitados a 10 segundos por ahora y el acceso por API se anunció para las semanas siguientes.

La edición conversacional es el cambio de flujo: iterar un vídeo hablando en vez de regenerar desde cero. Con clips de 10 segundos y sin API en mayo, el uso serio quedaba a la espera.

Fuente: Google DeepMind · también en TestingCatalog

Mistral Medium 3.5 y agentes remotos en Vibe

Mistral presentó el 22 de mayo Mistral Medium 3.5: modelo denso de 128B con contexto de 256k, pesos abiertos bajo licencia MIT modificada y autoalojable en 4 GPUs, con 77,6% en SWE-Bench Verified según el fabricante. La API cuesta 1,50 dólares por millón de entrada y 7,50 por millón de salida. Llegan además los agentes remotos a Vibe, su CLI de código: sesiones asíncronas en la nube lanzables desde el terminal o Le Chat, con función de teletransportar una sesión local a la nube, y el modo Work de Le Chat en preview, que resuelve tareas multi-paso con aprobación explícita antes de acciones sensibles.

Un modelo abierto de este nivel autoalojable en 4 GPUs es la opción europea seria para quien no puede sacar datos de su infraestructura; los agentes remotos cubren una función que hasta ahora solo ofrecían los CLI estadounidenses.

Fuente: Mistral AI · también en MarkTechPost e InfoQ

Nano Banana 2 y Nano Banana Pro pasan a disponibilidad general

Google Cloud confirmó el 29 de mayo la disponibilidad general de Nano Banana 2 (Gemini 3.1 Flash Image) y Nano Banana Pro (Gemini 3 Pro Image) en resoluciones 1K y 2K; la 4K sigue en preview, igual que la nueva generación de imagen a partir de vídeo (acepta un archivo o una URL pública de YouTube como contexto). Las versiones preview se apagan el 25 de junio. Entre los socios citados: Adobe (Firefly Enterprise), WPP con clientes como L’Oréal y Unilever, y Shopify. El acceso con SLA empresarial va por la Gemini Enterprise Agent Platform.

Con la disponibilidad general y el SLA empresarial, los pipelines de imagen sobre estos modelos ya se pueden comprometer con clientes. La fecha de apagado de las previews obliga a migrar los endpoints antes del 25 de junio.

Fuente: Google Cloud · también en TestingCatalog

Workflows dinámicos en Claude Code: cientos de subagentes por tarea

El 28 de mayo Anthropic lanzó los Dynamic Workflows de Claude Code, en disponibilidad general para los planes Pro, Max, Team y Enterprise y vía API, Bedrock, Vertex y Foundry. Claude genera un plan, reparte el trabajo entre decenas o cientos de subagentes en paralelo, verifica los resultados entre sí y repite hasta el consenso; el usuario confirma antes de ejecutar. Se activa pidiéndolo o con el ajuste ultracode. El ejemplo citado por Anthropic: la migración de Bun de Zig a Rust, unas 750.000 líneas, completada en 11 días con el 99,8% de los tests en verde. Tanto Anthropic como la comunidad advierten del consumo de tokens, notablemente mayor que en sesiones normales.

Para bases de código grandes cambia la escala de lo abordable en una sola tarea (migraciones, auditorías, refactors). La recomendación práctica es la del propio fabricante: empezar por tareas acotadas y vigilar la factura.

Fuente: Anthropic · también en TestingCatalog e InfoQ

Grok Build: el agente de código de terminal de xAI

xAI lanzó Grok Build, su agente de código de terminal, en beta temprana: el 14 de mayo para suscriptores de SuperGrok Heavy (299 dólares al mes) y el 25 de mayo para todos los SuperGrok y X Premium+. El CLI está escrito en Rust, coordina hasta 8 subagentes en paralelo, ejecuta en modo plan con aprobación previa paso a paso y es compatible con MCP. El 29 de mayo publicó el modelo grok-build-0.1 en API (beta pública): 256K de contexto, más de 100 tokens por segundo y 1 dólar por millón de tokens de entrada, 2 de salida. Una reseña independiente (Can Demir) matiza qué entrega de verdad y qué está sobrevendido.

En un mes ya lleno de agentes de código (Opus 4.8, los workflows dinámicos, Vibe), xAI se suma con precio agresivo y arquitectura de subagentes. Está en beta y atada a la suscripción de Grok, así que de momento solo se puede evaluar dentro de ese entorno.

Fuente: xAI · también en Grok Build 0.1 en API y reseña en Medium

Le Chat se convierte en Vibe, la plataforma de agentes de Mistral

El 28 de mayo Mistral relanzó Le Chat como Vibe, con dos modos. Work: búsqueda sobre Google Workspace, Outlook, SharePoint, Slack y GitHub, análisis de datos con gráficos, documentos vía Canvas y skills reutilizables. Code: agentes de codificación remotos en sandbox, integrados con GitHub para gestionar proyectos y pull requests, con sesiones que sobreviven al cierre del portátil, más una extensión de VS Code gratuita y una CLI con planes editables y permisos por sesión. Precios: gratuito, Pro a 14,99 euros al mes, Team a 24,99 por usuario.

Es la alternativa europea completa al paquete ChatGPT más Codex, con precios en euros y conectores a las suites que ya usan las empresas. Para equipos con requisitos de residencia de datos es una alternativa directa a evaluar.

Fuente: Mistral AI · también en InfoQ y The Decoder

Mistral entra en la simulación física con Physics AI

El 27 de mayo Mistral anunció Physics AI, una nueva clase de modelos nacida de la adquisición de la austriaca Emmi AI (importe no revelado), cuyo equipo de más de 30 investigadores se integra en Mistral. La base son los Large Engineering Models: modelos fundacionales entrenados con las leyes de la física que, según Mistral, predicen comportamiento físico (flujo de aire, calor, tensión de materiales) a partir de geometría y condiciones de contorno en segundos sobre una sola GPU, frente a las horas o semanas de los solvers tradicionales. Socios citados: ASML, Airbus, Safran y Siemens Energy. Sin fecha de lanzamiento, precios ni estado de beta; solo formulario de contacto.

Para industria (aeroespacial, automoción, energía) la promesa es iterar diseños en segundos en vez de esperar simulaciones. Con solo un formulario disponible, hoy es una señal de dirección, con nombres de socios que le dan credibilidad.

Fuente: Mistral AI · también en investigación de Mistral y HPCwire

¿Necesitas ayuda con la IA?

Agenda una llamada

30 minutos, gratis y sin compromiso.