OpenAI lanza GPT-5.6 en tres versiones y ChatGPT Work, su respuesta directa a Claude Cowork de Anthropic

Publicado el

OpenAI lanza GPT-5.6 en tres versiones y ChatGPT Work, su respuesta directa a Claude Cowork de Anthropic

OpenAI presentó ayer GPT-5.6, una familia de tres modelos, junto a ChatGPT Work, un agente de productividad que combina ChatGPT con Codex para ejecutar tareas de oficina sin conocimientos de programación. El lanzamiento es el más abiertamente competitivo de la empresa en meses: los benchmarks se comparan directamente con Anthropic, y la nomenclatura de ChatGPT Work imita la de Claude Cowork, el agente que Anthropic puso en marcha en enero de 2026.

Lo publica Lucas Ropek en TechCrunch, complementado por Axios y el propio OpenAI. El lanzamiento se retrasó varias semanas por solicitud del gobierno de EE.UU. por preocupaciones de seguridad nacional. Altman reconoció haber hecho «muchos cambios» tras una «colaboración de ida y vuelta» con la administración.

Las tres variantes y sus precios

GPT-5.6 llega en tres tamaños con nombres astronómicos:

  • Sol (razonamiento avanzado y programación): 5 dólares de entrada / 30 dólares de salida por millón de tokens (≈ 4,35 / 26 euros)
  • Terra (opción equilibrada): 2,50 dólares / 15 dólares por millón de tokens (≈ 2,17 / 13 euros)
  • Luna (modelo económico): 1 dólar / 6 dólares por millón de tokens (≈ 0,87 / 5,22 euros)

Sam Altman declaró que Sol es un 54% más eficiente en tokens para tareas de programación. El posicionamiento frente a Anthropic es explícito: Sol puntúa 80 sobre 100 en el Coding Agent Index de Artificial Analysis, 2,8 puntos por encima de Fable 5, usando menos de la mitad de tokens de salida, en menos de la mitad del tiempo y a aproximadamente un tercio del coste. Terra supera también a Fable 5; Luna supera a Claude Opus 4.8.

En capacidades generales, Sol establece nuevos máximos en BrowseComp (92,2%) y OSWorld 2.0 (62,6%), superando a Opus 4.8 usando un 85% menos de tokens de salida. En ciberseguridad, los filtros de Sol bloquean aproximadamente diez veces más actividad potencialmente dañina que los modelos anteriores, con 700.000 horas de GPU A100e de red teaming automatizado antes de la publicación.

El contexto de esta familia de modelos se entiende mejor si se recuerda que cuando GPT-5.5 Instant se convirtió en el modelo por defecto de ChatGPT en mayo, el énfasis ya estaba en la eficiencia y la integración con fuentes externas como Gmail. GPT-5.6 lleva esa dirección mucho más lejos. Luna puede completar las mismas tareas que Sol a aproximadamente un quinto del precio según el analista Max Weinbach de Creative Strategies: «Es la primera vez que veo los modelos pequeños completar este tipo de tareas», dijo.

ChatGPT Work: el agente de oficina que compite con Cowork

Al mismo tiempo, OpenAI presentó ChatGPT Work, una plataforma que conecta ChatGPT con Slack, Gmail, Google Drive, Notion, Microsoft 365 y los CRM más comunes. El agente puede acceder al contexto real de donde está el trabajo y producir entregables directamente: documentos, presentaciones, hojas de cálculo, webs alojadas. No hay que pegar texto en el prompt: el agente va a buscarlo donde ya está.

El precedente inmediato en la propia estrategia de OpenAI son los Workspace Agents que la empresa presentó en abril para equipos empresariales, y que sustituyeron a los GPTs personalizados. ChatGPT Work es la evolución hacia el usuario general no técnico: donde los Workspace Agents requerían administración de empresa, ChatGPT Work es plug-and-play.

El acceso se despliega en fases. Los usuarios de escritorio (Mac y Windows), incluyendo usuarios gratuitos, tienen acceso inmediato. Los planes Pro, Enterprise y Edu en web y móvil siguen en los próximos días; Plus y Business, en la semana siguiente. GPT-5.6 también es ya el modelo preferido en Microsoft 365 Copilot.

Lo que trae GPT-5.6 a la API: cinco novedades para desarrolladores

OpenAI envió ayer por la tarde un correo a su comunidad de desarrolladores con los detalles técnicos de GPT-5.6 en la API. Son cinco características nuevas que cambian cómo los equipos pueden construir agentes y flujos de trabajo multi-herramienta:

Programmatic Tool Calling. GPT-5.6 puede ejecutar JavaScript ligero en un entorno alojado por OpenAI para coordinar herramientas elegibles, pasar resultados entre llamadas y reducir el trabajo intermedio. La implicación práctica: los agentes pueden encadenar llamadas a herramientas sin necesidad de que el código del cliente gestione cada transición. Menos round trips, menos latencia, menos lógica de orquestación manual.

Multi-agente (beta). Dentro de una sola petición a la API, GPT-5.6 puede lanzar subagentes concurrentes para dividir el trabajo, explorar enfoques en paralelo y sintetizar los resultados. Antes, la orquestación multi-agente requería gestión en el lado del cliente o frameworks externos; ahora es nativa en el modelo. Llega en beta, lo que significa que la API puede cambiar.

Pro mode + max effort. Pro mode aplica más trabajo de modelo antes de devolver una única respuesta final para tareas donde la calidad importa más que la velocidad. Max reasoning effort da al modelo más espacio para explorar y verificar. Son dos palancas distintas: una para calidad de respuesta, otra para profundidad de razonamiento.

Persisted reasoning. El razonamiento se mantiene entre turnos de una conversación, mejorando la calidad en conversaciones largas y la eficiencia del caché cuando los objetivos permanecen estables. Relevante para cualquier flujo de trabajo donde el modelo necesita recordar su propio proceso de razonamiento anterior, no solo el historial de mensajes.

Prompt cache breakpoints. El desarrollador puede marcar los prefijos reutilizables del prompt que quiere cachear, para que el contexto repetido se procese de forma más eficiente en workloads de alto volumen. Traducido a costes: si tienes un prompt base que se repite en miles de llamadas diarias, esta función reduce el coste de inferencia de ese contexto.

Juntas, estas cinco funciones empujan a GPT-5.6 en una dirección clara: que el modelo pueda hacerse cargo de flujos de trabajo completos de principio a fin, con planificación, uso de herramientas, estado entre turnos y ejecución paralela. No es solo un modelo más capaz; es una plataforma de agencia con primitivas nativas que antes requerían middleware externo.

El contexto de la guerra entre modelos

Para entender el movimiento, hay que ver el tablero de 2026. Anthropic ha ganado cuota en el mercado empresarial de forma consistente, especialmente en programación. Un análisis citado repetidamente en el sector señalaba que había superado a OpenAI en despliegues de desarrollo de software. ChatGPT Work es la respuesta en el propio terreno de OpenAI: el consumidor masivo, donde ChatGPT tiene una base instalada que ningún rival ha igualado.

La apuesta de precio es también deliberada. El mercado empresarial de IA lleva meses sufriendo presión de costes, y los directores financieros están evaluando las facturas de inferencia con más atención que en 2024. Que Luna iguale al modelo grande al 20% del precio es, en ese contexto, más relevante que cualquier benchmark de razonamiento. Y GPT-5 ya demostró en su lanzamiento en 2025 que una nueva familia de modelos no basta por sí sola: necesita el producto correcto alrededor para cambiar hábitos.

Mi valoración

Llevo siguiendo los lanzamientos de modelos de OpenAI desde el GPT-3 original, y GPT-5.6 me parece el más honesto en términos de posicionamiento. En vez de prometer inteligencia general, promete eficiencia medible. Eso es exactamente lo que los clientes empresariales necesitan escuchar en 2026.

Lo que más me convence es el modelo de tres niveles. Tener Luna como opción económica que puede ejecutar las mismas tareas que Sol en muchos escenarios cambia el cálculo de coste para equipos que necesitan escala. Lo que más me preocupa es la curva de adopción de ChatGPT Work: el directorio de plugins necesita llenarse rápido para que el agente sea verdaderamente útil, y eso depende de que terceros integren sus herramientas.

La pregunta a doce meses no es si GPT-5.6 es bueno —claramente lo es— sino si ChatGPT Work puede convertirse en herramienta de trabajo cotidiana antes de que Anthropic consolide Claude Cowork en las empresas que ya usan Claude. El primero en crear hábito gana.

Preguntas frecuentes

¿Cuál de los tres modelos debo usar?

Sol es para tareas complejas de programación o razonamiento profundo donde la calidad importa más que el coste. Terra es la opción equilibrada para uso profesional general: documentos, análisis, asistencia. Luna es ideal para tareas repetitivas o cuando procesas volumen alto y la factura es una variable crítica. OpenAI indica que Luna puede igualar a Sol en muchas tareas a un quinto del precio.

¿ChatGPT Work sustituye a otras herramientas de gestión de tareas?

No exactamente. Es un agente que ejecuta tareas dentro de las herramientas que ya usas, no una herramienta de gestión independiente. Se conecta a Slack, Gmail, Drive o tu CRM y puede crear documentos o tablas desde ahí, pero no reemplaza a Notion ni a Jira: los complementa.

¿Tengo que pagar más para acceder a GPT-5.6?

No. GPT-5.6 está disponible en todos los planes de ChatGPT, incluyendo el gratuito, aunque con límites de uso distintos según el tier. La API cobra por token a los precios publicados arriba.