La startup de IA de Mira Murati ha encontrado su proveedor de infraestructura. Thinking Machines Lab, el laboratorio fundado por la ex-directora de tecnología de OpenAI, ha firmado hoy un acuerdo de 65 millones de dólares anuales con Crusoe para ejecutar la inferencia de sus modelos abiertos sobre un clúster dedicado de GPUs Nvidia HGX B200. Lo publican hoy los dos compañías y lo cubre Cristian Dina en The Next Web.
El acuerdo utiliza el servicio Crusoe Managed Inference, que se lanzó hace menos de un año. Con este contrato, Crusoe anuncia que su negocio de inferencia gestionada ha superado los 100 millones de dólares en ingresos anuales recurrentes contratados —un hito significativo para un producto que todavía no cumple su primer año.
¿Qué modelos correrá Crusoe para Thinking Machines Lab?
Los modelos que Crusoe ejecutará incluyen Inkling —los modelos propios de Thinking Machines Lab— y las versiones GLM 5.2 y GLM 5.3, además de variantes ajustadas (fine-tuned) que el laboratorio desarrolle. Los modelos GLM pertenecen a Z.ai, el laboratorio chino conocido anteriormente como Zhipu AI, que también publicó esta semana el código de su herramienta ZCode en código abierto. Es un detalle relevante: Thinking Machines Lab usa modelos de origen chino en parte de su cartera, lo que añade una capa de complejidad geopolítica al acuerdo con Crusoe.
El hardware sobre el que correrán es un despliegue dedicado de sistemas Nvidia HGX B200 conectados con redes InfiniBand Quantum-2 de Nvidia. Se trata del tier de hardware de última generación disponible en la nube de Crusoe. El acuerdo es un Tailored Deployment: un endpoint dedicado, benchmarked y con acuerdo de nivel de servicio, lo que significa que Thinking Machines Lab no tiene que gestionar su propia pila de inferencia.
La colaboración contempla también explorar inferencia batch para generación de datos sintéticos a gran escala: es decir, usar los modelos de Thinking Machines Lab para generar datos de entrenamiento, no solo para inferencia de usuarios finales.
¿Qué dice esto sobre Crusoe y el mercado de inferencia?
Que un acuerdo de 65 millones de dólares anuales sea una sola operación para Crusoe, y que aún así les deje por encima de los 100 millones en ARR contratado, indica que el mercado de inferencia gestionada está adquiriendo escala rápidamente. El contrato de 65 millones de Thinking Machines se añade al acuerdo de 13.000 millones en cinco años con Jane Street que Crusoe firmó a principios de septiembre, y a la ronda de financiación de 3.900 millones de dólares a una valoración de 30.900 millones que cerró la semana pasada. En pocas semanas, Crusoe ha acumulado más de 14.000 millones en contratos y capital nuevo.
Por su parte, Thinking Machines Lab está en conversaciones para levantar una ronda de 6.000 millones de dólares con Nvidia y Accel, según informó The Information. Un acuerdo de infraestructura de 65 millones al año con un proveedor establecido es exactamente el tipo de estructura operativa que hace creíble ese nivel de ambición ante los inversores: no es solo un laboratorio de investigación, sino una empresa con productos en producción.
La voz de Myle Ott, responsable de infraestructura de ML en Thinking Machines Lab, en el comunicado resume bien la lógica: «Crusoe Managed Inference nos llevó de evaluación a producción rápidamente y cumplió los estándares que exigimos a nuestros propios sistemas, dándonos la escala y la economía para reinvertir en la investigación central».
OpenAI amplía sus data centers en Canadá mientras el proyecto Stargate en el Reino Unido está pausado: la infraestructura de cómputo para IA se está construyendo en múltiples geografías a la vez, y la competencia entre proveedores como Crusoe, AWS y Google Cloud determina qué laboratorios pueden escalar cuánto y a qué precio. Irán y China han desplegado campañas de influencia con IA autónoma: que Z.ai —un laboratorio chino— sea parte de la cartera de modelos que Thinking Machines Lab lleva a producción en infraestructura americana introduce preguntas sobre cadena de suministro de IA que el sector todavía no tiene un marco para responder. La sala limpia de IMEC en Málaga y la candidatura española a la gigafactoría europea de IA apuntan a que Europa quiere construir su propia infraestructura de cómputo en lugar de depender de contratos como el de Crusoe-Thinking Machines.
El acuerdo de 65 millones anuales de Thinking Machines Lab cierra una semana en que la industria de IA ha movido más capital en contratos de infraestructura que en cualquier semana de los últimos doce meses.
El modelo de Crusoe Managed Inference es el equivalente del cloud computing para la inferencia de IA: el laboratorio paga por un endpoint con SLA y puede dedicar todo su capital a investigación de modelos, sin gestionar GPUs ni negociar directamente con Nvidia. Que Crusoe haya alcanzado 100 millones de ARR en menos de un año indica demanda real para ese modelo. La pregunta de largo plazo es si los grandes clouds o el propio Nvidia entrarán directamente en este segmento de inferencia gestionada especializada, o si dejarán que Crusoe y similares lo desarrollen antes de adquirirlos.
El riesgo adicional para Crusoe es la dependencia de Nvidia. Si AMD o Intel desarrollan aceleradores competitivos —o si Nvidia decide verticalizarse en servicios de inferencia gestionada— el margen que Crusoe obtiene siendo intermediario se comprime. La forma de mitigarlo es exactamente lo que están haciendo: construir la capa de servicio y los SLAs que hacen costoso para el cliente cambiar de proveedor, independientemente del hardware subyacente. El acuerdo de cinco años de 13.000 millones con Jane Street y el de un año de 65 millones con Thinking Machines son la evidencia de que la estrategia de fidelización por SLA está funcionando. En un mercado donde el hardware cambia de generación cada dos años, la capa de servicio es lo único que no caduca. Y eso, en la industria de la IA de 2026, tiene un valor de mercado considerable.
