La semana ha sido testigo de importantes lanzamientos en el ámbito de la inteligencia artificial, destacando las nuevas versiones de Grok 4.5 de SpaceXAI y Muse Spark 1.1 de Meta. Ambos modelos demuestran un salto cualitativo significativo, acercándose al rendimiento de los líderes del sector como OpenAI y Anthropic, pero con una ventaja crucial: un coste notablemente inferior. Esta estrategia podría redefinir el mercado al ofrecer una "inteligencia suficiente" por un precio mucho más accesible.
La reciente semana ha sido intensa en cuanto a la presentación de nuevos modelos de IA. Si bien la atención principal pudo haber recaído en la anticipada familia GPT-5.6 (con sus variantes Sol, Terra y Luna), también hemos sido testigos del lanzamiento de Grok 4.5 por parte de SpaceXAI y la actualización de Meta con Muse Spark 1.1. En ambos casos, se observa un prometedor avance cualitativo, y según evaluaciones internas e independientes, el desempeño de estos modelos se aproxima de manera considerable al de los modelos frontera de OpenAI y Anthropic.
Esto resultaba impensable hace apenas unos meses. Tanto Meta como xAI (ahora completamente integrada con SpaceX en la nueva SpaceXAI) parecían ocupar una posición secundaria o terciaria en el sector de la IA.
SpaceXAI ha compartido escasos resultados de Grok 4.5, pero la comparativa con Muse Spark 1.1 se presenta en una tabla. Meta, de hecho, llevaba meses trabajando en un enigmático nuevo modelo denominado Muse Spark, que finalmente se dio a conocer en abril, aunque su recepción fue tibia: no sobresalía en prácticamente nada y parecía que la compañía no había logrado cumplir con las expectativas. Con Grok, la situación fue diferente. La ambición de Musk en este campo siempre ha sido inmensa, pero desde el principio el enfoque de Grok resultó peculiar. Aquella primera versión parecía querer burlarse de sí misma (y de nosotros) con su tono sarcástico, pero su evolución demostró que estábamos ante un modelo con un potencial considerable que no terminaba de encontrar su rumbo.
Sin embargo, ambas empresas han impulsado estos modelos de manera más que prometedora. En SpaceXAI, es probable que se hayan beneficiado de la reciente adquisición de Cursor, que poseía su propia experiencia con Composer 2.5 y que, sin duda, ha influido en la creación de un Grok 4.5 mucho más competente en programación. Con Meta y su Muse Spark 1.1 se ha observado lo mismo: está mucho más cerca de sus grandes competidores, Fable 5 y GPT 5.6. Pero lo sorprendente no es solo su acercamiento, sino que lo han logrado reduciendo el precio de forma significativa. Y esa es su principal ventaja.
Lo verdaderamente relevante de estos modelos no es solo que el salto de calidad haya sido significativo, sino que su coste es realmente competitivo. En el anuncio de SpaceXAI, es algo que destacan especialmente al afirmar que "En general, Grok 4.5 ofrece la mayor inteligencia por unidad de tiempo y coste". En el lanzamiento de Meta no hay declaraciones directas al respecto, pero no es necesario: es el modelo frontera más económico entre sus rivales, como se puede observar en una tabla.
La pregunta es, por supuesto, si esos precios realmente compensan. Es decir, si se obtiene "suficiente inteligencia" por dólar. Y es precisamente lo que responde el ranking de Artificial Analysis, que evalúa el coste de completar tareas predefinidas en sus pruebas de rendimiento.
Por el momento, Muse Spark 1.1 no está incluido en ese ranking, pero de momento hay dos claros ganadores: por un lado, GPT-5.6 Luna. Por el otro, y aún mejor, Grok 4.5. Observen el cuadrante verde en la parte superior izquierda: los únicos modelos que entran son GPT-5.6 Luna y Grok 4.5. Muse Spark 1.1 aún está sin evaluar.
Esa conclusión parece dejar claro que esos modelos específicos de SpaceXAI y OpenAI son excelentes para tareas intensivas donde el consumo de tokens se dispara. Puede que no sean los ideales si se busca resolver conjeturas matemáticas extremadamente complejas, pero para tareas agénticas tenemos al menos esos dos candidatos claros. Muse Spark 1.1 probablemente también cumpla con esas premisas, a juzgar por las pruebas de rendimiento y el coste.
Estamos, por tanto, ante un giro interesante de los acontecimientos. Uno que además plantea una alternativa real a lo que era hasta ahora la gran baza de los modelos abiertos chinos: su coste era muy inferior al de los modelos frontera de OpenAI o Anthropic, pero el rendimiento también quedaba rezagado.
Lo que ofrecen Grok 4.5 y Muse Spark 1.1 (y GPT-5.6 Luna) es algo similar a lo mejor de ambos mundos: logran "regalarnos" el 90% de lo que hacen los mejores modelos del mundo, pero lo hacen a un 10 o un 20% de su precio. Buenos, bonitos y baratos. No es una mala apuesta, desde luego.