Nuestro análisis
Muse Spark 1.1 es el modelo con el que Meta cambia de estrategia. Salió el 9 de julio de 2026 desde Meta Superintelligence Labs y llegó acompañado de la Meta Model API, la primera API de pago de la compañía. Para una empresa cuya identidad en IA se construyó regalando los pesos de Llama, es un giro importante: este modelo no es abierto.
Técnicamente es un modelo de razonamiento multimodal pensado para tareas agénticas. Acepta texto, imágenes, vídeo y documentos, y responde en texto, con una ventana de 1 millón de tokens. Las mejoras frente al primer Muse Spark, de abril, están sobre todo en uso de herramientas, manejo del ordenador, programación y comprensión multimodal.
En los benchmarks queda en una posición interesante más que dominante. En SWE-Bench Pro saca 61,5 y supera a GPT-5.5 (58,6), pero se queda por detrás de Claude Opus 4.8 (69,2). En DeepSWE 1.1 baja a 53,3, con GPT-5.5 en 67,0 y Opus 4.8 en 59,0. Y en Terminal-Bench 2.1 marca 80,0, cerca de Opus 4.8 (82,7) y GPT-5.5 (83,4). En preguntas de nivel experto tipo GPQA es donde más flojea: es capaz, pero se equivoca con demasiada seguridad en temas alejados de su entrenamiento.
Su verdadero argumento es el precio: $1,25 por millón de tokens de entrada y $4,25 de salida. Ahí está la tesis del modelo. No busca ganar en calidad bruta, sino en coste por tarea completada: si orquesta herramientas bien y cuesta una fracción de lo que cuesta Opus, puede salir más rentable aunque puntúe algo menos.
Y ahora el aviso importante si lees esto desde España o Latinoamérica: la vista previa pública se lanzó solo para Estados Unidos y todavía no hay acceso desde la Unión Europea. Por muy bien que suene el precio, hoy no puedes montar tu producto sobre él si operas desde la UE. Si buscas algo parecido y disponible, mira Claude Sonnet 5 o DeepSeek V4.
✓ A favor
- Muy barato para ser un modelo frontera: $1,25 de entrada y $4,25 de salida por millón
- Fuerte en uso de herramientas y tareas agénticas, que es para lo que está pensado
- Ventana de 1 millón de tokens y entrada multimodal completa: texto, imagen, vídeo y documentos
- Trae salida estructurada, llamadas a herramientas en paralelo, API de ficheros y caché de prompts
✕ En contra
- La vista previa pública es solo para Estados Unidos: desde la UE todavía no puedes usarlo
- En programación va por detrás de Claude Opus 4.8 y GPT-5.5 en varios benchmarks
- Menos fiable en preguntas expertas: tiende a fallar con seguridad en temas de nicho
- No tiene pesos abiertos, al contrario que Llama
Veredicto
Muse Spark 1.1 obtiene un 8.9/10. Es especialmente recomendable para: Agentes que encadenan herramientas con un coste por tarea bajo.
Enlace al sitio oficial. Puede ser de afiliado: si contratas, DG Reviews IA podría llevarse una comisión sin coste extra para ti.