Meta lanza Muse Image, un generador de imágenes con IA agéntica, en Instagram y WhatsApp
Meta Superintelligence Labs lanzó Muse Image, un modelo de texto a imagen con llamada a herramientas y anclaje por búsqueda, que ocupa el puesto #2 en Arena. Un preview de Muse Video con audio nativo llega a continuación.
Meta Superintelligence Labs lanzó Muse Image, su modelo de texto a imagen más avanzado hasta la fecha, y ya está disponible en la app de Meta AI, meta.ai, Instagram Stories en Estados Unidos y WhatsApp en países seleccionados.
Qué lo hace diferente
Muse Image no es un modelo de difusión estándar acoplado a una interfaz de chat — está construido para actuar de forma agéntica. Sigue instrucciones de varios pasos con precisión, maneja composición multi-referencia para ediciones (le das varias imágenes de origen y las combina de forma coherente) y llama a herramientas externas durante la generación: crea gráficos, genera códigos QR, produce GIFs animados. También ancla sus resultados mediante búsqueda, incorporando datos de referencia del mundo real en lugar de depender únicamente de lo aprendido en el entrenamiento.
La calidad escala con el cómputo en tiempo de inferencia — cuanto más tiempo de inferencia se invierte, mejor es el resultado, la misma curva de compensación que ya es estándar en los modelos de razonamiento y que ahora aparece en la generación de imágenes.
Benchmarks y procedencia
Muse Image ocupa el puesto #2 en Arena en tres categorías separadas: texto a imagen, edición de una sola imagen y edición multi-imagen. Meta no especificó cuál es el modelo #1 en su anuncio, pero quedar segundo en las tres categorías frente a un campo que incluye Nano Banana de Google y las herramientas de imagen de OpenAI es un resultado real, no una cifra de marketing.
Cada resultado lleva una marca de agua invisible llamada “Content Seal”, diseñada para sobrevivir a recortes, recompresión y resubidas — una respuesta directa al problema de procedencia que ha perseguido a cada gran lanzamiento de generación de imágenes desde Stable Diffusion.
Muse Video es lo siguiente
Junto a Muse Image, Meta presentó un preview de Muse Video, construido sobre el mismo modelo base pero extendido con generación de audio nativo — es decir, los clips generados llegan con sonido sincronizado en lugar de requerir un paso de audio separado. Actualmente ocupa el puesto #3 en Arena para texto a video, es un preview, no un lanzamiento completo.
Por qué importa
La jugada de Meta aquí es de distribución, no solo de capacidad. Instagram Stories y WhatsApp ponen Muse Image frente a miles de millones de usuarios que nunca tocarán una herramienta de IA independiente, lo cual es un carril competitivo distinto al de OpenAI o Google persiguiendo tráfico de desarrolladores y empresas vía API. Si Muse Video se lanza con la misma llamada a herramientas agéntica y anclaje por búsqueda que el modelo de imagen, Meta tendrá un generador de video con audio nativo integrado directamente en las apps de mensajería más grandes del mundo — una ventaja de distribución que ni Sora de OpenAI ni Veo de Google tienen actualmente a esa escala.
Fuentes
Lecturas relacionadas
- Modelos de IA Meta lanza Muse Spark: su primer modelo de IA de código cerrado y un giro estratégico respecto a Llama
- Modelos de IA OpenAI convierte GPT-5.6 Luna en el modelo por defecto del ChatGPT gratuito — con chats de texto ilimitados
- Modelos de IA Gemini 3.5 Pro llega el 17 de julio con una ventana de contexto de 2 millones de tokens