Multiverse Computing abre sus modelos de IA comprimidos a los desarrolladores
La startup española Multiverse Computing lanzó un portal API de autoservicio y una app de chat para consumidores construida sobre sus modelos comprimidos de inspiración cuántica, dirigida a empresas que necesitan IA lista para producción sin la fricción de AWS Marketplace. La jugada pone la inferencia de modelos comprimidos — más rápida, más barata, desplegable en dispositivo — directamente en manos de los desarrolladores.
Multiverse Computing, la startup española que comprime modelos de OpenAI, Meta, DeepSeek y Mistral AI en versiones más ligeras y rápidas, ha dejado de exigir una cuenta de AWS Marketplace para acceder a su tecnología. Desde el 19 de marzo, desarrolladores y empresas pueden acceder a un portal API de autoservicio directamente — con monitorización de uso en tiempo real incluida, sin necesidad de proceso de compras.
El mismo día, la compañía lanzó CompactifAI, una app de chat orientada al consumidor que muestra sus modelos comprimidos frente a los originales. En la superficie tiene la forma de ChatGPT, pero la propuesta real es de infraestructura: Multiverse quiere que las empresas vean que una variante comprimida de Llama o Mistral puede gestionar su carga de trabajo con un gasto de computación materialmente menor.
La compresión mediante métodos de redes tensoriales de inspiración cuántica es la propiedad intelectual central. La técnica reduce el recuento de parámetros y la huella de memoria preservando la precisión en tareas específicas de dominio — a menudo mejor que el modelo base en benchmarks estrechos porque la compresión se aplica después del fine-tuning sobre datos del cliente. HyperNova 60B de Multiverse, publicado gratis en Hugging Face en febrero, demostró que un modelo comprimido de 60B puede superar a algunos modelos sin comprimir de 70B en tareas de razonamiento.
El timing es deliberado. La adopción empresarial de IA se está estancando en la fase de prueba de concepto porque ejecutar grandes modelos frontera a escala cuesta más de lo que la mayoría de los presupuestos de TI preveían. Un modelo comprimido que ofrece el 85% del rendimiento de GPT-5.4 al 30% del coste es una conversación real a nivel de dirección financiera, y Multiverse posiciona su portal API como el lugar donde esa conversación se convierte en contrato.
El contexto estratégico: según informaciones, Multiverse busca una ronda de financiación de 500 millones de euros. Abrir un canal directo de API — con datos de uso fluyendo de vuelta — le da a la compañía tanto ingresos como las métricas de tracción que justifican esa valoración. La alianza con Axelera AI anunciada el 18 de marzo, que apunta al despliegue en hardware edge, extiende el mismo argumento a la inferencia en dispositivo, donde el tamaño del modelo es una restricción absoluta.
La compresión sigue siendo un ciudadano de segunda clase en la mayoría de las discusiones empresariales sobre IA, dominadas por las narrativas de escalado de computación de OpenAI y Google. Pero para verticales donde la residencia de datos, la latencia y los costes recurrentes de inferencia importan — servicios financieros, sanidad, defensa — un modelo más pequeño y rápido que corre en tu propia infraestructura es a menudo la respuesta correcta. Multiverse apuesta a que el mercado empresarial lo descubra en 2026.
Lecturas relacionadas
- Infraestructura IA OpenAI duplicará su plantilla hasta 8.000 empleados y construirá un ejército de centros de datos
- Policy & Regulation Nueva York, Primer Estado en Congelar Nuevos Centros de Datos Hiperescala
- Big Tech Microsoft firma acuerdo de gas natural de $7.000 millones a 20 años con Chevron para alimentar su megacampus de IA en Texas