Multiverse Computing es una empresa fundada en San Sebastián, España, en 2019. Su plataforma CompactifAI reduce los modelos de lenguaje hasta un 95 % sin reentrenarlos, con compresión basada en redes tensoriales de inspiración cuántica. La empresa ofrece por API versiones comprimidas de Llama, DeepSeek, Mistral y Nemotron, con un coste de hasta un 75 % menos que la inferencia de modelos propietarios de frontera.
Founded: 2019
Acerca de Multiverse Computing
Multiverse Computing es una empresa española de infraestructura de IA, fundada en 2019 en San Sebastián, en el País Vasco. Su producto principal, CompactifAI, aplica matemáticas de redes tensoriales de inspiración cuántica para reorganizar las matrices de pesos de un modelo de lenguaje en representaciones comprimidas y eficientes. El proceso reduce el uso de memoria entre un 93 % y un 95 % y mantiene un buen rendimiento en pruebas de razonamiento, seguimiento de instrucciones y uso de herramientas. A diferencia de la cuantización clásica, CompactifAI cambia la arquitectura del modelo en lugar de limitarse a bajar la precisión numérica. Por eso funciona con los formatos BF16, FP8 y NVFP4.
La empresa trabaja de cerca con NVIDIA. Usa las bibliotecas Model Optimizer y Megatron Bridge de NVIDIA dentro de su flujo de compresión. Valida los modelos resultantes en infraestructura de cómputo acelerado de NVIDIA y los publica en formatos de precisión compatibles.
El modelo Pulsar 16B salió el 23 de junio de 2026. Con 16,15 mil millones de parámetros ofrece un razonamiento propio de la clase de 30B. Rinde un 43 % más que el modelo base Nemotron 3 Nano 30B. Además, el tiempo hasta el primer token baja de 2,18 s a 1,24 s en GPU NVIDIA Blackwell.
CompactifAI es una API de autoservicio, disponible en AWS Marketplace y en el portal de Multiverse Computing. Sirve versiones comprimidas de Meta Llama, DeepSeek, Mistral, NVIDIA Nemotron y modelos de la familia OpenAI a clientes empresariales. Se puede desplegar en la nube gestionada (AWS, Azure y GCP), en centros de datos privados y, en las variantes NVFP4, en el propio dispositivo: GPU de consumo y sistemas embebidos. Según la empresa, la API cuesta hasta un 75 % menos que la inferencia de modelos propietarios de frontera comparables en tareas de programación y razonamiento.
Entre sus productos están CompactifAI (la API de compresión de modelos de lenguaje), FinOptimal (optimización de carteras de inversión de inspiración cuántica para entidades financieras) y una gama creciente de modelos abiertos comprimidos. En 2026 tiene clientes en el sector de la energía (Iberdrola), el del automóvil (Bosch) y en más de 100 empresas de todo el mundo.
En junio de 2025, Multiverse Computing cerró una ronda de serie B de 189 millones de euros ($215M), liderada por Bullhound Capital. También entraron HP Tech Ventures, Toshiba, Santander Climate VC y CDP Venture Capital. El Gobierno de España pasó a ser accionista directo con una coinversión de 67 millones de euros a través de la Sociedad Española para la Transformación Tecnológica.
En enero de 2026, la empresa declaró unos ingresos recurrentes anuales de unos 100 millones de euros. Según la prensa de principios de 2026, estudiaba una serie C de hasta 500 millones de euros con una valoración de 1500 millones de euros. Al escribir esto, no había confirmación de que la ronda se hubiera cerrado.
La gama de modelos de la empresa a junio de 2026 incluye LittleLamb, un modelo compacto para llamadas a herramientas. También HyperNova 60B, una versión de GPT-OSS-120B comprimida un 50 % que salió a principios de 2026, y Pulsar 16B, derivado comprimido de NVIDIA Nemotron 3 Nano, publicado el 23 de junio de 2026. Todos los modelos abiertos están en Hugging Face con licencia Apache 2.0, dentro de la organización MultiverseComputingCAI.