Toda la infraestructurade IA,sin ser experto para usarla.

Token Factory para la API, Sandbox para trabajar y GPU dedicada para proyectos grandes.Un mismo saldo, en euros, en un centro de datos europeo.

Activas con tu tarjeta y en marcha en menos de un minuto. ¿Lo usas 3 minutos? Pagas 3 minutos.

  • cert.ISO 27001 y ENS Media
  • datos enEspaña, UE
  • facturaen EUR
  • cómputoNVIDIA B200

productos

Combina toda la infraestructura de IA que necesitas.

Inferencia con la API, agentes en el Sandbox, cargas pesadas en GPU dedicada, por separado o combinadas. Todo sobre un mismo saldo, una sola factura.

Token Factory

Una IA que contesta, vía API

Conectas tu web, tienda o aplicación a los mejores modelos abiertos. Compatible con los SDK de OpenAI y Anthropic.

Ejemplo real

una clínica que responde dudas de citas a cualquier hora.

  • TTFT es lo que tarda la IA en empezar a responder. Aquí, menos de una décima de segundo.
  • El chip de cálculo más avanzado de NVIDIA. Es el motor que ejecuta la inteligencia artificial.
  • Recargas saldo por adelantado y se descuenta según el uso real. Sin cuotas ni sorpresas.
desde 0,06 €/ M tokens entradasaldo desde 10 €

Sandbox

Tu espacio de trabajo en la nube

Un equipo potente encendido para ti, con plantillas de agentes listas. Se suspende solo cuando no lo usas y tus archivos siguen ahí.

Ejemplo real

un equipo que desarrolla y prueba sin depender de su propio hardware.

  • Red interna de muy baja latencia entre tu Sandbox y los modelos: las peticiones no salen a internet.
  • El almacenamiento del clúster. Guarda repositorios y datasets grandes sin penalizar la velocidad.
  • Si dejas de usarlo, se apaga solo y deja de consumir saldo. Tú decides tras cuánto tiempo.
desde 0,15 €/ hora activa+ volumen desde 5 €/mes

GPU dedicada

Una máquina entera para ti

Una NVIDIA B200 completa o en fracción MIG, sin compartir con nadie. Por mes o por año, para cargas serias.

Ejemplo real

una empresa que entrena su propio modelo con datos privados.

  • MIG divide una GPU en porciones independientes. Alquilas una porción o la máquina entera.
  • El chip de cálculo más avanzado de NVIDIA. Es el motor que ejecuta la inteligencia artificial.
  • La memoria de la GPU: cuanta más, más grande es el modelo que cabe. FP4 es el formato numérico que permite servirlo más rápido.
desde 1,10 €/ horareservado mensual −10%

El camino

Del primer experimento a producción.

El mismo saldo te acompaña en las tres etapas, sin cambiar de proveedor.

  1. 01

    Pruebas tu idea

    Token Factory

    Llamas a un modelo desde tu aplicación con la API. Los 50 € gratis dan de sobra.

  2. 02

    La desarrollas

    Sandbox

    Tu entorno persistente para construir, con plantillas de agentes listas.

  3. 03

    La pones a producir

    GPU dedicada

    Músculo reservado para tu carga real, por mes o por año.

Dos preguntas

¿Cuál necesito?

Dos preguntas. Tanto si gestionas infraestructura a diario como si es tu primer contacto con la IA, te indicamos por dónde empezar.

1. ¿Qué quieres conseguir?
2. ¿Cómo te llevas con la parte técnica?

Novedades

Los modelos más recientes del mercado, ya servidos desde nuestro clúster.

PublicadoVersiónModeloPara qué sirveVer más
GLM-5.3-NVFP4GLM 5.3 NVFP4Todoterreno para escribir y programar, con manejo de herramientas.Ver ficha
Qwen3.8-27B-NVFP4Qwen3.8 27BFuerte programando y encadenando tareas por su cuenta.Ver ficha
DeepSeek-V4-Pro-0813DeepSeek V4 ProEl más capaz del catálogo: razona problemas largos, escribe código y maneja tus herramientas.Ver ficha
NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4Nemotron 3.5 Lightning 30BRazona y usa herramientas gastando muy poco, pensado para responder deprisa.Ver ficha
DeepSeek-V4-Flash-0731DeepSeek V4 FlashRápido y con una memoria enorme: se lee un contrato entero sin perder el hilo.Ver ficha
ALIA-40b-instruct-2606ALIA 40B InstructEl modelo público español, entrenado en castellano, catalán, euskera y gallego.Ver ficha

infraestructura

Hardware soberano, sin tenant compartido.

Seis razones para traer aquí tu IA: qué hardware la mueve, dónde está, cómo se conecta, dónde viven tus datos, qué certificaciones tiene y cómo se factura.

01NVIDIA B200

NVIDIA B200

Aceleradores de última generación, dedicados, en bare metal. Sin tenant compartido.

02España

España

Centro de datos en suelo español. Sin transferencia internacional ni sub-procesadores fuera de la UE.

03Red interna RDMA

Red interna RDMA

Baja latencia entre nodos para multi-GPU y throughput sostenido en producción.

04DDN EXAScaler

DDN EXAScaler

Almacenamiento paralelo de alta velocidad para datasets, checkpoints y volúmenes persistentes.

05ISO 27001 y ENS Media

ISO 27001 y ENS Media

Certificaciones operativas. DPA estándar listo para firma. Retención cero opcional en enterprise.

06Factura española en EUR

Factura española en EUR

Deducible para empresas y autónomos UE, válida para reverse charge intracomunitario. Sin conversión USD/EUR, sin sorpresas de tipo de cambio.

modelos

Modelos open source, desplegados y listos.

Modelos abiertos de varios proveedores, desplegados en nuestra propia infraestructura en España.

Soporte

Todo pasa aquí, y hay gente detrás.

Escribes un correo y te contesta una persona, en menos de cuatro horas laborables. Para incidencias críticas, llamada con un experto.

Escríbenos
Máquinas en España
Centro de datos en suelo español, sin copias fuera de la UE.
Factura en euros
Válida para tu gestoría, con IVA y sin cambio de divisa.
ISO 27001 y ENS Media
Certificaciones descargables y DPA listo para firma.
Soporte humano
En español e inglés, en menos de 4 h laborables.

preguntas frecuentes

Lo que casi siempre nos preguntan antes de empezar.

¿Dónde se procesan mis datos?

Todos los datos se procesan en un centro de datos en España. No salen de la Unión Europea ni se replican en otras regiones. La plataforma cumple ISO 27001 y ENS categoría Media, y tenemos DPA estándar listo para firma.

¿Es compatible con el SDK de OpenAI o Anthropic?

Sí. La API expone /v1/chat/completions (OpenAI) y /v1/messages (Anthropic). Apuntas el SDK a api.gpuflow.ai con tu API key y los modelos del catálogo aparecen disponibles directamente. Soportamos streaming SSE y function calling donde el modelo lo permite.

¿Hace falta cuenta para probar? ¿Pongo tarjeta?

Cuenta sí, en 1 minuto con email o SSO. Añades tu tarjeta y recibes 50 € de saldo para llamar a la API o levantar un Sandbox. El cargo de verificación de 1 € se reembolsa.

¿Cómo funciona la facturación?

Modelo prepago. Recargas saldo cuando quieres y se consume según uso real, medido en tokens (Token Factory) o en horas activas (Sandboxes). Notificación automática cuando el saldo cae por debajo del 20 %. Factura en euros en cada recarga.

¿Qué pasa si el entorno se queda dormido?

Sólo cobramos las horas que el sandbox está activo. Tras el tiempo de inactividad que hayas configurado (de 10 min a 4 h, o sólo paro manual) sin actividad SSH ni procesos del usuario, se suspende automáticamente y deja de cobrar compute. Tu volumen persistente sobrevive intacto y vuelve a estar disponible en 5-8 segundos al reconectar.

¿Puedo cancelar o eliminar mi sandbox?

Sí, en cualquier momento desde el panel. La facturación se prorratea hasta el momento exacto de la baja. Si eliminas, se borra el volumen persistente y todas las snapshots; tienes hasta 7 días para deshacer la eliminación si fue accidental.

¿Tenéis SLA público?

Sí, publicamos el estado en tiempo real en gpuflow.ai/status. El SLA contractual con tiempos de respuesta de soporte se acuerda en los planes enterprise.

¿Qué significa que GPU Flow esté en beta?

Que el servicio ya está en producción y se factura por uso real, pero seguimos puliendo la plataforma: puede haber alguna interrupción puntual y la interfaz cambia de una semana a otra. Los precios, tu saldo y la residencia de los datos en España no cambian por estar en beta. El estado de cada servicio está publicado en la página de estado, y si algo falla nos escribes a [email protected] y lo resolvemos.

Tu infraestructura de IA, soberana y en euros.

Datos que no salen de Europa, facturación en euros y un mismo saldo para API, Sandbox y GPU. Abre cuenta, añade tu tarjeta y empieza con 50 € gratis.

¿Eres una startup europea? Solicita hasta 5.000 € en créditos