NVIDIA B200
Aceleradores de última generación, dedicados, en bare metal. Sin tenant compartido.
Token Factory para la API, Sandbox para trabajar y GPU dedicada para proyectos grandes.Un mismo saldo, en euros, en un centro de datos europeo.
Activas con tu tarjeta y en marcha en menos de un minuto. ¿Lo usas 3 minutos? Pagas 3 minutos.
productos
Inferencia con la API, agentes en el Sandbox, cargas pesadas en GPU dedicada, por separado o combinadas. Todo sobre un mismo saldo, una sola factura.
Una IA que contesta, vía API
Conectas tu web, tienda o aplicación a los mejores modelos abiertos. Compatible con los SDK de OpenAI y Anthropic.
Ejemplo real
una clínica que responde dudas de citas a cualquier hora.
Tu espacio de trabajo en la nube
Un equipo potente encendido para ti, con plantillas de agentes listas. Se suspende solo cuando no lo usas y tus archivos siguen ahí.
Ejemplo real
un equipo que desarrolla y prueba sin depender de su propio hardware.
Una máquina entera para ti
Una NVIDIA B200 completa o en fracción MIG, sin compartir con nadie. Por mes o por año, para cargas serias.
Ejemplo real
una empresa que entrena su propio modelo con datos privados.
El camino
El mismo saldo te acompaña en las tres etapas, sin cambiar de proveedor.
Pruebas tu idea
Token Factory
Llamas a un modelo desde tu aplicación con la API. Los 50 € gratis dan de sobra.
La desarrollas
Sandbox
Tu entorno persistente para construir, con plantillas de agentes listas.
La pones a producir
GPU dedicada
Músculo reservado para tu carga real, por mes o por año.
Dos preguntas
Dos preguntas. Tanto si gestionas infraestructura a diario como si es tu primer contacto con la IA, te indicamos por dónde empezar.
Los modelos más recientes del mercado, ya servidos desde nuestro clúster.
infraestructura
Seis razones para traer aquí tu IA: qué hardware la mueve, dónde está, cómo se conecta, dónde viven tus datos, qué certificaciones tiene y cómo se factura.
Aceleradores de última generación, dedicados, en bare metal. Sin tenant compartido.
Centro de datos en suelo español. Sin transferencia internacional ni sub-procesadores fuera de la UE.
Baja latencia entre nodos para multi-GPU y throughput sostenido en producción.
Almacenamiento paralelo de alta velocidad para datasets, checkpoints y volúmenes persistentes.
Certificaciones operativas. DPA estándar listo para firma. Retención cero opcional en enterprise.
Deducible para empresas y autónomos UE, válida para reverse charge intracomunitario. Sin conversión USD/EUR, sin sorpresas de tipo de cambio.
modelos
Modelos abiertos de varios proveedores, desplegados en nuestra propia infraestructura en España.
Texto y código
Chat, redacción y programación, con llamada a herramientas.
Razonamiento
Modelos que piensan antes de responder, con esfuerzo ajustable.
Visión y documentos
Leer imágenes, PDF y capturas: OCR y comprensión de documentos.
Voz
Transcripción de audio y síntesis de voz, con clonación.
Música
Canciones completas a partir de una letra y un estilo.
Soporte
Escribes un correo y te contesta una persona, en menos de cuatro horas laborables. Para incidencias críticas, llamada con un experto.
Escríbenospreguntas frecuentes
Todos los datos se procesan en un centro de datos en España. No salen de la Unión Europea ni se replican en otras regiones. La plataforma cumple ISO 27001 y ENS categoría Media, y tenemos DPA estándar listo para firma.
Sí. La API expone /v1/chat/completions (OpenAI) y /v1/messages (Anthropic). Apuntas el SDK a api.gpuflow.ai con tu API key y los modelos del catálogo aparecen disponibles directamente. Soportamos streaming SSE y function calling donde el modelo lo permite.
Cuenta sí, en 1 minuto con email o SSO. Añades tu tarjeta y recibes 50 € de saldo para llamar a la API o levantar un Sandbox. El cargo de verificación de 1 € se reembolsa.
Modelo prepago. Recargas saldo cuando quieres y se consume según uso real, medido en tokens (Token Factory) o en horas activas (Sandboxes). Notificación automática cuando el saldo cae por debajo del 20 %. Factura en euros en cada recarga.
Sólo cobramos las horas que el sandbox está activo. Tras el tiempo de inactividad que hayas configurado (de 10 min a 4 h, o sólo paro manual) sin actividad SSH ni procesos del usuario, se suspende automáticamente y deja de cobrar compute. Tu volumen persistente sobrevive intacto y vuelve a estar disponible en 5-8 segundos al reconectar.
Sí, en cualquier momento desde el panel. La facturación se prorratea hasta el momento exacto de la baja. Si eliminas, se borra el volumen persistente y todas las snapshots; tienes hasta 7 días para deshacer la eliminación si fue accidental.
Sí, publicamos el estado en tiempo real en gpuflow.ai/status. El SLA contractual con tiempos de respuesta de soporte se acuerda en los planes enterprise.
Que el servicio ya está en producción y se factura por uso real, pero seguimos puliendo la plataforma: puede haber alguna interrupción puntual y la interfaz cambia de una semana a otra. Los precios, tu saldo y la residencia de los datos en España no cambian por estar en beta. El estado de cada servicio está publicado en la página de estado, y si algo falla nos escribes a [email protected] y lo resolvemos.
Datos que no salen de Europa, facturación en euros y un mismo saldo para API, Sandbox y GPU. Abre cuenta, añade tu tarjeta y empieza con 50 € gratis.
¿Eres una startup europea? Solicita hasta 5.000 € en créditos