guía de migración
15 minutos2 líneas de códigoMigra de OpenAI a GPU Flow en 15 minutos
GPU Flow habla el mismo protocolo que OpenAI. Si tu código ya usa el SDK de OpenAI, migrar es cambiar dos líneas (la URL base y la API key) y elegir un modelo equivalente del catálogo. No reescribes nada más: mensajes, streaming, function calling y parámetros funcionan igual.
A cambio, tus datos se procesan en España (sin salir de la UE), facturas en euros y empiezas con 50 € de saldo gratis. Esta guía te lleva del primer curl a producción.
Crea tu cuenta y tu API key
Regístrate con email o Google: recibes 50 € de saldo gratis, sin tarjeta. La API key se crea desde el panel de usuario y se copia en ese momento, porque solo se muestra una vez. Nunca se envía por correo.
Cambia la URL base y la API key
Apunta el cliente de OpenAI a api.gpuflow.ai/v1 con tu nueva key. Lo demás de tu código no se toca.
python
# Antes / Before
client = OpenAI(api_key=os.environ["OPENAI_API_KEY"])
# Después / After
client = OpenAI(
base_url="https://api.gpuflow.ai/v1",
api_key=os.environ["GPUFLOW_API_KEY"],
)Elige el modelo equivalente
GPU Flow sirve 17 modelos open source. Sustituye el modelo de OpenAI por el equivalente del catálogo según tu caso: rápido y barato, o máxima capacidad.
| si usabas | usa | para |
|---|---|---|
| gpt-4o-mini | qwen-3.5-9b | Chat rápido, alto volumen, bajo coste |
| gpt-4o | deepseek-v4-pro, glm-5.3-nvfp4 | Razonamiento y código exigentes |
| o-series | deepseek-v4-pro + reasoning.effort | Cadenas de pensamiento largas |
Streaming, tools y razonamiento: igual que antes
Las respuestas en streaming (stream: true) y las herramientas (tools, o function calling) funcionan con el mismo formato de OpenAI. Además controlas el presupuesto de razonamiento con reasoning.effort ("low", "medium", "high" o "none").
python
resp = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "..."}],
stream=True,
extra_body={"reasoning": {"effort": "high"}},
)¿Usas el SDK de Anthropic? También
Si tu stack usa el SDK de Anthropic, apunta baseURL a api.gpuflow.ai y usa /v1/messages con los mismos modelos. No necesitas mantener dos integraciones.
Qué tener en cuenta
Gastas contra tu saldo en euros, que pagas por adelantado: si se agota, la API devuelve un 402 y recargas desde el panel. Bajo mucha carga puntual puede devolver 429 o 503 con cabecera Retry-After; reintenta con backoff. Los nombres y precios exactos de los modelos están en la página de precios y en la documentación.
Pruébalo con 50 € gratis
Crea tu cuenta, cambia la URL base y haz el primer curl contra cualquier modelo del catálogo. Sin tarjeta, con tus datos en Europa.