recursos
Comparativas, guías y material long-form
Todo lo que publicamos sobre inferencia LLM, sandboxes con agentes, arquitectura de clúster y soberanía de datos en Europa. Hecho para leerse despacio y citarse bien.
comparativas
Comparativas con otras plataformas
Tablas honestas con precios, latencia y certificaciones. Cuándo elegirnos y cuándo no.
GPU Flow vs OpenAI
Precios, factura, residencia de datos, SDK. Tabla completa + FAQ con datos citables.
leer publicadaGPU Flow vs Modal
GPU serverless de EE. UU. vs inferencia LLM lista en Europa. Precios, residencia de datos y cuándo elegir cada uno.
leer publicadaGPU Flow vs Replicate
Marketplace de modelos US vs API de tokens LLM drop-in europea. Catálogo, factura y residencia de datos.
leerguías
Guías técnicas
Cómo migrar de OpenAI/Anthropic, cómo conectar Claude Code a la API, cómo elegir modelo y tamaño de Sandbox.
Migrar de OpenAI a GPU Flow en 15 minutos
Cambia dos líneas del SDK de OpenAI, elige el modelo equivalente y mantén streaming, tools y razonamiento.
leer publicadaConectar Claude Code a Token Factory
Apunta Claude Code a tu inferencia europea con tres variables de entorno, o levántalo precableado en un Sandbox.
leer publicadaElegir Sandbox: CPU, RAM, storage
Cuándo te basta CPU, cuándo necesitas GPU, cuánta RAM y almacenamiento. Y cómo la auto-suspensión te ahorra.
leerblog
Notas y artículos
Lo que aprendemos operando GPU NVIDIA B200 sobre InfiniBand y DDN EXAScaler. Honesto, sin marketing inflado.
Por qué medimos en TTFT y no en tokens/segundo
El tiempo hasta el primer token es lo que siente tu usuario. Por qué lo priorizamos y cómo lo bajamos.
leer publicadaSoberanía de datos: lo que sí significa en 2026
El buzzword vs las garantías concretas: jurisdicción, sub-procesadores, certificaciones que tu DPO puede leer.
leer