modelos · catálogo
8 modelos open source, servidos en Europa.
Modelos abiertos desplegados en GPU NVIDIA B200 en España, con una API compatible con los SDK de OpenAI y Anthropic. Desde 0,03 € por millón de tokens, con tus datos en la UE.
DeepSeek V4 Pro★
DeepSeek AI
1,6T MoE en 8× B200. Razonamiento de máxima potencia.
1.6T MoE8× B20032.768 contextoFP4Ver fichaentrada / salida · €/M
0,42 / 0,85 €
GLM 5.2 FP8★
Z.ai
754B FP8 en 8× B200. Generalista y coding con tool calling.
743B · 39B active MoE8× B200202.752 contextoFP8Ver fichaentrada / salida · €/M
1,00 / 3,00 €
DeepSeek V4 Flash
DeepSeek AI
1,6T MoE en 2× B200. Alto throughput y contexto de 524K.
1.6T MoE2× B200524.288 contextoFP8Ver fichaentrada / salida · €/M
0,11 / 0,22 €
Qwen3.6 27B
Alibaba Cloud
27B denso. Fuerte en coding y agentes, con tool calling.
27B denseMIG B20098.304 contextoFP8Ver fichaentrada / salida · €/M
0,10 / 0,30 €
Qwen3 14B
Alibaba Cloud
14B FP8. Razonamiento con presupuesto de pensamiento.
14BMIG B20032.768 contextoFP8Ver fichaentrada / salida · €/M
0,10 / 0,24 €
Qwen3.5 9B
Alibaba Cloud
9B ultraligero. Rápido y económico, con tool calling.
9BMIG B20065.536 contextoFP8Ver fichaentrada / salida · €/M
0,03 / 0,15 €
Gemma 4 E4B
Google DeepMind
MoE de 4B activos. Ligero, con razonamiento y herramientas.
4B active · MoEMIG B200131.072 contextoBF16Ver fichaentrada / salida · €/M
0,10 / 0,28 €
Gemma 4 E2B
Google DeepMind
MoE de 2B activos. El más pequeño y económico.
2B active · MoEMIG B200131.072 contextoBF16Ver fichaentrada / salida · €/M
0,05 / 0,24 €
GPU NVIDIA B200 · España (UE)
¿Listo para llamarlos?
Crea tu cuenta con 5 € gratis, apunta tu SDK a GPU Flow y empieza en minutos.