Gemma 4 26B A4B
Entiende texto e imágenes a la vez sin ser un modelo pesado.
Lee de una vez
≈ 70 páginas
32.768 tokens
Tamaño del cerebro
Mediano
26B MoE, 3.8B active, NVFP4
Dónde funciona
España (UE)
MIG B200
Entiende
Texto, no imágenes
Razonamiento, Herramientas
En qué destaca
- Razonamiento. Piensa en varios pasos antes de responder, para problemas que no salen de una.
- Herramientas. Busca, consulta datos y llama a otros sistemas. Es la base de un agente.
- MoE. Mixture of Experts, «mezcla de expertos»: parte las tareas grandes y las reparte entre especialistas, encendiendo solo los que necesita. Rinde como un modelo enorme sin costar como uno.
¿Solo necesitas chat sencillo, clasificar o traducir? Qwen3.5 9B lo hace por una fracción del precio, y cambiar de modelo es cambiar una palabra.
Precio
€ por millón de tokens, IVA incluido
Le envías (entrada)0,12 €
Te responde (salida)0,30 €
Releer lo repetido (caché)0,012 €
1.000 respuestas de chat~0,15 €
Analizar un contrato de 200 páginas~0,01 €
probar con 50 € gratisSe activa con tu tarjeta. Dan para unas 333.333 respuestas.
Para tu equipo técnico
Compatible con el SDK de OpenAI: cambias la URL base y la clave, y listo.
curl https://api.gpuflow.ai/v1/chat/completions \
-H "Authorization: Bearer $GPUFLOW_API_KEY" \
-d '{ "model": "gemma-4-26b-a4b",
"messages": [{ "role": "user", "content": "Hola" }] }'