Gemma 4 26B A4B
gemma-4-26b-a4b · Google DeepMind
MoE multimodal, ~3.8B activos. Visión, razonamiento y herramientas.
Servido en GPU NVIDIA B200 · España (UE)
Fuente del modelo
Hugging Facegoogle/gemma-4-26B-A4B-itEspecificaciones
- Parámetros
- 26B · 3.8B active MoE
- Hardware
- MIG B200
- Contexto
- 32.768 tokens
- Cuantización
- NVFP4
- Modalidades
- texto
- Capacidades
- Razonamiento · Herramientas
Precio
entrada
0,12 €
salida
0,30 €
lectura de caché
0,012 €
€ / millón de tokens · IVA aparte
Ejemplo (curl)
Compatible con el SDK de OpenAI. Cambia la URL base y la API key.
curl https://api.gpuflow.ai/v1/chat/completions \
-H "Authorization: Bearer $GPUFLOW_API_KEY" \
-d '{ "model": "gemma-4-26b-a4b",
"messages": [{ "role": "user", "content": "Hola" }] }'Pruébalo con 5 € gratis
Crea tu cuenta, apunta tu SDK a GPU Flow y llama a este modelo en GPU NVIDIA B200, en España.