atrás

Gemma 4 E2B

gemma-4-e2b · Google DeepMind

MoE de 2B activos. El más pequeño y económico.

Servido en GPU NVIDIA B200 · España (UE)

Fuente del modelo

Hugging Facegoogle/gemma-4-E2B-it

Especificaciones

Parámetros
2B active · MoE
Hardware
MIG B200
Contexto
131.072 tokens
Cuantización
BF16
Modalidades
texto
Capacidades
chat · reasoning · tools

Precio

entrada

0,05

salida

0,24

€ / millón de tokens · IVA aparte

Ejemplo (curl)

Compatible con el SDK de OpenAI. Cambia la URL base y la API key.

curl https://api.gpuflow.ai/v1/chat/completions \
  -H "Authorization: Bearer $GPUFLOW_API_KEY" \
  -d '{ "model": "gemma-4-e2b",
        "messages": [{ "role": "user", "content": "Hola" }] }'

Pruébalo con 5 € gratis

Crea tu cuenta, apunta tu SDK a GPU Flow y llama a este modelo en GPU NVIDIA B200, en España.