DeepSeek V4 Flash
Rápido y con una memoria enorme: se lee un contrato entero sin perder el hilo.
Lee de una vez
≈ 1.100 páginas
524.288 tokens
Tamaño del cerebro
El mayor del catálogo
1.6T MoE, FP8
Dónde funciona
España (UE)
2× B200
Entiende
Texto, no imágenes
Chat, Razonamiento, Herramientas
En qué destaca
- Razonamiento. Piensa en varios pasos antes de responder, para problemas que no salen de una.
- Herramientas. Busca, consulta datos y llama a otros sistemas. Es la base de un agente.
- MoE. Mixture of Experts, «mezcla de expertos»: parte las tareas grandes y las reparte entre especialistas, encendiendo solo los que necesita. Rinde como un modelo enorme sin costar como uno.
- Contexto largo. Se lee documentos enormes de una sentada sin perder el hilo.
- Chat. Conversa, resume y redacta en lenguaje natural.
¿Solo necesitas chat sencillo, clasificar o traducir? Qwen3.5 9B lo hace por una fracción del precio, y cambiar de modelo es cambiar una palabra.
Precio
€ por millón de tokens, IVA incluido
Le envías (entrada)0,14 €
Te responde (salida)0,28 €
Releer lo repetido (caché)0,014 €
1.000 respuestas de chat~0,15 €
Analizar un contrato de 200 páginas~0,01 €
probar con 50 € gratisSin tarjeta. Dan para unas 324.675 respuestas.
Para tu equipo técnico
Compatible con el SDK de OpenAI: cambias la URL base y la clave, y listo.
curl https://api.gpuflow.ai/v1/chat/completions \
-H "Authorization: Bearer $GPUFLOW_API_KEY" \
-d '{ "model": "deepseek-v4-flash",
"messages": [{ "role": "user", "content": "Hola" }] }'