Qwen3 14B
Piensa antes de contestar y tú decides cuánto: equilibrio entre calidad y gasto.
Lee de una vez
≈ 70 páginas
32.768 tokens
Tamaño del cerebro
Pequeño y rápido
14B, FP8
Dónde funciona
España (UE)
MIG B200
Entiende
Texto, no imágenes
Chat, Razonamiento, Herramientas
En qué destaca
- Razonamiento. Piensa en varios pasos antes de responder, para problemas que no salen de una.
- Herramientas. Busca, consulta datos y llama a otros sistemas. Es la base de un agente.
- Chat. Conversa, resume y redacta en lenguaje natural.
¿Solo necesitas chat sencillo, clasificar o traducir? Qwen3.5 9B lo hace por una fracción del precio, y cambiar de modelo es cambiar una palabra.
Precio
€ por millón de tokens, IVA incluido
Le envías (entrada)0,20 €
Te responde (salida)1,00 €
Releer lo repetido (caché)0,02 €
1.000 respuestas de chat~0,40 €
Analizar un contrato de 200 páginas~0,02 €
probar con 50 € gratisSin tarjeta. Dan para unas 125.000 respuestas.
Para tu equipo técnico
Compatible con el SDK de OpenAI: cambias la URL base y la clave, y listo.
curl https://api.gpuflow.ai/v1/chat/completions \
-H "Authorization: Bearer $GPUFLOW_API_KEY" \
-d '{ "model": "qwen-3-14b",
"messages": [{ "role": "user", "content": "Hola" }] }'