Atender a tus clientes
Dudas de horarios, citas, tallas o pedidos, contestadas al momento también de madrugada.
Token Factory
Tus clientes preguntan y reciben respuesta al momento, a cualquier hora. Funciona en nuestras máquinas en España y solo pagas por lo que se usa.
Sin escribir código para probarlo: activas el saldo de bienvenida con tu tarjeta.
cómo funciona
Todo el recorrido dura menos de un segundo y no montas nada: nosotros ponemos las máquinas y los modelos.
Desde tu web, tienda o aplicación. De cara a tus clientes no cambia nada.
En un centro de datos español con los chips más potentes de NVIDIA. Tus datos no salen de la UE ni entrenan ninguna IA.
España, UEEscrita en tu tono, también de madrugada y en agosto. Cada respuesta cuesta una fracción de céntimo.
La conexión con tu web o app la hace una persona técnica en una tarde. Si no la tienes, te acompañamos nosotros.
para qué lo usa la gente
Con el coste real al lado, en tareas de tu día a día.
Dudas de horarios, citas, tallas o pedidos, contestadas al momento también de madrugada.
Le pasas la foto o el escaneo y te devuelve los datos ordenados: fechas, importes, quién factura.
Descripciones de producto, correos y publicaciones que suenan a tu marca, no a robot.
los cerebros disponibles
Todos listos para usar, cada uno bueno en algo distinto. Empiezas con el que te propongamos y lo cambias cuando quieras.
| modelo | entrada €/Mtok | salida €/Mtok | ficha | |
|---|---|---|---|---|
DeepSeek V4 Pro El más capaz del catálogo: razona problemas largos, escribe código y maneja tus herramientas. ChatRazonamientoCódigoHerramientas | ChatRazonamientoCódigoHerramientas | 1,00 € | 2,10 € | ficha |
GLM 5.3 NVFP4 Todoterreno para escribir y programar, con manejo de herramientas. ChatCódigoRazonamientoHerramientas | ChatCódigoRazonamientoHerramientas | 1,206 € | 3,789 € | ficha |
Qwen3.8 27B Fuerte programando y encadenando tareas por su cuenta. RazonamientoRespuesta en JSON | RazonamientoRespuesta en JSON | 0,10 € | 0,30 € | ficha |
Qwen3 14B Piensa antes de contestar y tú decides cuánto: equilibrio entre calidad y gasto. ChatRazonamientoHerramientas | ChatRazonamientoHerramientas | 0,20 € | 1,00 € | ficha |
Qwen3.5 9B Ligero y muy rápido, para tareas sencillas y mucho volumen. ChatRazonamientoHerramientas | ChatRazonamientoHerramientas | 0,10 € | 0,15 € | ficha |
ALIA 40B Instruct El modelo público español, entrenado en castellano, catalán, euskera y gallego. Chat | Chat | 0,20 € | 2,00 € | ficha |
Gemma 4 26B A4B Entiende texto e imágenes a la vez sin ser un modelo pesado. RazonamientoHerramientas | RazonamientoHerramientas | 0,12 € | 0,30 € | ficha |
Nemotron Nano 12B VL Lee documentos escaneados y fotos: facturas, contratos, formularios. VisiónOCR | VisiónOCR | 0,06 € | 0,24 € | ficha |
Qwen3-VL 32B OCR Lectura de documentos con maquetación difícil: tablas, columnas y texto a mano. VisiónOCR | VisiónOCR | 0,10 € | 0,35 € | ficha |
Nemotron 3.5 Lightning 30B Razona y usa herramientas gastando muy poco, pensado para responder deprisa. RazonamientoHerramientas | RazonamientoHerramientas | 0,12 € | 0,30 € | ficha |
Whisper large-v3 Convierte audio en texto: reuniones, llamadas, entrevistas y vídeos. Transcripción | Transcripción | 0,0015 €por minuto de audio | ficha | |
Qwen3-TTS CustomVoice Lee tus textos en voz alta con la voz que elijas. TTSClonación de voz | TTSClonación de voz | 19,00 €por millón de caracteres | ficha | |
Qwen3-TTS Base (clone) Convierte texto en voz: la opción más económica del catálogo. TTS | TTS | 5,00 €por millón de caracteres | ficha | |
Fish Speech S2 Pro Voz muy natural, capaz de imitar la de la muestra que le des. TTSClonación de voz | TTSClonación de voz | 8,00 €por millón de caracteres | ficha | |
Voxtral TTS Voces ya preparadas de Mistral para leer tus textos en alto. TTS | TTS | 6,00 €por millón de caracteres | ficha | |
ACE-Step Music Compone una canción completa a partir de una letra y un estilo. Texto a músicaVersionesRehacer partesSeparar pistasEditar la canción | Texto a músicaVersionesRehacer partesSeparar pistasEditar la canción | 0,50 €por canción | ficha | |
El precio es por millón de tokens: unas 750.000 palabras.
cuánto cuesta
Cargas saldo en euros y cada respuesta descuenta su parte. Sin cuotas mensuales, sin permanencia y sin sustos: si el saldo se acaba, simplemente se para.
hazte una idea
Te costaría1,43 €al mes
Un comercio con movimiento. Menos que un café al mes, atendiendo a cualquier hora. Calculado con Qwen3.5 9B, el modelo más económico del catálogo, suponiendo 500 tokens de entrada y 300 de salida por respuesta. Con un modelo más potente sube, y puedes cambiarlo cuando quieras.
Vídeos cortos grabados sobre el panel real: crear tu clave, hacer tu primera llamada y seguir tu consumo.
ver las guíasCompatible con las herramientas de OpenAI y Anthropic: se conecta cambiando una línea. Documentación completa en su página.
guía para desarrolladorespreguntas frecuentes
Y si la tuya no está, escríbenos: contesta una persona, no un robot.
No. Token Factory habla el protocolo de OpenAI (/v1/chat/completions) y el de Anthropic (/v1/messages). Apuntas el SDK que ya usas a https://api.gpuflow.ai, pegas tu key y el resto de tu código no se toca.
Los 16 del catálogo (DeepSeek, GLM, Qwen, Gemma, NVIDIA, OpenAI, Mistral, Fish Audio y ACE Studio), todos con la misma API key. Si necesitas otro modelo open source y entra en la GPU, lo desplegamos.
Consumes contra tu saldo prepago: pagas por tokens hasta donde tengas cargado, sin cuotas ni mínimos. Si necesitas volumen alto sostenido, escríbenos y ajustamos los límites de tu cuenta.
No. Tus prompts y respuestas se procesan para servir tu petición y no se usan para entrenar modelos. El detalle está en la política de privacidad.
En nuestro datacenter en España, sobre GPU NVIDIA B200 dedicada. Los datos no salen de Europa.
Publicamos la disponibilidad en la página de estado. Para un SLA contractual (cuentas enterprise), escríbenos y lo acordamos.
Creas la cuenta, añades tu tarjeta, escribes una pregunta en el panel y ves la respuesta. Sin escribir código.