Deepseek Flash
deepseek-v4-flash
El modelo más ágil de la familia DeepSeek, diseñado para respuestas en milisegundos sin perder calidad. Ideal para atención al cliente, asistentes en tiempo real y automatización inteligente. Flash Thinking: razonamiento ultrarrápido. Contexto ampliado: hasta 1M de tokens. Bajo costo por inferencia: máximo rendimiento, mínimo gasto. Lleva la inteligencia artificial instantánea a tu negocio. ¡Potencia tu flujo de trabajo con DeepSeek-V4-Flash!
De un vistazo
Capacidades
stream: true.
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Franjas horarias de precio
Dentro de estas franjas de alta demanda del proveedor el precio se multiplica (hora UTC). Fuera de ellas, precio base.
Razonamiento
Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.
Ejemplo
deepseek-v4-flash seleccionado para ver la respuesta — varía en cada turno.