GLM 5.3 Flash
Mejor precio1.000.000 tokens de contexto
GLM-5.3-Flash es un modelo abierto nativamente multimodal de Z.ai con arquitectura Mixture-of-Experts (MoE), optimizado para programación eficiente, tareas de agentes de IA de largo horizonte y pruebas visuales de interfaces. Su arquitectura híbrida de atención dispersa y lineal mantiene un comportamiento preciso con contextos largos y reduce el costo de cómputo
Proveedor
WellFlow Premium
Modelo del proveedor
glm-5.3-flash
Precio
por 1 M de tokens
Entrada
precio de Wellflow: 0,04 $precio del proveedor: 0,15 $
Salida
precio del proveedor: 0,50 $precio de Wellflow: 0,14 $
Ahorro
72%
Caché de prompts
La parte repetida de la solicitud (prompt del sistema, documentos, historial de la conversación) se guarda en caché. Volver a leerla cuesta menos que la entrada normal.
- Lectura de caché
- precio de Wellflow: 0,01 $
- -75% respecto al precio de entrada
- Escritura en caché
- precio de Wellflow: 0,04 $
Rendimiento
Disponibilidad y velocidad del modelo a través de Wellflow.