全部模型
GLM 5.3 Flash
超值1,000,000 token 上下文
GLM-5.3-Flash 是 Z.ai 推出的原生多模态开放模型,采用 Mixture-of-Experts(MoE)架构,针对高效编程、长周期 AI 智能体任务和界面视觉测试进行了优化。其混合稀疏与线性注意力架构在降低计算开销的同时,保持了准确的长上下文表现
提供商
WellFlow Premium
提供商模型
glm-5.3-flash
价格
每 100 万 token
输入
Wellflow 价格: $0.04官方价格: $0.15
输出
官方价格: $0.50Wellflow 价格: $0.14
节省
72%
提示词缓存
请求中重复的部分(系统提示词、文档、对话历史)会存入缓存。再次读取时的费用低于常规输入。
- 缓存读取
- Wellflow 价格: $0.01
- 相对输入价格 -75%
- 缓存写入
- Wellflow 价格: $0.04
性能
通过 Wellflow 调用该模型的可用性和速度。
可用性
正常部分故障故障