智谱发布GLM-5.1高速版API,输出速度达400tokens/s,刷新全球大模型API速度纪录。该模型打破“高性能=高延迟”或“高速=轻量”的传统认知,首次在国产大模型中实现旗舰级能力与极致低延迟的融合,用户无需在响应速度与模型质量间取舍。
Google
-
输入tokens/百万
输出tokens/百万
上下文长度