
GLM-5.1-highspeed is coming, 400 tokens per second. Very expensive, but bring a new possibility.
A 400 /second variant of GLM-5.1 targets latency-sensitive workloads, trading higher cost for much faster generation, useful for engineers optimizing agent-loop speed.
Checking sign-in…
Loading comments…