Zhipu AI has launched GLM-5.1-highspeed, a high-speed API variant of its GLM-5.1 large language model, delivering 400 to...

Zhipu AI has launched GLM-5.1-highspeed, a high-speed API variant of its GLM-5.1 large language model, delivering 400 tokens per second and reportedly setting a new global benchmark for inference speed among major LLM providers. The API targets enterprise applications requiring real-time text generation at scale. https://pandaily.com/zhipu-ai-glm-5.1-high-speed-api-400-tokens-s-may2026 #China #Tech #AI

Read Original

Related