Skip to main content
模型上线DeepSeek
上线 DeepSeek-V4-Flash-0731 版本

【模型上线】DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 面向通用对话、代码辅助和复杂任务处理场景,适合需要兼顾响应速度与推理效果的应用。
模型上线GLM
上线 GLM-5.2 PD 分离版本

【模型上线】GLM-5.2 PD 分离版本

GLM-5.2 PD 分离版本采用 Prefill / Decode 分离部署方式,适合长上下文、高吞吐或对推理服务稳定性有更高要求的调用场景。