openai/<model> + 自定义 api_base)可以接入 siflow endpoint。
本文默认模型为 glm-5.2;完整模型列表和价格请查看 模型广场。
配置
在 API 密钥 页面创建 API Key,并将其导出为环境变量。请不要把 key 写入源码:SDK
SDK 调用时,在模型名前加openai/ 前缀,并设置 api_base:
Proxy
LiteLLM proxy server 也使用同样的路由方式,在config.yaml 中配置:
自定义 OpenAI-compatible endpoint 需要使用
openai/ 前缀。否则 LiteLLM 会尝试从裸模型 ID 推断 provider,并且不会路由到 api_base。
如果要使用 LiteLLM 的 function-calling 功能,请选择原生支持 tool calling 的模型。
验证
导出SIFLOW_API_KEY 后运行上面的 SDK 示例。如果返回正常回复,即表示连接成功:
model: glm-5.2 调用 http://localhost:4000/v1/chat/completions。
LiteLLM 内置的模型数据库没有列出模型 ID,因此可能提示未知 context size 或 price。可以显式传入 max_tokens,或通过 litellm.register_model({...}) 注册模型。这不会影响对话响应。