> ## Documentation Index
> Fetch the complete documentation index at: https://docs.siflow.cn/llms.txt
> Use this file to discover all available pages before exploring further.

# 管理通用服务

> 在人工智能平台中查找、访问、更新、重启、上下线、分享和删除通用服务，并规划发布和回滚。

通用服务创建后，您可以在服务列表中查找服务，在详情页查看访问端点、负载详情、日志和监控，并按业务需要执行上线、下线、更新、重启、定时任务、分享或删除。

## 查找服务

1. 进入 **推理服务 > 通用服务**。
2. 选择 **区域**、**集群** 和 **项目组**。
3. 按服务名称、项目组或其他筛选条件查找服务。
4. 在 **个人服务** 或 **被分享服务** 页签中查看服务。

查找服务时，重点确认服务状态、访问端点、资源配置、目标副本、就绪副本和公开范围。服务未进入 **运行中** 时，优先查看负载详情、事件和日志。

## 验证服务访问

服务创建或更新完成后，可以在负载详情或 **Endpoints** 中查看访问路径。

| 访问方式   | 说明                               |
| ------ | -------------------------------- |
| 集群外部访问 | 通过平台提供的 URL 访问服务。                |
| 集群内部访问 | 在同一集群内通过服务域名访问，适合其他服务或 Pod 内部调用。 |
| 独立网关   | 通过单独配置的网关访问服务。                   |

验证访问时，按实际协议、端口、路径和鉴权方式发送最小请求。若服务开启鉴权，请在 **Endpoints** 中获取平台生成的 Token，并在请求 Header 中携带 `Authorization`；若开启 **Base URL**，请确认服务能够处理带前缀的请求路径。

服务多副本运行时，请求不会严格按轮询分配到每个副本，而是基于概率随机或连接级负载均衡实现整体流量均衡。排查单副本问题时，应结合实例日志和请求时间范围定位。

## 查看负载详情

在服务详情页进入负载详情，用于确认服务实例是否按预期运行。

| 查看目标      | 适合排查的问题                 | 操作建议                           |
| --------- | ----------------------- | ------------------------------ |
| 工作负载版本和副本 | 服务未就绪、目标副本与就绪副本不一致。     | 先确认版本和副本变化，再判断是否需要继续等待、扩容或回滚。  |
| 实例日志      | 应用启动失败、端口未监听、依赖缺失或请求报错。 | 先看异常实例实时日志；实例重启后，查看上一次运行日志。    |
| 监控指标      | CPU、GPU、内存、网络或业务指标异常。   | 对比请求时间范围和资源曲线，判断瓶颈在服务资源还是应用逻辑。 |

## 管理服务

在 **推理服务 > 通用服务** 中找到目标服务后，可以按需执行以下操作。

| 操作       | 用途                                | 操作前关注                                        |
| -------- | --------------------------------- | -------------------------------------------- |
| **上线**   | 启动已下线服务，使其开始提供访问。                 | 上线后等待服务进入 **运行中**，再验证端点。                     |
| **下线**   | 停止服务并释放运行资源。                      | 下线前迁移或停止业务流量。                                |
| **更新**   | 修改服务配置或发布新版本。                     | 修改镜像、命令、端口或探针后，需要重新验证最小请求。                   |
| **重启**   | 按滚动升级方式重新拉起服务实例，适合处理临时异常或让配置重新生效。 | 新实例因资源不足无法调度时，旧版本实例仍可继续提供服务，平台会在资源满足后继续完成重启。 |
| **定时任务** | 通过 Cron 表达式配置定时上线、定时下线或定时重启。      | 确认执行时间、资源可用性和业务影响；资源不足或调度异常时，定时任务可能延迟或失败。    |
| **分享**   | 将服务分享给其他用户。                       | 确认服务配置、访问端点和数据依赖是否适合共享。                      |
| **删除**   | 删除服务记录和相关资源。                      | 删除前确认没有调用方依赖，并保存必要配置或日志。                     |

## 发布和回滚建议

| 发布方式    | 适合场景                       | 关注点                         |
| ------- | -------------------------- | --------------------------- |
| 直接编辑并发布 | 测试环境，或影响可控的小改动。            | 观察实例更新和业务请求结果。              |
| 灰度发布    | 更换镜像、命令或关键运行配置，需要先用部分流量验证。 | 规划新旧版本容量、放量节奏和回滚窗口。         |
| 当前灰度回滚  | 灰度过程中发现新版本异常。              | 确认旧版本容量可承接流量。               |
| 历史版本回滚  | 恢复曾正式生效的配置版本。              | 回滚恢复版本配置，不恢复数据库或 Volume 数据。 |

有状态应用需要评估多副本、新旧版本并行运行和数据结构兼容性。涉及数据库迁移、外部依赖变更或 Volume 数据写入时，应单独规划数据恢复方案。

## 相关文档

* [使用灰度发布更新推理服务](./release-inference-services-with-canary)
* [推理服务高级运维](./advanced-inference-service-operations)
