跳转至

部署安全

独立专题

部署安全保护模型 API、权重、算力和租户数据,重点是身份、授权、资源隔离与审计。

快速开始

所有入口启用 TLS 和鉴权;按主体实施最小权限;限制请求体、上下文、输出、并发和速率;隔离租户缓存与日志;对管理接口和模型文件采用更严格权限。

API 鉴权与权限控制

API Key 应具备过期、撤销和轮换能力,服务端只存不可逆摘要或交由密钥系统管理。授权需要区分模型、配额、组织和管理操作,不能把“已登录”等同于“可调用所有模型”。

模型窃取

攻击者可通过大量查询蒸馏模型行为,或直接获取权重文件。控制措施包括速率和预算限制、异常查询检测、权重加密存储、节点访问隔离和下载审计。输出水印不能单独防止模型窃取。

拒绝服务与资源滥用

拒绝服务 (Denial-of-Service, DoS) 与资源滥用可由超长 Prompt、超大输出、多并发连接和高成本采样参数触发。网关和推理层应共同设置长度、速率、并发、超时和总 Token 预算,并确保客户端断开后取消任务。

多租户隔离案例

Prefix Cache 若仅按 Token 前缀索引,可能让不同租户错误共享缓存。缓存键必须包含租户和模型版本等隔离维度,或对敏感业务禁用跨请求复用。日志、指标标签、批处理元数据和临时文件也要遵循同样边界。

日志与审计

审计日志记录主体、时间、模型版本、操作、资源量和结果,不默认保存完整 Prompt、输出或密钥。日志访问本身也应授权和留痕,并设置保留期限与删除流程。