Skip to content

管理员配置与运维

本页只描述当前代码已提供的管理能力。菜单、公开页面和调用行为均可能受系统设置、部署配置、账号类型、渠道平台与版本限制;未启用时不要向用户承诺对应功能。

功能开关与公开范围

  • 「模型广场」「可用渠道」「渠道状态」「支付」等入口由各自功能开关控制;模型广场还可要求登录。
  • plugin_management_enabled 只控制管理员侧边栏是否显示「插件管理」,不会停止已加载或正在运行的插件。
  • channel_monitor_show_quota 默认关闭;只有显式开启后,普通用户才会看到渠道配额或余额。吞吐隐藏开关独立生效。
  • 用户可见的模型、分组与价格来自公开配置;实际调用范围始终以该用户的 API Key 请求 /v1/models 为准。

用户与认证

管理员可对单个用户启用「限制可访问的公开分组」。关闭时用户可使用全部公开分组;开启后只能使用勾选的公开分组,专属分组与订阅分组仍按各自绑定规则处理。用户并发值 0 表示不限制,不能填写负数。

邮箱注册和换绑会进行主域名、别名与并发冲突校验。SMTP 测试会沿用已保存的 TLS 模式;修改邮件配置后应分别验证连接测试和真实验证码投递。OAuth 注册的优惠码会保留到待处理注册完成,但管理员仍应核对优惠码有效期和适用范围。

账号、配额与重置卡

OpenAI OAuth 账号可选择自动使用重置卡,默认关闭。5 小时与 7 天窗口分别配置 0.1%100% 的阈值,任一窗口达到自身阈值时使用最早到期的可用卡;没有可用卡或重置失败时账号保持暂停。该能力不适用于 Spark 影子账号,运行状态由后端维护,不应通过旧的账号编辑数据覆盖。

智谱团队版 GLM Coding Plan 可在账号配置中填写组织 ID 与项目 ID,让配额查询使用团队版端点;个人版留空。账号批量编辑会显式保存 Codex 指纹收敛开关,关闭后不应因省略字段而被旧值重新启用。

渠道、模型与计价

渠道分时计价可设置 IANA 时区、不重叠时段,并选择每日或仅周一至周五生效。模型广场的分时行不包含另行显示的高峰倍率;两者重叠时按页面说明叠加。长上下文阶梯必须明确是整单档位还是仅超出部分计价,并分别配置输入、输出、缓存写入与缓存读取口径。

OpenAI/Anthropic 服务层级倍率按请求值与实际上游响应共同结算,只允许按实际结果降档,不允许由未知或更高响应层级抬高费用。修改渠道模型映射、带后缀模型规则或官方价格数据后,应使用实际请求核对使用记录中的请求模型、上游模型、响应模型、服务层级与最终费用。

OAuth 出站插件

管理员入口为 /admin/plugins,初期仅支持 OpenAI OAuth 出站传输能力,API Key 请求不受影响。安装包扩展名为 .s2plugin,默认必须由可信发布者签名;安装后保持停用,确认当前网关版本兼容、运行时健康和配置测试通过,再按 1%100% 流量逐步启用。

插件安装、启用、停用与配置通常不需要重启宿主。停用后新的 OAuth 请求立即回到原有路径;卸载前必须先停用。生产环境保持 plugins.allow_unsigned: false,第三方发布者公钥通过 plugins.trusted_publishers 追加,不能用同名配置覆盖内置信任来源。

网关与部署检查

  • gateway.openai_ws.force_httpGATEWAY_OPENAI_WS_FORCE_HTTP=true 只强制 OpenAI Responses 使用 HTTP/SSE,不会关闭 HTTP/2;HTTP/2 由独立开关控制。
  • gateway.models_list_read_max_bytes 限制上游模型列表响应体,默认 8 MiB。调整前应先确认是上游响应过大,而不是代理错误页或循环响应。
  • Compose 更新后检查网关环境变量是否透传、容器是否保留资源约束与安全选项;不要把示例配置中的调试开关直接用于生产。
  • Caddy 或反向代理应让静态资源使用受控缓存,让 SSE/流式响应及时刷新,并避免对已经压缩或不适合压缩的响应重复压缩。

变更设置后至少验证:管理员页面保存与重新加载、受影响的公开设置、目标 API 路由、使用记录,以及渠道状态