月宫玉兔 · AI 工作台

聊天管理

返回聊天 ↗
正在验证管理员身份…

模型服务

配置聊天端点、密钥与模型。保存后,新请求立即生效。

回复速度与自动排序

用同一段短提示实际生成回复,按首次可见文字耗时排序,取近期最多 3 次成功测试的中位数。失败或过期结果靠后展示。

每轮逐个测试已启用的模型,每次最多 512 输出 tokens、45 秒。测速会产生少量模型费用;等待用户生成结束后再开始下一项。

会员 API 节点

共享节点会显示提供者。所选模型每小时实际测试,失败下线、成功恢复;管理员可停用整个节点。

密钥仅保存在服务器私有数据库中,页面不会返回完整密钥。连接检查只请求模型列表,不发送付费对话。

模型配置

WS 使用 WSS Responses 端点。上下文上限需按此端点实际支持填写,初始 32768 为保守配置值,非已验证最大容量。输出预算会从总上下文中预留;接近输入预算上限时压缩,保留约 80% 最近原文与核心记忆,并计入用量。选择默认模型时需要同时启用。

模型连接检查