共 {{ upstreams.length }} 个上游
共 {{ efforts.length }} 条配置。模型名支持通配符
*;"推荐值"用于客户端未传思考等级时自动补上,"强制值"用于强制覆盖客户端传的等级。
| 模型 |
推荐值 |
强制值 |
操作 |
| {{ e.model }} |
{{ e.recommended || '-' }} |
{{ e.forced || '-' }} |
|
共 {{ logTotal }} 条(每 10 秒刷新)
|
{{ col.label }}
|
|
{{ (l.ts||'').substring(0,19) }}
{{ truncKeyName(l.api_key||'') }}
{{ l.upstream }}
{{ l.user_agent.length > 28 ? l.user_agent.substring(0, 26) + '..' : l.user_agent }}
{{ l.client_addr || '-' }}
{{ l.model }}
{{ l.endpoint || '-' }}
{{ l.status }}
{{ l.duration_ms }}
{{ l.prompt_tokens }}
{{ l.completion_tokens }}
{{ l.tokens }}
{{ cacheRate(l) }}
{{ fmtMoney(l.cost) }}
|
{{ logPage }} / {{ logTotalPage }}
{{ metricsRangeLabel }}
{{ summary.total_requests || 0 }}
总请求数
{{ summary.success_rate ? fmtNum(summary.success_rate*100, 1)+'%'
: '-' }}
请求成功率
{{ fmtTokens(summary.total_tokens) }}
总 Tokens
{{ summary.avg_latency_ms ? fmtNum(summary.avg_latency_ms, 0) :
'0' }}
平均延迟(ms)
{{ fmtMoney2(costStats.total_cost) }}
总费用(元)
按天 Token 用量趋势({{ metricsRangeLabel }},共 {{ dailyStats.length
}} 天)
折线:每日 Token 总用量,悬停数据点可看具体值
按天费用趋势({{ metricsRangeLabel }},共 {{ (costStats.by_day ||
[]).length }} 天)
每上游 {{ metricsRangeLabel }}统计
| 上游 |
状态 |
探测健康度 |
请求数 |
成功 |
失败 |
请求成功率 |
延迟(ms) |
Tokens |
费用(元) |
| {{ s.name }} |
{{
s.state==='healthy'?'正常':s.state==='degraded'?'降级':'不可用'
}}
|
{{ (s.probe_success || s.probe_fail) ?
fmtNum(s.health_rate*100, 1)+'%' : '-' }}
|
{{ s.requests }} |
{{ s.successes }} |
{{ s.failures }} |
{{ s.requests > 0 ? fmtNum(s.successes/s.requests*100, 1)+'%' :
'-' }}
|
{{ s.avg_latency_ms ? fmtNum(s.avg_latency_ms, 0) : '-' }}
|
{{ fmtTokens(s.total_tokens) }}
|
{{ fmtMoney(costByUpstream(s.name)) }} |
每 API Key {{ metricsRangeLabel }}统计(区分各 AI 程序/客户端用量)
| API Key 名称 |
请求数 |
成功 |
失败 |
请求成功率 |
延迟(ms) |
Tokens |
费用(元) |
|
{{ s.name }}{{ expandedAPIKey === s.name ? ' ▼' : ' ▶' }}
|
{{ s.requests }} |
{{ s.successes }} |
{{ s.requests - s.successes }} |
{{ s.requests > 0 ? fmtNum(s.successes/s.requests*100, 1)+'%'
: '-' }}
|
{{ s.avg_latency_ms ? fmtNum(s.avg_latency_ms, 0) : '-' }}
|
{{ fmtTokens(s.total_tokens) }}
|
{{ fmtMoney(costByAPIKey(s.name)) }} |
|
加载中…
该 API Key 暂无模型使用记录
|
按「上游真实模型名」定价,单位:元 / 百万
token;未单独定价的模型使用默认价(*)
| 模型名 |
输入(未命中) |
输入(缓存命中) |
输出 |
备注 |
更新时间 |
操作 |
|
默认价(所有未定价模型){{ p.model }}
|
{{ p.price_input }} |
{{ p.price_cache }} |
{{ p.price_out }} |
{{ p.note || '-' }} |
{{ (p.updated_at||'').substring(0,19) }} |
|
共 {{ apiKeys.length }} 个下游 API Key
| ID |
名称 |
状态 |
创建时间 |
操作 |
| {{ k.id }} |
{{ k.name || '-' }} |
{{ k.enabled ? '启用' : '禁用' }}
|
{{ (k.created_at||'').substring(0,19) }} |
|
当前登录账号:{{ username || '-'
}}。定期修改密码可防止管理后台被未授权访问。
思考等级(最佳思考等级配置在"思考等级"页维护)
保存后自动热重载生效。已实测推荐:deepseek-v4-flash=high、商汤=low、mimo-v2.5=medium。
视频透传
默认关闭:视频流量大且多数模型不支持,需显式开启。关闭时含
video_url 的请求直接返回 400。
developer 角色兼容
默认开启:部分客户端(pi agent、Hermes、Claude Code 等)会发
developer 角色,但商汤/基元律动等上游只认
system/user/assistant/tool,收到 developer 直接 400。
thinking 模式 reasoning_content 回传
默认开启:DeepSeek V4 等 thinking 模式多轮 Tool-Calling 要求
assistant 消息的 reasoning_content 原样回传,客户端(pi/Claude
Code/Hermes 等)规范化丢掉后上游会 400,网关自动补回。关闭时 body
原样透传。
系统配置
| 配置项 |
当前值 |
操作 |
| {{ c.key }} |
{{ c.value }} |
-
|
可编辑项:上游请求超时(秒)、故障冷却(分)、后台探测间隔(分)、最大重试次数、触发重试的
HTTP 状态码(逗号分隔)、重试关键词(逗号分隔)。保存后自动热重载生效。
渠道优惠时段
共 {{ discounts.length }}
条优惠规则(用于记录各渠道夜间/特定模型的折扣时段)
| 上游 |
适用模型 |
时段 |
折扣 |
备注 |
操作 |
| {{ d.upstream }} |
{{ d.model_pattern === '*' ? '全部模型' : d.model_pattern }}
|
{{ d.start_time }} - {{ d.end_time }} |
{{ d.discount < 1 ? fmtNum(d.discount*10, 1)+' 折' : '无折扣'
}}
|
{{ d.note || '-' }} |
|
数据库备份(每周自动备份,保留最近 10 个)
{{ backupLoading ? '加载中…' : (backups.length ? '共 ' +
backups.length + ' 个备份' : '暂无备份') }}
| 文件名 |
大小 |
备份时间 |
时间 |
操作 |
| {{ b.name }} |
{{ b.size > 1048576 ? fmtNum(b.size/1048576, 2) + ' MB' :
(b.size > 1024 ? fmtNum(b.size/1024, 1) + ' KB' : fmtNum(b.size,
0) + ' B') }}
|
{{ b.time || '-' }} |
{{ b.age || '-' }} |
|
备份为 gzip 压缩的 SQLite 快照,存放在数据库同目录 backups/
下。手动备份同样参与保留轮转,超出 10 个自动清理最旧的。