feat: 添加持久化用量计费与管理面板

- 使用 SQLite 保存关联后的请求生命周期和用量记录
- 支持长上下文阶梯价格和可配置的 Fast 计费倍率
- 添加管理接口和可配置列的用量面板
- 保留失败、取消、重试和 compact 请求,便于计费核对
This commit is contained in:
2026-08-14 21:08:02 +08:00
parent 42be14c8d0
commit 6a461bf1f3
26 changed files with 2809 additions and 31 deletions
+2 -2
View File
@@ -271,7 +271,7 @@ Reasoning Token 用于后台明细,但若上游语义表明其已经包含在
### 5.3 Fast / priority 2.5×
Fast/priority 是金额倍率,不是另一种余额单位:
Fast/priority 是金额倍率,不是另一种余额单位。OpenAI/Codex 通过 `service_tier=priority` 表达,Anthropic 通过 `speed=fast` 表达
```text
Fast 最终金额 = 基础金额 × 2.5
@@ -286,7 +286,7 @@ effective_service_tier =
否则 standard
```
然后只应用一次倍率。倍率必须保存在账本价格快照中。
两种表达先归一化为一个 `fast_requested` 事实,然后只应用一次倍率。价格配置可以关闭 Fast 加价;关闭后请求仍使用 Fast,但金额不乘倍率。倍率和是否实际应用必须保存在账本价格快照中。
Fast 规则必须是版本化价格政策的一部分,不能依赖管理员每次手工补规则。实现时需要用当前 OpenAI 官方资料再次核对支持模型和倍率。
+2 -2
View File
@@ -221,7 +221,7 @@ Reasoning Token 若已经包含在输出中,不增加第五段价格。后台
## 6. Fast / priority 政策
Fast 是金额倍率,不是独立余额单位。GPT-5.6 Fast/priority 的当前产品政策保存为版本化 `5/2`,只应用一次。
Fast 是金额倍率,不是独立余额单位。GPT-5.6 Fast/priority 的当前产品政策保存为版本化 `5/2`,只应用一次。请求可能使用 OpenAI/Codex 的 `service_tier=priority`,也可能使用 Anthropic 的 `speed=fast`。采集层必须把两种输入和最终上游请求中的 Fast 状态归一化为一个 `fast_requested` 事实。
首先合并请求和响应事实:
@@ -232,7 +232,7 @@ effective_service_tier =
否则 standard
```
然后只对 `effective_service_tier=priority` 应用一次倍率。禁止同时配置:
`effective_service_tier=priority` 或请求 `speed=fast` 都表示 Fast。价格政策中的 `fast_pricing_enabled` 决定是否应用倍率,因此 Fast 请求可以按标准价格结算。禁止同时配置:
- `service_tier=priority × 2.5`;以及
- `response_service_tier=priority × 2.5`