文本链路优先复核
媒体实测后置,核对四协议透传、new-api 计价、缓存推理与异常恢复
2026-09-21,用户将真实媒体接入验证后置,当前优先确保文本模型链路。已用当前 Core/Edge 源码重新构建并复测,已支持的纯文本范围通过本地回归与历史真实样本回放。本次没有新增收费请求、生产切流或恢复容量压测;不能把结果外推为全部文本模型和全部 new-api 功能已验收。
本次结果
| 检查 | 结果与证据范围 |
|---|---|
| Core / Edge 全仓 | race、vet、build、diff 及固定源码来源检查全部通过 |
| new-api 计价一致性 | 17 组相同用量/相同参数,与固定版本原始函数的 canonical usage 和 quota 一致 |
| 历史真实用量 | 7 份已观察用量 + 2 份非零推理用量,用新构建计算器回放,9 份 quota 均与原账单一致 |
| 独立进程链路 | Core、Edge 与恢复 Worker 共 51 项检查通过;25 次合成模型执行,正常链路日志查询 0 次 |
| 四协议 / 双客户 | Chat、Responses、Messages、Gemini 各普通/SSE,共 16 个客户场景;原文保持、客户费率和唯一扣款均通过 |
| 流式尾部 | 历史 Messages 缓存命中响应重建后与独立上游摘要一致:1239 字节,原始两片 usage 不变;不是新增供应调用 |
| 异常恢复 | 准入/发送许可/usage/settle 丢响应、断流、缺用量、Worker 崩溃与双进程竞争通过;恢复期间不重发模型 |
| 无法确认费用 | 超上界、缺 usage、断流保留预留并待核对;没有用零值凑账,也没有重复扣费 |
源码与检查记录在 coordination/text-priority-review。临时联合测试进程已停止,私有夹具已清理;现有本地验收入口保留。媒体接线草稿单独保存在 coordination/next13-media-integration/draft-core,没有进入本次文本运行源码;复核前 Core 的 211 个文件与 NEXT12-B 交接摘要完全一致。
当前允许的真实模型范围
下表来自现有 verified-text-v1.json 和此前真实有界调用证据;本次只重新核验代码和已有样本,没有重新检查当前在线供应可用性。
| 模型 | 协议与模式 | 已验限制 |
|---|---|---|
| claude-haiku-4-5 | Chat 普通/SSE | 文本,输出上限 16;转换后的缓存语义未开放 |
| claude-haiku-4-5 | Messages 普通/SSE | 输出上限 16,原生 5m 缓存创建/命中;1h 和过期行为未开放 |
| gpt-5.4-mini | Responses 普通/SSE | reasoning.effort=low,输出上限 1024;推理计入输出且不重复累加 |
| gemini-2.5-flash-lite | Gemini v1beta 普通/SSE | 输出上限 16,thinkingBudget=0,单候选 |
这些是当前有证据的验收配置,不是产品最终限制,也不是模型本身的上下文上限。uumi 继续负责供应商协议转换;Core/Edge 不重写其供应适配。未验模型/协议/缓存 TTL/推理档位通过显式能力策略提前拒绝,不能仅添加一个模型名就宣称精确计费已通过。
计费判断
已核对的流程仍是:客户请求 → Edge/Core 鉴权与冻结价格、预算预留 → uumi 执行 → Edge 保留原始完整 usage → Core 按 new-api 规则计算标准 quota → 按客户冻结费率换算积分 → 唯一扣款。
输入输出路径不会单独决定计费语义。缓存读写和推理明细进入对应协议归一化,再使用同一计算器;不能只提取输入/输出 token 而丢弃其他计费维度。相同输入和参数下标准 quota 一致,不意味着不同客户的最终积分账单应相同。
缺少最终证据或遇到尚不支持的维度时,当前行为是待核对并保留预留,不能保证每个断流请求都自动结清。该边界与已完成的正常收费、幂等恢复分别成立。
后续顺序
- 继续以文本为主线,按拟开放模型逐项扩展真实能力证据、价格快照和供应上限;目前没有启用未经验证的组合。
- 工具附加费、多模态、按次/表达式计费、更多推理档位与缓存 1h/过期另做明确切片,不自动继承本次通过结论。
- 真实媒体、生产商业规则、迁移与高档容量按后置事项保留。NEXT-13 未验收,也不转入创作产品真实供应阶段。