台账第 027 条:环节评析首跑与推理型模型的额度坑

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
This commit is contained in:
zlt 2026-09-04 11:35:58 +08:00
parent 49e423e0de
commit 5e72282e8d
1 changed files with 13 additions and 0 deletions

View File

@ -207,3 +207,16 @@
- PMS 那边同改两处:跳过原因只写原因不写判决名;候选一只不剩时的说明不再把计数字典原样打印,改成只念不为零的那几项。 - PMS 那边同改两处:跳过原因只写原因不写判决名;候选一只不剩时的说明不再把计数字典原样打印,改成只念不为零的那几项。
- **一个此前没人发现的事实**:选股系统的计划接口是每次实时重算的,从来不读快照,实测耗时 24 秒;而 PMS 的取数超时是 10 秒。之前一直能过是因为容器热着。09-04 重建容器后立刻暴露,已把 PMS_PLAN_TIMEOUT 从 10 调到 60。这一条要记住容器重建之后第一次拉计划必然比平时慢。 - **一个此前没人发现的事实**:选股系统的计划接口是每次实时重算的,从来不读快照,实测耗时 24 秒;而 PMS 的取数超时是 10 秒。之前一直能过是因为容器热着。09-04 重建容器后立刻暴露,已把 PMS_PLAN_TIMEOUT 从 10 调到 60。这一条要记住容器重建之后第一次拉计划必然比平时慢。
- 复核日期下一个交易日09-07看候选数与提议数是否稳定在这个量级。 - 复核日期下一个交易日09-07看候选数与提议数是否稳定在这个量级。
## 027 · 2026-09-04 · 环节评析首跑五个;模型该用云端,且额度必须调大
- **模型这件事方向是反的**:这个任务本来就配的是云端。它取模型的写法是向路由器要"关系抽取"这个任务的升级档,那一档指向 https://api.deepseek.com 的 deepseek-v4-pro。判定依据是地址指向公网域名不是配置里的标签也不是模型名字像什么——内网那台机器上也挂着一个名字很像的本地量化副本光看名字会认错。
- 结论是**保持云端,不要改本地**。三条理由都有实测:本地那台机器在端点池里标的可用时段是盘后,盘中不进候选;本地默认队列积压 696 条,日志里有进程排了 25 分钟的队;评析的瓶颈是网络等待不是本地算力,放云端不占显卡。
- 一条千万别走的路:改配置把那个基地址指向本地。端点池是按档位名判定的,对这一档一律放行,改完之后评析会在不占槽位、不记账的情况下直接压显卡,池子一点都拦不住。
- **首跑五个环节,四个第一轮就失败**,一个只跑了两轮、自我校验是空的。原因查清了:这个模型是推理型的,它先在内部写一长串推理再写答案,而推理和答案共用同一个输出额度。实测十二次调用的推理长度是 3,647 到 25,535 个字符,而额度只有 8192推理还没写完就见底接口返回 finish=length答案要么是空的要么是半截 JSON。任务重试一次再烧一次额度然后放弃——钱花了一个结论都没落库。
- 修法是把额度从 8192 提到 32768单点探过接口接受自我校验那一轮从硬写的 2048 提到 8192。这不会让平时的调用变贵按实际生成的字数计费额度只是上限。反过来额度太小才真的浪费。
- 顺带把日志说清楚。原先只写"空响应",看不出是额度不够还是模型没话说,而这两种的处置完全不同。
- **修完重跑,五个环节全部落库、全部三轮跑通。** 采信倾向都是偏多;自我校验两个通过、两个未通过、一个是修改前留下的空值。校验确实在挑毛病——固态电解质那条被它抓出"证据只说了自生负极技术和新兴应用,没提固态电池,撑不起固态电解质受益这个推断"。
- 实测耗时:单个环节 235 到 366 秒,输入约 4,000 到 5,700 token材料 34 到 44 条。
- 一处此前没人知道的事实:**这个任务在今天之前一次都没跑过**。它被路由到一条独立队列,而消费这条队列的容器 09-04 才在配置里定义、从未创建。库里那三条单冒号开头的旧记录是 07-10 的旧格式,与这个任务无关。
- 复核日期:下次投递前先看一眼额度够不够,日志里出现 finish=length 就是又不够了。