读出一个数字还不够。我们还要知道它在哪个字段、是不是完整读数,以及识别程序有没有把旁边图标当成字。文字组保留实际画面,读不清时明确留空。

本页先解释文字是怎样进入字段的,再看哪些地方仍为空。完整数字、字段归属和面板是否可读分开验收;不要把重复OCR一致当成正确保证。

这里的 OCR 是文字识别。下文 PP 指 PP-OCRv6 medium,VL 指 PaddleOCR-VL-1.6;它们是两种本地模型。最新数量牌比较另见 P912,不与书页、属性的成绩合并。

1. 先看一个例子

例如法术名称旁有三个角标,整屏识别漏掉了其中一些小字。现在只对没读出的角标截取原图区域,让已有的两个本地文字识别模型再读一次;已经接受的原读数不改,前后矛盾则保留未知。

六张同源书页的名称—角标正确配对从 102/126 提高到 122/126,另有 4 项未读出,没有接受错字。其他五段录像的八张旧图中,角标内容和位置从 211/257 提高到 257/257;这一组没有名称参考,不能算名称配对准确率。两组都用过,不是独立测试,也尚未成为默认视频读法。

打开逐图审阅页,切换数据组、点击名称,就能查看原图、裁图框和补读原文。详细方法见面板定位文章。

现在也可以从原录像直接运行这一步。在一个 12 秒的开发片段中,程序选出 7 张图,其中一张进入法术书补读。它保留了原来读出的 15 个角标,又补出 5 个,另有 1 个仍读不清。但名称只接受了 5 个候选,还有两格名称未知——数字读到了,不等于名称与数字已经配齐。这轮没有新增人工参考,不能据此计算准确率。

查看这 7 张原视频结果,第三张是书页;在“显示内容”选择“魔法书 · 仅本地候选”,即可查看名称、角标与补读来源。它是明确开启的可选读法,旧输出和默认读法不变。

2. 当前做到哪一步

文字读取分三层检查:字是否读对,是否放进正确字段,以及最终结果是否真的输出了这个字段。 三层不能互相代替。

内容 目前最有代表性的检查 仍缺什么
时钟与英雄数值 已知首帧的战斗计时由 12/20 补到 20/20 这是入口修复;不能代替完整英雄面板验收
生物标题与属性 同 15 张图由 99/165 到 165/165 相符 不包含能力说明、魔法图标身份和剩余时间
法术名称与角标 两张旧书页由 35/48 到 43/48 相符 一个名称仍冲突;读到数字不等于配对完成
脚下数量 另 30 张图中,VL 四倍读法读对 200/202 个可读参考 仍错读,并给假框、不可读位置出数;默认未换
状态说明 能保存标题、正文及可见的小数字 小数字尚不能自动解释为剩余回合

以上是不同批次的结果,参考仍需审阅,不能相加成全屏精度。重复的书顶资源已退出独立优化,由英雄面板负责;法术名称、消耗等非重复内容继续保留。

展开逐次修复记录与原图证据(不同批次分别计分)

新录像抽检提醒我们,读字和最终输出要分别检查。三段录像的六张首帧中,21 个计时原文全部读对;其中 20 个属于战斗计时,最终只输出了 12 个。另外 8 个不是 OCR 读错,而是所在画面被上游判成未知,后续模块跳过了它们。逐图对照页把这两层结果放在一起。参考由助手填写,待审阅。

候选中被拒绝的书页也检查了:它只有五个法术、占两行,旧检查要求至少六个名称、覆盖三行,因而整页没送去读字。现在逐格核对名称位置和三个圆环,只让有支持的格子读取;变暗不再单独否决清楚的角标。五个名称、十五个角标与原图参考相符,其中四个角标由本地模型补读,九个空槽没有冒出数字。

当时,黑洞图标中央的“5”和书页上方的“163/270”没有进入结果,所以旧版逐项对照记为 20/22。后来两项均已补接,实际时间线保留原文和位置。现在收窄任务:书页顶部资源与英雄面板重复,不再为它另做标注、算法或独立验收。资源统一由英雄面板负责;每个法术的名称、消耗和其他非重复字段仍要读。 旧成绩保留,不倒改分母。

计时的修复现在已经接入可选录像流程:复用已经读到的字,只检查左右角落的四个计时结构,不要求先确认整个战场。在全部 29 张旧图中,原来 14 张 HUD 结果不变,另 8 张补出计时,7 张选秀图仍拒识。六张首帧里的战斗计时由 12/20 恢复到 20/20。原图与首次结果继续保留。这是已知失败的回归,参考待审,不是新视频精度;默认流程没有切换。

另一个 6 秒原视频片段从头跑出了 4 张图,三张只读计时,一张正常读取 HUD。打开实际时间线,在“显示内容”选择“英雄数字与时钟”,即可切帧查看。页面直接写着“英雄数值未读取”:读出四个时钟,并不代表整张图完成了。下一步回到法术书和完整属性的缺口,不再只围绕这几个时钟调参数。

生物属性的下一处改善来自入口,而不是换识字模型。15 张面板共 165 个标题和属性字段,原局部候选有 99 项相符,其余 66 项全来自 6 张被跳过的图。现在只凭当前图里的标题、数量和生命等局部结构,也能把这些面板送去读字;同一批图的 165 项都与参考相符,包括负数、零和生命分数。逐张看原图、旧读数与新候选。

这不等于完整面板完成:能力说明、魔法图标与时长不在这 165 项里,参考仍待 CTO 审阅。后来又补了背景检查:一张已知半透明图改为等待,15 张清楚面板仍能进入;没有重新计算这 165 项识字成绩。查看背景反例和保留对照。

状态行现在也能跟着局部面板进入读取。两张圣骑兵面板的新结果各找到一个图标,原尺寸和四倍 OCR 都读到下方的“2”;数字连到同帧图标和面板,但不自动填成“剩余2回合”。这一步新增了局部识字,以下复用15个旧读数的记录只描述此前属性步骤。

状态悬浮说明也接通了局部入口:53张旧候选的回放有15张读到标题和整段正文,网站同时显示原尺寸、四倍读法及同帧图标位置候选。7张清楚参考的14项相符,不过旧读法只差了三个逗号的中英文形式,不能说汉字或数字精度提高了。另有2张半透明提示仍通过,属于要修的选帧质量问题;图标身份和剩余回合仍未知。P68方法说明解释这一步。

6秒片段的5张图也已重新接线,两张未知场景单独读面板,第四张的伤害仍冲突。它复用原图和15个已有局部识字记录;续跑没有重写33个证据文件,只有运行进度索引会刷新。没有新增OCR或截图,不能把这种缓存续跑当作新视频扫描速度。

两张书页还暴露了另一类问题:字已经读到了,组合结果时却被丢掉。“暗影披风”被完整截图读对,但另一块从名称末尾开始的图片只能读到“风”。程序以前把它们当成两个相互矛盾的完整名称。现在先检查每块图片是否覆盖整个名称,再比较完整读法;不完整的切块仍保留,但不能否决完整名称。

另外两格漏掉,不是字太小,而是旧定位器要求同一行有两个名称,或者要求文字能匹配已知法术名。现在只在已经确认的同侧书页寻找:文字位置与三个角标圆框都相符,就补读这格。这里读的是画面,不依靠法术目录猜内容。

同两张图从 35/48 提高到 43/48 项相符;名称 10/11,角标 33/33,数字与正确名称同时配对 30/33。打开两张原图与新旧结果,还能展开查看每次完整识别的原文。这次复用了已有 OCR,没有重新扫描,也没有新增截图。

剩下的名称是真冲突:“召唤原始残骸”的整图识别漏掉首字,与局部完整读法不一致。因此这格数字虽然读出,名称仍显示未知。两图来自同一录像、已用于修复,参考待 CTO 审阅;51 个空角标没有多报。这不是独立准确率,默认算法没有切换。

资源和中央数字则是另一种情况:OCR 已经读到了,但旧结果只收名称和三个角标,把它们漏在外面。 现在沿用每格的读取检查,再比较完整覆盖该区域的扫描结果;完整切块漏字、有冲突或字跨出范围,仍然留空。

历史六项的三图对照显示:三个重复资源读数,以及中央的 2、4、5,内容和位置全部相符。资源部分不再作为后续独立验收目标。13 个有图案但没有中央数字的位置、26 个空槽没有多报。中央字只按原文保存,不解释为冷却回合,没读到也不表示零。

这次没有新增 OCR 调用、截图、模型或环境。三图的已有结果读取和组合约 1.9 秒,不包含此前识字耗时,不能当作完整扫描速度。可选视频读法和网站已经接线,在原有六帧区间上复用局部记录,续跑不重写已有证据。三图来自两个录像,均已用于开发,参考待 CTO 审阅;这个结果只说明六处缺口补通了,不说明所有书页或整张画面都完成。

补查 22 张暂停、断线和桌面画面后,发现原局部规则还会接受其中 6 张:角落的字确实清楚,但中间已经有阻断窗口。补上场景文字识别后,6 张都拒识;原有计时回归结果不变。逐图检查反例。这不是 OCR 精度提高,而是更清楚地规定“什么时候不该读”。四张断线来自同一录像,特定桌面规则也不代表能识别所有软件。

展开工程任务、各轮测量与接线明细

最后核对:2026-09-24 · 交付进度,不是完成证明

代码、历史报告与接线盘点;跨来源整帧验收未完成。统一环境的真实模型兼容检查见 p140,不计作准确率验收。

整帧准确率
未测
统一环境 p50 / p95 耗时
未测
独立录像 / 已审字段
未汇总

p50 是一半运行能达到的耗时,p95 是 95% 运行能达到的耗时。尚未在统一环境测量,不能用某个局部模型的速度替代。

p61 · 共用 OCR

已集成待验收

已采用 OCR 可在统一环境运行,遗留活动入口默认改用当前环境的独立进程;局部补读与整帧质量仍需验收。

p62 · 小数字、罗马数字与无穷符号

原型 / 待接入

新三录像30图213自动裁图五读法完成;202可读数中PP原尺寸184对5错13拒识,VL原尺寸199对3错、四倍200对2错。VL另在1/5假框与5/6不可读参考出数字,默认不换;助手待CTO、来源隔离未闭合,非独立验收。旧10图83区域成绩另列。

p63 · 英雄数字与计时

已集成待验收

局部计时已接入可选视频流程和网站;29 张真实回归中另 8 张补出计时,六张首帧 20/20;22 张阻断图全拒识。新 6 秒/4 图完整运行及续跑通过。仅局部计时,不代表完整英雄 HUD 或独立精度;默认未切换。

p64 · 生物属性

已集成待验收

可选局部入口增加背景补查;已知半透明图改为等待,15张参考面板保留。5帧原视频结果用同一原图/OCR重接网站。先前99/165→165/165是历史开发结果;默认未切换,参考待审,非独立精度。

p65 · 法术书

已集成待验收

可选 v4 已补出三张开发图的中央字,39 个无中央字位置未多报;既有6帧流程和网站已接线,名称真冲突仍保留。CTO明确:书页顶部163/270等重复资源不再单独优化或作为验收必需项,英雄面板负责该读数。旧资源测量保留为历史;参考待审,非独立精度,默认未切换。

p66 · 日志原文

已集成待验收

字面解析已接入;不把陈述时间当当前剩余回合。

p67 · 悬浮说明与伤害预览

已集成待验收

双行数字候选已接入;目标、含义、完整文字仍有限。

p68 · 状态剩余时间

已集成待验收

局部生物面板的角标和悬浮文字均接入可选视频步骤。53张旧图里15张读到标题/正文并保存同帧槽位候选;7张清楚参考14字段相符,但旧差异只是逗号,不代表内容精度提高。另2张半透明仍被接受,属于质量缺口;效果身份与剩余回合未确认。

已有测量能说明什么

30图自动数量框的VL四倍读数相符:200/202 字段。 固定开发预选检测器213框;IoU0.3:200对2错0拒识0漏牌,另1/5假框与5/6不可读参考出数字;严格IoU0.5为192对2错8漏牌。PP原184对5错13拒,PP四倍122对,VL原199对。PP三变体21.424秒、VL两变体69.142秒含启动读图、不含检测解码。助手待CTO、本批已曝光/来源隔离未闭合,未默认采用,非整帧验收。

新录像四战斗首帧英雄数字与时钟相符:48/48 字段。 四张选中首帧、两录像;每侧3属性、1资源对、2时钟,助手待CTO;非完整UI或独立精度,未含选秀HUD。

本地VL原尺寸数量读数相符:54/56 字段。 三段已曝光录像7图完整数量牌参考;自动框未改,1错1漏牌,另2不可读,3假框均未吐数字。原PP43对1错11拒识1漏牌;双VL+PP融合42对未采用。旧3图单列,参考待CTO,默认不变,非独立验收。

局部提示标题与整段正文相符:14/14 字段。 单录像三个旧片段共53帧;仅7张清楚参考计分,原尺寸和4倍各14/14,旧11/14的差异全是中英文逗号,不是内容精度改善。2半透明正例另列为质量失败;参考待CTO、非独立,关系未计准确率。

补出的书页资源与中央字内容及位置相符:6/6 字段。 两个录像的三张已曝光开发图;资源3项、中央字3项。13有图案无字与26空槽均未多报;未知不作零或无冷却。参考待CTO审阅、未批准训练;不与旧成绩拼成整帧精度。

完整切块与漏槽修复后内容及位置相符:43/48 字段。 同两张已曝光书页;名称10/11、角标33/33、名称与角标配对30/33;一名称真冲突,资源与中央字4项未接通。51空角标无输出,26旧图槽许可不变;参考待审,非独立精度。

新局部入口的标题与属性内容及位置相符:165/165 字段。 同一批 7 个录像标识、15 张开发图;参考待 CTO 审阅,未批准训练;不含全部能力、状态图标或说明。当时1半透明反例误放行,后续P44已局部修复;这是先前开发回归,不能充当视频流程的独立精度。

局部候选的标题与属性内容及位置相符:99/165 字段。 7 个录像标识、15 张开发图;9 张放行各 11 项相符,6 张跳过共缺 66 项。参考待 CTO 审阅,未批准训练;不含全部能力、状态图标或说明;非默认生产与独立精度。

另一个来源两张稀疏书页内容及位置相符:35/48 字段。 两图同源且已用于开发;名称 8/11,角标 27/33,名称与角标同时配对 24/33;资源与中央数字也计分。51 个空角标无输出;参考待 CTO 审阅,非独立精度。

稀疏书页名称及可见数字内容与位置相符:20/22 字段。 一张已曝光开发图:5 名称及15角标相符;中央数字与书页资源未接通;27个空角标位置无输出。助手参考待 CTO 审阅,不是整页或独立准确率。

可选视频分支首帧战斗计时正确:20/20 字段。 已曝光六张首帧中的五张战斗图;助手参考待审,不是独立验收;另 22 张开发阻断图在实际 worker 全部拒识。

局部计时旧图抽查内容及位置正确:32/32 字段。 从候选中按来源取八张旧图;非盲抽查,助手参考待 CTO 审阅;另十三张不适用图全部拒识,未覆盖真实暂停和断线。

首次抽检战斗计时结构化正确:12/20 字段。 五张战斗首帧(含布阵);八个缺失均为场景跳过;参考由助手对照原图填写,待 CTO 审阅。

名称—角标正确配对:122/126 字段。 6 张同源同书页开发图;助手参考待用户审核;未默认接入。

旧图角标内容及位置正确:257/257 字段。 5 段录像、8 张已用于实验的旧图;名称未标注,79 个空或遮挡位置无输出;不是独立测试。

下一步:局部状态标题、正文与同帧槽位候选已接网站;补半透明反例、明确图标关系标签和回合含义证据。优先复用完整整屏读数,避免仅为逗号差异重复OCR;继续独立整帧验收。按CTO反馈,不再为书页顶部重复资源新增标注、算法或独立验收;保留英雄面板读数任务,法术名称、逐法术消耗和其他非重复字段仍在范围内。

返回 p00 总报告 · 全部阅读目录

3. 接下来怎么推进

先用同一批新录像整帧检查:哪些字段没送去读,哪些送去了却读错,哪些读对了又在组合时丢失。优先检查状态说明、法术名称配对和脚下小数字;保留空值与冲突,不靠重复识别一致来宣布正确。

读完这一组,可以回到 p00 总报告,再决定要深入哪个问题。 更多历史方法仍可在 阅读目录 查阅。