研究不是每次都要换出一个新模型。它也要回答:一个听起来合理的办法,实际帮到了哪里,又制造了什么新错误。这里记录尚未采用、已撤回或只在可选路径运行的方法,不把它们算作默认生产能力。

本轮到此暂停。最有希望的是更好的数量牌定位和局部数字读取;最明确的限制是遮挡、假框和对象关系。 不能只把正确数字增加了多少写进结论,还要保留错读与拒识。

1. 一项改进,要同时看收益和代价

例如身体检测器把分数门槛降低,75张旧图里的漏检从31减到8;但多报从33猛增到178。这个办法确实找回了目标,却不适合直接采用。若用数量牌支持低分身体,则能更克制地补漏;但靠近牌的错位身体框仍会混进来。

每个试验都要说清:看哪批图、输入是什么、与谁比较、找到和漏掉多少、花了多久、有没有进入默认流程。换了数据分母,就不把两轮百分比当成同一条进步曲线。

2. 按问题查试过的方法

问题 做过什么,结果怎样 去哪里看方法和失败
没有游戏训练,能直接搜索图标吗 通用特征能提出身份建议,但裁框不稳、强制三个答案;七帧不足以给准确率 P901
只用干净图鉴训练够不够 训练身份和裁图质量,仍受真实画面外观和框的位置影响;各变体按原实验比较 P902
选择页可以直接学定位吗 小数据微调找到8张图的24目标、多报1;部分来源重叠,不代表战场可用 P903
身体检测器选哪个 YOLO候选较好,RT-DETR这一配方召回不足;只测位置,不是物种与数量联合成绩 P904
数量牌能减少身体漏检吗 75图基线漏31/多报33,新牌辅助漏20/多报34;相对旧血条只是找回3、丢1、多误1 P912 身体对照
把身体和脚下牌一起框进训练呢 当前辅助大框配方漏56/多报15,漏得更多;不是所有联合训练都失败 P912 同批比较
加训练数据一定提高定位吗 68图788牌补训后,旧4图37/40→36/40,另7图仍56/58;未采用 补训失败
直接放大整图或分块呢 固定旧权重,分块没补回真牌,合并反而多报;输入与训练尺寸可能不匹配 分辨率对照
训练时也加入局部图呢 55原图训练、17开发图选型;11张回归混合模型整图97/98、0多报,但新30图仍有漏与多报 匹配训练与推理
拥挤时如何配身体和牌 60旧图中双向领先法699条相符,原唯一法575;漏牌和身体争议仍在 三种配对
换OCR、放大小数字呢 新30图202可读数字,PP原尺寸184对,VL四倍200对;仍有2错,且假框也能出数字 最后一轮读字
半透明图能提前过滤吗 局部质量分类器未超过旧五帧;三帧多留短提示,也选进2张过渡,未采用 P20 / P914
网格能帮身体和牌吗 固定标定有结果;身体单独、加牌、加网格、三者联合的四路比较还没跑 P105 已有网格与P912 待做协议

P82 身体、P83 数量牌与P100 关系讲相应任务的主线。本表中的历史数字各有自己的来源与人工审核等级,不能合并为一个产品准确率。

3. 最新30张图,把两种“准确”分开了

三段录像各取十个预先固定窗口,选出30张图;其中9张没有数量牌,仍用于检查误检。参考在这轮模型输出之前制作:208块牌,202个可读数字,6个看不清。助手参考待CTO,完整对局和改名副本审计尚未闭合。

固定方法 找到 / 208 漏 多报 整张无漏无多报 / 30
旧模型 203 5 1 26
新整图模型 208 0 5 25
混合训练模型,整图使用 205 3 1 27

这是较宽松的位置门槛。严格检查后,找到数分别为187、198、201;偏框可以同时造成一次漏和一次多报,不一定是两个物体。新整图在开发集已预先选中,本轮没有看完结果再改选混合模型。全部定位结果可切换方法。

最后保持新整图的自动框,比较两种本地OCR。VL四倍在202个可读参考中读对200个,但它也把 185 读成 18、把 80 读成 30;还在一个假框及五个不可读参考上输出数字。“有数字”不是“可信数字”,更不是“已知属于哪支部队”。 数字审阅页保留五种读法,不按答案逐项挑赢家。

4. 研究什么时候才能转入默认流程

先让CTO审阅本轮参考与失败。恢复后,候选需要通过按完整来源隔离的验收,再检查实际视频入口、对象配对、未知项和端到端速度。已经反复看过的旧图用作回归,不能继续叫盲测。

联合数据也不是全部解决:60图第一版736牌中,3张身体参考有争议;后来补回两图漏标身体,另存59图723牌的研究参考,仍有1张存活/倒地争议隔离。原评分保留,修标签不算模型进步。标注修订过程说明原因。

已撤回的 P906 敌方推断视频保持草稿,不恢复制作;有用的可见UI训练候选保留,推断结果不当标注真值。大型历史产物的清理状态需要独立核对,不能因报告整理就声称磁盘已清空。

5. 代码和状态明细

实验目录保存协议、配置、紧凑参考与结果;可复用算法仍属于 Perception 包。下表是工程索引,首次阅读可以略过。

展开研究任务及各轮测量明细

最后核对:2026-09-24 · 未采用研究,不计生产能力

代码、历史报告与接线盘点;跨来源整帧验收未完成。统一环境的真实模型兼容检查见 p140,不计作准确率验收。

整帧准确率
未测
统一环境 p50 / p95 耗时
未测
独立录像 / 已审字段
未汇总

p50 是一半运行能达到的耗时,p95 是 95% 运行能达到的耗时。尚未在统一环境测量,不能用某个局部模型的速度替代。

p901 · 全屏图标检索

原型 / 待接入

历史研究,未采用为生产链路。

p902 · 图鉴特征检索

原型 / 待接入

历史研究,生产不依赖研究实现。

p903 · 通用检测与分割比较

原型 / 待接入

旧研究;其活动权重缓存需要先迁出再清理。

p904 · 战场检测器比较

原型 / 待接入

候选结果较好,但不等于已替换默认检测器。

p905 · 录屏等待剪辑

原型 / 待接入

历史应用,保留用户所需成片;暂停继续制作。

p906 · 撤回的敌方推断视频

原型 / 待接入

已撤回;回收的训练图片独立保留,不重启推断。

p907 · 单页法术书配对候选

原型 / 待接入

6 张同源开发图有结果;等待独立数据与默认链路验收。

p908 · 状态图标与时长候选

原型 / 待接入

分别验证图标、角标和悬浮,不用日志猜当前时长。

p909 · 对象关联候选

原型 / 待接入

同类不等于同一对象;仍需要更完整的关系参考。

p910 · 头像与行动侧候选

原型 / 待接入

头像和颜色证据还没有完整默认接入。

p911 · 未采用 OCR 后端比较

原型 / 待接入

历史比较留档,不把所有框架装进统一生产环境。

p912 · 身体与数量牌融合候选

原型 / 待接入

三段新来源30固定窗口208牌、202可读/6未知、9负例;旧/新整图/混合找到203/208/205,多报1/5/1。预选新整图213框再比五种读法:PP原184对5错13拒识,VL四倍200对2错,另假框出数字1。放大PP仅122对、双VL一致仍有185→18;默认不换。已曝光待CTO、来源隔离未闭合,身体/网格和独立整帧验收未完成。

p913 · 预览语义与目标关联候选

原型 / 待接入

当前仅部分数字候选接入;语义关联仍未交付。

p914 · 局部过渡质量候选

原型 / 待接入

三帧质量候选新录像72点,5次可读事件2→4,但两张半透明图被选中,未采用。旧132点3/7→7/7同时选3过渡1未知。参数固定、旧89C/T训练;研究到此收束,回到整帧覆盖,默认未改、待CTO。

已有测量能说明什么

新来源自动框:VL四倍数字相符:200/202 字段。 三源30图213自动框五读法,预选检测器不改、无参考框补裁;宽匹配200对2错,1/5假框出数字,5/6不可读参考出数字不计对错。严格定位192对2错8漏;PP原184对、四倍122对。无重训、未换默认,助手待CTO/非独立验收。

新来源30图冻结比较:混合整图:205/208 plates。 三源30固定窗口,9无牌负例;先标参考再推理。旧203命中5漏1多报26全对,新整图208/0/5/25,混合205/3/1/27;严格IoU0.5分别187/21/17、198/10/15、201/7/5。热调用19.8/18.8/18.7ms含视图/推理/去重,不含读图加载OCR。预选仍新整图;无默认更换,助手待CTO/来源暂定,非生产独立验收。

匹配局部训练:回归候选,未按此重选:97/98 plates。 55训练图617牌;17开发图212牌预先选新整图模型,11曝光回归95命中3漏1多报/7帧全对。混合模型整图回归97命中1漏0多报/10帧全对;严格IoU0.5为96/2/1和9帧全对。四块/并集仍97命中却多7/9框。开发选型与回归候选不同,默认不换;助手待CTO、同局审计/独立验收/数字和关系均未完成。

数量牌分块回归:未补回真牌:18/40 plates。 固定原12图权重,先2图开发选择旧整图1280;再旧4图四块18/22/2、另7图25/33/2(找到/漏/多报)。与旧整图合并仍37/40、56/58却多5、3假框;整图2560严重漏检。均曝光回归/助手待CTO,无独立验收,默认不换。

68图补训数量牌回归:未胜过旧模型:36/40 plates。 68训练图788牌/20录像,26轮436次实际更新。旧4图原始37/3/1→36/4/0;原有去重后37/3/0→36/4/0(找到/漏/多报)。另7图去重后两者56/2/0。数据与回归已曝光、助手待CTO,不是独立验收或OCR/关系成绩,默认和旧权重不换。

双向分差身体—牌配对诊断:699/736 plates。 60旧训练/开发图、736牌(734单一关系/2未知),真实检测717命中/1多报/19漏;唯一575相符2不符141拒绝,双向699相符2不符17拒绝。不符包含旧身体参考争议和框未达匹配门槛;3图训练隔离但仍计诊断。未运行数字OCR、身份或网格,不是独立准确率,默认不换,助手待CTO。

学习式数量牌支持旧身体候选:949/969 bodies。 75已曝光旧开发图2录像;IoU0.5,949对34多报20漏。身体基线938/33/31,旧血条947/33/22。相对旧血条找回3丢1多误1,无新训练;非数字、身份或关系准确率,默认未换,助手参考待CTO。

三帧候选新来源误放过渡:2/11 frames。 人工选3片段72点;2过渡均成为最终代表,可读事件2/5→4/5;不采用,非全片验收。89旧参考训练、无新点调参,待CTO。

新局部质量单独误放过渡帧:5/15 frames。 三录像七个3秒片段210帧:192清楚、15过渡、3不确定;旧稳定和组合0/15误放且拒35/192清楚。中心区域助手待CTO,不是整帧或独立验收。

跨录像固定模型直接定位:56/58 plates。 三段已曝光录像,7图全可见数量牌参考、含1非战斗负例;IoU0.3/0.5均56命中2漏0多报。补绿色规则同56命中却多报3;实际门控与数字成绩另列。未调参、未重训、待CTO,非全UI验收。

整图数量牌研究检测器:比较图找到数:37/40 plates。 12训练图103框、2验证图14框;另2段旧录像4图40框找到37、漏3、多报1,全对2/4;IoU≥0.3和0.5均37/40。标签助手待CTO,仅研究训练,未采用、非新视频验收。

黄血条/字形研究候选的开发整图找到数:20/22 plates。 两张1440p开发图;旧18/22,新20/22,均多报0;不是OCR或关联精度,候选未采用,参考待CTO。

同候选在另外三段录像的整图找到数:19/21 plates。 旧20/21,新19/21,均多报0;三张部署图来自旧曝光图库,非独立验收;未因字不可读排除参考。书页另有新假框/遮挡退步,不混入此分母。

YOLO 候选身体检测 precision / recall:未测。 旧报告 96.60% / 96.80%;401 训练图、75 来源隔离测试图;没有重跑或重计分母;不是身份/数量联合成绩。

下一步:30图检测与数字比较均完成;本轮暂停等待CTO审阅。恢复后优先来源别名/完整分局和整帧参考,再做身体—牌—网格四路比较;不反调已曝光11/30图,不将参考不可读位置的输出当成正确,1存活争议图仍隔离。

返回 p00 总报告 · 全部阅读目录