研究不是每次都要换出一个新模型。它也要回答:一个听起来合理的办法,实际帮到了哪里,又制造了什么新错误。这里记录尚未采用、已撤回或只在可选路径运行的方法,不把它们算作默认生产能力。
本轮到此暂停。最有希望的是更好的数量牌定位和局部数字读取;最明确的限制是遮挡、假框和对象关系。 不能只把正确数字增加了多少写进结论,还要保留错读与拒识。
1. 一项改进,要同时看收益和代价
例如身体检测器把分数门槛降低,75张旧图里的漏检从31减到8;但多报从33猛增到178。这个办法确实找回了目标,却不适合直接采用。若用数量牌支持低分身体,则能更克制地补漏;但靠近牌的错位身体框仍会混进来。
每个试验都要说清:看哪批图、输入是什么、与谁比较、找到和漏掉多少、花了多久、有没有进入默认流程。换了数据分母,就不把两轮百分比当成同一条进步曲线。
2. 按问题查试过的方法
| 问题 | 做过什么,结果怎样 | 去哪里看方法和失败 |
|---|---|---|
| 没有游戏训练,能直接搜索图标吗 | 通用特征能提出身份建议,但裁框不稳、强制三个答案;七帧不足以给准确率 | P901 |
| 只用干净图鉴训练够不够 | 训练身份和裁图质量,仍受真实画面外观和框的位置影响;各变体按原实验比较 | P902 |
| 选择页可以直接学定位吗 | 小数据微调找到8张图的24目标、多报1;部分来源重叠,不代表战场可用 | P903 |
| 身体检测器选哪个 | YOLO候选较好,RT-DETR这一配方召回不足;只测位置,不是物种与数量联合成绩 | P904 |
| 数量牌能减少身体漏检吗 | 75图基线漏31/多报33,新牌辅助漏20/多报34;相对旧血条只是找回3、丢1、多误1 | P912 身体对照 |
| 把身体和脚下牌一起框进训练呢 | 当前辅助大框配方漏56/多报15,漏得更多;不是所有联合训练都失败 | P912 同批比较 |
| 加训练数据一定提高定位吗 | 68图788牌补训后,旧4图37/40→36/40,另7图仍56/58;未采用 | 补训失败 |
| 直接放大整图或分块呢 | 固定旧权重,分块没补回真牌,合并反而多报;输入与训练尺寸可能不匹配 | 分辨率对照 |
| 训练时也加入局部图呢 | 55原图训练、17开发图选型;11张回归混合模型整图97/98、0多报,但新30图仍有漏与多报 | 匹配训练与推理 |
| 拥挤时如何配身体和牌 | 60旧图中双向领先法699条相符,原唯一法575;漏牌和身体争议仍在 | 三种配对 |
| 换OCR、放大小数字呢 | 新30图202可读数字,PP原尺寸184对,VL四倍200对;仍有2错,且假框也能出数字 | 最后一轮读字 |
| 半透明图能提前过滤吗 | 局部质量分类器未超过旧五帧;三帧多留短提示,也选进2张过渡,未采用 | P20 / P914 |
| 网格能帮身体和牌吗 | 固定标定有结果;身体单独、加牌、加网格、三者联合的四路比较还没跑 | P105 已有网格与P912 待做协议 |
P82 身体、P83 数量牌与P100 关系讲相应任务的主线。本表中的历史数字各有自己的来源与人工审核等级,不能合并为一个产品准确率。
3. 最新30张图,把两种“准确”分开了
三段录像各取十个预先固定窗口,选出30张图;其中9张没有数量牌,仍用于检查误检。参考在这轮模型输出之前制作:208块牌,202个可读数字,6个看不清。助手参考待CTO,完整对局和改名副本审计尚未闭合。
| 固定方法 | 找到 / 208 | 漏 | 多报 | 整张无漏无多报 / 30 |
|---|---|---|---|---|
| 旧模型 | 203 | 5 | 1 | 26 |
| 新整图模型 | 208 | 0 | 5 | 25 |
| 混合训练模型,整图使用 | 205 | 3 | 1 | 27 |
这是较宽松的位置门槛。严格检查后,找到数分别为187、198、201;偏框可以同时造成一次漏和一次多报,不一定是两个物体。新整图在开发集已预先选中,本轮没有看完结果再改选混合模型。全部定位结果可切换方法。
最后保持新整图的自动框,比较两种本地OCR。VL四倍在202个可读参考中读对200个,但它也把 185 读成 18、把 80 读成 30;还在一个假框及五个不可读参考上输出数字。“有数字”不是“可信数字”,更不是“已知属于哪支部队”。 数字审阅页保留五种读法,不按答案逐项挑赢家。
4. 研究什么时候才能转入默认流程
先让CTO审阅本轮参考与失败。恢复后,候选需要通过按完整来源隔离的验收,再检查实际视频入口、对象配对、未知项和端到端速度。已经反复看过的旧图用作回归,不能继续叫盲测。
联合数据也不是全部解决:60图第一版736牌中,3张身体参考有争议;后来补回两图漏标身体,另存59图723牌的研究参考,仍有1张存活/倒地争议隔离。原评分保留,修标签不算模型进步。标注修订过程说明原因。
已撤回的 P906 敌方推断视频保持草稿,不恢复制作;有用的可见UI训练候选保留,推断结果不当标注真值。大型历史产物的清理状态需要独立核对,不能因报告整理就声称磁盘已清空。
5. 代码和状态明细
实验目录保存协议、配置、紧凑参考与结果;可复用算法仍属于 Perception 包。下表是工程索引,首次阅读可以略过。
展开研究任务及各轮测量明细
最后核对:2026-09-24 · 未采用研究,不计生产能力
代码、历史报告与接线盘点;跨来源整帧验收未完成。统一环境的真实模型兼容检查见 p140,不计作准确率验收。
- 整帧准确率
- 未测
- 统一环境 p50 / p95 耗时
- 未测
- 独立录像 / 已审字段
- 未汇总
p50 是一半运行能达到的耗时,p95 是 95% 运行能达到的耗时。尚未在统一环境测量,不能用某个局部模型的速度替代。
p901 · 全屏图标检索
原型 / 待接入
历史研究,未采用为生产链路。
p902 · 图鉴特征检索
原型 / 待接入
历史研究,生产不依赖研究实现。
p903 · 通用检测与分割比较
原型 / 待接入
旧研究;其活动权重缓存需要先迁出再清理。
p904 · 战场检测器比较
原型 / 待接入
候选结果较好,但不等于已替换默认检测器。
p905 · 录屏等待剪辑
原型 / 待接入
历史应用,保留用户所需成片;暂停继续制作。
p906 · 撤回的敌方推断视频
原型 / 待接入
已撤回;回收的训练图片独立保留,不重启推断。
p907 · 单页法术书配对候选
原型 / 待接入
6 张同源开发图有结果;等待独立数据与默认链路验收。
p908 · 状态图标与时长候选
原型 / 待接入
分别验证图标、角标和悬浮,不用日志猜当前时长。
p909 · 对象关联候选
原型 / 待接入
同类不等于同一对象;仍需要更完整的关系参考。
p910 · 头像与行动侧候选
原型 / 待接入
头像和颜色证据还没有完整默认接入。
p911 · 未采用 OCR 后端比较
原型 / 待接入
历史比较留档,不把所有框架装进统一生产环境。
p912 · 身体与数量牌融合候选
原型 / 待接入
三段新来源30固定窗口208牌、202可读/6未知、9负例;旧/新整图/混合找到203/208/205,多报1/5/1。预选新整图213框再比五种读法:PP原184对5错13拒识,VL四倍200对2错,另假框出数字1。放大PP仅122对、双VL一致仍有185→18;默认不换。已曝光待CTO、来源隔离未闭合,身体/网格和独立整帧验收未完成。
p913 · 预览语义与目标关联候选
原型 / 待接入
当前仅部分数字候选接入;语义关联仍未交付。
p914 · 局部过渡质量候选
原型 / 待接入
三帧质量候选新录像72点,5次可读事件2→4,但两张半透明图被选中,未采用。旧132点3/7→7/7同时选3过渡1未知。参数固定、旧89C/T训练;研究到此收束,回到整帧覆盖,默认未改、待CTO。
已有测量能说明什么
新来源自动框:VL四倍数字相符:200/202 字段。 三源30图213自动框五读法,预选检测器不改、无参考框补裁;宽匹配200对2错,1/5假框出数字,5/6不可读参考出数字不计对错。严格定位192对2错8漏;PP原184对、四倍122对。无重训、未换默认,助手待CTO/非独立验收。
新来源30图冻结比较:混合整图:205/208 plates。 三源30固定窗口,9无牌负例;先标参考再推理。旧203命中5漏1多报26全对,新整图208/0/5/25,混合205/3/1/27;严格IoU0.5分别187/21/17、198/10/15、201/7/5。热调用19.8/18.8/18.7ms含视图/推理/去重,不含读图加载OCR。预选仍新整图;无默认更换,助手待CTO/来源暂定,非生产独立验收。
匹配局部训练:回归候选,未按此重选:97/98 plates。 55训练图617牌;17开发图212牌预先选新整图模型,11曝光回归95命中3漏1多报/7帧全对。混合模型整图回归97命中1漏0多报/10帧全对;严格IoU0.5为96/2/1和9帧全对。四块/并集仍97命中却多7/9框。开发选型与回归候选不同,默认不换;助手待CTO、同局审计/独立验收/数字和关系均未完成。
数量牌分块回归:未补回真牌:18/40 plates。 固定原12图权重,先2图开发选择旧整图1280;再旧4图四块18/22/2、另7图25/33/2(找到/漏/多报)。与旧整图合并仍37/40、56/58却多5、3假框;整图2560严重漏检。均曝光回归/助手待CTO,无独立验收,默认不换。
68图补训数量牌回归:未胜过旧模型:36/40 plates。 68训练图788牌/20录像,26轮436次实际更新。旧4图原始37/3/1→36/4/0;原有去重后37/3/0→36/4/0(找到/漏/多报)。另7图去重后两者56/2/0。数据与回归已曝光、助手待CTO,不是独立验收或OCR/关系成绩,默认和旧权重不换。
双向分差身体—牌配对诊断:699/736 plates。 60旧训练/开发图、736牌(734单一关系/2未知),真实检测717命中/1多报/19漏;唯一575相符2不符141拒绝,双向699相符2不符17拒绝。不符包含旧身体参考争议和框未达匹配门槛;3图训练隔离但仍计诊断。未运行数字OCR、身份或网格,不是独立准确率,默认不换,助手待CTO。
学习式数量牌支持旧身体候选:949/969 bodies。 75已曝光旧开发图2录像;IoU0.5,949对34多报20漏。身体基线938/33/31,旧血条947/33/22。相对旧血条找回3丢1多误1,无新训练;非数字、身份或关系准确率,默认未换,助手参考待CTO。
三帧候选新来源误放过渡:2/11 frames。 人工选3片段72点;2过渡均成为最终代表,可读事件2/5→4/5;不采用,非全片验收。89旧参考训练、无新点调参,待CTO。
新局部质量单独误放过渡帧:5/15 frames。 三录像七个3秒片段210帧:192清楚、15过渡、3不确定;旧稳定和组合0/15误放且拒35/192清楚。中心区域助手待CTO,不是整帧或独立验收。
跨录像固定模型直接定位:56/58 plates。 三段已曝光录像,7图全可见数量牌参考、含1非战斗负例;IoU0.3/0.5均56命中2漏0多报。补绿色规则同56命中却多报3;实际门控与数字成绩另列。未调参、未重训、待CTO,非全UI验收。
整图数量牌研究检测器:比较图找到数:37/40 plates。 12训练图103框、2验证图14框;另2段旧录像4图40框找到37、漏3、多报1,全对2/4;IoU≥0.3和0.5均37/40。标签助手待CTO,仅研究训练,未采用、非新视频验收。
黄血条/字形研究候选的开发整图找到数:20/22 plates。 两张1440p开发图;旧18/22,新20/22,均多报0;不是OCR或关联精度,候选未采用,参考待CTO。
同候选在另外三段录像的整图找到数:19/21 plates。 旧20/21,新19/21,均多报0;三张部署图来自旧曝光图库,非独立验收;未因字不可读排除参考。书页另有新假框/遮挡退步,不混入此分母。
YOLO 候选身体检测 precision / recall:未测。 旧报告 96.60% / 96.80%;401 训练图、75 来源隔离测试图;没有重跑或重计分母;不是身份/数量联合成绩。
下一步:30图检测与数字比较均完成;本轮暂停等待CTO审阅。恢复后优先来源别名/完整分局和整帧参考,再做身体—牌—网格四路比较;不反调已曝光11/30图,不将参考不可读位置的输出当成正确,1存活争议图仍隔离。
Comments