OwnerSunshine530
|
4257df795f
|
feat: bench.py 加 --diag 诊断模式(序列长度分布 + sign-id 超界比例)
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-06-14 21:38:50 +08:00 |
|
OwnerSunshine530
|
c0c23ad224
|
fix: bench.py 只保留测试用户数据(流式过滤+磁盘缓存),解决 OOM 与 16min 重载
不同用户被因果mask隔离,过滤非测试用户对测试样本AUC/PCOC零影响。
流式加载只持有测试用户记录,避免 CTRTestSeqDataset 构造期 OOM;
过滤结果缓存到 bench_filtered_cache.pt,后续秒级复用。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-06-14 21:12:15 +08:00 |
|
OwnerSunshine530
|
8c1d1cbaa5
|
feat: bench.py 加命令行参数,支持子进程方式跑(绕开内核torch限制)
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-06-14 19:53:21 +08:00 |
|
OwnerSunshine530
|
ab9c624167
|
fix: bench.py 在 import torch 前补上 baseline 的 libraries 路径
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-06-14 19:46:21 +08:00 |
|
OwnerSunshine530
|
9d5a5a52f2
|
feat: infer.py 接入 CONFIG 实验开关 + 新增 bench.py 测量闭环
- infer.py: 模块级 CONFIG(fp16/keep_fp32_modules/expert_merge/
merge_threshold/signid_mode/sync_timing),默认值=当前最优行为;
load_model 按 CONFIG 控制半精度/FP32敏感层/expert合并;
RepEncoder 支持 clamp/modulo 两种 sign-id 处理;
新增 _force_fp32_io 钩子让敏感层在FP16模型里以FP32 IO 计算。
- bench.py: 设置 CONFIG → 跑推理 → cuda.synchronize 真实计时 →
_cal_score 打印 AUC/PCOC/延迟/总分,支持配置/batch扫描。不进提交包。
- EXPERIMENTS.md: 实验记录表。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-06-14 16:48:38 +08:00 |
|