Runtime & Efficiency¶
Development profiling。 当前没有同 hardware/input/budget 的 formal cross-method efficiency table; 论文数字保持为空,直到对应 manifest 与 artifact hash 完整。
效率结果只接受不改变算法、reference、batch semantics 或 evaluator 的优化;改变环境数、采样量、reward、schedule 的改动必须作为新的实验条件,而不是“加速”。
已有记录¶
| 主题 | 可用材料 | 使用边界 |
|---|---|---|
| Reconstruction preprocess | stage timing 与 bottleneck ranking | 只指导工程排程,不改变主实验定义 |
| Batched loss | batch 化损失与验证 | 必须保留数值结果与原实现一致 |
| Physics backend | reference getter、tensor reset、telemetry I/O 的候选等价优化 | 每项须 GPU tensor parity 后进入正式 run |
Physics 训练的大头通常是 Isaac articulated contact simulation。官方 native reproduction 必须保持原方法的 environment count、batch 与总优化语义;显存不够时的下调必须明确披露,不能与 official row 混写。
详细 profiling 和实现记录见 Preprocess Runtime、Preprocess Optimization 与 Batched Loss Speedup。