跳转至

Runtime & Efficiency

Development profiling。 当前没有同 hardware/input/budget 的 formal cross-method efficiency table; 论文数字保持为空,直到对应 manifest 与 artifact hash 完整。

效率结果只接受不改变算法、reference、batch semantics 或 evaluator 的优化;改变环境数、采样量、reward、schedule 的改动必须作为新的实验条件,而不是“加速”。

已有记录

主题 可用材料 使用边界
Reconstruction preprocess stage timing 与 bottleneck ranking 只指导工程排程,不改变主实验定义
Batched loss batch 化损失与验证 必须保留数值结果与原实现一致
Physics backend reference getter、tensor reset、telemetry I/O 的候选等价优化 每项须 GPU tensor parity 后进入正式 run

Physics 训练的大头通常是 Isaac articulated contact simulation。官方 native reproduction 必须保持原方法的 environment count、batch 与总优化语义;显存不够时的下调必须明确披露,不能与 official row 混写。

详细 profiling 和实现记录见 Preprocess RuntimePreprocess OptimizationBatched Loss Speedup