跳转至

Physics 比较方法

正文主要比较 CoDA、InterMimic、RePHO 和 Ours。HDMI 只有在截止时间前完成公平接入时才加入,不能因此 拖延其他方法。

正文方法

方法 原始任务 在本文中的用法 论文角色
CoDA Articulated HOI generation 接收统一的 articulated reference 正文 baseline
InterMimic Whole-body rigid HOI imitation 适配 articulated object 后接收统一 reference 正文 baseline
RePHO Rigid HOI reconstruction-to-physics 保留 tracking/repair 方法,接收统一 reference 正文 baseline
Ours 本文方法 完整 Physics 方法 正文 proposed method
HDMI G1 video-conditioned HOI control 适配到 SMPL-X 和 articulated object time-gated baseline

CoDA 使用作者提供的实现。该实现基于 PhysHOI 修改,并增加 articulated object 支持;具体来源和改动在 附录的实现细节中说明。PhysicalArtiObj 只是这份代码的目录名,不是另一种方法,也不是数据集。

为什么不加入更多方法

方法 不进入正文比较的原因
PHC-X 只用于检查人体跟踪,不解决 articulated manipulation
WristMimic 使用 SMPL-X,但物体是 rigid,且代码尚未公开
ContactMimic 代码已公开,但主体是 Unitree G1,物体也是 rigid
DeVI 主体和物体设置均不同,且代码尚未公开
PhysHOI 是 CoDA 实现的基础,不作为第二条重复基线

这些方法继续保留在 Related Work,用来说明与本文任务的关系,但不需要为了增加表格行数而强行适配。

现在实际完成到哪

这里分清三个状态:

  • Pipeline-validated:单个 ARCTIC case 用 10 epoch 跑通官方预处理输入 → 作者训练器 → 可加载 checkpoint;允许为共享 GPU 降低并行环境数。
  • Full-trained:保持作者 num_envs、minibatch 和训练器,并使用 visible validation 预先冻结的预算完成训练;只有 CoDA 的 3000 epoch 是作者配置直接给出的固定值。
  • Formal-ready:还要完成 checkpoint reload → 统一 rollout/evaluator,并保存 manifest、telemetry 和 hashes。

2026-08-15,CoDA、InterMimic 和 RePHO 均已通过第一层,随后已用作者环境数启动 budget calibration; 这仍不是论文结果,也不能替代冻结预算后的全 case 训练。

Method Studio adapter Train → reload → eval Evaluator telemetry Readiness 下一步 / 证据
Ours Implemented 多个 dev lifecycle;非 formal pairwise contact 与 formal aggregate 缺 Partial / dev output/verification/shared_migration_20260801/ours_d3d_studio_residual_ppo_f/
CoDA Implemented 4096 env calibration 正在 GPU 0 运行;epoch 500/2000 均已由作者 player clean reload 两者都仅 14/300 帧,2000 未改善;仍需比较 3000 Reload validated / bulk No-Go output/physics_only/arctic/coda_eval/arctic_s02_microwave_use_02_checkpoint_2000_eval/seed42/
InterMimic Implemented 4096 env、500-epoch calibration 已完成;epoch 13250/13500 均由作者 player clean reload valid prefix 13→18/653,仍 early terminate;不能据此启动 ARCTIC-40 bulk queue Reload validated / bulk No-Go output/physics_only/arctic/intermimic_eval/arctic_s01_laptop_use_01_checkpoint_13500_eval/seed42/
RePHO Implemented 1024 env × 2 workers calibration 正在 GPU 1–2 运行;epoch 53100 双 checkpoint 已由作者 player clean reload 并写出 common rollout 当前 rollout early terminate;仍需比较 54500/56000 Reload validated / calibration running output/physics_only/arctic/repho_eval/arctic_s01_laptop_use_01_checkpoint_53100_eval/seed42/
HDMI Adapter/launcher code exists target 没有 submodules/HDMI dependency,无 lifecycle missing Missing / time-gated 补 pinned upstream 后做 dry-run、train/reload/eval;到期未完成就删 row
PHC-X Implemented player/common-eval smoke only manipulation telemetry 不适用 Diagnostic 只作 human-tracking sanity,不参与排名

/DATA/intern/hoi4d/projects/zhanbaiting/ArtHOI4D/output/physics_studio_verification/final_author_20260729/ 属于只读历史 checkout,不是 target-local formal result。

公平比较

同一张表中的方法使用相同的参考动作、物体模型、初始关节状态、接触标注、训练步数、模型选择规则和 评测程序。方法可以保留自己的 observation、action、reward、网络和训练器。

每个预注册 case×seed 只使用一个逻辑环境并做一次 canonical evaluation。InterMimic 原生代码中的大量并行环境是训练或批量评测方式, 不代表论文中有更多独立样本,也不采用多次试跑中的最好结果。

两种输入设置

  • 重建输入:D3D-HOI RGB 经过固定的 Ours Recon,所有 Physics 方法接收相同结果。
  • 采集标注输入:ARCTIC 和 ParaHome 标注直接进入 Physics,完全绕过 Recon。

ARCTIC Physics-only 不生成 result.pt 或落盘的通用 canonical case。InterMimic 和 RePHO 读取官方 InterAct 的 human.npz + object.npz,CoDA 读取作者的 ARCTIC motion 文件;Studio 只做薄的内存加载、case 调度和 provenance 记录。train-only 阶段不要求 D3D 人工 contact_region、common evaluator 或尚未冻结的 Physics primary metric;这些只在之后的统一正式评测阶段补齐。

具体任务见 Physics 实验设置,指标见 Physics 评测指标,任务顺序见 28 天实验计划