Physics 比较方法¶
正文主要比较 CoDA、InterMimic、RePHO 和 Ours。HDMI 只有在截止时间前完成公平接入时才加入,不能因此 拖延其他方法。
正文方法¶
| 方法 | 原始任务 | 在本文中的用法 | 论文角色 |
|---|---|---|---|
| CoDA | Articulated HOI generation | 接收统一的 articulated reference | 正文 baseline |
| InterMimic | Whole-body rigid HOI imitation | 适配 articulated object 后接收统一 reference | 正文 baseline |
| RePHO | Rigid HOI reconstruction-to-physics | 保留 tracking/repair 方法,接收统一 reference | 正文 baseline |
| Ours | 本文方法 | 完整 Physics 方法 | 正文 proposed method |
| HDMI | G1 video-conditioned HOI control | 适配到 SMPL-X 和 articulated object | time-gated baseline |
CoDA 使用作者提供的实现。该实现基于 PhysHOI 修改,并增加 articulated object 支持;具体来源和改动在
附录的实现细节中说明。PhysicalArtiObj 只是这份代码的目录名,不是另一种方法,也不是数据集。
为什么不加入更多方法¶
| 方法 | 不进入正文比较的原因 |
|---|---|
| PHC-X | 只用于检查人体跟踪,不解决 articulated manipulation |
| WristMimic | 使用 SMPL-X,但物体是 rigid,且代码尚未公开 |
| ContactMimic | 代码已公开,但主体是 Unitree G1,物体也是 rigid |
| DeVI | 主体和物体设置均不同,且代码尚未公开 |
| PhysHOI | 是 CoDA 实现的基础,不作为第二条重复基线 |
这些方法继续保留在 Related Work,用来说明与本文任务的关系,但不需要为了增加表格行数而强行适配。
现在实际完成到哪¶
这里分清三个状态:
- Pipeline-validated:单个 ARCTIC case 用 10 epoch 跑通官方预处理输入 → 作者训练器 → 可加载 checkpoint;允许为共享 GPU 降低并行环境数。
- Full-trained:保持作者
num_envs、minibatch 和训练器,并使用 visible validation 预先冻结的预算完成训练;只有 CoDA 的 3000 epoch 是作者配置直接给出的固定值。 - Formal-ready:还要完成 checkpoint reload → 统一 rollout/evaluator,并保存 manifest、telemetry 和 hashes。
2026-08-15,CoDA、InterMimic 和 RePHO 均已通过第一层,随后已用作者环境数启动 budget calibration; 这仍不是论文结果,也不能替代冻结预算后的全 case 训练。
| Method | Studio adapter | Train → reload → eval | Evaluator telemetry | Readiness | 下一步 / 证据 |
|---|---|---|---|---|---|
| Ours | Implemented | 多个 dev lifecycle;非 formal | pairwise contact 与 formal aggregate 缺 | Partial / dev | output/verification/shared_migration_20260801/ours_d3d_studio_residual_ppo_f/ |
| CoDA | Implemented | 4096 env calibration 正在 GPU 0 运行;epoch 500/2000 均已由作者 player clean reload |
两者都仅 14/300 帧,2000 未改善;仍需比较 3000 | Reload validated / bulk No-Go | output/physics_only/arctic/coda_eval/arctic_s02_microwave_use_02_checkpoint_2000_eval/seed42/ |
| InterMimic | Implemented | 4096 env、500-epoch calibration 已完成;epoch 13250/13500 均由作者 player clean reload |
valid prefix 13→18/653,仍 early terminate;不能据此启动 ARCTIC-40 bulk queue | Reload validated / bulk No-Go | output/physics_only/arctic/intermimic_eval/arctic_s01_laptop_use_01_checkpoint_13500_eval/seed42/ |
| RePHO | Implemented | 1024 env × 2 workers calibration 正在 GPU 1–2 运行;epoch 53100 双 checkpoint 已由作者 player clean reload 并写出 common rollout |
当前 rollout early terminate;仍需比较 54500/56000 | Reload validated / calibration running | output/physics_only/arctic/repho_eval/arctic_s01_laptop_use_01_checkpoint_53100_eval/seed42/ |
| HDMI | Adapter/launcher code exists | target 没有 submodules/HDMI dependency,无 lifecycle |
missing | Missing / time-gated | 补 pinned upstream 后做 dry-run、train/reload/eval;到期未完成就删 row |
| PHC-X | Implemented | player/common-eval smoke only | manipulation telemetry 不适用 | Diagnostic | 只作 human-tracking sanity,不参与排名 |
旧 /DATA/intern/hoi4d/projects/zhanbaiting/ArtHOI4D/output/physics_studio_verification/final_author_20260729/
属于只读历史 checkout,不是 target-local formal result。
公平比较¶
同一张表中的方法使用相同的参考动作、物体模型、初始关节状态、接触标注、训练步数、模型选择规则和 评测程序。方法可以保留自己的 observation、action、reward、网络和训练器。
每个预注册 case×seed 只使用一个逻辑环境并做一次 canonical evaluation。InterMimic 原生代码中的大量并行环境是训练或批量评测方式, 不代表论文中有更多独立样本,也不采用多次试跑中的最好结果。
两种输入设置¶
- 重建输入:D3D-HOI RGB 经过固定的 Ours Recon,所有 Physics 方法接收相同结果。
- 采集标注输入:ARCTIC 和 ParaHome 标注直接进入 Physics,完全绕过 Recon。
ARCTIC Physics-only 不生成 result.pt 或落盘的通用 canonical case。InterMimic 和 RePHO 读取官方 InterAct
的 human.npz + object.npz,CoDA 读取作者的 ARCTIC motion 文件;Studio 只做薄的内存加载、case 调度和
provenance 记录。train-only 阶段不要求 D3D 人工 contact_region、common evaluator 或尚未冻结的 Physics
primary metric;这些只在之后的统一正式评测阶段补齐。
具体任务见 Physics 实验设置,指标见 Physics 评测指标,任务顺序见 28 天实验计划。