{"as_of":"2026-08-23T04:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86c002b6b3b309ab3b5ac420527234a3fb7c49f9c9a6aa50732cee2149fedf2c","coverage":[{"denominator":135,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:19:19.105644Z","state":"measured"},{"denominator":110,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":110,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:30:08.486479Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T18:15:21.352627Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-08-07T04:54:00.566994Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09366","last_updated":"2025-06-11T03:24:26Z","snapshot_observed_at":"2026-08-13T22:45:09.284828Z","submitted_at":"2025-06-11T03:24:26Z","title":"SkillBlender: Towards Versatile Humanoid Whole-Body Loco-Manipulation via Skill Blending","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.566994Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2506.09366"},"observation_digest":"sha256:a465c436812d65ce1f8314da022114afffe866e2e32ea5d27439aca49d41bc18","observation_id":"fac5658f-3ebd-44c5-840a-d269efe4c959","resolution":{"observed_at":"2026-08-07T04:54:00.566994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2512.09646","last_updated":"2026-04-08T15:03:02Z","snapshot_observed_at":"2026-08-21T19:31:51.873037Z","submitted_at":"2025-12-10T13:40:24Z","title":"VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T23:30:14.969895Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2512.09646"},"observation_digest":"sha256:7a91366735b7de1901984a2325824906b5130b535de93749c01672a63ab494aa","observation_id":"db114602-f4d3-425d-a7c5-10a17435cf6d","resolution":{"observed_at":"2026-05-16T23:31:22.042028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2604.20336","last_updated":"2026-04-22T08:31:40Z","snapshot_observed_at":"2026-08-11T12:11:37.458388Z","submitted_at":"2026-04-22T08:31:40Z","title":"Stability-Driven Motion Generation for Object-Guided Human-Human Co-Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T01:09:08.784456Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2604.20336"},"observation_digest":"sha256:7c7d089b71c11b4c9425d40ddf7f1f946a2651a3bb4cf53a292d528ccf261f58","observation_id":"c19d9fee-8077-4d23-a1f7-9bb32c339023","resolution":{"observed_at":"2026-05-10T01:10:09.139780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2604.21351","last_updated":"2026-06-30T15:14:54Z","snapshot_observed_at":"2026-08-11T02:57:03.626943Z","submitted_at":"2026-04-23T07:10:05Z","title":"Learn Weightlessness: Imitate Non-Self-Stabilizing Motions on Humanoid Robot","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T21:51:07.814456Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2604.21351"},"observation_digest":"sha256:8cfabed37a47445e0188672dde0411c4831404d06831f50e599428fc6de34a88","observation_id":"0f29ebc4-cacd-4cff-abae-db9f8d9af360","resolution":{"observed_at":"2026-05-11T14:26:03.590458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2606.25591","last_updated":"2026-06-28T08:36:47Z","snapshot_observed_at":"2026-08-12T22:32:25.935138Z","submitted_at":"2026-06-24T08:59:59Z","title":"WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-25T21:06:58.911521Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2606.25591"},"observation_digest":"sha256:62b9a5b93c4e68b0b5f8f2ec9874efc08414dd1fd6a7251a5b7b3818edb5d6dc","observation_id":"c1fbb86f-cace-4381-bc29-f364dca795d3","resolution":{"observed_at":"2026-07-04T19:40:06.895418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2606.25591","last_updated":"2026-06-28T08:36:47Z","snapshot_observed_at":"2026-08-12T22:32:25.935138Z","submitted_at":"2026-06-24T08:59:59Z","title":"WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T10:10:42.040332Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2606.25591"},"observation_digest":"sha256:d691b37c91b649bbcd936f5d79f756dc618c6812418d5b5de21d0a67686ee44d","observation_id":"e27f565a-376d-4453-adec-3e3f983c3a37","resolution":{"observed_at":"2026-06-30T12:44:39.898046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2607.02034","last_updated":"2026-07-03T05:22:51Z","snapshot_observed_at":"2026-08-16T01:43:18.668877Z","submitted_at":"2026-07-02T11:01:20Z","title":"ComplexMimic: Human-Scene Interaction Imitation in Complex 3D Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T16:06:43.130827Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2607.02034"},"observation_digest":"sha256:763e88d83a0e36924a92a399edebb0bda1e0ef4c334ef0d0d15f5ca77a808b04","observation_id":"f337de91-1ef9-4e85-9fcf-b0ee6243fbb9","resolution":{"observed_at":"2026-07-03T16:08:36.728936Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-12T08:30:04.246695Z","title":"arXiv preprint arXiv:2412.17730 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02034","last_updated":"2026-07-03T05:22:51Z","snapshot_observed_at":"2026-08-16T01:43:18.668877Z","submitted_at":"2026-07-02T11:01:20Z","title":"ComplexMimic: Human-Scene Interaction Imitation in Complex 3D Environments","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T08:30:04.246695Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2607.02034"},"observation_digest":"sha256:8cefc68efdea9b2305f906273ce85c03ac45199ca1d672ab6c7221dda923351e","observation_id":"297781a9-284e-47e4-927a-31ee67c81133","resolution":{"observed_at":"2026-07-12T08:30:04.246695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":"2412.17730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-07-08T18:15:21.352627Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking","venue":"cs.RO","work_id":"ba1ecbdd-3688-4705-b0a4-f7717d871df3","year":2024},"citing_paper":{"arxiv_id":"2607.06052","last_updated":"2026-07-07T09:26:51Z","snapshot_observed_at":"2026-08-12T12:46:33.226481Z","submitted_at":"2026-07-07T09:26:51Z","title":"ThorArena: Benchmarking Humanoid Physical Interaction with Human Motion-Force Demonstrations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T18:10:36.258268Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2607.06052"},"observation_digest":"sha256:176cc727b22362818f771204eaf90c6ec171f945b7400b5bac915e77de919c05","observation_id":"2548c1c0-398f-4172-8e98-bfc520a42ef7","resolution":{"observed_at":"2026-07-08T18:15:21.355299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17730","snapshot_observed_at":"2026-08-16T00:30:08.486479Z","title":"Mimicking-bench: A benchmark for generalizable humanoid-scene interaction learning via human mimicking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11769","last_updated":"2026-08-12T08:13:44Z","snapshot_observed_at":"2026-08-22T22:03:01.538448Z","submitted_at":"2026-08-12T08:13:44Z","title":"Policy-Induced Hand Priors in Humanoid Dual-Arm Manipulation: Diagnosing and Mitigating Initial-Pose Dependence","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:30:08.486479Z"},"links":{"cited_paper":"/paper/2412.17730","citing_paper":"/paper/2608.11769"},"observation_digest":"sha256:0d31ab665eccd008227e9d2ec320852f388a3581760f944c21bcc9199990d036","observation_id":"55238deb-256b-4cd3-bca8-716ff03a1729","resolution":{"observed_at":"2026-08-16T00:30:08.486479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.17730/citation-record","integrity":"/paper/2412.17730/integrity","json":"/paper/2412.17730/citation-record.json","paper":"/paper/2412.17730"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.781512Z","title":"https://github.com/tonyzhaozh/act ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.781512Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:dd4c5a607f989007557fbd0e2b2acf798f58393f90bde9fa88ffa566b4ba4b86","observation_id":"48535129-9939-4c2a-aeee-53b4bc884b6e","resolution":{"observed_at":"2026-08-11T05:19:18.781512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.785618Z","title":"https://franka.de/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.785618Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:98607ef51b1ad026d171259929972a07730a212c89c2a493799ecf023c99d583","observation_id":"07643b38-26d5-47e3-bbb3-5af7ef6752ea","resolution":{"observed_at":"2026-08-11T05:19:18.785618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.790017Z","title":"https : / / github","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.790017Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:aa07e63fd87a9c048a4e7a6a05154ce4ae5e1029f1b96af122ebe5787206a324","observation_id":"d21a39bc-3773-45c7-b168-98391ab1d8f5","resolution":{"observed_at":"2026-08-11T05:19:18.790017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T05:19:18.793609Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.793609Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:29a0c0bb0ab3901aa3519655dbdcf4022986ce8484f63296fa5dc3a64471de7b","observation_id":"347e81f0-9378-4356-921c-7dee08100e22","resolution":{"observed_at":"2026-08-11T05:19:18.793609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02496","last_updated":"2023-11-30T17:47:04Z","snapshot_observed_at":"2026-08-16T14:45:58.483915Z","submitted_at":"2023-11-04T19:41:50Z","title":"LocoMuJoCo: A Comprehensive Imitation Learning Benchmark for Locomotion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02496","snapshot_observed_at":"2026-08-11T05:19:18.797729Z","title":"Locomujoco: A comprehensive imita- tion learning benchmark for locomotion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.797729Z"},"links":{"cited_paper":"/paper/2311.02496","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:5fe90a3fd698dcb017659a5193cc9b39ed64d7d0355fa0acf3a6d50e80b64a7c","observation_id":"38fcfcc2-e7ec-4db9-b036-23c7ae9cd684","resolution":{"observed_at":"2026-08-11T05:19:18.797729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.802114Z","title":"Circle: Capture in rich contextual environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.802114Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:8d2b33b86d9e529376bde00cc399d64948567d853f651ee0c4d6279a718693ce","observation_id":"b8e07a62-2413-4930-bda2-99e79e13ee36","resolution":{"observed_at":"2026-08-11T05:19:18.802114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.805201Z","title":"Behave: Dataset and method for tracking human object in- teractions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.805201Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:91e38b78ce979d5bdc5a70bbb0e6796e1509a5e1eb7f45a0d5bd971093acfbc5","observation_id":"16f912bd-b99f-4c61-8283-675603fc6031","resolution":{"observed_at":"2026-08-11T05:19:18.805201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-11T05:19:18.809313Z","title":"Openai gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.809313Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:4e3e224c53e22861c5e5319581f87861b62d2df9d26ba2258e03b499d0fdcdad","observation_id":"144d491a-44b7-4fd6-96f7-a7699691b1ed","resolution":{"observed_at":"2026-08-11T05:19:18.809313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-15T22:26:43.274625Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-11T05:19:18.812542Z","title":"Shapenet: An information-rich 3d model repository","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.812542Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:cbbca4d4f666ca9ba89be7ef214e6e37bb86220a289cc7b3ae13db0657a19970","observation_id":"6ad13f01-28c0-45cd-8560-5fedc6c92bfa","resolution":{"observed_at":"2026-08-11T05:19:18.812542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.815849Z","title":"Learning to sit: Synthesizing human-chair interactions via hierarchical control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.815849Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:df896f376196f94b91ec1c433d1be266d22a23a926d5a6c4d86ae1abce635695","observation_id":"eac26a4d-794e-4d9a-8f00-2e6f18331ad8","resolution":{"observed_at":"2026-08-11T05:19:18.815849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11825","last_updated":"2024-10-28T09:46:19Z","snapshot_observed_at":"2026-08-16T13:09:05.331502Z","submitted_at":"2024-10-15T17:52:20Z","title":"Learning Smooth Humanoid Locomotion through Lipschitz-Constrained Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11825","snapshot_observed_at":"2026-08-11T05:19:18.819026Z","title":"Learning smooth humanoid locomotion through lipschitz-constrained poli- cies","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.819026Z"},"links":{"cited_paper":"/paper/2410.11825","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:ed08f861a3458ae5cba37319230e9318508cffc6181f8088aecb7795d5c5db59","observation_id":"b7698c4b-3f81-4782-860e-893cca420512","resolution":{"observed_at":"2026-08-11T05:19:18.819026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16796","last_updated":"2024-03-06T02:19:38Z","snapshot_observed_at":"2026-08-19T20:14:54.650795Z","submitted_at":"2024-02-26T18:09:24Z","title":"Expressive Whole-Body Control for Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16796","snapshot_observed_at":"2026-08-11T05:19:18.822249Z","title":"Expressive whole-body con- trol for humanoid robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.822249Z"},"links":{"cited_paper":"/paper/2402.16796","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:5d2154cd323370282a8e90b4cc23aae8ac089582da5bc0b72a2544aeb8dac91d","observation_id":"861e5ae7-bb58-480c-b25e-9340e2e79cbe","resolution":{"observed_at":"2026-08-11T05:19:18.822249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01512","last_updated":"2024-07-08T16:59:38Z","snapshot_observed_at":"2026-08-19T19:56:49.881044Z","submitted_at":"2024-07-01T17:55:35Z","title":"Open-TeleVision: Teleoperation with Immersive Active Visual Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01512","snapshot_observed_at":"2026-08-11T05:19:18.825661Z","title":"Open-television: Teleoperation with immersive active visual feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.825661Z"},"links":{"cited_paper":"/paper/2407.01512","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:8d52e3f2494c973269714b4382559bbad59f2c012f394bbad0743c2ed2647032","observation_id":"db573c81-dcaf-4e4f-a3ba-5cc80aee81b1","resolution":{"observed_at":"2026-08-11T05:19:18.825661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.828865Z","title":"Physics-based motion capture imitation with deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.828865Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:3008c1eb08a876b5e1b28526456a34067c147ce9fe929eccd2c63e708c690a68","observation_id":"6bba53e1-a761-40ce-83f0-5f3bbbd77083","resolution":{"observed_at":"2026-08-11T05:19:18.828865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07788","last_updated":"2024-07-11T16:26:09Z","snapshot_observed_at":"2026-08-16T20:17:37.049101Z","submitted_at":"2024-07-10T16:04:18Z","title":"BiGym: A Demo-Driven Mobile Bi-Manual Manipulation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07788","snapshot_observed_at":"2026-08-11T05:19:18.831957Z","title":"Bigym: A demo- driven mobile bi-manual manipulation benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.831957Z"},"links":{"cited_paper":"/paper/2407.07788","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:ac24ad90de9915ce83412dc019d14864c1afd7d6c7d327fea23b9d370099ff6d","observation_id":"764d608a-654e-4cd6-a0d0-641a718b6ce7","resolution":{"observed_at":"2026-08-11T05:19:18.831957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-11T05:19:18.835190Z","title":"Diffu- sion policy: Visuomotor policy learning via action diffu- sion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.835190Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:335002e9fd1137fab8bd575b76274994ad54dab14e59242e7d49ab0caed72f75","observation_id":"6c792bbe-1b59-496b-8106-32e95e9b1da6","resolution":{"observed_at":"2026-08-11T05:19:18.835190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.838804Z","title":"Anyskill: Learning open- vocabulary physical skill for interactive agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.838804Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:709dfae1bf67a0537727a6c17d6b3840a2f898594a74e6e6255e4d97870ec99b","observation_id":"b5f3dd23-3379-4f63-aac4-72c33f2bb240","resolution":{"observed_at":"2026-08-11T05:19:18.838804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.841810Z","title":"Sim-to-real learning for humanoid box loco-manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.841810Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:f10c379a971143ada72d2bde3a87fdfa78444b197659b4cdb45006a3b2513fd8","observation_id":"64f37649-89a3-49ef-9f4a-526525c6af30","resolution":{"observed_at":"2026-08-11T05:19:18.841810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16097","last_updated":"2024-05-17T15:00:55Z","snapshot_observed_at":"2026-08-16T14:39:55.793006Z","submitted_at":"2023-11-27T18:59:10Z","title":"CG-HOI: Contact-Guided 3D Human-Object Interaction Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16097","snapshot_observed_at":"2026-08-11T05:19:18.844487Z","title":"Cg-hoi: Contact-guided 3d human-object interaction generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.844487Z"},"links":{"cited_paper":"/paper/2311.16097","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:7a6e5d861d1811d64cfbc4792b17e1bd245ca49f9153ac51195a95e8dd790afa","observation_id":"f0af0e58-ee74-42d6-978a-bcf080e48cc6","resolution":{"observed_at":"2026-08-11T05:19:18.844487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.847967Z","title":"C· ase: Learning conditional adversar- ial skill embeddings for physics-based characters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.847967Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:50fca107d9623ad51558ffaffdf557436f3144c227f89e6539883b14c106a73b","observation_id":"2b3c6f33-09ab-4ff8-a990-d218928d5772","resolution":{"observed_at":"2026-08-11T05:19:18.847967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07295","last_updated":"2026-04-21T21:13:56Z","snapshot_observed_at":"2026-08-20T16:36:05.854728Z","submitted_at":"2024-07-30T09:10:24Z","title":"Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07295","snapshot_observed_at":"2026-08-11T05:19:18.850984Z","title":"Learning multi-modal whole-body control for real-world humanoid robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.850984Z"},"links":{"cited_paper":"/paper/2408.07295","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:7553fba83bc094d1daa126691d0940184cebe9f5bd32f0ddd2aee88426e3e2cb","observation_id":"71443d46-8815-4b13-b5be-352a83320e59","resolution":{"observed_at":"2026-08-11T05:19:18.850984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.854208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.854208Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:2a31e326ade5830734d5681a1efb68ff261ba2666206b575d3b2e7015f333296","observation_id":"ce0ea5cb-5f1d-48ca-9495-9e5ffbcb264c","resolution":{"observed_at":"2026-08-11T05:19:18.854208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.857655Z","title":"Optimization based full body control for the atlas robot","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.857655Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:e67ca5e60be36d3719dba3298a5eda57d2ab4e9952c73f0db98d8a4cc4ae8e59","observation_id":"0e0ab3e0-b685-4917-9f53-649c24ddb6dc","resolution":{"observed_at":"2026-08-11T05:19:18.857655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10454","last_updated":"2024-06-15T00:41:34Z","snapshot_observed_at":"2026-08-20T20:46:27.308603Z","submitted_at":"2024-06-15T00:41:34Z","title":"HumanPlus: Humanoid Shadowing and Imitation from Humans","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10454","snapshot_observed_at":"2026-08-11T05:19:18.860731Z","title":"Humanplus: Humanoid shadowing and im- itation from humans","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.860731Z"},"links":{"cited_paper":"/paper/2406.10454","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a5156e0f8eac1e59362ef4350f1757f9b6bdddda3828f1cddbe459c02e4990eb","observation_id":"feaa8275-075a-4b8a-b3c1-a6ffc3635caa","resolution":{"observed_at":"2026-08-11T05:19:18.860731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.867810Z","title":"Super- track: Motion tracking for physically simulated characters using supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.867810Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:45bc76661923e6cf865d527f7bc4d5822f074986418de82e870ed56a06a50d2f","observation_id":"3e68613e-8732-424c-8ac3-f4c364ef5eef","resolution":{"observed_at":"2026-08-11T05:19:18.867810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14558","last_updated":"2024-10-30T02:58:10Z","snapshot_observed_at":"2026-08-16T13:40:59.877192Z","submitted_at":"2024-06-20T17:59:22Z","title":"CooHOI: Learning Cooperative Human-Object Interaction with Manipulated Object Dynamics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14558","snapshot_observed_at":"2026-08-11T05:19:18.870813Z","title":"Coohoi: Learning cooperative human- object interaction with manipulated object dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.870813Z"},"links":{"cited_paper":"/paper/2406.14558","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:2c67122fd4653588d32dfd899d10225bec08f0b17cd97e2646496e8d58e1144a","observation_id":"884e0859-4ac6-4d5a-a6fb-37780734fd5b","resolution":{"observed_at":"2026-08-11T05:19:18.870813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.874205Z","title":"Generative adversarial networks.Com- munications of the ACM, 63(11):139–144, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.874205Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:c7296b469ff1c08ae7b48b88139465118ea4c0a4aac248cc5ce94bffc4ca8d9b","observation_id":"3861b555-1b85-4530-9545-45c717f40904","resolution":{"observed_at":"2026-08-11T05:19:18.874205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04659","last_updated":"2023-02-09T14:24:01Z","snapshot_observed_at":"2026-08-18T12:59:35.154897Z","submitted_at":"2023-02-09T14:24:01Z","title":"ManiSkill2: A Unified Benchmark for Generalizable Manipulation Skills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04659","snapshot_observed_at":"2026-08-11T05:19:18.877567Z","title":"Maniskill2: A unified bench- mark for generalizable manipulation skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.877567Z"},"links":{"cited_paper":"/paper/2302.04659","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:9f94a1129ce99660207ff72ee178e927dc083ca50505df26577a2ce770851b48","observation_id":"0a98de62-7c61-46dc-a5d7-a8870ba8bdcd","resolution":{"observed_at":"2026-08-11T05:19:18.877567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05695","last_updated":"2024-05-18T10:00:30Z","snapshot_observed_at":"2026-08-16T14:02:39.085762Z","submitted_at":"2024-04-08T17:26:28Z","title":"Humanoid-Gym: Reinforcement Learning for Humanoid Robot with Zero-Shot Sim2Real Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05695","snapshot_observed_at":"2026-08-11T05:19:18.881244Z","title":"Humanoid- gym: Reinforcement learning for humanoid robot with zero-shot sim2real transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.881244Z"},"links":{"cited_paper":"/paper/2404.05695","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:9be64859befa58015e5beddf0fedec48afdad7f3d4647e8150668edfb5eaf0c0","observation_id":"704da6a1-d5a4-47d4-b0cf-7886aca63e5d","resolution":{"observed_at":"2026-08-11T05:19:18.881244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-11T05:19:18.884429Z","title":"Td-mpc2: Scalable, robust world models for continuous control.arXiv preprint arXiv:2310.16828, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.884429Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:f1479077ed186c44527f31f316087465e10b2336490d695a846cdb4e86afe264","observation_id":"e95de61e-de2f-47a6-b1f0-a5bd8a33f9c5","resolution":{"observed_at":"2026-08-11T05:19:18.884429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18418","last_updated":"2025-05-14T18:27:05Z","snapshot_observed_at":"2026-08-16T13:48:30.228926Z","submitted_at":"2024-05-28T17:57:23Z","title":"Hierarchical World Models as Visual Whole-Body Humanoid Controllers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18418","snapshot_observed_at":"2026-08-11T05:19:18.887553Z","title":"Hierarchical world models as visual whole-body humanoid controllers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.887553Z"},"links":{"cited_paper":"/paper/2405.18418","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:37de53c0e304318f6bb0d0fc3ac21216e8b4c8e5fc9eecc4dab6dc6d2f20b4a8","observation_id":"87e7e531-6447-40ec-b399-7ec1da287b8b","resolution":{"observed_at":"2026-08-11T05:19:18.887553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.890743Z","title":"Resolving 3d human pose ambiguities with 3d scene constraints","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.890743Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:1fc1ac3717d2ffa29d7b112b619b86cae3a8dd00637907514de3aabb3a1f6ee7","observation_id":"9a849e6c-9865-4d11-90dd-07e65db71347","resolution":{"observed_at":"2026-08-11T05:19:18.890743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.893329Z","title":"Stochas- tic scene-aware motion prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.893329Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:1ffb9134fdb8c7a7455e2db8903944cd3811571c6014620f29278534dac88e99","observation_id":"42c7cc37-dc44-4f22-899e-188fa2d2ee14","resolution":{"observed_at":"2026-08-11T05:19:18.893329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.896170Z","title":"Synthesizing phys- ical character-scene interactions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.896170Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:2516a1f37af9630db229c8377f9b6f70afa08209dfa29c29844a6c92c6b647d7","observation_id":"576ba209-b585-4a0b-9292-3baf5a86caf5","resolution":{"observed_at":"2026-08-11T05:19:18.896170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08858","last_updated":"2024-06-13T06:44:46Z","snapshot_observed_at":"2026-08-19T21:16:35.742198Z","submitted_at":"2024-06-13T06:44:46Z","title":"OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08858","snapshot_observed_at":"2026-08-11T05:19:18.900085Z","title":"Omnih2o: Universal and dexterous human- to-humanoid whole-body teleoperation and learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.900085Z"},"links":{"cited_paper":"/paper/2406.08858","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:b1d058969902c97d994433fe9608fed95f20bb2e914ac72946341d78a045ce09","observation_id":"c4ef2b71-dfad-4691-a717-93ab8611e081","resolution":{"observed_at":"2026-08-11T05:19:18.900085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04436","last_updated":"2024-03-07T12:10:41Z","snapshot_observed_at":"2026-08-19T20:01:24.150265Z","submitted_at":"2024-03-07T12:10:41Z","title":"Learning Human-to-Humanoid Real-Time Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04436","snapshot_observed_at":"2026-08-11T05:19:18.903701Z","title":"Learning human- to-humanoid real-time whole-body teleoperation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.903701Z"},"links":{"cited_paper":"/paper/2403.04436","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:c4387b234ce408eb5b5c1add31f050a9b838752736e99024fe1ae1307371de0c","observation_id":"de10ed6e-5cc5-4f06-beaa-164615942c99","resolution":{"observed_at":"2026-08-11T05:19:18.903701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21229","last_updated":"2025-03-06T07:50:56Z","snapshot_observed_at":"2026-08-20T09:50:25.144827Z","submitted_at":"2024-10-28T17:15:24Z","title":"HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21229","snapshot_observed_at":"2026-08-11T05:19:18.906685Z","title":"Hover: Versatile neural whole-body controller for humanoid robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.906685Z"},"links":{"cited_paper":"/paper/2410.21229","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:6cbb60992e252e4b1e14fdbcce77c853e71e6721cdcbf7739836821a8b2298c2","observation_id":"5c0b71b0-797f-4df8-a612-96d2a991653a","resolution":{"observed_at":"2026-08-11T05:19:18.906685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12821","last_updated":"2023-05-22T08:29:00Z","snapshot_observed_at":"2026-08-22T02:52:38.073721Z","submitted_at":"2023-05-22T08:29:00Z","title":"FurnitureBench: Reproducible Real-World Benchmark for Long-Horizon Complex Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12821","snapshot_observed_at":"2026-08-11T05:19:18.909605Z","title":"Furniturebench: Reproducible real-world benchmark for long-horizon complex manipulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.909605Z"},"links":{"cited_paper":"/paper/2305.12821","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:5a5e74c71fae5ee5d4b73f5cd9f505bcf3a875a3fd14e3842a30dbbe2e20a992","observation_id":"64aa6a2e-8205-44f2-b8b8-d5ecb05bdd24","resolution":{"observed_at":"2026-08-11T05:19:18.909605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.912607Z","title":"Intercap: Joint markerless 3d tracking of humans and objects in interaction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.912607Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:3c4662a2274dc791244df5ccef2ff39c0824df3d0f11bc1559325c2b216e0c19","observation_id":"4f052364-a733-4bbe-b132-fd55b83aaa0f","resolution":{"observed_at":"2026-08-11T05:19:18.912607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.915789Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.915789Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:dfdce3804a899364765e7ee9a0b4cc61cd12c73931f503bd2dfbe092b5f7ac7b","observation_id":"3bbd1945-ac34-4b9c-bad9-2b58c401f3ba","resolution":{"observed_at":"2026-08-11T05:19:18.915789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.918843Z","title":"Rlbench: The robot learning benchmark & learning environment","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.918843Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:480bd6ef23065347c7cf0959b481cebb27c3d00f39c0c5b0e2931b80f1cf55ab","observation_id":"627a4601-b197-4c61-b69d-d3681b88b76d","resolution":{"observed_at":"2026-08-11T05:19:18.918843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.921922Z","title":"Dtc: Deep tracking control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.921922Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:261ae329a5e863aa57e57c17ea9a82d8e69afc449a2381dca088cc1e25f3defd","observation_id":"b5b92b24-5fa3-48a6-a210-95f7ae201d6a","resolution":{"observed_at":"2026-08-11T05:19:18.921922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14606","last_updated":"2024-02-22T14:54:28Z","snapshot_observed_at":"2026-08-16T14:16:13.369792Z","submitted_at":"2024-02-22T14:54:28Z","title":"Towards Diverse Behaviors: A Benchmark for Imitation Learning with Human Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14606","snapshot_observed_at":"2026-08-11T05:19:18.924685Z","title":"Towards diverse behaviors: A benchmark for imitation learning with human demonstrations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.924685Z"},"links":{"cited_paper":"/paper/2402.14606","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:0576389b9427749941fe75b4ff865c30d94cc64d1c215bae0c675e3597060685","observation_id":"b0d97ae4-6ead-4a36-bc3f-5a334f983f77","resolution":{"observed_at":"2026-08-11T05:19:18.924685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.927517Z","title":"Full-body articulated human-object interac- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.927517Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:6661b7e66fa157f80972e4e725296a5e7b64775ea9cb982531efce861a1f47ce","observation_id":"126175a7-c3f7-4c7f-98ae-fc2ea9a636c8","resolution":{"observed_at":"2026-08-11T05:19:18.927517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08629","last_updated":"2024-05-24T09:11:04Z","snapshot_observed_at":"2026-08-16T14:10:08.765768Z","submitted_at":"2024-03-13T15:45:04Z","title":"Scaling Up Dynamic Human-Scene Interaction Modeling","version":2},"cited_work":{"arxiv_id":"2403.08629","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.08629","snapshot_observed_at":"2026-08-11T05:19:19.759617Z","title":"Scaling Up Dynamic Human-Scene Interaction Modeling","venue":"cs.CV","work_id":"7266d736-4ec5-40fb-92ec-2886b8dd33a9","year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.930961Z"},"links":{"cited_paper":"/paper/2403.08629","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a834a59b4058ab3ecfe92297aed0ce022f03c580a931018309fa46472217d44d","observation_id":"ad1464fd-553a-45e2-bb2c-61324baf1afb","resolution":{"observed_at":"2026-08-11T05:19:19.763595Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.934270Z","title":"Scaling up dynamic human-scene interaction mod- eling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.934270Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:0eddb10c021222191d703107c8f26411c68690ce7643079c96b97b3c401e1aba","observation_id":"8c2bb21c-a048-4af4-96de-abb7432892ee","resolution":{"observed_at":"2026-08-11T05:19:18.934270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12773","last_updated":"2024-10-16T17:48:50Z","snapshot_observed_at":"2026-08-19T20:26:51.223935Z","submitted_at":"2024-10-16T17:48:50Z","title":"Harmon: Whole-Body Motion Generation of Humanoid Robots from Language Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12773","snapshot_observed_at":"2026-08-11T05:19:18.937404Z","title":"Harmon: Whole-body motion generation of humanoid robots from language descriptions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.937404Z"},"links":{"cited_paper":"/paper/2410.12773","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:4d4b18dae2f87d2aa9edd040030922c0e001cad3b64bcfd8bcb59e7edbd44b05","observation_id":"92c981e3-6208-4519-8451-319abb053be0","resolution":{"observed_at":"2026-08-11T05:19:18.937404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24185","last_updated":"2025-03-06T05:34:17Z","snapshot_observed_at":"2026-08-19T21:18:09.402808Z","submitted_at":"2024-10-31T17:48:45Z","title":"DexMimicGen: Automated Data Generation for Bimanual Dexterous Manipulation via Imitation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24185","snapshot_observed_at":"2026-08-11T05:19:18.941016Z","title":"Dexmim- icgen: Automated data generation for bimanual dexter- ous manipulation via imitation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.941016Z"},"links":{"cited_paper":"/paper/2410.24185","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:45a9d958f1bcef85bea499eb821ccf9342f0b473a1de51ff3d833453963f6d97","observation_id":"7a44e4d5-305c-4150-b66a-4208244f55aa","resolution":{"observed_at":"2026-08-11T05:19:18.941016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.944809Z","title":"Padl: Language-directed physics-based character control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.944809Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:cfb31c078a40b0e3b45f50b085b74db3d9eb4e12d91363947b09306d008bf6ed","observation_id":"6eb1a89d-1e2b-4a79-86ad-dbf7a1fb5a0d","resolution":{"observed_at":"2026-08-11T05:19:18.944809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.947957Z","title":"Unicon: Combat- ing label noise through uniform selection and contrastive learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.947957Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:1a3ccb5d7a4e5634d09b97f6a9575c33d358a3317efa17e0a06878c28429646b","observation_id":"4bcc1d44-a8c1-4a58-b427-70b5913f15f3","resolution":{"observed_at":"2026-08-11T05:19:18.947957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.950728Z","title":"Devel- opment of life-sized high-power humanoid robot jaxon for real-world use","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.950728Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:899d071fa26dee4a86150791739da1a7da057d8f3f1eea8e38c63a6cc21ac997","observation_id":"2deb9802-492b-4fe3-b895-158687f5d2ee","resolution":{"observed_at":"2026-08-11T05:19:18.950728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07511","last_updated":"2023-07-14T17:59:38Z","snapshot_observed_at":"2026-08-16T15:16:09.684075Z","submitted_at":"2023-07-14T17:59:38Z","title":"NIFTY: Neural Object Interaction Fields for Guided Human Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07511","snapshot_observed_at":"2026-08-11T05:19:18.953732Z","title":"Nifty: Neural object interaction fields for guided human motion synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.953732Z"},"links":{"cited_paper":"/paper/2307.07511","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:19be24352cb9d19c52070349ac6167f6a47471cafbeadb1f9c32e3dea157a443","observation_id":"53eae60d-be8c-480f-bf4b-992dcbcd65e2","resolution":{"observed_at":"2026-08-11T05:19:18.953732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.957148Z","title":"Fast, strong and compliant pneumatic actuation for dexterous tendon- driven hands","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.957148Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:e1e34df1cec710d1b09e0198764c8b721e02429e9a9d3c2f73b4256709b5d1c0","observation_id":"983a79ec-2e80-4fc3-94da-04b4dd29ad78","resolution":{"observed_at":"2026-08-11T05:19:18.957148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03913","last_updated":"2024-07-14T23:00:54Z","snapshot_observed_at":"2026-08-21T21:36:23.765699Z","submitted_at":"2023-12-06T21:14:20Z","title":"Controllable Human-Object Interaction Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03913","snapshot_observed_at":"2026-08-11T05:19:18.960179Z","title":"Controllable human-object interaction synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.960179Z"},"links":{"cited_paper":"/paper/2312.03913","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:fb59a66ea0eaa22603a0b4d3dcf847ae894fb9a7ddefce6d1bd2766bdd9a9838","observation_id":"4d63c9b5-00e2-4028-abe4-7f455b7d5829","resolution":{"observed_at":"2026-08-11T05:19:18.960179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.963210Z","title":"Object motion guided human motion synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.963210Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:ac6d1daa098c97bba4bedc615c2b67cdd7e47f5f3c5eef88beb94808ea033a25","observation_id":"62d4579e-5e52-4f1f-80d8-1749310052c5","resolution":{"observed_at":"2026-08-11T05:19:18.963210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11792","last_updated":"2024-10-15T17:17:54Z","snapshot_observed_at":"2026-08-19T21:39:55.065669Z","submitted_at":"2024-10-15T17:17:54Z","title":"OKAMI: Teaching Humanoid Robots Manipulation Skills through Single Video Imitation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11792","snapshot_observed_at":"2026-08-11T05:19:18.965900Z","title":"Okami: Teaching humanoid robots manipulation skills through single video imitation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.965900Z"},"links":{"cited_paper":"/paper/2410.11792","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:05a715fee68c134d4451b87188c18e740415b23b56b00bdee599412211758b34","observation_id":"d5923a76-7bd3-42b9-ab89-2826f390f7a3","resolution":{"observed_at":"2026-08-11T05:19:18.965900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21781","last_updated":"2024-07-31T17:52:55Z","snapshot_observed_at":"2026-08-20T12:00:28.667633Z","submitted_at":"2024-07-31T17:52:55Z","title":"Berkeley Humanoid: A Research Platform for Learning-based Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21781","snapshot_observed_at":"2026-08-11T05:19:18.970502Z","title":"Berkeley humanoid: A research platform for learning-based control.arXiv preprint arXiv:2407.21781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.970502Z"},"links":{"cited_paper":"/paper/2407.21781","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:54f531fb5a7c0e1d60072ec232866a2551b4b778bcb79a284839822670666a7a","observation_id":"53e5ec65-8ca3-429b-b529-119f87edb739","resolution":{"observed_at":"2026-08-11T05:19:18.970502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.974089Z","title":"Opt2skill: Imitating dynamically- feasible whole-body trajectories for versatile humanoid loco-manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.974089Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:26c418d09451da033b06be1a6687219d608ad90eb684a08343349a02ec40cb61","observation_id":"45a2a7c5-a687-4ffd-a177-dc2b2de51368","resolution":{"observed_at":"2026-08-11T05:19:18.974089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08983","last_updated":"2024-02-05T13:39:03Z","snapshot_observed_at":"2026-08-17T18:11:36.764343Z","submitted_at":"2023-12-14T14:29:52Z","title":"Interactive Humanoid: Online Full-Body Motion Reaction Synthesis with Social Affordance Canonicalization and Forecasting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08983","snapshot_observed_at":"2026-08-11T05:19:18.977547Z","title":"Interactive humanoid: Online full-body motion reaction synthesis with social af- fordance canonicalization and forecasting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.977547Z"},"links":{"cited_paper":"/paper/2312.08983","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:6114e1f80b7a526064de33aa3cd991a685164624453f0ef5712cb2b562349406","observation_id":"adf6421c-188d-45f7-a6d8-6d2ea1dbe734","resolution":{"observed_at":"2026-08-11T05:19:18.977547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.981819Z","title":"Dynamics-regulated kinematic policy for egocentric pose estimation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.981819Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:295a86ec832bf300bae74a9ae15c286191402de5f1d466d8270b62f22cb57a52","observation_id":"54c37ac9-6fd2-4664-a38d-95eebf32f664","resolution":{"observed_at":"2026-08-11T05:19:18.981819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.984670Z","title":"Perpetual humanoid control for real-time simulated avatars","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.984670Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:297e85e99bf06070af60ccfc4c387e7416f823119020f178a53befdd13e73827","observation_id":"e2ff78ec-025b-40ec-bab2-09d4b2fbd53e","resolution":{"observed_at":"2026-08-11T05:19:18.984670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04582","last_updated":"2024-04-12T03:33:31Z","snapshot_observed_at":"2026-08-16T14:54:21.317439Z","submitted_at":"2023-10-06T20:48:43Z","title":"Universal Humanoid Motion Representations for Physics-Based Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04582","snapshot_observed_at":"2026-08-11T05:19:18.987220Z","title":"Universal hu- manoid motion representations for physics-based control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.987220Z"},"links":{"cited_paper":"/paper/2310.04582","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:889750486a0545da1f7134260e148ec183bb1a3aa13927e3a4716ddf9b57ba8e","observation_id":"21c45de2-faac-406f-9150-ecbe1c1b2890","resolution":{"observed_at":"2026-08-11T05:19:18.987220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00187","last_updated":"2024-06-28T18:53:05Z","snapshot_observed_at":"2026-08-16T19:19:32.506013Z","submitted_at":"2024-06-28T18:53:05Z","title":"SMPLOlympics: Sports Environments for Physically Simulated Humanoids","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00187","snapshot_observed_at":"2026-08-11T05:19:18.991013Z","title":"Smplolympics: Sports environ- ments for physically simulated humanoids","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.991013Z"},"links":{"cited_paper":"/paper/2407.00187","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:43dbc590958e11bb8ebd6ce5831977408e1946ca5f757190aeede39bf6a7298a","observation_id":"69aac4d0-d43f-4913-99a3-787f5c020a2d","resolution":{"observed_at":"2026-08-11T05:19:18.991013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:18.993924Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.993924Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:3bf1b55a7bdd88af8c51e383638560218954abd2a9eb3f1a82221b54aef2dc48","observation_id":"836312f4-e48e-4d53-a8dc-627d5317ec33","resolution":{"observed_at":"2026-08-11T05:19:18.993924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-11T05:19:18.996742Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:18.996742Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:6493896e8e469163528dc0fb3653056538997daca34c5b14d28f7f7f044a8441","observation_id":"e6aaf096-c257-4a4f-ba5c-1d00821f40bf","resolution":{"observed_at":"2026-08-11T05:19:18.996742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14612","last_updated":"2024-07-19T18:12:12Z","snapshot_observed_at":"2026-08-16T13:32:36.880491Z","submitted_at":"2024-07-19T18:12:12Z","title":"A Biomechanics-Inspired Approach to Soccer Kicking for Humanoid Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14612","snapshot_observed_at":"2026-08-11T05:19:19.000520Z","title":"A biomechanics-inspired approach to soccer kicking for humanoid robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.000520Z"},"links":{"cited_paper":"/paper/2407.14612","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:f0b20f410ca486678ca2c29716e670770ba223047a0686dd5b94c48429f143be","observation_id":"07fd1e81-c72f-425d-8163-a1574a89b6ca","resolution":{"observed_at":"2026-08-11T05:19:19.000520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.003277Z","title":"Simitate: A hybrid imitation learning benchmark","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.003277Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:5c2a4f50fcb67e2a67389ae1ed736e188ce50f99be44ce3ebaf175658ff70f15","observation_id":"2741e9c2-a093-4159-be01-eebf3d7832f0","resolution":{"observed_at":"2026-08-11T05:19:19.003277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.006417Z","title":"Online adaptive motion gen- eration for humanoid locomotion on non-flat terrain via template behavior extension","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.006417Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:9ceaec3be12895626fae0ff135e4f2a3fa971bad05b03b4f73e1bffabea4d9d9","observation_id":"c9ea90e8-4a55-422b-a676-67bd54f3d94d","resolution":{"observed_at":"2026-08-11T05:19:19.006417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.009544Z","title":"Catch & carry: reusable neu- ral controllers for vision-guided whole-body tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.009544Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:1aea8d70ffd9c8a505a6dfac5b949b18e4cd8323474e4fbd95edb5bb0fe89978","observation_id":"d182eeec-c126-406b-b95f-65f8366bda3d","resolution":{"observed_at":"2026-08-11T05:19:19.009544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.012518Z","title":"Elevation mapping for locomotion and navigation using gpu","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.012518Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:c789118ae41612a23a45fbf13cd87c34a031bdc090025e53c4559b25468b5787","observation_id":"4cce9e98-68c7-42fb-828f-50b502b86565","resolution":{"observed_at":"2026-08-11T05:19:19.012518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.015440Z","title":"Chang, Li Yi, Subarna Tripathi, Leonidas J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.015440Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a66fdaf7713c4a3736edf2fe2f6430f20365caefcb13cd06d0176d90954929ec","observation_id":"0ca8b6a2-02a4-4ae9-a24f-a57d16d71ea0","resolution":{"observed_at":"2026-08-11T05:19:19.015440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14483","last_updated":"2021-11-04T12:11:21Z","snapshot_observed_at":"2026-08-16T18:06:24.201768Z","submitted_at":"2021-07-30T08:20:22Z","title":"ManiSkill: Generalizable Manipulation Skill Benchmark with Large-Scale Demonstrations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14483","snapshot_observed_at":"2026-08-11T05:19:19.018558Z","title":"Maniskill: Generalizable manipulation skill bench- mark with large-scale demonstrations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.018558Z"},"links":{"cited_paper":"/paper/2107.14483","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a37aba334fab636bd96bfa656873d3a77e354f7591141a2181b673447e4587b6","observation_id":"684ece2b-5bd4-4585-ba65-abd830c331cb","resolution":{"observed_at":"2026-08-11T05:19:19.018558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.021639Z","title":"Synthesiz- ing physically plausible human motions in 3d scenes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.021639Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:aa81b7375ef5caf6902170f3ce5a33e4a833d27d2b8fef213fc3e8579c8bc305","observation_id":"b1ea3b71-97ed-443e-b66e-eec3496d1d3e","resolution":{"observed_at":"2026-08-11T05:19:19.021639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.024320Z","title":"Expressive body capture: 3d hands, face, and body from a single image","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.024320Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:633724ddae2d579f71262a8b7b7b19cf19d318a830aa042730a86818d8a00ded","observation_id":"31af5cda-583f-4361-a223-d4b8e201d3ec","resolution":{"observed_at":"2026-08-11T05:19:19.024320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06553","last_updated":"2025-07-07T05:09:32Z","snapshot_observed_at":"2026-08-20T10:40:30.650361Z","submitted_at":"2023-12-11T17:41:17Z","title":"HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06553","snapshot_observed_at":"2026-08-11T05:19:19.027080Z","title":"Hoi-diff: Text-driven syn- thesis of 3d human-object interactions using diffusion mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.027080Z"},"links":{"cited_paper":"/paper/2312.06553","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:ce8f7096268eccdd6ef78ae552b5b7a19ab9edb88f63a912fb42bbbb9b4b507c","observation_id":"9c231415-547c-4fbc-a454-b27c14b07eb0","resolution":{"observed_at":"2026-08-11T05:19:19.027080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.030926Z","title":"Deepmimic: Example-guided deep rein- forcement learning of physics-based character skills","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.030926Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:709da9edc66867f79bddf3e60205d3fc114b20fcfa4677e20cde99bd9e20fbee","observation_id":"cd5be3fd-db00-4aa8-824a-bab62edcea94","resolution":{"observed_at":"2026-08-11T05:19:19.030926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.034365Z","title":"Amp: Adversarial motion priors for stylized physics-based character control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.034365Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:99342b7f94b9ffa597fe261bbbb0e4f57b29774498819fa17a788c72352e9e74","observation_id":"c10ff7b3-5487-416b-92d1-02b2758f0de5","resolution":{"observed_at":"2026-08-11T05:19:19.034365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.037408Z","title":"Ase: Large-scale reusable adversarial skill embeddings for physically simulated characters","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.037408Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a04531ce8fadc1736d30f33d67bb17a881a88c96bf7400e5930d5ca9e9d0757b","observation_id":"12ebdd80-a3ee-42bd-891f-03106c930a77","resolution":{"observed_at":"2026-08-11T05:19:19.037408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09464","last_updated":"2018-03-10T18:11:25Z","snapshot_observed_at":"2026-08-14T19:42:01.790871Z","submitted_at":"2018-02-26T17:20:14Z","title":"Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09464","snapshot_observed_at":"2026-08-11T05:19:19.040108Z","title":"Multi-goal reinforcement learning: Challenging robotics environments and request for research","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.040108Z"},"links":{"cited_paper":"/paper/1802.09464","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:83927cbdfa1c3dcba6cab4ccdbb7688c321aa9f4755b037dec4d66b28eed288b","observation_id":"515a57b4-4c8a-4839-b3a2-ee77ed65d582","resolution":{"observed_at":"2026-08-11T05:19:19.040108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01402","last_updated":"2024-05-20T12:15:56Z","snapshot_observed_at":"2026-08-16T23:15:40.244750Z","submitted_at":"2024-05-02T15:53:43Z","title":"Learning Force Control for Legged Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01402","snapshot_observed_at":"2026-08-11T05:19:19.043548Z","title":"Learning force control for legged manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.043548Z"},"links":{"cited_paper":"/paper/2405.01402","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:5ff013d0b8aef84472e00fe53bb38babf4a1d6d35576dad49febbd55ca53d866","observation_id":"af1f36c9-7301-435b-aaa1-9813f69b7a87","resolution":{"observed_at":"2026-08-11T05:19:19.043548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19469","last_updated":"2024-02-29T18:57:37Z","snapshot_observed_at":"2026-08-20T14:59:44.264279Z","submitted_at":"2024-02-29T18:57:37Z","title":"Humanoid Locomotion as Next Token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19469","snapshot_observed_at":"2026-08-11T05:19:19.046581Z","title":"Humanoid locomotion as next token prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.046581Z"},"links":{"cited_paper":"/paper/2402.19469","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:fac44c076c4c2358e8019f2efe095d34d27eeaeddc01d725196b7884b2707079","observation_id":"bbdb8530-655a-4fcb-9947-41359c519e79","resolution":{"observed_at":"2026-08-11T05:19:19.046581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.049871Z","title":"Trace and pace: Controllable pedestrian animation via guided tra- jectory diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.049871Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:4506e7e2fb4ea05f7d96560f8e592ef491b455868732ad369ab987c4a584dcff","observation_id":"3011370e-edac-4c65-8106-b8af28ed2d73","resolution":{"observed_at":"2026-08-11T05:19:19.049871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03274","last_updated":"2023-04-26T06:29:21Z","snapshot_observed_at":"2026-08-18T20:54:05.412118Z","submitted_at":"2023-04-06T17:56:22Z","title":"DiffMimic: Efficient Motion Mimicking with Differentiable Physics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03274","snapshot_observed_at":"2026-08-11T05:19:19.052599Z","title":"Diffmimic: Efficient motion mimicking with differentiable physics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.052599Z"},"links":{"cited_paper":"/paper/2304.03274","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:dec4eb988069adaf762d6990cfceedbf12c120bacbee0a395f8f0c3acc927f09","observation_id":"6a2b3bee-446b-4ab9-9423-334439662134","resolution":{"observed_at":"2026-08-11T05:19:19.052599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T05:19:19.056027Z","title":"Proximal policy optimization al- gorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.056027Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:b38656895cad5be3fcc8183fa3f2418fad18cdccb7fc8f0d13c81eec07301f30","observation_id":"a756f0bf-eccc-4a6a-8ea9-d60e92c95e0a","resolution":{"observed_at":"2026-08-11T05:19:19.056027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.058979Z","title":"Deep imita- tion learning for humanoid loco-manipulation through hu- man teleoperation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.058979Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:22bf7a4b14cf293dc144b0c8348c7dc9f247600afb5ddee04acb4909bef7cf67","observation_id":"565a3601-244b-471e-a6b0-77e31acb7f30","resolution":{"observed_at":"2026-08-11T05:19:19.058979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.061859Z","title":"Vmp: Versatile motion priors for ro- bustly tracking motion on physical characters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.061859Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:992ca258744fe1f76291cc22aad36e612a7ae49a252a59caf7ea7745c734ce7d","observation_id":"f8dffec8-f911-4905-a1b2-a6bfe4897d93","resolution":{"observed_at":"2026-08-11T05:19:19.061859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10506","last_updated":"2024-06-18T18:11:07Z","snapshot_observed_at":"2026-08-19T08:20:22.286458Z","submitted_at":"2024-03-15T17:45:44Z","title":"HumanoidBench: Simulated Humanoid Benchmark for Whole-Body Locomotion and Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10506","snapshot_observed_at":"2026-08-11T05:19:19.064523Z","title":"Humanoidbench: Simulated humanoid benchmark for whole-body locomotion and ma- nipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.064523Z"},"links":{"cited_paper":"/paper/2403.10506","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:b7a165c10686d96f1d4612b208d297b049d2134f2c8fdb64dc81cc665f5a4a0d","observation_id":"d8025dc4-7ead-4c19-958e-4f4aeb838564","resolution":{"observed_at":"2026-08-11T05:19:19.064523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14326","last_updated":"2023-07-26T17:45:55Z","snapshot_observed_at":"2026-08-20T15:06:50.954281Z","submitted_at":"2023-07-26T17:45:55Z","title":"Waypoint-Based Imitation Learning for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14326","snapshot_observed_at":"2026-08-11T05:19:19.068221Z","title":"Waypoint-based imitation learning for robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.068221Z"},"links":{"cited_paper":"/paper/2307.14326","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:eeabfc323e26754086b810e5f851e258e255a7ebba744d5c02dc7bce72714b30","observation_id":"73e6e832-f19d-4bab-b893-a399b073ba46","resolution":{"observed_at":"2026-08-11T05:19:19.068221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.071695Z","title":"Learn- ing structured output representation using deep conditional generative models","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.071695Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:a50166a3b6d22ef7dcdff4266d95ee1981d4dafb97a2e88fede04c314e4b3802","observation_id":"ac02e224-7dab-41d6-9eab-418f5822a2f5","resolution":{"observed_at":"2026-08-11T05:19:19.071695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.074619Z","title":"Neural state machine for character-scene interactions.ACM Trans","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.074619Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:afbb4e3c34e64abccd4fec2525ed59a8f57e550a5c6df328b0b468c9441eb932","observation_id":"a79820f3-07c7-41a7-a99d-4704223b985c","resolution":{"observed_at":"2026-08-11T05:19:19.074619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.077518Z","title":"Neural state machine for character-scene interactions.ACM Transactions on Graphics, 38(6):178, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.077518Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:1a15bd90d423e1315939494c870b68ea80ef587d143fd25ca1b92d25955f1ddb","observation_id":"dd0aed74-6f10-4ae5-a782-0083bd2d8a98","resolution":{"observed_at":"2026-08-11T05:19:19.077518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.080357Z","title":"Robustfusion: Robust volu- metric performance reconstruction under human-object in- teractions from monocular rgbd stream","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.080357Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:f1c6c3e219dc4fa550e2cb4e2e9dce789cda8bae0030c8f19add9087e6cede12","observation_id":"aed342da-22cc-427b-bcbc-39c0663295e8","resolution":{"observed_at":"2026-08-11T05:19:19.080357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.083154Z","title":"Humanmimic: Learning natural locomo- tion and transitions for humanoid robot via wasserstein ad- versarial imitation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.083154Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:c05db4da67c5d45c28ebd09367ade7c4ae3a740aa563b95b13bb7a746b0ca719","observation_id":"f13d525c-3fa9-4434-b599-f07f5830e63f","resolution":{"observed_at":"2026-08-11T05:19:19.083154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-20T08:13:02.541942Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-11T05:19:19.086253Z","title":"Deepmind control suite","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.086253Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:b02d1fdf8ed6d71e95f860fad92e6bd176a58795019d61e231132f5d93e6c695","observation_id":"477d9800-9cd4-4f15-bd20-12d6563daecb","resolution":{"observed_at":"2026-08-11T05:19:19.086253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.090304Z","title":"Calm: Conditional ad- versarial latent models for directable virtual characters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.090304Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:142172fdecb96504e6d42c49dccefdda7a95828baaa31b7de5955ab404d41488","observation_id":"af582dcf-8b94-4b42-9beb-4be85abf6bd0","resolution":{"observed_at":"2026-08-11T05:19:19.090304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14393","last_updated":"2024-09-22T11:10:59Z","snapshot_observed_at":"2026-08-16T13:16:32.391270Z","submitted_at":"2024-09-22T11:10:59Z","title":"MaskedMimic: Unified Physics-Based Character Control Through Masked Motion Inpainting","version":1},"cited_work":{"arxiv_id":"2409.14393","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.14393","snapshot_observed_at":"2026-08-11T05:19:19.472736Z","title":"MaskedMimic: Unified Physics-Based Character Control Through Masked Motion Inpainting","venue":"cs.AI","work_id":"ceb78146-28c0-4f75-9747-8e357b7c968a","year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.093732Z"},"links":{"cited_paper":"/paper/2409.14393","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:825e28618f5e429ffdddc5e88350d08a66345c2f2c464b16df8c8bee4def702e","observation_id":"c8b6b287-33d9-48c5-b855-9d394a81a7c9","resolution":{"observed_at":"2026-08-11T05:19:19.476435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03441","last_updated":"2024-10-04T13:56:48Z","snapshot_observed_at":"2026-08-16T13:12:34.424178Z","submitted_at":"2024-10-04T13:56:48Z","title":"CLoSD: Closing the Loop between Simulation and Diffusion for multi-task character control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03441","snapshot_observed_at":"2026-08-11T05:19:19.096518Z","title":"Closd: Closing the loop between simula- tion and diffusion for multi-task character control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.096518Z"},"links":{"cited_paper":"/paper/2410.03441","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:7c3a9df15d3707bc3d10b4fa18759cfa78f9dabf3ca037025e72b8036b7d63df","observation_id":"85bd1775-b11c-4f4e-92ad-1f1644aa69c2","resolution":{"observed_at":"2026-08-11T05:19:19.096518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00960","last_updated":"2024-12-04T21:46:41Z","snapshot_observed_at":"2026-08-16T13:46:54.836903Z","submitted_at":"2024-06-03T03:31:37Z","title":"PDP: Physics-Based Character Animation via Diffusion Policy","version":2},"cited_work":{"arxiv_id":"2406.00960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00960","snapshot_observed_at":"2026-08-11T05:19:19.446180Z","title":"PDP: Physics-Based Character Animation via Diffusion Policy","venue":"cs.GR","work_id":"f4d02725-182c-4916-a1e5-9abd1297ef2e","year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.099937Z"},"links":{"cited_paper":"/paper/2406.00960","citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:b02b03911e0d8a46523917f22cd64593b149303f63515b73cc7b2d220672074e","observation_id":"9ab036c2-3711-4728-9f20-46e9d48376f3","resolution":{"observed_at":"2026-08-11T05:19:19.451576Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.102911Z","title":"Unitree’s first universal humanoid robot","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.102911Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:818398273fd296084e3b1a0bbcff14f567e719eb4f5bd3bed8f3b3a25bd79aab","observation_id":"fa0b5307-0cac-4f07-a117-700fe40cf8e8","resolution":{"observed_at":"2026-08-11T05:19:19.102911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:19:19.105644Z","title":"Unitree rl gym","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:19.105644Z"},"links":{"citing_paper":"/paper/2412.17730"},"observation_digest":"sha256:e57df84937f2392f3cc0ed661de64f695afc1f5f5180af2a131d2fd8311a430f","observation_id":"3118a447-3882-46c9-937a-6c32f1f1ac13","resolution":{"observed_at":"2026-08-11T05:19:19.105644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17730","last_updated":"2024-12-23T17:27:30Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T02:38:10.559377Z","submitted_at":"2024-12-23T17:27:30Z","title":"Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":135},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 10 inbound Pith citation observations for arXiv:2412.17730."}