{"as_of":"2026-08-19T09:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4d62e326a01fee80d4f7f55a2a2b69120eca4717cad5c06e185987c4b04d86e","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:51:50.755943Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.18046/citation-record","integrity":"/paper/2509.18046/integrity","json":"/paper/2509.18046/citation-record.json","paper":"/paper/2509.18046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.621121Z","title":"Advancements in humanoid robots: A comprehensive review and future prospects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.621121Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:ae369c8ea391cff802cbaae412e41ec97c962d5af71e5867c262db53558198e5","observation_id":"5614fd3e-7f35-44a4-a129-7bb0d13cebde","resolution":{"observed_at":"2026-08-04T15:51:50.621121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.628977Z","title":"Reinforcement learning in robotic applications: a comprehensive survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.628977Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:0f0de81625ba2488f6df60b470b4d847074404f4d642ea6015840e275de36cdd","observation_id":"1fab63ac-c489-4936-b7a0-b1e6ed191f63","resolution":{"observed_at":"2026-08-04T15:51:50.628977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.634466Z","title":"A comprehensive survey on humanoid robot development,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.634466Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:dc0fd9230af6dd7c9406fe9f9a33380f9fd50e79d01916148b3921200913cf31","observation_id":"888ec996-93d1-46c2-9556-09a6a01935db","resolution":{"observed_at":"2026-08-04T15:51:50.634466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.641308Z","title":"Teleoperation of humanoid robots: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.641308Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:8c540a5d5d9ce691cfa09f303dfce69cd34a13435e941e44173c2c89f39cd5ed","observation_id":"bc339678-607c-4c30-a359-ced574570e83","resolution":{"observed_at":"2026-08-04T15:51:50.641308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.647887Z","title":"Learning agile and dynamic motor skills for legged robots,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.647887Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:7ba8e01156a82df7f810cfe1ab6e4922ffa5005cc53104ab4c1a31f8da23250d","observation_id":"445469d6-58d4-4151-8a97-1fddef0d5cfc","resolution":{"observed_at":"2026-08-04T15:51:50.647887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.663390Z","title":"Learning quadrupedal locomotion over challenging terrain,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.663390Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:80846dedd9a00941d52f52c68829e1a62c3d6b34927c986275c9cc455d74d1a0","observation_id":"93a96076-dc11-449b-98ab-64055af883ff","resolution":{"observed_at":"2026-08-04T15:51:50.663390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-08-16T17:54:17.503988Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-04T15:51:50.669910Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.669910Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:f87f68a2986f0907779ea0d29a68ecf77abbdfe058637cd5036031541f7a3359","observation_id":"6696e8fd-b032-4923-af16-a615fe5efbc7","resolution":{"observed_at":"2026-08-04T15:51:50.669910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-08-18T15:06:14.253218Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-04T15:51:50.677905Z","title":"Rma: Rapid motor adaptation for legged robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.677905Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:023bd7d3a6460a414a566ec08edff3a67d4c4ff769dee1e9fc7643cdb14f9078","observation_id":"afbdb6b5-2968-412f-a626-b63b4f44a9ae","resolution":{"observed_at":"2026-08-04T15:51:50.677905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.686949Z","title":"Sim-to- real learning of all common bipedal gaits via periodic reward composition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.686949Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:7279fe0e75363e106856ea784877ea6dd9b118ee39d22ae717c6e75c8ed38d0c","observation_id":"7c70bd06-36e5-405c-9820-03799fbc1f63","resolution":{"observed_at":"2026-08-04T15:51:50.686949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.695300Z","title":"Reinforcement learning for robust parameterized locomotion control of bipedal robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.695300Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:00fac3474b37f9ea342fca90abc07f72b5ebf34182dbed10e88be2d902ae5177","observation_id":"83283a16-58f7-4486-8a5d-30677e8de08a","resolution":{"observed_at":"2026-08-04T15:51:50.695300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08328","last_updated":"2021-05-18T07:49:15Z","snapshot_observed_at":"2026-08-19T01:38:50.492592Z","submitted_at":"2021-05-18T07:49:15Z","title":"Blind Bipedal Stair Traversal via Sim-to-Real Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08328","snapshot_observed_at":"2026-08-04T15:51:50.702075Z","title":"Blind bipedal stair traversal via sim-to-real reinforce- ment learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.702075Z"},"links":{"cited_paper":"/paper/2105.08328","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:1fe1c2149672801bbce01fed7167bedf93fd682e977841f55d42f0b8cb7beaa7","observation_id":"d148a5eb-44ab-43be-81d9-2c8b62d6e559","resolution":{"observed_at":"2026-08-04T15:51:50.702075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02991","last_updated":"2020-02-07T19:40:59Z","snapshot_observed_at":"2026-08-13T23:34:15.294796Z","submitted_at":"2020-02-07T19:40:59Z","title":"Learning Whole-body Motor Skills for Humanoids","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02991","snapshot_observed_at":"2026-08-04T15:51:50.707129Z","title":"Learning whole-body motor skills for humanoids,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.707129Z"},"links":{"cited_paper":"/paper/2002.02991","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:c94c1e0c1d2ac9480a60e9ba83fd2a098daa644d87db4f20d719ba68a1bd7316","observation_id":"054be262-3706-4214-ad2b-c434c2078cae","resolution":{"observed_at":"2026-08-04T15:51:50.707129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.00534","last_updated":"2021-06-01T14:51:12Z","snapshot_observed_at":"2026-08-16T18:20:32.371603Z","submitted_at":"2021-06-01T14:51:12Z","title":"DeepWalk: Omnidirectional Bipedal Gait by Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.00534","snapshot_observed_at":"2026-08-04T15:51:50.712600Z","title":"Deepwalk: Omnidirectional bipedal gait by deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.712600Z"},"links":{"cited_paper":"/paper/2106.00534","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:188f77b8360e1554020b4289c502288f0dc08bbd8debb67bc974a264f84e4ac1","observation_id":"6daf4b9a-fbee-4a06-bd3d-a5c2d82e369e","resolution":{"observed_at":"2026-08-04T15:51:50.712600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15309","last_updated":"2021-03-29T03:33:52Z","snapshot_observed_at":"2026-08-16T18:35:42.288346Z","submitted_at":"2021-03-29T03:33:52Z","title":"Robust Feedback Motion Policy Design Using Reinforcement Learning on a 3D Digit Bipedal Robot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15309","snapshot_observed_at":"2026-08-04T15:51:50.718680Z","title":"Robust feedback motion policy design using reinforcement learning on a 3d digit bipedal robot,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.718680Z"},"links":{"cited_paper":"/paper/2103.15309","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:fe7f95cff9286f28b14fa5392c69add28a1caa91098cab8db71a71e7bd5ca6f0","observation_id":"7063757d-ab51-48ad-a26a-7879e874448c","resolution":{"observed_at":"2026-08-04T15:51:50.718680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04323","last_updated":"2020-08-30T00:45:00Z","snapshot_observed_at":"2026-08-18T21:28:37.623309Z","submitted_at":"2020-05-09T00:16:38Z","title":"ALLSTEPS: Curriculum-driven Learning of Stepping Stone Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.04323","snapshot_observed_at":"2026-08-04T15:51:50.724880Z","title":"Allsteps: Curriculum-driven learning of stepping stone skills,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.724880Z"},"links":{"cited_paper":"/paper/2005.04323","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:8982f95d977bdd684da6d144f0e0e370b5bd383ea8ed0ec1cbccf83d616d3daa","observation_id":"5aabc96b-c7ab-45f4-ac27-011e6ca243fb","resolution":{"observed_at":"2026-08-04T15:51:50.724880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01807","last_updated":"2022-05-03T22:29:33Z","snapshot_observed_at":"2026-08-16T17:02:47.211486Z","submitted_at":"2022-05-03T22:29:33Z","title":"Learning Dynamic Bipedal Walking Across Stepping Stones","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01807","snapshot_observed_at":"2026-08-04T15:51:50.729742Z","title":"Learning dynamic bipedal walking across stepping stones,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.729742Z"},"links":{"cited_paper":"/paper/2205.01807","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:24af064614e06172c23b77e61f855046865bd185a2608401d723f57f478d7f2b","observation_id":"bb0fba7e-4829-493b-a06f-af9dd85bf626","resolution":{"observed_at":"2026-08-04T15:51:50.729742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T15:51:50.735924Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.735924Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:d48ef3b82061b897c27a76b7510ed4f688d8f97b4c3d8a530b052c6677f320b5","observation_id":"4ecfbcb7-a13b-4d21-bbac-d4d676e4964b","resolution":{"observed_at":"2026-08-04T15:51:50.735924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.740784Z","title":"mc-mujoco: Simulating articulated robots with fsm controllers in mujoco,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.740784Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:56239586957dcdbed675f3337f2313242685f359afbd707a72189c7071e8c83f","observation_id":"abc0fe63-f1cf-4004-af73-0cb21c07bfa5","resolution":{"observed_at":"2026-08-04T15:51:50.740784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.745743Z","title":"Proposal of inspection and rescue tasks for tunnel disasters—task development of japan virtual robotics challenge,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.745743Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:8038b2e6b1119b0d980a9d781666e665da8ab75ca8022a3b2cc0eb59135ff1c9","observation_id":"8706442c-7780-4927-9711-c6667e8c16ab","resolution":{"observed_at":"2026-08-04T15:51:50.745743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.750687Z","title":"Learning bipedal walking on planned footsteps for humanoid robots,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.750687Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:77902448214917a5c6063e6ee7e4c90e43b73d772525a8949c1d4344058d7f79","observation_id":"77263eb5-5a78-4fbe-b4c1-fda63dd38cc5","resolution":{"observed_at":"2026-08-04T15:51:50.750687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.755943Z","title":"Anytime search-based footstep planning with suboptimality bounds,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.755943Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:c23062b8e24b7eaa6395b8d87ef5af683d918a64353c0fee6479e9c78e68eede","observation_id":"89db7155-f7cd-4582-864c-06c0974b7b4e","resolution":{"observed_at":"2026-08-04T15:51:50.755943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.655273Z","title":"Available: https://www.science.org/doi/ 10.1126/scirobotics.aau5872","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.655273Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:38799febc8a6b2a9746f52522a32067f1848584c74994e0fcc9db30ba62f09e5","observation_id":"95317a5b-85ae-4903-b7e1-bec7e17835ce","resolution":{"observed_at":"2026-08-04T15:51:50.655273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T12:39:54.584645Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2509.18046."}