{"as_of":"2026-08-09T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b1d29fef13f8b9c79b61b6a362e1e2bf363c3fd5ac6f758aea3e5f7980d4cfb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:50:11.167208Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":101,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-04T15:51:50.669910Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.669910Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:7470cfaa1338434f49ac0668c62199e6aad4ada0523a15202e13f4ddc35cdc1c","observation_id":"6696e8fd-b032-4923-af16-a615fe5efbc7","resolution":{"observed_at":"2026-08-04T15:51:50.669910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-04T14:43:59.131592Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.23650","last_updated":"2026-06-20T04:11:26Z","snapshot_observed_at":"2026-08-07T20:57:40.967858Z","submitted_at":"2025-09-28T05:31:07Z","title":"KiVi: Kinesthetic-Visuospatial Integration for Dynamic and Safe Egocentric Legged Locomotion","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:59.131592Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2509.23650"},"observation_digest":"sha256:718175486bc2166927c7c26c9ebb0f852da63ac65f6f981ea1d9c733c1ff5ac1","observation_id":"bfaa350b-4deb-4aa6-93e7-7264d043b1c4","resolution":{"observed_at":"2026-08-04T14:43:59.131592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2510.03599","last_updated":"2026-05-02T16:55:36Z","snapshot_observed_at":"2026-08-05T17:44:24.192483Z","submitted_at":"2025-10-04T01:23:30Z","title":"Learning to Act Through Contact: A Unified View of Multi-Task Robot Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T10:51:33.636604Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2510.03599"},"observation_digest":"sha256:644c29ad44a532491a9c3895719c2bf64c09ce0fff1691bb4ad71e5c84bb1a90","observation_id":"334138f3-2d2e-4a0c-8653-288e3f3413ea","resolution":{"observed_at":"2026-05-18T10:52:33.775213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-03T17:39:11.090248Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.08656","last_updated":"2026-06-29T14:28:58Z","snapshot_observed_at":"2026-08-06T04:49:43.282415Z","submitted_at":"2025-12-09T14:42:26Z","title":"Sim2Swim: Zero-Shot Velocity Control for Agile AUV Maneuvering in 3 Minutes","version":2},"reference_index":866,"source":"pdf_text","source_observed_at":"2026-08-03T17:39:11.090248Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2512.08656"},"observation_digest":"sha256:64574826edf980d7c8e872a95046fa227cef7b41420c326e7db85800d4db96a4","observation_id":"e65fbe94-dd4b-4250-8b1b-481caed6fbfa","resolution":{"observed_at":"2026-08-03T17:39:11.090248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2512.19576","last_updated":"2026-04-08T15:38:50Z","snapshot_observed_at":"2026-08-08T13:12:25.875087Z","submitted_at":"2025-12-22T17:00:25Z","title":"LeLaR: The First In-Orbit Demonstration of an AI-Based Satellite Attitude Controller","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T20:28:11.486929Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2512.19576"},"observation_digest":"sha256:8de788bdcd96caaa944bbf89ca74fe6af180c74f9a44eb9a1517994693b0bc1e","observation_id":"e453db3b-2d6b-42a9-b3da-c67dffaea1ed","resolution":{"observed_at":"2026-05-16T20:28:23.847565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2604.05394","last_updated":"2026-04-07T03:47:14Z","snapshot_observed_at":"2026-07-06T22:54:08.897942Z","submitted_at":"2026-04-07T03:47:14Z","title":"Neural Assistive Impulses: Synthesizing Exaggerated Motions for Physics-based Characters","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T19:25:46.825686Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2604.05394"},"observation_digest":"sha256:2b7d5c9ff7c84b0f574b07b69ec9a2f6ddab307df082cd8d90fcb89f8c226822","observation_id":"6506e0a6-8304-4130-9834-3536ac5d70bd","resolution":{"observed_at":"2026-05-10T23:00:48.467691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2605.03846","last_updated":"2026-05-05T15:13:15Z","snapshot_observed_at":"2026-07-06T23:16:44.876986Z","submitted_at":"2026-05-05T15:13:15Z","title":"SigLoMa: Learning Open-World Quadrupedal Loco-Manipulation from Ego-Centric Vision","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T15:41:18.805962Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2605.03846"},"observation_digest":"sha256:56ad5993173624cd5339d0b77ed08b3f530b55495601fd01d89b5da0fdf4e91b","observation_id":"60098fd0-2727-4dc9-ac1f-1a31e393c0fd","resolution":{"observed_at":"2026-05-12T00:11:17.706807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2605.26478","last_updated":"2026-05-26T02:35:08Z","snapshot_observed_at":"2026-08-02T15:14:06.593016Z","submitted_at":"2026-05-26T02:35:08Z","title":"Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T17:34:41.053725Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2605.26478"},"observation_digest":"sha256:f270524c0b6aaea6af91b029af764c54e4afa5deee4e473c8e5b707d1487cc93","observation_id":"08ab8680-a352-489b-bbf3-277799f12320","resolution":{"observed_at":"2026-06-29T18:03:48.582335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2606.08564","last_updated":"2026-06-07T10:41:38Z","snapshot_observed_at":"2026-08-02T02:27:26.406086Z","submitted_at":"2026-06-07T10:41:38Z","title":"Real-IKEA: Physical Fidelity is the Prerequisite for Robust Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T18:18:34.508629Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2606.08564"},"observation_digest":"sha256:9e74b4475dda89bc4cb2ebaf28bc5930614bc9e43fb1a7a728883ebc7a3f3c6b","observation_id":"aa81de37-b181-412d-a592-715729be0dd6","resolution":{"observed_at":"2026-07-02T23:17:29.864617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2606.09439","last_updated":"2026-06-08T12:48:38Z","snapshot_observed_at":"2026-07-06T23:48:48.962930Z","submitted_at":"2026-06-08T12:48:38Z","title":"Tracking the Effective Surface Area of Non-Convex Satellites","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T15:27:51.585099Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2606.09439"},"observation_digest":"sha256:48a2537e6fc75ebcef283c1b310b6e02b1b0ba74d15b4911100a52d4443ed100","observation_id":"66805cec-6e97-429c-827b-303c00a57e35","resolution":{"observed_at":"2026-06-27T15:31:00.472681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2606.19333","last_updated":"2026-06-17T17:57:34Z","snapshot_observed_at":"2026-08-02T12:23:55.177494Z","submitted_at":"2026-06-17T17:57:34Z","title":"Do as I Do: Dexterous Manipulation Data from Everyday Human Videos","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-26T20:51:21.209882Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2606.19333"},"observation_digest":"sha256:bb6535ab89b36b131dba9c8cbb264af9f87b2f69029e985012356438734a1cc6","observation_id":"bb7d2dce-2d78-4686-a2f2-1a8b07cfd53c","resolution":{"observed_at":"2026-07-04T00:59:19.491757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.11978","doi":"10.48550/arxiv.2109.11978","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":"arXiv (Cornell University)","work_id":"38035e41-2283-4216-ba81-602c7bc6d4f4","year":2022},"citing_paper":{"arxiv_id":"2606.28237","last_updated":"2026-06-26T16:23:40Z","snapshot_observed_at":"2026-07-07T00:02:18.989389Z","submitted_at":"2026-06-26T16:23:40Z","title":"Unleashing Infinite Motion: Scaling Expressive Quadrupedal Motion via Generative Video Priors","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T04:10:56.435946Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2606.28237"},"observation_digest":"sha256:6c6506a50c3bf3c0f8d6549079f2524b891923247d8ff3074e244150ba0685d2","observation_id":"072e22d4-eb5e-4d14-a741-d2a53da2e421","resolution":{"observed_at":"2026-07-01T17:05:51.257955Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-01T12:31:21.159967Z","title":"Rudin, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19530","last_updated":"2026-07-21T19:19:23Z","snapshot_observed_at":"2026-08-01T12:31:19.292225Z","submitted_at":"2026-07-21T19:19:23Z","title":"Milo, a Fully Autonomous Indoor/Outdoor Robotic Guide Dog","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T12:31:21.159967Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2607.19530"},"observation_digest":"sha256:672aa8a1947c77f8bb85153514ec1a51ec18e896934a3c34c42c2104466cfb80","observation_id":"4145546a-2be1-4287-939a-8cd0b7579b6c","resolution":{"observed_at":"2026-08-01T12:31:21.159967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-01T09:58:57.023092Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20399","last_updated":"2026-07-22T17:35:43Z","snapshot_observed_at":"2026-08-08T10:08:30.980056Z","submitted_at":"2026-07-22T17:35:43Z","title":"Towards Miniature Humanoid Tele-Loco-Manipulation Using Virtual Reality and Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T09:58:57.023092Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2607.20399"},"observation_digest":"sha256:cc7a86314075e905ad94f532acb033f144311d1063168809cd3c2d31240b1735","observation_id":"7a76c281-1f55-4f8f-ac52-8240c310737b","resolution":{"observed_at":"2026-08-01T09:58:57.023092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-01T06:32:51.170921Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.170921Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:f70793fd97f6e2c9070dbc8946ea3e079e5b5d7895610007151d13a1ebe05d71","observation_id":"68e1e66d-4eae-4f6a-b47e-19f2bd22b0c6","resolution":{"observed_at":"2026-08-01T06:32:51.170921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-04T19:45:35.176096Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":217,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.176096Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:0473a6d0adb7318675bce75d261a02d17e15334caf77de3d2334afe088fa8e7c","observation_id":"ebb70748-2f9e-4da4-8aeb-b4543c30fa2a","resolution":{"observed_at":"2026-08-04T19:45:35.176096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-06T20:50:11.167208Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04612","last_updated":"2026-08-05T09:18:16Z","snapshot_observed_at":"2026-08-09T01:13:53.441373Z","submitted_at":"2026-08-05T09:18:16Z","title":"GASP: GPU-Accelerated Safe Planner for Real-Time Collision-Aware Motion Generation with Latent Trajectory Sampling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:11.167208Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2608.04612"},"observation_digest":"sha256:22773c1de8a1e3053bac4af80330527d3d64e132e17b9a2466fc227727d7c82e","observation_id":"6f022b49-bb8b-4a64-ba4b-48bdb5456236","resolution":{"observed_at":"2026-08-06T20:50:11.167208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2109.11978/citation-record","integrity":"/paper/2109.11978/integrity","json":"/paper/2109.11978/citation-record.json","paper":"/paper/2109.11978"},"outbound":[],"paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2109.11978."}