{"as_of":"2026-08-18T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:11ca45336e100b0f5aab09a6cd635f4bc4b16001d37644e9528cae075a9cf062","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:02:50.959705Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:59:44.516619Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-11T17:03:40.028557Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09520","last_updated":"2024-12-12T18:06:22Z","snapshot_observed_at":"2026-08-17T05:35:57.106762Z","submitted_at":"2024-12-12T18:06:22Z","title":"GainAdaptor: Learning Quadrupedal Locomotion with Dual Actors for Adaptable and Energy-Efficient Walking on Various Terrains","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:03:40.028557Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2412.09520"},"observation_digest":"sha256:587513bc09f5d81c0d03141eb42b24d046441322dabfc68fe901f1fd9087572a","observation_id":"adaf0512-ca9c-4bd3-9b87-f80adaa970db","resolution":{"observed_at":"2026-08-11T17:03:40.028557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-11T14:25:47.791148Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12098","last_updated":"2025-07-31T14:50:20Z","snapshot_observed_at":"2026-08-13T21:19:52.365622Z","submitted_at":"2024-12-16T18:59:53Z","title":"MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T14:25:47.791148Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2412.12098"},"observation_digest":"sha256:aad57dc810def64be72dbb0a3fddf4e1e57473bb0884b21d1a6e42c3b5e94374","observation_id":"7c554196-6718-4ebf-8985-26d5af9a0978","resolution":{"observed_at":"2026-08-11T14:25:47.791148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-09T11:31:10.727780Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02705","last_updated":"2025-02-04T20:40:44Z","snapshot_observed_at":"2026-08-17T19:59:44.269774Z","submitted_at":"2025-02-04T20:40:44Z","title":"Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T11:31:10.727780Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2502.02705"},"observation_digest":"sha256:38a5885704bdd77ed6549b2fefcdc61b728b6d08496bedb4f090c0e66d5d908c","observation_id":"691abc2e-98b5-4e5c-a791-9e7d5ee60c29","resolution":{"observed_at":"2026-08-09T11:31:10.727780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-15T23:02:50.959705Z","title":"Smith, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05753","last_updated":"2025-08-29T01:37:51Z","snapshot_observed_at":"2026-08-15T22:55:24.584595Z","submitted_at":"2025-05-09T03:25:43Z","title":"Towards Embodiment Scaling Laws in Robot Locomotion","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T23:02:50.959705Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2505.05753"},"observation_digest":"sha256:12db47a028e565d8eef9ebd3efd6534bce18328282464f9935275a8dee61c008","observation_id":"bc5d08c0-927e-4a52-b7bd-611c58b120dd","resolution":{"observed_at":"2026-08-15T23:02:50.959705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-15T20:48:29.670571Z","title":"arXiv preprint arXiv:2208.07860","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12029","last_updated":"2025-05-17T14:42:47Z","snapshot_observed_at":"2026-08-18T00:05:45.186197Z","submitted_at":"2025-05-17T14:42:47Z","title":"Growable and Interpretable Neural Control with Online Continual Learning for Autonomous Lifelong Locomotion Learning Machines","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:29.670571Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2505.12029"},"observation_digest":"sha256:14cd2d617c76612fb64a7a2e964d3a828b7020a99e0a22cd63c0bd08a549b376","observation_id":"8e2158b0-5700-4a09-9b6e-fd711c8aa12d","resolution":{"observed_at":"2026-08-15T20:48:29.670571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T12:10:07.379760Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00563","last_updated":"2025-09-08T18:56:14Z","snapshot_observed_at":"2026-08-15T02:41:01.519002Z","submitted_at":"2025-05-31T13:43:41Z","title":"Understanding Behavioral Metric Learning: A Large-Scale Study on Distracting Reinforcement Learning Environments","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:10:07.379760Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.00563"},"observation_digest":"sha256:e126189796551a612a456432a872419eb089b081a0c934d392a104c9ffaadc3d","observation_id":"9049565e-2b4a-44b2-8be0-bc466da837ba","resolution":{"observed_at":"2026-08-07T12:10:07.379760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T10:53:07.128785Z","title":"Smith, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04147","last_updated":"2026-07-17T06:06:23Z","snapshot_observed_at":"2026-08-17T20:30:31.644510Z","submitted_at":"2025-06-04T16:41:55Z","title":"SLAC: Safe and Efficient Real-Robot Reinforcement Learning via Unsupervised Simulation Pre-Training","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:53:07.128785Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.04147"},"observation_digest":"sha256:d16995a768b2ff26893b95bfb5b8f63668184c43ac535fa3ea890cd8713df510","observation_id":"008756a5-6252-4f50-a846-96a0130fb978","resolution":{"observed_at":"2026-08-07T10:53:07.128785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T00:31:46.391421Z","title":"Smith, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13762","last_updated":"2025-06-16T17:59:48Z","snapshot_observed_at":"2026-08-13T22:06:31.770530Z","submitted_at":"2025-06-16T17:59:48Z","title":"Touch begins where vision ends: Generalizable policies for contact-rich manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:31:46.391421Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.13762"},"observation_digest":"sha256:0c1eb8ee1e62e4eea8bdbfaf723748282fb93b71a31e7efeca6992ca573ff014","observation_id":"d833eb6d-4ee0-4940-8d2c-d12b39720723","resolution":{"observed_at":"2026-08-07T00:31:46.391421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-04T09:48:07.562879Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13704","last_updated":"2026-06-03T03:31:14Z","snapshot_observed_at":"2026-08-04T09:47:43.934006Z","submitted_at":"2025-10-15T16:01:30Z","title":"Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-04T09:48:07.562879Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2510.13704"},"observation_digest":"sha256:6ab601bf6888dc91eca4cdf75e400a2cd6a24242e92db4abb4cc6c58f09181ff","observation_id":"52a55d8a-da05-415b-b158-c3d4ab448f53","resolution":{"observed_at":"2026-08-04T09:48:07.562879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-04T07:06:51.320227Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.27048","last_updated":"2026-07-10T16:45:48Z","snapshot_observed_at":"2026-08-10T03:40:46.048209Z","submitted_at":"2025-10-30T23:33:07Z","title":"SpikeATac: A Multimodal Tactile Finger with Taxelized Dynamic Sensing for Dexterous Manipulation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T07:06:51.320227Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2510.27048"},"observation_digest":"sha256:ea4e8cab47f3e5486d47066a90ddcb1b750f471eb0b38c2b3d4206dbed9a015a","observation_id":"4b78d0c1-9b47-4201-9aa8-9af4373338c9","resolution":{"observed_at":"2026-08-04T07:06:51.320227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2601.14617","last_updated":"2026-04-03T08:41:56Z","snapshot_observed_at":"2026-08-16T20:24:31.881145Z","submitted_at":"2026-01-21T03:19:32Z","title":"UniCon: A Unified System for Efficient Robot Learning Transfers","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T12:58:56.857747Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2601.14617"},"observation_digest":"sha256:e14f81477ba4cdd6181a0d4ed0acf1d664ce713068f70d31d20d54764341f2a8","observation_id":"518df3ee-2b6b-4322-a7f9-e53688b1326b","resolution":{"observed_at":"2026-05-16T13:00:54.948804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-14T03:44:45.711934Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T03:36:09.272019Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:088da63deb77e96933904d54e37df8e2c31d4cb42a12ea8e052165e3c1699858","observation_id":"fd58f5fa-15bc-4e3f-8b5c-c38985818e96","resolution":{"observed_at":"2026-05-16T03:37:13.821187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-03T02:55:50.745366Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning.arXiv preprint arXiv:2208.07860, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-14T03:44:45.711934Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T02:55:50.745366Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:3f9585783774f5818ef54ede66fed6cca2e057964328c39fc51c36c483ae24bf","observation_id":"d0b0b0e8-b22e-47a1-9907-9cab4e547686","resolution":{"observed_at":"2026-08-03T02:55:50.745366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-02T21:36:16.982549Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning.arXiv preprint arXiv:2208.07860, 2022.(Cited on pages 3 and 21)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.20220","last_updated":"2026-07-22T18:26:39Z","snapshot_observed_at":"2026-08-15T05:21:43.801650Z","submitted_at":"2026-02-23T10:34:15Z","title":"What Matters for Simulation to Online Reinforcement Learning on Real Robots","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T21:36:16.982549Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.20220"},"observation_digest":"sha256:f9d2054371993b677bd04d94dfe5cbbea586284d4daeed93f41fcb1b59b9f706","observation_id":"ec06c701-36de-4cb1-b092-0e80c8cf97d6","resolution":{"observed_at":"2026-08-02T21:36:16.982549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2603.15759","last_updated":"2026-05-12T15:04:33Z","snapshot_observed_at":"2026-07-06T22:49:19.323519Z","submitted_at":"2026-03-16T18:00:23Z","title":"Simulation Distillation: Pretraining World Models in Simulation for Rapid Real-World Adaptation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T09:49:03.333757Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2603.15759"},"observation_digest":"sha256:af10c20b0173e013dda0a9c95c23c899f9a96a1d5c0ed80bce484c7f1d615cc6","observation_id":"abfc8f1f-7e80-4579-9867-f33f589a7c45","resolution":{"observed_at":"2026-05-15T09:49:54.489556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.09595","last_updated":"2026-06-09T02:45:20Z","snapshot_observed_at":"2026-08-11T10:45:38.544948Z","submitted_at":"2026-05-10T15:16:07Z","title":"Neuromorphic Reinforcement Learning for Quadruped Locomotion Control on Uneven Terrain","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T04:24:33.237352Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.09595"},"observation_digest":"sha256:7624485159a868e378179a14407bb979b9cdc0967cf241771aae14fb56ba1001","observation_id":"b4e40f6f-1ea1-41b7-b80c-14d9493a5469","resolution":{"observed_at":"2026-05-12T06:16:29.172728Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.09595","last_updated":"2026-06-09T02:45:20Z","snapshot_observed_at":"2026-08-11T10:45:38.544948Z","submitted_at":"2026-05-10T15:16:07Z","title":"Neuromorphic Reinforcement Learning for Quadruped Locomotion Control on Uneven Terrain","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-30T22:48:25.063920Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.09595"},"observation_digest":"sha256:4f9f32fd8480113a1f1436a837a5055c6de56bb8dc5b6a28f6c20be7831d4bc4","observation_id":"8703c14d-c0d9-4ca6-9564-fba6b44f6171","resolution":{"observed_at":"2026-07-01T13:45:45.934686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-16T00:35:49.068855Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T05:33:19.038889Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:d6c23e678b9df74bd1d6989c8283fb2830c3d265a83f38232734396e597f0e6b","observation_id":"aabff9cb-616a-448c-8fc2-bf1ec5898f58","resolution":{"observed_at":"2026-05-12T05:36:24.566962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-16T00:35:49.068855Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T06:27:38.643667Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:6196b76abb12f34bf121e2aeaa0ae12bd2a7b43536854d3ea7474b12f54cba6a","observation_id":"24c88951-5282-45be-81dc-f913bedbfa8a","resolution":{"observed_at":"2026-05-13T06:32:24.777585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-16T00:35:49.068855Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T23:04:12.943222Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:2fbb27deed2af45c6eaecbab66fe1aa163c1752074ab9a9e43258dff412fb4b6","observation_id":"f047453d-503a-48b7-86ac-4d39acb90258","resolution":{"observed_at":"2026-05-20T23:09:12.669798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.14350","last_updated":"2026-05-14T04:22:24Z","snapshot_observed_at":"2026-08-16T10:30:54.722430Z","submitted_at":"2026-05-14T04:22:24Z","title":"Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-15T03:05:36.871497Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.14350"},"observation_digest":"sha256:8450af87911ca375b3161fc01957b6bad499264a30b1ab5590b4ceba3e97e9a4","observation_id":"cbbc3c3e-e3a0-492d-94aa-786dc12e75b3","resolution":{"observed_at":"2026-05-15T03:08:59.660784Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2606.23640","last_updated":"2026-06-22T17:30:24Z","snapshot_observed_at":"2026-08-02T09:22:48.099895Z","submitted_at":"2026-06-22T17:30:24Z","title":"Learning Process Rewards via Success Visitation Matching for Efficient RL","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-26T09:20:35.062060Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2606.23640"},"observation_digest":"sha256:1e69719925ec93606af375db1102ba4c2d78b9aec81d494432e3bd6c734327e4","observation_id":"49d4e92b-8c72-4978-ab81-c257e0044bf5","resolution":{"observed_at":"2026-07-04T09:59:44.518538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2208.07860/citation-record","integrity":"/paper/2208.07860/integrity","json":"/paper/2208.07860/citation-record.json","paper":"/paper/2208.07860"},"outbound":[],"paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T16:38:51.702743Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2208.07860."}