{"as_of":"2026-08-14T13:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb877f7eb01a0d0b6ea61a4b510a78bb7e803b44f323148161ffb8fb9b555551","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:38:49.293219Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":38,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:52:55.580702Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:40:06.222586Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:ace978cdef814bdcde97a8cd30be011667faeb7e696abcbb15021ebe45eb7522","observation_id":"f5578e8b-4e33-4e1a-8997-c08afc1f36da","resolution":{"observed_at":"2026-05-19T13:52:19.873923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-08-04T15:45:50.039437Z","title":"Rsl-rl: A learning library for robotics research,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.18608","last_updated":"2025-11-03T20:29:38Z","snapshot_observed_at":"2026-08-12T12:51:00.142108Z","submitted_at":"2025-09-23T03:56:10Z","title":"End-to-End Crop Row Navigation via LiDAR-Based Deep Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T15:45:50.039437Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2509.18608"},"observation_digest":"sha256:ed904a4761900cc5acd3b3d4cac13cb8b3c04bfbe39d9f78a46bcbf4a9c8674c","observation_id":"2a6661cc-b6f7-4548-995b-a178c868a1a9","resolution":{"observed_at":"2026-08-04T15:45:50.039437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-08-04T10:03:32.299059Z","title":"Rsl-rl: A learning library for robotics research","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12363","last_updated":"2026-07-15T13:48:12Z","snapshot_observed_at":"2026-08-14T07:16:57.487382Z","submitted_at":"2025-10-14T10:25:40Z","title":"Pretraining in Actor-Critic Reinforcement Learning for Locomotion","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T10:03:32.299059Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2510.12363"},"observation_digest":"sha256:b7fc04251e4b6d7e53bfda2a74cc88241c33e6d9a8e20936d95913b75efe5c25","observation_id":"22d664b8-f072-4b50-acea-3046f2fa3812","resolution":{"observed_at":"2026-08-04T10:03:32.299059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-07T13:59:26.312342Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-11T10:22:52.472354Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2511.04831"},"observation_digest":"sha256:bc6e608b136b4c68b0e2f3baf3ec9c6187ec8ccd6acac6cd6691831676386797","observation_id":"60f9e8ea-6424-4121-a0fc-086492a58e47","resolution":{"observed_at":"2026-05-11T10:22:52.765435Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-14T03:44:45.711934Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T03:36:09.272019Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:7d7af49c5fb13f99889512475dcb820054da18a049be14ba627b4a9de7c2c91b","observation_id":"a932eb6e-7b36-4a7b-a246-d4397e81e934","resolution":{"observed_at":"2026-05-16T03:37:13.834854Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-08-03T02:55:50.711955Z","title":"Rsl-rl: A learning library for robotics research.arXiv preprint arXiv:2509.10771, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-14T03:44:45.711934Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T02:55:50.711955Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:b21c3480e4843c46855cf3473c84f493aefdf8e492613a7c65e706166633cb6e","observation_id":"b216fdfb-4ac4-42a6-9bf3-d87a189c4e08","resolution":{"observed_at":"2026-08-03T02:55:50.711955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.04539","last_updated":"2026-05-15T07:15:36Z","snapshot_observed_at":"2026-08-02T17:13:51.910717Z","submitted_at":"2026-04-06T09:03:41Z","title":"FlashSAC: Fast and Stable Off-Policy Reinforcement Learning for High-Dimensional Robot Control","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T20:04:56.512544Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.04539"},"observation_digest":"sha256:af71314901fec0cfee7c0a046e3966c25248ad2b205396eddaa9ab2140ee3b02","observation_id":"27bcb81e-2dfe-42bd-94b8-6a3975c01484","resolution":{"observed_at":"2026-05-10T22:15:49.843355Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.04539","last_updated":"2026-05-15T07:15:36Z","snapshot_observed_at":"2026-08-02T17:13:51.910717Z","submitted_at":"2026-04-06T09:03:41Z","title":"FlashSAC: Fast and Stable Off-Policy Reinforcement Learning for High-Dimensional Robot Control","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-19T17:08:31.770889Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.04539"},"observation_digest":"sha256:88aa46cd62ed3b0cbcdbf9c7e7abac69a71e9abae229c7e8fb5bb8091fca5981","observation_id":"47dbf6f2-1b75-47e2-ae0c-151d798dadc6","resolution":{"observed_at":"2026-05-19T17:12:41.336343Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.08036","last_updated":"2026-04-09T09:41:11Z","snapshot_observed_at":"2026-07-06T22:57:13.745326Z","submitted_at":"2026-04-09T09:41:11Z","title":"PriPG-RL: Privileged Planner-Guided Reinforcement Learning for Partially Observable Systems with Anytime-Feasible MPC","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T17:38:14.002685Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.08036"},"observation_digest":"sha256:e31647d23e91399c1e56fdac73f4d58c0bd27f18723adc89f26b1757b722d26d","observation_id":"25054616-d2d1-415d-9b19-f10f696d3595","resolution":{"observed_at":"2026-05-11T06:26:00.258272Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.11138","last_updated":"2026-04-13T07:50:41Z","snapshot_observed_at":"2026-08-11T14:00:11.398874Z","submitted_at":"2026-04-13T07:50:41Z","title":"ViserDex: Visual Sim-to-Real for Robust Dexterous In-hand Reorientation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T15:27:22.684701Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.11138"},"observation_digest":"sha256:14f19638aad82f11de79070b79897289febd9e0d25297609e0ca798c81940203","observation_id":"55d57a97-b826-489c-9cf4-5d44588ee711","resolution":{"observed_at":"2026-05-11T10:31:01.740070Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.18578","last_updated":"2026-04-30T14:35:55Z","snapshot_observed_at":"2026-08-14T01:17:07.593263Z","submitted_at":"2026-04-20T17:59:01Z","title":"Bounded Ratio Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T04:50:11.020901Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.18578"},"observation_digest":"sha256:fce56778ce169aaa1b20091d0b12822d7876184ae0cb2394b4dd390d7448c9f1","observation_id":"31f58ba1-6054-4c23-be9c-2a794b606765","resolution":{"observed_at":"2026-05-10T11:35:19.081916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.18887","last_updated":"2026-04-20T22:09:27Z","snapshot_observed_at":"2026-07-31T17:40:38.082594Z","submitted_at":"2026-04-20T22:09:27Z","title":"HALO: Hybrid Auto-encoded Locomotion with Learned Latent Dynamics, Poincar\\'e Maps, and Regions of Attraction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-10T03:48:23.076362Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.18887"},"observation_digest":"sha256:00c6eec214b35d117f7556f01b3b3a42af6e2de77407fe1a496291507b22160c","observation_id":"997dfbd6-f0cd-4a44-95a7-39c7346174a3","resolution":{"observed_at":"2026-05-11T12:21:05.750172Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2604.24018","last_updated":"2026-04-27T03:58:50Z","snapshot_observed_at":"2026-08-11T08:15:09.724244Z","submitted_at":"2026-04-27T03:58:50Z","title":"Betting for Sim-to-Real Performance Evaluation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T03:06:00.096162Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2604.24018"},"observation_digest":"sha256:449407d699628880dd2ee2bb5f9d446465054af54720babdbebc52202de5a931","observation_id":"71c46e55-da28-4f35-82bc-95c03fc2793d","resolution":{"observed_at":"2026-05-11T22:16:37.189388Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.12735","last_updated":"2026-05-12T20:39:35Z","snapshot_observed_at":"2026-08-10T21:36:20.977450Z","submitted_at":"2026-05-12T20:39:35Z","title":"The Unified Autonomy Stack: Toward a Blueprint for Generalizable Robot Autonomy","version":1},"reference_index":235,"source":"arxiv_source","source_observed_at":"2026-05-14T19:42:39.831386Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.12735"},"observation_digest":"sha256:961683d1d3379cea5271d5a3b51b548355d9bc6b0fb1ed29aee0113df3d5537c","observation_id":"a7e1ba5e-4f5b-47de-b2e4-7223fa8a1b43","resolution":{"observed_at":"2026-05-14T19:42:53.464912Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.15517","last_updated":"2026-05-15T01:27:50Z","snapshot_observed_at":"2026-08-14T08:00:12.621745Z","submitted_at":"2026-05-15T01:27:50Z","title":"Terrain Consistent Reference-Guided RL for Humanoid Navigation Autonomy","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T15:22:38.188537Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.15517"},"observation_digest":"sha256:0897d88183b11373a3745dc39bc2a9eb4ec1bd0f3d86673f9d374ca37555d71e","observation_id":"a2cd8c5b-3017-4412-a8ee-eba16d0114c7","resolution":{"observed_at":"2026-05-19T15:23:07.704262Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.23863","last_updated":"2026-05-22T17:21:06Z","snapshot_observed_at":"2026-08-13T16:22:58.887119Z","submitted_at":"2026-05-22T17:21:06Z","title":"Robotic Strawberry Harvesting with Robust Vision and Deep Reinforcement Learning based Sim-to-Real Control","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-25T03:48:21.595326Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.23863"},"observation_digest":"sha256:b915b358762f4f58a171bcc26f741963e4a66b8fd28b0a813f04e63c59edd79a","observation_id":"8203f553-c57c-4d3b-8a67-f4613ad0d8c7","resolution":{"observed_at":"2026-05-25T03:50:19.447839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.24975","last_updated":"2026-05-24T10:04:11Z","snapshot_observed_at":"2026-08-08T13:46:54.260741Z","submitted_at":"2026-05-24T10:04:11Z","title":"Bridging the Gap: Enabling Soft Actor Critic for High Performance Legged Locomotion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T00:54:12.099045Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.24975"},"observation_digest":"sha256:59a655b5af0b2807edd490a0ef3d2ca8096e1cfb0df21f36c0142077be235fe4","observation_id":"f3b136ab-a76c-4889-8cc7-dc5a4538f607","resolution":{"observed_at":"2026-07-01T16:05:49.722217Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.26478","last_updated":"2026-05-26T02:35:08Z","snapshot_observed_at":"2026-08-12T14:23:50.664257Z","submitted_at":"2026-05-26T02:35:08Z","title":"Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T17:34:41.053725Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.26478"},"observation_digest":"sha256:40bed2f84f32322fcbeedcd84b0eb60d79c28cda0010c3aedb84507601a8ef2d","observation_id":"49368f56-8c82-4784-968a-869b50dc1ae9","resolution":{"observed_at":"2026-06-29T18:03:48.637192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.27909","last_updated":"2026-05-27T03:34:16Z","snapshot_observed_at":"2026-08-06T19:47:27.091726Z","submitted_at":"2026-05-27T03:34:16Z","title":"S-Cheetah: A Novel Quadrupedal Robot with a 3-DOF Active Spine Learning Agile Locomotion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T12:15:34.353976Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.27909"},"observation_digest":"sha256:4a477518f3e9c1ae40c53e36d0177a93882c73cdffff76835bfacb4ea986b8ad","observation_id":"51afcd1d-9abd-4ee5-b06f-83d5b90fe003","resolution":{"observed_at":"2026-06-29T12:23:24.516196Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2605.28812","last_updated":"2026-05-27T17:59:02Z","snapshot_observed_at":"2026-08-12T23:58:02.949919Z","submitted_at":"2026-05-27T17:59:02Z","title":"Beyond Binary: Sim-to-Real Dexterous Manipulation with Physics-Grounded Contact Representation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T11:30:12.878240Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2605.28812"},"observation_digest":"sha256:607d24d0e5b4cda22228d2397bac914c9030a409c5d5f346397bc200882c67b8","observation_id":"fa4ca173-b351-4b3d-b40f-77c3f4dcb686","resolution":{"observed_at":"2026-06-29T11:33:22.681061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.05143","last_updated":"2026-06-03T17:50:02Z","snapshot_observed_at":"2026-08-13T21:33:03.668182Z","submitted_at":"2026-06-03T17:50:02Z","title":"HORIZON: Recoverability-Governed Curriculum for Physical-Domain Scaling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T05:48:14.933538Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.05143"},"observation_digest":"sha256:257177bb497d175a35c75013ec4a17ed6e43442220a7c5b81d7e5db7f2ad6fa7","observation_id":"e66899bd-dabd-4ed2-8bbe-6b1df59904c0","resolution":{"observed_at":"2026-07-02T08:46:48.885844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.05880","last_updated":"2026-06-04T08:52:56Z","snapshot_observed_at":"2026-08-06T03:43:38.490393Z","submitted_at":"2026-06-04T08:52:56Z","title":"TAGA: Terrain-aware Active Gaze Learning for Generalizable Agile Humanoid Locomotion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T01:19:16.753735Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.05880"},"observation_digest":"sha256:4e980d83d93fa8200f89c76e258ca5fda749e6f610d2f836ff61f6934177f495","observation_id":"46dff797-962f-474e-96ca-2ada836eef3b","resolution":{"observed_at":"2026-07-02T13:26:59.116429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.06493","last_updated":"2026-06-09T07:34:32Z","snapshot_observed_at":"2026-07-06T23:46:20.554117Z","submitted_at":"2026-06-04T17:59:50Z","title":"HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teachers","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T01:11:22.341714Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.06493"},"observation_digest":"sha256:54be717f87e168516f6040fac26f9adc445d07cc4e61dbbd4c6c9e16d816ede4","observation_id":"67e2c530-30d5-42ec-bff9-1143c5ecd1e1","resolution":{"observed_at":"2026-07-02T13:36:59.134539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.10288","last_updated":"2026-06-09T01:21:26Z","snapshot_observed_at":"2026-08-14T02:13:50.086256Z","submitted_at":"2026-06-09T01:21:26Z","title":"MARCH: Model-Assisted Reinforcement Learning for the Perceptive Control of Humanoids over Sparse Footholds","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T13:28:36.443684Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.10288"},"observation_digest":"sha256:64dc7458a4c37539cfa7a5c332832df45a3af0b23e355d7fc5b40149cf8a151e","observation_id":"58957d9f-4ac4-4a22-af9a-a7d284b4b3c9","resolution":{"observed_at":"2026-07-03T05:07:38.557244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.12604","last_updated":"2026-06-10T19:01:40Z","snapshot_observed_at":"2026-08-05T03:29:41.720044Z","submitted_at":"2026-06-10T19:01:40Z","title":"EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T09:27:43.453005Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.12604"},"observation_digest":"sha256:48f783708feb163a5395aaad6540d9541665b22656ebf529ea507da0655d3021","observation_id":"451f5be9-17c8-434e-b2e5-13bb6e2e4cc9","resolution":{"observed_at":"2026-07-03T11:38:05.087525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.13169","last_updated":"2026-06-11T10:40:43Z","snapshot_observed_at":"2026-08-02T16:07:10.369312Z","submitted_at":"2026-06-11T10:40:43Z","title":"Redesigning Regularization for Effective Policy Smoothing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T06:59:15.421795Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.13169"},"observation_digest":"sha256:72d86ca1fa43d3d9de7bacb52ecaf62037f2ce9207d12576725504c1e2e41233","observation_id":"bb7fd42c-2017-42f3-a73d-f17663003fdd","resolution":{"observed_at":"2026-07-03T14:38:29.150802Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.19633","last_updated":"2026-06-17T22:25:49Z","snapshot_observed_at":"2026-08-07T14:33:45.225276Z","submitted_at":"2026-06-17T22:25:49Z","title":"CTS-MoE: Implicit Terrain Adaptation via Mixture-of-Experts for Perceptive Locomotion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T20:21:02.275457Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.19633"},"observation_digest":"sha256:75551e524ee599b0963359de7df784c1de8c3d4cfbfc3a9f768a4bb7d23b8a1a","observation_id":"014b3766-373c-45a6-a690-bed1c176a76f","resolution":{"observed_at":"2026-07-04T01:29:22.507612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.21788","last_updated":"2026-06-19T22:38:51Z","snapshot_observed_at":"2026-07-06T23:56:45.447705Z","submitted_at":"2026-06-19T22:38:51Z","title":"Rotation-Aware Point-Cloud Embeddings for Vision-Based In-Hand Reorientation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T13:54:05.409504Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.21788"},"observation_digest":"sha256:7cdb227fdcf3e85c4264431eecff05759ed28a26d9b5dd4caf600e6f0f51cdd1","observation_id":"3773202b-5868-4192-ab99-f83978048da0","resolution":{"observed_at":"2026-07-04T06:59:38.342883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.25398","last_updated":"2026-06-24T04:52:04Z","snapshot_observed_at":"2026-08-06T04:56:00.009279Z","submitted_at":"2026-06-24T04:52:04Z","title":"MAPL: Multi-Objective Preference Learning for Robot Locomotion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-25T21:11:00.753949Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.25398"},"observation_digest":"sha256:b09c7c2d2e6b4c269773753f1c23cf7884abe3561d83cdd6cf9f5325db18fb2a","observation_id":"4eac1dcd-a468-4758-827e-ebf5f5baa4c3","resolution":{"observed_at":"2026-07-04T19:40:06.224115Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.27861","last_updated":"2026-06-26T08:59:38Z","snapshot_observed_at":"2026-08-14T09:55:43.968590Z","submitted_at":"2026-06-26T08:59:38Z","title":"PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T04:49:22.328169Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.27861"},"observation_digest":"sha256:5f72c51381b1d423d255d6a44f07ec0d359cdfb197eb4c99d282863f1ad2b0c7","observation_id":"b33d0ae4-9b6a-4036-a867-60e1149ae472","resolution":{"observed_at":"2026-06-29T19:13:53.375760Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.31912","last_updated":"2026-07-02T12:23:51Z","snapshot_observed_at":"2026-08-02T06:05:09.136604Z","submitted_at":"2026-06-30T16:16:37Z","title":"Learning Locomotion on Discrete Terrain via Minimal Proximity Sensing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T04:54:58.487286Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.31912"},"observation_digest":"sha256:dd1d2a14735ab82c757d2451bd5b07123293b876d8155de95069bba1c4caeee9","observation_id":"e56f1b43-153e-427e-bf97-c940cb3540b8","resolution":{"observed_at":"2026-07-01T10:55:42.170846Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2606.31912","last_updated":"2026-07-02T12:23:51Z","snapshot_observed_at":"2026-08-02T06:05:09.136604Z","submitted_at":"2026-06-30T16:16:37Z","title":"Learning Locomotion on Discrete Terrain via Minimal Proximity Sensing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-03T21:58:56.771899Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2606.31912"},"observation_digest":"sha256:73ea0f31ba1022786d61e55d17853155676ce7b6b75b69921e71cde1b67a0c79","observation_id":"926fae87-865b-48d5-adac-c988bdc332a8","resolution":{"observed_at":"2026-07-03T22:08:58.726136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2607.01281","last_updated":"2026-07-01T08:28:15Z","snapshot_observed_at":"2026-08-05T21:23:06.631212Z","submitted_at":"2026-07-01T08:28:15Z","title":"WaveLander: A Generalizable Hierarchical Control Framework for UAV Landing on Wave-Disturbed Platforms via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T20:40:48.256192Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2607.01281"},"observation_digest":"sha256:a582d3345cf9b8f5584d6406dedc0af86912ac9ea613b1479c0738f87714a967","observation_id":"6ac1238b-15b8-4bcf-96fe-bbfe2984f4d1","resolution":{"observed_at":"2026-07-03T20:48:55.426236Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-12T01:30:09.928609Z","title":"Schwarke, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03570","last_updated":"2026-07-03T19:19:20Z","snapshot_observed_at":"2026-08-13T09:24:56.719493Z","submitted_at":"2026-07-03T19:19:20Z","title":"Cross-Embodiment Robot Manipulation via a Unified Hand Action Space","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T01:30:09.928609Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2607.03570"},"observation_digest":"sha256:87b5bbaee4833b03c32daf7060dbd1f75866a883e2d90dc7ab436423316a619f","observation_id":"b1c1fadc-b6de-4b23-99f3-6f9bcbea8811","resolution":{"observed_at":"2026-07-12T01:30:09.928609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-31T23:58:10.642081Z","title":"Rsl-rl: A learning library for robotics research,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23268","last_updated":"2026-07-25T16:11:15Z","snapshot_observed_at":"2026-08-14T11:07:59.000407Z","submitted_at":"2026-07-25T16:11:15Z","title":"Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T23:58:10.642081Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2607.23268"},"observation_digest":"sha256:27209ead2ea9827d9173103cb1098a7bc2249d5b73d036a82244945203ea7581","observation_id":"5c7fc0f9-1eac-4354-a17e-e4489d239924","resolution":{"observed_at":"2026-07-31T23:58:10.642081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-31T19:04:34.661550Z","title":"Rsl-rl: A learning library for robotics research.arXiv preprint arXiv:2509.10771, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24292","last_updated":"2026-07-27T11:39:22Z","snapshot_observed_at":"2026-08-07T12:54:19.753424Z","submitted_at":"2026-07-27T11:39:22Z","title":"Learning Adaptive Multi-Task Guidance, Navigation, and Control via Hypernetworks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T19:04:34.661550Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2607.24292"},"observation_digest":"sha256:3eaebb284e965a81490ed5bb655a97f14166bfed444d7e2b099598c0a786379a","observation_id":"87d040ba-6008-4995-9794-933da99b46fa","resolution":{"observed_at":"2026-07-31T19:04:34.661550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-31T01:53:50.422624Z","title":"Rsl-rl: A learning library for robotics research,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28623","last_updated":"2026-07-30T17:59:35Z","snapshot_observed_at":"2026-08-14T00:00:06.689533Z","submitted_at":"2026-07-30T17:59:35Z","title":"PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T01:53:50.422624Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2607.28623"},"observation_digest":"sha256:ae985f4f36653a76374b30fd6642861dd48d09328e1aac63e0d6c7714779fcfb","observation_id":"f528a161-7649-4ee5-bac8-828e1bbc3f6c","resolution":{"observed_at":"2026-07-31T01:53:50.422624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-08-04T15:52:55.580702Z","title":"RSL-RL: A learning library for robotics research,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02069","last_updated":"2026-08-03T11:11:13Z","snapshot_observed_at":"2026-08-07T17:02:14.042996Z","submitted_at":"2026-08-03T11:11:13Z","title":"Open-DiffLoco: Open-Source Differentiable Learning for Deployable Blind Quadruped Locomotion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T15:52:55.580702Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2608.02069"},"observation_digest":"sha256:f8a52c7479331c73a48efc22eb1981fb91c464c6220ca36be187e267dfb3c214","observation_id":"daf7ca54-f5f5-42fa-90ae-bdd036cdcc2b","resolution":{"observed_at":"2026-08-04T15:52:55.580702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.10771/citation-record","integrity":"/paper/2509.10771/integrity","json":"/paper/2509.10771/citation-record.json","paper":"/paper/2509.10771"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:44.706572Z","title":"Tensorflow: Large-scale machine learning on heterogeneous distributed systems","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:44.706572Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6d0466c514e5b47ffcb8caa4e283a0cc48d027d38cd537433821d4e791c00a6c","observation_id":"1065ab50-d2b1-4d1d-9840-ff2b4d914462","resolution":{"observed_at":"2026-08-04T17:38:44.706572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:44.760465Z","title":"Pedipulate: Enabling manipulation skills using a quadruped robot’s leg","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:44.760465Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:46ea3782f73c5011f8c3fbf859b85d720d9742b846c1eb87568919a76be530a8","observation_id":"e845b6b5-434a-4538-bf03-3b76a2afd95b","resolution":{"observed_at":"2026-08-04T17:38:44.760465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:44.792698Z","title":"Experiment tracking with weights and biases, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:44.792698Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:7e90ab2e89920efc007b43671be1bd023fbac00d59a4611c987fe08513327cd1","observation_id":"02e1f8da-4cfc-419f-9734-b5481a8a458b","resolution":{"observed_at":"2026-08-04T17:38:44.792698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:44.861932Z","title":"Torchrl: A data-driven decision-making library for pytorch, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:44.861932Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6d5075466a4dd033f1d360a93af7614c19bd3e8bb20b8b9e5a00707856d2f70b","observation_id":"7fbdeb03-0697-49b5-a2aa-a002674afa4c","resolution":{"observed_at":"2026-08-04T17:38:44.861932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:44.972732Z","title":"Exploration by random network distillation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:44.972732Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:0db350ba9cd3141985cdf1a27bef87523750fd3c5c0ebcbd0738fab9cdf91fd9","observation_id":"c5d11590-7c32-49a6-9064-addc00a700ef","resolution":{"observed_at":"2026-08-04T17:38:44.972732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.077989Z","title":"Cat: Constraints as terminations for legged locomotion reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.077989Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:b2c6d75a61bc1ded43fff94aeb6a826915b651cce181aa9e430fd382ecb39822","observation_id":"7e359a0c-d9d0-43e5-a1fa-9cc3ded0c554","resolution":{"observed_at":"2026-08-04T17:38:45.077989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.160382Z","title":"Extreme parkour with legged robots","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.160382Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:a8bc560f14e47b152faddca741e8241b56f6db3b25ffef6d218eef28c3f9ff60","observation_id":"a217db7a-9015-47a7-9c3e-ef45be72a4f1","resolution":{"observed_at":"2026-08-04T17:38:45.160382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.309669Z","title":"Dynamic object goal pushing with mobile manipulators through model-free constrained reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.309669Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6d926bf6cb208a92d8d3ca3c179a8dde4433e10b26413a697c4747ee36b56c91","observation_id":"08a6fec3-c19a-45df-8398-a41de0bbfc2e","resolution":{"observed_at":"2026-08-04T17:38:45.309669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.427776Z","title":"Deep whole-body control: learning a unified policy for manipulation and locomotion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.427776Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:3f7e10b0386a26fe31578b271161e2b81cc66c61fb13d4addfcb03dfc17269e8","observation_id":"b2d63cd4-4f27-47bb-a1b4-7e03869256f8","resolution":{"observed_at":"2026-08-04T17:38:45.427776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.503609Z","title":"Dextreme: Transfer of agile in-hand manipulation from simulation to reality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.503609Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:7fa057cae29fcb326a18846d1e9fa02cb6d8c4ff626fdb533df67d0057ba11ef","observation_id":"7c46f757-ea04-4819-880b-cf160d9eba1b","resolution":{"observed_at":"2026-08-04T17:38:45.503609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.593452Z","title":"Attention-based map encoding for learning generalized legged locomotion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.593452Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:7a0b1648fffe005c45cecdd9408cde84c69d54a96025316e0181cae09420cdd9","observation_id":"a6178732-aa3c-44e3-85a2-cde176698c4a","resolution":{"observed_at":"2026-08-04T17:38:45.593452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21229","last_updated":"2025-03-06T07:50:56Z","snapshot_observed_at":"2026-08-14T12:07:38.283436Z","submitted_at":"2024-10-28T17:15:24Z","title":"HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21229","snapshot_observed_at":"2026-08-04T17:38:45.728666Z","title":"Hover: Versatile neural whole-body controller for humanoid robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.728666Z"},"links":{"cited_paper":"/paper/2410.21229","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6737d9267be7aacdd1ccb32112ddf3274eca18651311aac41fe309ec2d9e62c1","observation_id":"0268c452-dcf4-44c2-ab04-d50ba5443363","resolution":{"observed_at":"2026-08-04T17:38:45.728666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.830929Z","title":"Anymal parkour: Learning agile navigation for quadrupedal robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.830929Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:a3f815b530edf0458e5395e5b1e3a4dc86b22c9793908e146d66c00f4d27ef65","observation_id":"9112fec6-1c4b-470d-82e9-a9ffddb3949d","resolution":{"observed_at":"2026-08-04T17:38:45.830929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:45.938181Z","title":"The 37 implementation details of proximal policy optimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:45.938181Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:9143c39238856087361017d49d44816c28b04eb56f0c534430ec6190ab0d4b1d","observation_id":"b9971dcd-ccce-4cb5-88bf-eb0acd3c8b96","resolution":{"observed_at":"2026-08-04T17:38:45.938181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.046708Z","title":"Cleanrl: High-quality single-file implementations of deep reinforcement learning algorithms","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.046708Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6a2a154fdad6fe250ecdd63d89ef87fac3b7949b84d7f20ac78557d370abdc0c","observation_id":"f471bcc2-38f4-4df7-aa9b-7e37c0f3bdbb","resolution":{"observed_at":"2026-08-04T17:38:46.046708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.130125Z","title":"Learning agile and dynamic motor skills for legged robots","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.130125Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:256bc48a295877126aa07bddf737ae6483d498153b03616e54b9baeb78a7ba8b","observation_id":"9d7d36cc-871f-439f-8a11-fae515dfe611","resolution":{"observed_at":"2026-08-04T17:38:46.130125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.263737Z","title":"Learning robust autonomous navigation and locomotion for wheeled-legged robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.263737Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:9bf5a6690b9c5109c09e774a56e6c8f080c3648f799a5dc9810a8778fc765da6","observation_id":"35e8cc0a-f389-4119-a6f0-70d06b7aba94","resolution":{"observed_at":"2026-08-04T17:38:46.263737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.381540Z","title":"Marladona-towards cooperative team play using multi-agent reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.381540Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:0872af79383c69c00625dcd33a3764145f90d0ddf478bf3aca4f91a2632fb2a3","observation_id":"e1aad844-6731-479e-831d-7c42c92aaa5d","resolution":{"observed_at":"2026-08-04T17:38:46.381540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.502558Z","title":"Rllib: Abstractions for distributed reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.502558Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:3908b95afa96326738fd2c25d41d432a158ceefe52efc7ef2522795824c49e18","observation_id":"d992db19-a3e7-4214-beb8-606f168589a4","resolution":{"observed_at":"2026-08-04T17:38:46.502558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.632215Z","title":"rl-games: A high-performance framework for reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.632215Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:6bcdbd1468c4054c0cf886488f3e4ea12675bdb13515eff24f871388086f513a","observation_id":"f511368e-5b80-4f23-b830-98fcaa96632a","resolution":{"observed_at":"2026-08-04T17:38:46.632215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.737251Z","title":"Isaac gym: High performance gpu based physics simulation for robot learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.737251Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:c27349f0a74d7fa7496009d543d37b4d9044d380626bf0de23de2d3c37d38bd4","observation_id":"03a54cea-b197-410f-bcac-cf8ed75250f4","resolution":{"observed_at":"2026-08-04T17:38:46.737251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.811503Z","title":"Margolis and Pulkit Agrawal","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.811503Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:e949860888c416257ad32e05be9e698877113deb39511d4464040f0237cab44f","observation_id":"2f72c44c-2ce4-441d-966d-57a1baf6cfef","resolution":{"observed_at":"2026-08-04T17:38:46.811503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:46.925751Z","title":"Learning robust perceptive locomotion for quadrupedal robots in the wild","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:46.925751Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:87e6bf6137b09a7f5319de87c4f0b79efa82948bed960370a4171ae2f017459f","observation_id":"2b43cc4e-898f-4b2d-a280-6eda8745cc06","resolution":{"observed_at":"2026-08-04T17:38:46.925751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.034804Z","title":"Orbit: A unified simulation framework for interactive robot learning environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.034804Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:9f5fdbb657f2900e021e6a49c07951baa52fd3c5f75d93c6a081eb72ed2c9262","observation_id":"8238d3da-75ab-46e9-aa6a-b5d6f5f00caf","resolution":{"observed_at":"2026-08-04T17:38:47.034804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.145691Z","title":"Symmetry considerations for learning task symmetric robot policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.145691Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:34b98e386103933eda0391472ef0442d937665a5f4ad52df5c3f10501224e59d","observation_id":"1b307c7c-aae4-455c-9842-235e43af28a4","resolution":{"observed_at":"2026-08-04T17:38:47.145691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.309798Z","title":"neptune.ai: experiment tracker, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.309798Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:7f5eff390ea20aeaf81eb756f29e118d84c9152e23dfe8e0361256a8711733d7","observation_id":"6350b5c2-c696-4a0a-9058-cdf8ed92a71b","resolution":{"observed_at":"2026-08-04T17:38:47.309798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.412195Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.412195Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:2ad13c3021771876c8db91e1c46f6a4eb833e781d93efbfa0a2d1ca65f556077","observation_id":"5fb63184-769c-48ea-9f66-0b732da0f7ef","resolution":{"observed_at":"2026-08-04T17:38:47.412195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.536880Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.536880Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:56f27c6a24bb0fba4320843773ab209497c68a11a3f843ca0250f4be5dd445e4","observation_id":"fe4e9fc1-a2eb-42e5-808b-a17ebf3ce920","resolution":{"observed_at":"2026-08-04T17:38:47.536880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.621469Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.621469Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:fe9d4ed5c31b2d252cac8915e0970b2864ef77625c078687a1f73b081d4261cb","observation_id":"69a36922-9aa7-462e-a781-7843abf7a820","resolution":{"observed_at":"2026-08-04T17:38:47.621469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.749008Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.749008Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:cba9c42f6254a9b066a415f1a4e6cc62569a15fd0095e676215b103831f3fc61","observation_id":"5b27aa67-03bc-4189-a3d9-c4c4d36a8cbd","resolution":{"observed_at":"2026-08-04T17:38:47.749008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:47.885876Z","title":"Parkour in the wild: Learning a general and extensible agile locomotion policy using multi-expert distillation and rl fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:47.885876Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:7e793bd8e4ac087a070caa411a95901c70d678c827fe3bd702279bee5af9db2d","observation_id":"ab4c1a0e-6fc7-4767-930e-32a2229043e3","resolution":{"observed_at":"2026-08-04T17:38:47.885876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.013524Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.013524Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:0472333463019b6ea60bd415ff80f3b47a7e51705667c800d91b10aeaa8f5666","observation_id":"bcb68454-8b23-4ee7-bd81-6888e6f3cddb","resolution":{"observed_at":"2026-08-04T17:38:48.013524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.124110Z","title":"Curiosity-driven learning of joint locomotion and manipulation tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.124110Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:89b5a4fe4a55fa70a805e4047ced73bcd0a583a6d0ef0f5adec54ce8479b4c24","observation_id":"11297233-61fb-4281-b316-48dc7bb0cc05","resolution":{"observed_at":"2026-08-04T17:38:48.124110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.266182Z","title":"skrl: Modular and flexible library for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.266182Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:c7a377e34819bd9fb7a3610cca8b0ec013209ebd12bf66744e43604f5f70d812","observation_id":"c2c75671-3565-475d-ab3b-c96e20d2040b","resolution":{"observed_at":"2026-08-04T17:38:48.266182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.372949Z","title":"Reinforcement learning algorithms: A brief survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.372949Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:9ca7890a82a7fe695f0dcef030880ff31340db35453464cb9f086f7e2abef84d","observation_id":"d0c3f685-72be-4e19-8a74-354a94f6858e","resolution":{"observed_at":"2026-08-04T17:38:48.372949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.530763Z","title":"Guided reinforcement learning for robust multi-contact loco-manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.530763Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:55ea4c8447aa35f6767c3975ce6eb31f482dd08535a8db35be79360577cce8b7","observation_id":"bde32c1a-0d8e-4429-ae85-c1f09e9cf532","resolution":{"observed_at":"2026-08-04T17:38:48.530763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-04T17:38:48.677916Z","title":"Gymnasium: A standard interface for reinforcement learning environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.677916Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:77bcd8e10e1b7e759f942c0ac24b2e862d41389769d8ab3cd16a9ee838e3f95d","observation_id":"ed32b555-96ae-4fd8-9598-d3c8e767157f","resolution":{"observed_at":"2026-08-04T17:38:48.677916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14912","last_updated":"2022-03-23T09:24:06Z","snapshot_observed_at":"2026-08-13T22:08:13.539230Z","submitted_at":"2022-03-23T09:24:06Z","title":"Advanced Skills through Multiple Adversarial Motion Priors in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14912","snapshot_observed_at":"2026-08-04T17:38:48.783261Z","title":"Advanced skills through multiple adversarial motion priors in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.783261Z"},"links":{"cited_paper":"/paper/2203.14912","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:26180717cc45d955a64eaa9dfaca67ebbeed43ca02d37e6b659a24fbc9b8ef65","observation_id":"735fed6e-cc75-4330-b794-f5ad8601ee17","resolution":{"observed_at":"2026-08-04T17:38:48.783261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05997","last_updated":"2025-09-04T14:30:12Z","snapshot_observed_at":"2026-08-08T00:00:29.316020Z","submitted_at":"2025-06-06T11:35:48Z","title":"Spatially-Enhanced Recurrent Memory for Long-Range Mapless Navigation via End-to-End Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05997","snapshot_observed_at":"2026-08-04T17:38:48.852715Z","title":"Improving long-range navigation with spatially-enhanced recurrent memory via end-to-end reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.852715Z"},"links":{"cited_paper":"/paper/2506.05997","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:52b5393e627177ac2070582c8d16f1360a850804f28a0e7c2dd314312b22288e","observation_id":"d4364306-456f-4aea-8d9d-80679aa261e8","resolution":{"observed_at":"2026-08-04T17:38:48.852715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:48.958810Z","title":"Mujoco playground","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:48.958810Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:0add554f853efffc4e7b6e8a7545ab59bf32bbf691e2a73af9da85c4d0a4ae30","observation_id":"07ce98bc-c8b7-4293-b843-600a34059ce7","resolution":{"observed_at":"2026-08-04T17:38:48.958810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:49.074807Z","title":"Learning agile locomotion on risky terrains","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:49.074807Z"},"links":{"citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:a9a64a88aead7775d756d83ae8f41fbb5366118e9e67935db9f40260ef9d69d7","observation_id":"d634a121-a55b-4f16-9787-6560895ee271","resolution":{"observed_at":"2026-08-04T17:38:49.074807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06005","last_updated":"2024-11-07T13:59:05Z","snapshot_observed_at":"2026-08-12T23:46:46.147796Z","submitted_at":"2024-06-10T04:00:55Z","title":"WoCoCo: Learning Whole-Body Humanoid Control with Sequential Contacts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06005","snapshot_observed_at":"2026-08-04T17:38:49.183232Z","title":"Wococo: Learning whole-body humanoid control with sequential contacts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:49.183232Z"},"links":{"cited_paper":"/paper/2406.06005","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:bc0af376e15115fd668b4c599bd4672ef02d1ae046c8ae9510d02fb3ad701fe4","observation_id":"6728c86b-8e61-4089-9923-eb4ce094462b","resolution":{"observed_at":"2026-08-04T17:38:49.183232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11814","last_updated":"2022-06-17T02:39:04Z","snapshot_observed_at":"2026-08-14T10:36:21.193454Z","submitted_at":"2022-05-24T06:15:51Z","title":"Penalized Proximal Policy Optimization for Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11814","snapshot_observed_at":"2026-08-04T17:38:49.293219Z","title":"Penalized proximal policy optimization for safe reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T17:38:49.293219Z"},"links":{"cited_paper":"/paper/2205.11814","citing_paper":"/paper/2509.10771"},"observation_digest":"sha256:f4eaca1ca75b1f38f3997b0ccb17fccf246aa4db32cd9ba82902266180c75282","observation_id":"369daf1f-519e-46e2-968d-d24922a62b65","resolution":{"observed_at":"2026-08-04T17:38:49.293219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 38 inbound Pith citation observations for arXiv:2509.10771."}