{"as_of":"2026-08-21T09:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5311f901648248df650517754a492f6f1e374cfaeba9fb5b119e15ff83794107","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:20:31.071434Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00880/citation-record","integrity":"/paper/2608.00880/integrity","json":"/paper/2608.00880/citation-record.json","paper":"/paper/2608.00880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.679857Z","title":"Bokser,et al., System Design of the Ultra Mobility Vehicle: A Driving, Balancing, and Jumping Bicycle Robot.arXiv preprint arXiv:2602.22118(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.679857Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:60f3a3e6a74a95410813c58e3f5747698b5c90cc157ff5efc2d9c8506b0b22cd","observation_id":"70b2668b-4eb0-41d0-b60e-b9399d260cb2","resolution":{"observed_at":"2026-08-15T15:20:30.679857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.684762Z","title":"Dynamics, Introducing Handle, Y outube video, https://www.youtube","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.684762Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1b003fe6b33d5c2cb60502a9b2cf33d94a46e2908ca8bb93a82abfdb65852df5","observation_id":"3b509cd4-2b80-43ab-92b4-35d13831f685","resolution":{"observed_at":"2026-08-15T15:20:30.684762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.689325Z","title":"Kashiri,et al., Centauro: A hybrid locomotion and high power resilient manipulation platform.IEEE Robotics and Automation Letters 4(2), 1595–1602 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.689325Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:61f1b526036ac35f9a21f8be040b2010733729832a21c9c46b007d753965ea02","observation_id":"d38a7698-d32c-4a72-b409-3a3da3821ca8","resolution":{"observed_at":"2026-08-15T15:20:30.689325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.693438Z","title":"Klemm,et al., Ascento: A two-wheeled jumping robot, in2019 International conference on robotics and automation (ICRA)(IEEE) (2019), pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.693438Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0648bb1aac07c0596fd000102fdc16da7bb097d29cad6b91c381240c93ed90f9","observation_id":"1b5ccf1e-a306-4be1-ad88-954e62480803","resolution":{"observed_at":"2026-08-15T15:20:30.693438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.697418Z","title":"Bjelonic, P","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.697418Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:88546dba8ef31344653ee3d2afdb1f26e5a34415ac3ec3d576be09c6da56a19c","observation_id":"84dff52e-09a0-4e61-8a52-4bb595f72e4d","resolution":{"observed_at":"2026-08-15T15:20:30.697418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.701278Z","title":"Bjelonic, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.701278Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7b99a95899a6babf361d43c4dc8df000220ff77070beef4d2ce093f00f89b0fb","observation_id":"c5d5da6b-33c6-4134-8b98-659e56ce5075","resolution":{"observed_at":"2026-08-15T15:20:30.701278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.705518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.705518Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:585262d925e38404b2982d26a6272fb69d320c2f75d456297724a8dd7900fbdf","observation_id":"fd36f65b-8c0d-4843-a67b-9fc48cea6d28","resolution":{"observed_at":"2026-08-15T15:20:30.705518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.709458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.709458Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:516a0050eab33f74c2b20f7612f9f7bb8cab577103b20d61ca48c13f3513be8d","observation_id":"fea9a12f-68fa-4ea4-9c6e-170035c44668","resolution":{"observed_at":"2026-08-15T15:20:30.709458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.713418Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.713418Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5fa5241ed5ad472e66ca4f5c4be022c550ab64b6e7ad9ce92aa6c947d64273b5","observation_id":"b2106733-1e37-4629-8ce2-7ee1b36efc12","resolution":{"observed_at":"2026-08-15T15:20:30.713418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.717404Z","title":"Astrom, R","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.717404Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:eae4fe26ed079a1965e95ac1f040a192df3bc13e51013d86018b943098eb6dba","observation_id":"d4c73f48-4023-40e8-bfb0-dd9c8cf4fd8c","resolution":{"observed_at":"2026-08-15T15:20:30.717404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.721505Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.721505Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9b0ea0b527ccb3550a4a865a21d4967d24be690e8abbcfdb9134e5c62b4d74f4","observation_id":"1cec8c81-68e3-4cdb-9f9b-bdd261f28a4b","resolution":{"observed_at":"2026-08-15T15:20:30.721505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.725427Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.725427Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:46724c5b7c5839fc7ff92e4661c5f0f55da00208ebbcc18fc5c7bfece55ecc98","observation_id":"335d983f-9da6-4814-8657-472244f71b31","resolution":{"observed_at":"2026-08-15T15:20:30.725427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.729299Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.729299Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:25c17d7fc70d291cbc503eda3e2a918473b568a9723c85deefdab8d9bffdd97b","observation_id":"372974be-9b9c-483c-8697-a5f9b8c44a90","resolution":{"observed_at":"2026-08-15T15:20:30.729299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.737279Z","title":"Xiong, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.737279Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:76cd5f905ead7c8fc9c79948152c23d4344e1ee6ef3318c43f790a27e55fb37c","observation_id":"463e6cf4-e373-4b66-8390-046c4d1339eb","resolution":{"observed_at":"2026-08-15T15:20:30.737279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.741311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.741311Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c4f9a8084581017f762f83c1b3567d200816d3e33f44800984d5b0d79ac76d97","observation_id":"c244d780-bb11-4a8d-8947-d27748bc2a78","resolution":{"observed_at":"2026-08-15T15:20:30.741311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.515116Z","title":null,"venue":null,"work_id":"b39a050b-4fd1-47c3-bb85-7b41bad4b060","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.745519Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2f3456b744c005f4f7b64aa9e5f176828bcad7ebf622ab574d9efaed973bee16","observation_id":"a9031de8-321a-4b37-8699-cf5e0c4e4871","resolution":{"observed_at":"2026-08-15T15:20:32.519096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.502806Z","title":"Randløv, P","venue":null,"work_id":"f5ced35c-91d3-4cd0-af71-e0b51664e3ee","year":1998},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.750231Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:491e2f04c8a818b573b6a5b0e73d5cdf855734cfa8e16fb9f43d5ba791713e35","observation_id":"1bda3074-1f84-4232-9864-fbd9b0548316","resolution":{"observed_at":"2026-08-15T15:20:32.507243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.490284Z","title":null,"venue":null,"work_id":"463c93d8-61be-4cb2-8000-3908200cdcd8","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.755896Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b23d41d4e8f8978e0fad7c19685d534704e349299dc49e4c5fc7deedc947b0e2","observation_id":"376245e4-e372-415d-972b-c94562aaed0f","resolution":{"observed_at":"2026-08-15T15:20:32.494178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.478679Z","title":"Zheng,et al., Reinforcement learning-based control of single-track two-wheeled robots in narrow terrain.Actuators12(3), 109 (2023)","venue":null,"work_id":"06d6ab7b-03c8-4a1c-a3ce-213e9de06f5f","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.759881Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2e433874876eea12edb39b8e8ec014abed8f00adb272b72873bbc902032fd277","observation_id":"b6c54ef7-1a69-42ec-8165-22655658be5e","resolution":{"observed_at":"2026-08-15T15:20:32.482545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.467889Z","title":"Baltes, G","venue":null,"work_id":"5384f578-d340-4be6-a654-5219f510478e","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.763822Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:ff8ee2ec80df62d5f852dd100e3aafa5e451b7d7f7c2da32a94d59b48dd43c7c","observation_id":"948b6118-a193-462b-ba74-ec19e5c1b47f","resolution":{"observed_at":"2026-08-15T15:20:32.471862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.456036Z","title":"Zheng, D","venue":null,"work_id":"8c9798bb-e082-4987-b062-c3af68acc984","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.767922Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8c3e6d0b52ae6cb252acfe19ac2dec48cba12dfdc8fa278a432cfb3c7da5c8bc","observation_id":"990176fe-4387-45b5-b4f0-31e64c55a7c4","resolution":{"observed_at":"2026-08-15T15:20:32.459974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.444573Z","title":null,"venue":null,"work_id":"ef4d6812-7a86-4dbc-a21c-e0e386c67ae0","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.771806Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:ac185571b99f1c9beab79c6c687d1446c26c3d9f3ae31016a4ad48eb36c4d259","observation_id":"e815078e-98d7-4dab-901a-075f2a06f694","resolution":{"observed_at":"2026-08-15T15:20:32.448166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.434259Z","title":null,"venue":null,"work_id":"beb93c8e-eac9-4cff-bfa9-25dd2aac6ef3","year":2014},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.775689Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8c3789fb3ebc29cdcfadf4c8e924363aa9db645050ae8091c8ac6450c5fd8416","observation_id":"123e173e-0aa0-4be3-aa50-2b16d1a00463","resolution":{"observed_at":"2026-08-15T15:20:32.437816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.422048Z","title":null,"venue":null,"work_id":"1dcbcbae-3f52-4bf8-924d-9dc83e7a4985","year":1986},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.779676Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:78b7dbff7b360f72714d6eed6b1f4b86260b5a6e696b73e335bd306c7eba0ef8","observation_id":"ac1dff7c-be1a-43bb-8969-dce463d655c0","resolution":{"observed_at":"2026-08-15T15:20:32.426448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.408705Z","title":"Kuindersma,et al., Optimization-based locomotion planning, esti- mation, and control design for the atlas humanoid robot.Autonomous Robots40(3), 429–455 (2016),","venue":null,"work_id":"5ff76ab1-3894-476c-ae65-fe4d3b051406","year":2016},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.783677Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:576bf2f723e644a25a584971f69ac4fc591441824d3a7c67b71f46a32e3c9df3","observation_id":"c5a5028a-439c-41cf-9ee1-6346454771b8","resolution":{"observed_at":"2026-08-15T15:20:32.413834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.393319Z","title":"Di Carlo, P","venue":null,"work_id":"f51e972f-e7c4-442a-9828-a8d9f79ae8d0","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.787652Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:61b6287b5ebad6718dd6762fed1ebc34bf024a7be26e70922042fcf2dcd266d8","observation_id":"284f7c33-c429-4179-a331-de37abdc7aa2","resolution":{"observed_at":"2026-08-15T15:20:32.397291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.381749Z","title":null,"venue":null,"work_id":"bbed99d9-12bc-4bdc-8a6a-e3a8c94ffea6","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.791421Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:bb0ecb73199fb5d0c6131b76d2bf6f62ae0df04abc564cec748dfecebce345b7","observation_id":"7e513410-0b09-49d3-84ee-c2a3acd23176","resolution":{"observed_at":"2026-08-15T15:20:32.385736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.370542Z","title":"Fahmi, C","venue":null,"work_id":"f49b0af8-0ae3-455a-a2b6-9b0af58eb4e9","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.795942Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d5e918cc587555dfef757a5a1631dc8493cbe740f864c18e9a5b541ca27ce3fc","observation_id":"3d63ce7c-808f-43e2-8d46-f1fe23f3f4a6","resolution":{"observed_at":"2026-08-15T15:20:32.374169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.359022Z","title":"Rudin, D","venue":null,"work_id":"6ea41e02-940b-4978-a60f-08f4a222b2c1","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.799652Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7bb3202261d3942529fdac689a91e53cedcb15e5037db148b3c5c131ea3955d2","observation_id":"a1b1ca8f-4124-4ad1-88ce-224e6f56f02c","resolution":{"observed_at":"2026-08-15T15:20:32.362999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.346189Z","title":"Ha,et al., Learning-based legged locomotion: State of the art and future perspectives.Int","venue":null,"work_id":"61b9e0a0-a349-456a-9954-4187b0a183d8","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.803509Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:debf9d7f7c717f1cc880478a43ed1ba6ca613d5412db93d281a314bb296f7cad","observation_id":"3225f8f1-6b7a-45f1-b855-f41f5922ee7f","resolution":{"observed_at":"2026-08-15T15:20:32.350284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.334196Z","title":null,"venue":null,"work_id":"eea62c3e-f4ec-4b9d-b3b5-de43947ceeea","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.807383Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8649b0494887a536220ceda7eb83bb93712318683d5b51ba026afc4433230b8f","observation_id":"ccc3704e-344a-4257-9538-8934b30cdf6c","resolution":{"observed_at":"2026-08-15T15:20:32.337937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.811235Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.811235Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:901ae99d232e3a248197a902e843113fb52a82d635f11cfa4aa0dde17f5c74e2","observation_id":"ccad76a2-eb1e-4250-8db6-39962bca0064","resolution":{"observed_at":"2026-08-15T15:20:30.811235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.319775Z","title":"Hoeller, N","venue":null,"work_id":"ea782816-23d5-4da6-bd22-c9dd846af089","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.815349Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f1654d7418d5f92e54c70ffa217aad508b5dccc03bb770f3e43b7252bfc20766","observation_id":"58018126-b8f8-4fb6-9f5e-633bcb1b6cc7","resolution":{"observed_at":"2026-08-15T15:20:32.325157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.303956Z","title":"Cheng, K","venue":null,"work_id":"f1cde581-e4f2-42e4-b0df-ab6cf28bbcea","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.819497Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4eb2e919e573c94066d523fd671473f8520fdbae406f4172466aaa4abd9529b5","observation_id":"3f430b46-e207-49ca-b74c-c3abefcf209e","resolution":{"observed_at":"2026-08-15T15:20:32.308219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.290151Z","title":"Zhuang,et al., Robot Parkour Learning, inConference on Robot Learning(PMLR) (2023), pp","venue":null,"work_id":"f56b4eb3-e9b1-4e35-b4d1-a62a67194e6d","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.823248Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d4afd365d2ec27c367ca2fbb10a344bd322392e77125a25b82f222cd129a7cd6","observation_id":"d964b997-a84e-42ac-b0c1-f6f030c22490","resolution":{"observed_at":"2026-08-15T15:20:32.294177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.275995Z","title":"Li,et al., Robust and Versatile Bipedal Jumping Control through Re- inforcement Learning, inRobotics science and systems(RSS) (2023)","venue":null,"work_id":"88b95590-77c4-42f1-b412-897e21984a14","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.827043Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:be7ab76a146e1b108a4fd615c3091d6267d6341525c3539e696e5f5b6dd7182f","observation_id":"abf073d7-07bb-466a-868b-4250d58cd034","resolution":{"observed_at":"2026-08-15T15:20:32.280208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.263737Z","title":"Lee,et al., Learning robust autonomous navigation and locomotion for wheeled-legged robots.Science Robotics9(89), eadi9641 (2024)","venue":null,"work_id":"a2bf3c1e-ee3e-4016-af10-3063659ff318","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.830825Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8f1b8866d034300fabb7e367155c857d5ec78ac3744fbfdb6c8b972fff4b680e","observation_id":"b72746cc-2d9f-4fd8-bb90-c4180c5487b3","resolution":{"observed_at":"2026-08-15T15:20:32.268081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.249600Z","title":"Kim,et al., High-speed control and navigation for quadrupedal robots on complex and discrete terrain.Science Robotics10(102), eads6192 (2025)","venue":null,"work_id":"a95b00f0-8799-490e-a8b1-e120e403aa05","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.835269Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:722e63dd7fdce59096178dc12e5957a0d9e45c155b6463a0782f105bdd2a9c27","observation_id":"7fb7b8d2-6ecc-4c7b-a986-16fb29ea166e","resolution":{"observed_at":"2026-08-15T15:20:32.255109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.839034Z","title":"He,et al., Attention-based map encoding for learning generalized legged locomotion.Science Robotics10(105), eadv3604 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.839034Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4dbfc2923c708e8317a5b2c53aefa652f3cc2abedd7e92e70963ed3440c680e7","observation_id":"2503c6ad-fc8d-43c9-87da-404cfdc2b933","resolution":{"observed_at":"2026-08-15T15:20:30.839034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16481","last_updated":"2026-05-18T07:58:00Z","snapshot_observed_at":"2026-07-06T22:00:57.880339Z","submitted_at":"2025-07-22T11:36:45Z","title":"Guided Reinforcement Learning for Omnidirectional 3D Jumping in Quadruped Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16481","snapshot_observed_at":"2026-08-15T15:20:30.842877Z","title":"Bussola, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.842877Z"},"links":{"cited_paper":"/paper/2507.16481","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c295413fa4159b72d357e70772cb0736a7ba24ee7833f0b0995ecc1556862ae0","observation_id":"b0e3e562-ceaf-4086-8ce9-9ae31212a4c3","resolution":{"observed_at":"2026-08-15T15:20:30.842877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.223292Z","title":null,"venue":null,"work_id":"9830eb94-d453-4b9f-9603-e75a8baf63fe","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.846724Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b698239872c7398819246976508ca07c94fedce22881a05386ca9534dfb92c3d","observation_id":"a2508b65-5b43-42ce-9e57-29e158fdb790","resolution":{"observed_at":"2026-08-15T15:20:32.227901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.206763Z","title":null,"venue":null,"work_id":"a38a943c-20ea-4585-8e2c-e7966acdcc4d","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.851125Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f90316b7ee9ea753024a5e4c0ffb4c561fb9d8d328aca221dab0dde4438758b7","observation_id":"627d7db9-ac7a-4523-8e6b-3811d72e800f","resolution":{"observed_at":"2026-08-15T15:20:32.211795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.193462Z","title":null,"venue":null,"work_id":"a2c6e446-5754-49fd-a02a-3775e91acc1e","year":2021},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.855132Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8e0d909c41342037a2f71b749730a01a21354aa726b7abbc8d7ffe8f106379dc","observation_id":"7ab20264-5a0d-4aca-a27a-57c2983bebb2","resolution":{"observed_at":"2026-08-15T15:20:32.197430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.180364Z","title":null,"venue":null,"work_id":"baedb04d-af39-4bc8-8418-f4f4da1ca749","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.859040Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:40692f31a3d75d39e1d0129bf7f02f3350b420c63a862fbeb4ac26610dd45269","observation_id":"8dadc89b-ce5c-467f-ba0c-d188fb64442d","resolution":{"observed_at":"2026-08-15T15:20:32.184405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.168804Z","title":"Tessler, Y","venue":null,"work_id":"06b55b3b-fa3f-484e-96d1-89ca17eef950","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.863108Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e41d147ac52cd9ffa32e83f60c8e12cc7ea9e09f7ca16c904c29363d8856237f","observation_id":"c36a769b-959d-41d5-a419-d2c2adf8f61f","resolution":{"observed_at":"2026-08-15T15:20:32.172896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.866617Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.866617Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3929b2f3f61990ee4c70e6daf33bcb20911a64747171984452b95212093a55b5","observation_id":"e72ccc95-1255-4a94-8dd9-58087f169b3a","resolution":{"observed_at":"2026-08-15T15:20:30.866617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.870466Z","title":"Kang,et al., Learning Steerable Imitation Controllers from Unstruc- tured Animal Motions.arXiv preprint arXiv:2507.00677(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.870466Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5aa7eae0da161b1c2043055c5422b1f6ce8c85737affae9f613c5ee373fa95ce","observation_id":"10a009a3-0d01-4df8-842d-1c39e173b8c7","resolution":{"observed_at":"2026-08-15T15:20:30.870466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.155154Z","title":null,"venue":null,"work_id":"2efacf12-545d-4f1c-bd12-b95c4fb2d361","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.873975Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:31afad7a9f5e4987c33b91ca5304cd53efc3c0d2fe758c58f1359d8926297c96","observation_id":"bd484a3a-e56a-4d66-83d1-6edb08974e68","resolution":{"observed_at":"2026-08-15T15:20:32.158910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10989","last_updated":"2023-05-18T14:09:04Z","snapshot_observed_at":"2026-08-21T02:18:53.725078Z","submitted_at":"2023-05-18T14:09:04Z","title":"Reinforcement Learning for Legged Robots: Motion Imitation from Model-Based Optimal Control","version":1},"cited_work":{"arxiv_id":"2305.10989","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10989","snapshot_observed_at":"2026-08-15T15:20:31.474500Z","title":"Reinforcement Learning for Legged Robots: Motion Imitation from Model-Based Optimal Control","venue":"cs.RO","work_id":"b45c9bd3-e0b8-4f5a-b6a6-b169255cca90","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.877693Z"},"links":{"cited_paper":"/paper/2305.10989","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:95b341c3059b6967396486f8c3621084209ba623fa748fc10862d5262da01479","observation_id":"1fc000c0-7f1d-4018-820b-09830a322986","resolution":{"observed_at":"2026-08-15T15:20:31.479707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.140805Z","title":null,"venue":null,"work_id":"1e1f4291-325a-43b2-a27a-ec22f03f6fc1","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.881747Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e844e04bdf90d75b8237bba3255ea9e82a2461b29e57883d42b64ac207c926d9","observation_id":"70377422-dd93-4ca6-8063-8f7f71ed5b79","resolution":{"observed_at":"2026-08-15T15:20:32.146130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.124241Z","title":"Y oum,et al., Imitating and finetuning model predictive control for robust and symmetric quadrupedal locomotion.IEEE Robotics and Automation Letters8(11), 7799–7806 (2023)","venue":null,"work_id":"ac206350-cab7-440a-8fbf-72f948e6585c","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.885374Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0d571fa6b3c233adb39ba961c24c62c0ae98df55332189823c8495357c7b1046","observation_id":"dea73991-cb1d-405d-866f-1f144f70e2a3","resolution":{"observed_at":"2026-08-15T15:20:32.129304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01247","last_updated":"2023-03-23T21:50:08Z","snapshot_observed_at":"2026-08-16T16:27:11.781955Z","submitted_at":"2022-10-03T21:58:25Z","title":"OPT-Mimic: Imitation of Optimized Trajectories for Dynamic Quadruped Behaviors","version":3},"cited_work":{"arxiv_id":"2210.01247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.01247","snapshot_observed_at":"2026-08-15T15:20:31.452346Z","title":"OPT-Mimic: Imitation of Optimized Trajectories for Dynamic Quadruped Behaviors","venue":"cs.RO","work_id":"3d1a4e70-abc9-41c3-b801-554a89796282","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.889172Z"},"links":{"cited_paper":"/paper/2210.01247","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3d8238bfac94e10e64299655e44a456b0ac98336b53d70cc3584f1423fbecee0","observation_id":"a6e37e3e-3d26-4d2a-8157-03e90a9b8506","resolution":{"observed_at":"2026-08-15T15:20:31.459258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.893520Z","title":"Liu,et al., Opt2skill: Imitating dynamically-feasible whole-body trajectories for versatile humanoid loco-manipulation.arXiv preprint arXiv:2409.20514(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.893520Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d67dd68022f7c1bc2945ca8a043e98a2cfb11fbe9249fbf3419a63ef4c112a39","observation_id":"6eb73797-b78e-405b-bea5-3bd9e95d9e36","resolution":{"observed_at":"2026-08-15T15:20:30.893520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26633","last_updated":"2026-06-15T23:36:36Z","snapshot_observed_at":"2026-08-19T20:36:45.259495Z","submitted_at":"2025-09-30T17:59:02Z","title":"OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.26633","snapshot_observed_at":"2026-08-15T15:20:30.897390Z","title":"Y ang,et al., OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction, inarxiv preprint arXiv:2509.26633(2026), pp","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.897390Z"},"links":{"cited_paper":"/paper/2509.26633","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f5b09901e4458cd6f90924abb48ea5a4f1fa1e50c90d4f6476d0bba1ece691ae","observation_id":"baa6edf4-d022-4820-865f-27df86d45d2b","resolution":{"observed_at":"2026-08-15T15:20:30.897390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.110849Z","title":"Mahmood, N","venue":null,"work_id":"0c684d4e-96e6-4dbd-a0d5-db4d06afb0e7","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.901704Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:aba83c0bfb2ad0095738e49b9106be2dc04fbc2fc3d8f8df77fc642c839b3436","observation_id":"c35dcc02-4c47-4f6d-b3e0-f691e31c176b","resolution":{"observed_at":"2026-08-15T15:20:32.114692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.097920Z","title":null,"venue":null,"work_id":"5e4e470e-2c51-4508-be15-a1a7f0a830ef","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.905662Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:eb9ed5996a41f51341bf15ed145ad8bbd8dc21032737a61786c27d5746da8b7a","observation_id":"f68e09aa-70b9-40c9-8f6a-b208f5350179","resolution":{"observed_at":"2026-08-15T15:20:32.102419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08858","last_updated":"2024-06-13T06:44:46Z","snapshot_observed_at":"2026-08-19T21:16:35.742198Z","submitted_at":"2024-06-13T06:44:46Z","title":"OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08858","snapshot_observed_at":"2026-08-15T15:20:30.909504Z","title":"He,et al., OmniH2O: Universal and Dexterous Human-to- Humanoid Whole-Body Teleoperation and Learning.arXiv preprint arXiv:2406.08858(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.909504Z"},"links":{"cited_paper":"/paper/2406.08858","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:ea4218db5beff850f922b1f3aafd298369abdf2f041a248af01cd24e922d23a7","observation_id":"4f921d9b-933a-470f-b0db-24392e83cd10","resolution":{"observed_at":"2026-08-15T15:20:30.909504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01143","last_updated":"2025-04-26T03:22:14Z","snapshot_observed_at":"2026-08-20T19:33:12.526162Z","submitted_at":"2025-02-03T08:22:46Z","title":"ASAP: Aligning Simulation and Real-World Physics for Learning Agile Humanoid Whole-Body Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01143","snapshot_observed_at":"2026-08-15T15:20:30.914367Z","title":"He,et al., Asap: Aligning simulation and real-world physics for learn- ing agile humanoid whole-body skills.arXiv preprint arXiv:2502.01143 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.914367Z"},"links":{"cited_paper":"/paper/2502.01143","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7df6b739cb36c245739c76a72e968c2ac86939aa682c67e00c8c63963e8217fc","observation_id":"d06e224d-c0b4-4cf8-a5f7-e5690717ff29","resolution":{"observed_at":"2026-08-15T15:20:30.914367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14770","last_updated":"2025-09-04T02:48:07Z","snapshot_observed_at":"2026-08-14T19:22:40.392293Z","submitted_at":"2025-06-17T17:59:33Z","title":"GMT: General Motion Tracking for Humanoid Whole-Body Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14770","snapshot_observed_at":"2026-08-15T15:20:30.918642Z","title":"Chen,et al., GMT: General Motion Tracking for Humanoid Whole- Body Control.arXiv preprint arXiv:2506.14770(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.918642Z"},"links":{"cited_paper":"/paper/2506.14770","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:381f85d8fb97acc0073bf959d24b57cadd2aba41be3521c3c961c19cda84248e","observation_id":"13541ca3-778f-46df-99e9-74037e5e0fe8","resolution":{"observed_at":"2026-08-15T15:20:30.918642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15827","last_updated":"2026-05-06T20:45:29Z","snapshot_observed_at":"2026-07-06T22:46:12.384926Z","submitted_at":"2026-02-17T18:59:11Z","title":"Perceptive Humanoid Parkour: Chaining Dynamic Human Skills via Motion Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15827","snapshot_observed_at":"2026-08-15T15:20:30.923069Z","title":"Wu,et al., Perceptive humanoid parkour: Chaining dynamic human skills via motion matching.arXiv preprint arXiv:2602.15827(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.923069Z"},"links":{"cited_paper":"/paper/2602.15827","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:758444af31c1b0735b1d9304cbcf56ed98c05cc963c9351a8a119ccac7f5f27d","observation_id":"54e00089-315a-4d7c-b050-ac5791c8013d","resolution":{"observed_at":"2026-08-15T15:20:30.923069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.927624Z","title":"Sleiman, ZEST: Zero-shot Embodied Skill Transfer for Athletic Robot Control.arXiv preprint arXiv:2602.00401(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.927624Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:99a50a7ded09606c9b7979f35eff9b20213e2f312787f12fb758cb1628a5ff14","observation_id":"0682d286-642c-484e-a998-7d3b22ea41d3","resolution":{"observed_at":"2026-08-15T15:20:30.927624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.085104Z","title":null,"venue":null,"work_id":"0e1ea02d-325c-480c-92c2-65b7131ffedc","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.932024Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:dc80d3a35c81a9edc8009761de2175e735558b2dcd2290dd43f16ab1b5a741ef","observation_id":"c369d56a-569c-4011-832e-23a7954d4069","resolution":{"observed_at":"2026-08-15T15:20:32.089379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.071986Z","title":null,"venue":null,"work_id":"d83197c0-986b-4ff8-bb9c-553fa92e9bb7","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.935861Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8b9bbb1182d90629c2c2df0ab9436263bc10ecff6e29c7314da8a420a1276ef8","observation_id":"3d20cbd2-863b-4a53-bbdf-3fd5ab91c824","resolution":{"observed_at":"2026-08-15T15:20:32.076545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.044162Z","title":null,"venue":null,"work_id":"cfb9215a-b55c-4b09-924f-57c3037a75a0","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.939713Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c7268c34b6dfa270db4a4d8724cd0946e067e820c6965665378c5cdc5944751b","observation_id":"55935f32-87c8-4d21-a5f0-6c4121eb1694","resolution":{"observed_at":"2026-08-15T15:20:32.048390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.031999Z","title":"Li,et al., Learning agile skills via adversarial imitation of rough partial demonstrations, inConference on Robot Learning(PMLR) (2023), pp","venue":null,"work_id":"bbdbd105-057e-4c1e-a1b3-5fd95d1c2eb2","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.943034Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3315be1f6ac8dc409580400392b7930809c559bc5eca59676a314311e6af4c8b","observation_id":"d82ace34-d19f-4915-abf4-631d4eb11ed1","resolution":{"observed_at":"2026-08-15T15:20:32.036914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.020023Z","title":"Zargarbashi, J","venue":null,"work_id":"047c11e8-421e-4a21-a8f9-3af558539f91","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.947641Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:fecf9782a84a8799c519429f50b9b0a2bd5a9ff7617dcd09f588c9308436a267","observation_id":"69ad7e7c-08d2-4ff2-b380-fced12bb450b","resolution":{"observed_at":"2026-08-15T15:20:32.024171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.006627Z","title":"Rho,et al., LineRides: Line-Guided Reinforcement Learning for Bicycle Robot Stunts.IEEE Robotics and Automation Letters(2026),","venue":null,"work_id":"e2f1c11f-8c6c-4c25-8406-ba1cc6b47ffd","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.951593Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:08e4e813b2bf77921936f8398e392341932f1d56ae5c05baa7286aa6e13d142c","observation_id":"0da85ed4-38b2-434e-aa46-da89b0109250","resolution":{"observed_at":"2026-08-15T15:20:32.011080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.994296Z","title":null,"venue":null,"work_id":"785b92cc-613d-48ca-ba4c-9b0d1bc05141","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.955417Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e0596bf0c21c7d3a244a9734c23e99ad84d25337c1426479d001a1af4abaa30e","observation_id":"611a2d88-86b2-4560-b9e3-faf22584deb5","resolution":{"observed_at":"2026-08-15T15:20:31.998779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08378","last_updated":"2025-04-19T20:24:29Z","snapshot_observed_at":"2026-08-14T07:06:18.521079Z","submitted_at":"2025-02-12T13:10:09Z","title":"Learning Humanoid Standing-up Control across Diverse Postures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08378","snapshot_observed_at":"2026-08-15T15:20:30.960092Z","title":"Huang,et al., Learning Humanoid Standing-up Control across Di- verse Postures.arXiv preprint arXiv:2502.08378(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.960092Z"},"links":{"cited_paper":"/paper/2502.08378","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d9505264487d324f540984dadf2914512db58a06493762afd4a59f15c425d208","observation_id":"c95c2c09-2d5b-46e4-a482-325f675f001c","resolution":{"observed_at":"2026-08-15T15:20:30.960092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.964285Z","title":"Strauch,et al., Robot Crash Course: Learning Soft and Stylized Falling.arXiv preprint arXiv:2511.10635(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.964285Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4036e539e18912928410ff825d39e43aafce14360bfc71d61fda6705520e9afd","observation_id":"a17b5db7-db0d-46f5-876e-677f89c7e346","resolution":{"observed_at":"2026-08-15T15:20:30.964285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.979511Z","title":"MacAskill, Red Bull, Danny MacAskill’s Imaginate (2013), https: //www.youtube.com/watch?v=Sv3xVOs7_No, accessed: 2026-05-18","venue":null,"work_id":"efc32779-ee41-4099-b0d0-7704ab6c74bd","year":2013},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.968708Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8ec5d89383cfb382366676aa563bf4c58b768c6ad1c252bb313cc8082352c74c","observation_id":"9524057f-1322-45f0-9a3c-f8dfcc9d6ba8","resolution":{"observed_at":"2026-08-15T15:20:31.984465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.967883Z","title":"MacAskill, Redd Bull Bike, Danny MacAskill’s Gymnasium (2020), https://www.youtube.com/watch?v=fAEBNEscL0c, accessed: 2026-05- 18","venue":null,"work_id":"dd3a13cd-aa8c-4e48-9b9b-e87bf5c35505","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.972531Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0b316318c4b024a9d7830e5bb579aacf3e5cd1bcbbaa7e9575007cb5d251a127","observation_id":"c9264d1c-fc09-46eb-b1f3-96117778f14e","resolution":{"observed_at":"2026-08-15T15:20:31.972078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.956594Z","title":null,"venue":null,"work_id":"45ae1c02-30e3-4be3-b914-806f9393514e","year":1999},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.976719Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b957757db774e8d528b23cb88131ea0531050dcf6f3370fa8e62e0e1685f61f2","observation_id":"40b936d4-6112-422c-9975-7575913c0856","resolution":{"observed_at":"2026-08-15T15:20:31.960198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.943614Z","title":"Rudin, D","venue":null,"work_id":"0407f18f-d2ce-4759-b121-d98bed713501","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.980805Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:373199886631e80dd4b7a9673a5264946a7cdf9d9c639278476f25b3ce7f71bd","observation_id":"d3768a7e-e90e-4aa3-ae85-b6bf87c2891c","resolution":{"observed_at":"2026-08-15T15:20:31.948014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.924773Z","title":null,"venue":null,"work_id":"24124dfe-ac8a-44b0-b1a1-a78505b47ac8","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.985113Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:66a1865750d5963e100039a19cb062154ec779f9be0c1f66dd19c68b2c95fc77","observation_id":"d493ba73-173b-4109-b568-3b7ee089ca88","resolution":{"observed_at":"2026-08-15T15:20:31.930844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.904168Z","title":"Portelas, C","venue":null,"work_id":"48811092-38b3-4d43-8cdf-5ffb896ca281","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.989750Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:70db2d12ceb70f0baf6eacf76afbcced7e8e12568d14872074cf78e371138ad1","observation_id":"063cfea2-04e8-4c0b-8b86-60c71a892e9a","resolution":{"observed_at":"2026-08-15T15:20:31.909102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.888515Z","title":"Hwangbo,et al., Learning agile and dynamic motor skills for legged robots.Science Robotics4(26), eaau5872 (2019)","venue":null,"work_id":"8ad163ff-11f5-4937-a616-005f5dfe4805","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.993972Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1684a87d5f598d6efec24e8cc67f6c44fbcb3355cc26cf56a906c83a7256d191","observation_id":"aeccaf49-db11-4984-a2c8-9704a483ba74","resolution":{"observed_at":"2026-08-15T15:20:31.892915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.876159Z","title":null,"venue":null,"work_id":"776193bc-cc6c-4094-986c-bc64f7764db2","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.999077Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:201c1a5eacec9c2553fa5ef7ec0b53dfe029426928f39aa1ffd0bd29fb2852b2","observation_id":"59c1c74d-324f-4da6-8fff-0baa6d75cc8f","resolution":{"observed_at":"2026-08-15T15:20:31.880194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T15:20:31.004000Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.004000Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:71079d47713c70c1f4831c72b97f7ea8b7a2e6017343575720da1656dd5a3ff5","observation_id":"f264c837-9830-4810-9e5c-3bfac113ab43","resolution":{"observed_at":"2026-08-15T15:20:31.004000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-19T12:26:40.549434Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.04831","snapshot_observed_at":"2026-08-15T15:20:31.008582Z","title":"Mittal,et al., Isaac Lab: A GPU-Accelerated Simulation Frame- work for Multi-Modal Robot Learning.arXiv preprint arXiv:2511.04831 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.008582Z"},"links":{"cited_paper":"/paper/2511.04831","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2c391dce2080a06af537441b29c652191809c39642ca69f78cc8eb3d6d0a26b1","observation_id":"df2e71ea-671a-46ed-9f18-e6bf67e58719","resolution":{"observed_at":"2026-08-15T15:20:31.008582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06542","last_updated":"2017-10-18T01:10:37Z","snapshot_observed_at":"2026-08-14T20:22:42.955584Z","submitted_at":"2017-10-18T01:10:37Z","title":"Asymmetric Actor Critic for Image-Based Robot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.06542","snapshot_observed_at":"2026-08-15T15:20:31.012846Z","title":"Pinto, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.012846Z"},"links":{"cited_paper":"/paper/1710.06542","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5764b3bc85aba2a75b3ba9aebf3b43f7e0e73e5bc4f55574d8ee2db14ea0bb39","observation_id":"2a347df2-0ab7-476b-91ca-bcc9cb2bcc6d","resolution":{"observed_at":"2026-08-15T15:20:31.012846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.858105Z","title":"Abdolhosseini, H","venue":null,"work_id":"e4b9f020-f8d8-4126-8c0c-833792572d20","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.017710Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b8e0fdb905f8619d8026e81821be843f6b73238dbc8881c66a800d4855301ba4","observation_id":"57543452-8b01-4c4b-8eb2-bfe19d70a9eb","resolution":{"observed_at":"2026-08-15T15:20:31.865207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.842663Z","title":null,"venue":null,"work_id":"f8d3d555-f96c-4a9f-9f80-e2107a4ea673","year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.022440Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:ceda727cb9aad1d5e6814053eee37f5cb9690bc6a2105c97594cb3b4c289c196","observation_id":"a30d98d3-01cc-4fb5-b08d-08ae94a6e8c7","resolution":{"observed_at":"2026-08-15T15:20:31.846705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.829709Z","title":null,"venue":null,"work_id":"35e6777c-a544-40c8-885b-f12d0548dd04","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.026204Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5d788ec6fb12fadbc1fedb14b0601c5d83e8f7c6724f5df31ba7e87c00724367","observation_id":"e40a63ba-bfec-47d4-9966-2d4bb67a26e8","resolution":{"observed_at":"2026-08-15T15:20:31.833583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10332","last_updated":"2018-05-16T20:35:34Z","snapshot_observed_at":"2026-08-14T19:21:23.179705Z","submitted_at":"2018-04-27T03:42:55Z","title":"Sim-to-Real: Learning Agile Locomotion For Quadruped Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10332","snapshot_observed_at":"2026-08-15T15:20:31.030954Z","title":"Tan,et al., Sim-to-real: Learning agile locomotion for quadruped robots.arXiv preprint arXiv:1804.10332(2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.030954Z"},"links":{"cited_paper":"/paper/1804.10332","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c2db5442c43d1d6cda984261226de756b9a51f96ae258e14b2c7f2d6b4786d34","observation_id":"b1c11b73-d267-46d2-84da-7f545c857794","resolution":{"observed_at":"2026-08-15T15:20:31.030954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.814736Z","title":"Choi,et al., Learning quadrupedal locomotion on deformable terrain","venue":null,"work_id":"9734ffe6-d51e-4446-bffc-d46621ece7e9","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.035163Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0ab32fc3e8ca130e967ff48ba98eff6fc3909bce39c4b25fc0cad5a7f694279d","observation_id":"3153df8e-fba7-4209-828b-a2563a2fe8a0","resolution":{"observed_at":"2026-08-15T15:20:31.819010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.801619Z","title":"Todorov, T","venue":null,"work_id":"d37249e5-ae4a-479e-a771-a08e21c0a4db","year":2012},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.039698Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9caec9abd4ab4e4dbe6b4e9d9d72ca9b038dad233f17dcb2afc943cc631fa200","observation_id":"6156e641-a08c-4390-a9d5-67bbe964b67c","resolution":{"observed_at":"2026-08-15T15:20:31.806387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.786923Z","title":null,"venue":null,"work_id":"f2a249dd-a849-4479-9c02-bc57a5a4b9f3","year":null},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.044802Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7fc87aab0609d42a0f7e56d0ad05441011fca383760ff7243d399d547e59d439","observation_id":"05e9884e-f2cb-4a20-84a1-41922d090a3d","resolution":{"observed_at":"2026-08-15T15:20:31.790976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.772873Z","title":"Bellicoso, A","venue":null,"work_id":"c4dfe01a-ffdb-4b86-bc03-d06acbf9d111","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.048863Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5e6c2683462186a7dfc3a173a5b4cf03a6fbaa00ccf75a5a0339839449941470","observation_id":"6119261c-39e3-426e-b1cd-0efa9733589b","resolution":{"observed_at":"2026-08-15T15:20:31.777932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.758525Z","title":null,"venue":null,"work_id":"c0149b27-0b7a-4705-8807-a4344bfeaa9b","year":null},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.054630Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c95508f2a58f120fc26fd81ae57051ca48624cc6839fdcb238c1b235260c2a08","observation_id":"48e22604-9c55-4db4-a66c-9a1ed66a896b","resolution":{"observed_at":"2026-08-15T15:20:31.762856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.743731Z","title":null,"venue":null,"work_id":"bc51a612-8084-4739-a6d0-1678e3245753","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.058964Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1c7ebeb28fa1c17a9db8f62224ed18e018ebd6dc77c326ea4152d1913e9ec1b4","observation_id":"db0d5f7a-0b8c-4825-9dde-cd6b3b3f1797","resolution":{"observed_at":"2026-08-15T15:20:31.747803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.730271Z","title":"Dellaert,et al., borglab/gtsam: Release 4.2.Zenodo(2023)","venue":null,"work_id":"23d69846-debf-42bd-8a8d-ebcb8acc1310","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.063027Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b237ba31707bb1e9cbd73e68821da91c4e6bcd2850252cc89bf8c2cc4d18f9f1","observation_id":"c9064be9-e991-49e0-a26a-e9027672823b","resolution":{"observed_at":"2026-08-15T15:20:31.734735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.717356Z","title":"Goldfain,et al., Autorally: An Open Platform for Aggressive Au- tonomous Driving.IEEE Control Systems Magazine39(1), 26–55 (2019)","venue":null,"work_id":"7401164c-25b0-471f-b6b8-e95df06cc36e","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.066762Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7d98240e1c5ef718f81332641ed13932654ed8afbc4ae637917b796b1cc79b06","observation_id":"f9ca2262-3509-4c34-859c-d70e35971599","resolution":{"observed_at":"2026-08-15T15:20:31.721607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.702988Z","title":"bail out","venue":null,"work_id":"e603fcee-6afb-46bb-bca0-d14081a27489","year":2015},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.071434Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f6350bba32017c5daccc17fad08beb81ca7e88b66be85b4b2e3cf0dd8e37c046","observation_id":"99b32d12-a94a-40c1-95b9-4fceb243d2ac","resolution":{"observed_at":"2026-08-15T15:20:31.707153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-19T03:31:31.217310Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":2,"verified_fuzzy":33},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 0 inbound Pith citation observations for arXiv:2608.00880."}