{"as_of":"2026-08-16T15:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab38d42de382c9d1c62f404d9f4eb3ede4f9a3f723ffaba2c3b56d1fcd433dd3","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:49:33.639683Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20382/citation-record","integrity":"/paper/2507.20382/integrity","json":"/paper/2507.20382/citation-record.json","paper":"/paper/2507.20382"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.408286Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.408286Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:610dc7a3dc25ce58406035fe5e70bb9d72f19ea1dadfe289a718ae7ace0094c5","observation_id":"7776d6b1-3e61-4325-9866-f4614b50116a","resolution":{"observed_at":"2026-08-15T17:49:33.408286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-08-15T19:30:43.427473Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-15T17:49:33.413736Z","title":"Rma: Rapid motor adaptation for legged robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.413736Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:44531c669b4d124720b0f55e27105490da5acc89fe451968cf8d71ea18d56e4d","observation_id":"59234158-b3df-455a-99b0-b44d0f2edf62","resolution":{"observed_at":"2026-08-15T17:49:33.413736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.418477Z","title":"Anymal parkour: Learning agile navigation for quadrupedal robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.418477Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:50f1fe55b1e1382252e8c387bb544e1d3ea4044d9ba8805939b66b811642a2f9","observation_id":"52b3e8c3-c6f9-40a0-b9e7-a7baaba46a07","resolution":{"observed_at":"2026-08-15T17:49:33.418477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.422845Z","title":"Hybrid internal model: Learning agile legged locomotion with simulated robot response,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.422845Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:9939d09f6353def5de6c7a66f260a68da633b26a3d2eb17dd975807c22996064","observation_id":"8eff08c3-eb11-424f-b17e-3cfa7a33fda1","resolution":{"observed_at":"2026-08-15T17:49:33.422845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.333288Z","title":"Soloparkour: Constrained reinforcement learning for visual locomotion from privileged experience,","venue":null,"work_id":"127b0093-4788-4710-8a8f-4bef837e7935","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.427618Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:4914695f85e89dc18d3db84331bb5eef3ee781f0c0aab1ad033804040776b3af","observation_id":"35f86f85-2f6a-45e1-a798-6f95be219115","resolution":{"observed_at":"2026-08-15T17:49:34.336998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.320925Z","title":"SLR: Learning quadruped locomotion without privileged information,","venue":null,"work_id":"beac2f28-704b-49df-8858-cb39d80a3482","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.431841Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:a4e87671d2e8d6168e161ec9c7f7129af9530cd67360ea5e5f7b772e0d10d15e","observation_id":"1accfd9b-572d-44ab-a24f-836436b8017e","resolution":{"observed_at":"2026-08-15T17:49:34.325078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.307429Z","title":"Learning h-infinity locomotion control,","venue":null,"work_id":"bdca279c-09ef-40eb-bfd7-f66f0fed7063","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.437507Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:92b41a0f7afaa46e80ce076c13196d6b8103f837bad1dc3fd248e40da66a3135","observation_id":"0027b7fc-7c2d-4841-8c79-173efa594a22","resolution":{"observed_at":"2026-08-15T17:49:34.312354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.294845Z","title":"Gaitor: Learning a unified representation across gaits for real-world quadruped locomotion,","venue":null,"work_id":"26f2d7ca-565e-4902-87e4-c7bd2e99cb5b","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.441346Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:31dfd12137f15e5d5aa3ca78de848f485b6868778517f485999265a10f1cf6dc","observation_id":"2d988cc7-0833-4d96-ad4e-fe7aab44deda","resolution":{"observed_at":"2026-08-15T17:49:34.299149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.280966Z","title":"TOP-nav: Legged navigation integrating terrain, obstacle and proprioception estimation,","venue":null,"work_id":"c1063741-ffa8-4aca-895b-c5218da50295","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.445420Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:8c2b92150a7ca0de7d6afc92c5b1edd5d835b94c6b342920b74021189a3c8142","observation_id":"9770f932-55a4-41b6-b29e-97b64095913e","resolution":{"observed_at":"2026-08-15T17:49:34.286180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.267721Z","title":"Robotkeyframing: Learning locomotion with high-level objectives via mixture of dense and sparse rewards,","venue":null,"work_id":"b92a2e1c-fcfd-49ea-b972-72d8c73cf9e9","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.448869Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:dd7f84ee10ab9d4f7b18b25bc001e95e214f4ce3ad752c3140ae802fe95dd7d2","observation_id":"312ebc98-1e85-4312-be3e-9ad51a262b04","resolution":{"observed_at":"2026-08-15T17:49:34.272061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.254775Z","title":"Generalized animal imitator: Agile locomotion with versatile motion prior,","venue":null,"work_id":"ec3e3e6b-13ac-41f8-95ad-40373c665be0","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.453158Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:6948bd0b52e4d1d09e5b200e40f3ca91ef43174daa6feeff69c384793b8afa92","observation_id":"71f4d2e9-b625-48ca-af9b-84da693b7a15","resolution":{"observed_at":"2026-08-15T17:49:34.259039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.241585Z","title":"UMI-on-legs: Making manipulation policies mobile with a manipulation-centric whole-body controller,","venue":null,"work_id":"9232b99d-ad0e-48ef-b100-91e5337831b0","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.457518Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:c2f2c0bc6fd3649ee316a67e47a45986912b096910a28d89ec8d3b5ebf93d507","observation_id":"a71b033e-ea7c-473c-89b4-91b5d039c967","resolution":{"observed_at":"2026-08-15T17:49:34.246157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.229059Z","title":"Guided reinforcement learning for robust multi-contact loco-manipulation,","venue":null,"work_id":"d690d796-42fa-4531-a994-10ec2a50ad10","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.461498Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:5cb6ccebc6fd82ba09d7f063ad217062cc815c8a70c10fd2c16d4e450212b7e2","observation_id":"0c882ac1-1ef2-4b1c-8892-a2c4c7e9fc20","resolution":{"observed_at":"2026-08-15T17:49:34.232872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.217019Z","title":"Continuously improving mobile manipulation with autonomous real-world RL,","venue":null,"work_id":"103b94e7-8b18-44cb-b2b8-d7b6706d2899","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.465313Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:5d0f748f517c4292ae5fe7a182976d1a4e805b8e8a95f937d79fcc9e81ffd102","observation_id":"9e97b181-b03c-4978-a836-ff0f0c95a2aa","resolution":{"observed_at":"2026-08-15T17:49:34.220779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.203745Z","title":"Learning to open and traverse doors with a legged manipulator,","venue":null,"work_id":"7aa75cbe-3706-4a73-82bb-8dd5ea962e44","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.469252Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:98748ba2f44e3b07eddf076560a92fe65fbd7dcd66e587de89e65c5bd7dcb1d2","observation_id":"4758cbd8-b858-4c12-b582-03659326ce95","resolution":{"observed_at":"2026-08-15T17:49:34.208481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.189971Z","title":"A versatile planner for learning dexterous and whole-body manipulation,","venue":null,"work_id":"2285e212-20b1-4b26-9ac7-798ab57d4b5e","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.473167Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:cd3a24a024a27fc8b3199ae9f6877dd6e0cb6efebbce873305a035a7155c1493","observation_id":"7e643678-4167-46cf-80d7-c377fc682ae0","resolution":{"observed_at":"2026-08-15T17:49:34.194240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.175205Z","title":"Hierarchical reinforcement learning for precise soccer shooting skills using a quadrupedal robot,","venue":null,"work_id":"e7d25842-6f3e-4829-a232-8c8b37cb17cc","year":2022},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.477086Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:9ee0f7e4e9e59d172a1b6d8980184184c8f82e93b1643dc4d72fe17de1675c8f","observation_id":"8d7e49fb-3eef-40a9-b20b-f339a3c965eb","resolution":{"observed_at":"2026-08-15T17:49:34.180500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.161864Z","title":"Dribblebot: Dynamic legged manipulation in the wild,","venue":null,"work_id":"d245afd7-4eda-45e2-a852-2cf700f2ca27","year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.480931Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:6359343f342a89cfc68064fa6448d5fdd45968951e46eef8555cc76691ad59a4","observation_id":"94a5d241-e059-436e-99a8-c5840e386a27","resolution":{"observed_at":"2026-08-15T17:49:34.166120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.148395Z","title":"Event- based agile object catching with a quadrupedal robot,","venue":null,"work_id":"4ead0327-0fe8-47ff-93e0-10bdf1744485","year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.485060Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:24175d182b53a8feb56bd494292383403a9b15142b8dcf8633864eef19c970d6","observation_id":"9a00f4ae-829c-4aae-a038-0ff0eac00dc1","resolution":{"observed_at":"2026-08-15T17:49:34.152736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.135217Z","title":"Creating a dynamic quadrupedal robotic goalkeeper with reinforcement learning,","venue":null,"work_id":"daedfb72-e772-4d7a-8241-19d68b51df43","year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.489131Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:fff1136480bb1035e8fa22fdc6774aed800a7d6b0daba7deeb82a57d109da129","observation_id":"8a8f6db0-8400-487c-884a-89d521f328e4","resolution":{"observed_at":"2026-08-15T17:49:34.139486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.493119Z","title":"Versatile multicontact planning and control for legged loco-manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.493119Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:f370b8a8b86206d01f16544e6e10bc2821ff6e09e6226eecc05189bdd5ae0377","observation_id":"31c5342f-fc42-416b-bc50-9ef04643ff5e","resolution":{"observed_at":"2026-08-15T17:49:33.493119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.497279Z","title":"Deep whole-body control: learning a unified policy for manipulation and locomotion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.497279Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:ac344171b80c1cc00f4fa97d693f89309065e593d597b830e337abedb5c1cbd3","observation_id":"1232e0c8-9cb6-4e81-b7cb-e4ae378b4c7c","resolution":{"observed_at":"2026-08-15T17:49:33.497279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18197","last_updated":"2024-10-18T16:47:50Z","snapshot_observed_at":"2026-08-16T14:06:03.763863Z","submitted_at":"2024-03-27T02:13:24Z","title":"LocoMan: Advancing Versatile Quadrupedal Dexterity with Lightweight Loco-Manipulators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18197","snapshot_observed_at":"2026-08-15T17:49:33.501173Z","title":"Locoman: Advancing versatile quadrupedal dexterity with lightweight loco-manipulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.501173Z"},"links":{"cited_paper":"/paper/2403.18197","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:85dbd18fbe206f36f8a9031d2c272afc4a409947fe39daab5594f727ffe9b10a","observation_id":"cc038f6d-625d-4c93-b8aa-c144c887ddd2","resolution":{"observed_at":"2026-08-15T17:49:33.501173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.104738Z","title":"The evolution of human bipedality: ecology and func- tional morphology,","venue":null,"work_id":"e4157fb1-2aaa-476d-9020-381175a49606","year":1994},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.505226Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:526612a4122c22a0e286fd9e3148826492eb377c31e2eb80bd5a17bfe310ddbe","observation_id":"f5bb9a5a-0bb1-4720-bdba-7461907ddad6","resolution":{"observed_at":"2026-08-15T17:49:34.109391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.091223Z","title":"Models, feedback control, and open problems of 3d bipedal robotic walking,","venue":null,"work_id":"18d8a197-67b8-49b9-a631-d702704b7380","year":1955},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.509247Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:ffd01317a3b19f57798788e43494bf915b68d0eb951e7a1b61d53790f852cf45","observation_id":"2a0432ad-c133-4789-b4da-421078554dbe","resolution":{"observed_at":"2026-08-15T17:49:34.095995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18972","last_updated":"2024-09-09T05:13:02Z","snapshot_observed_at":"2026-08-16T14:05:44.073048Z","submitted_at":"2024-03-27T19:37:36Z","title":"Risk-Aware Robotics: Tail Risk Measures in Planning, Control, and Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18972","snapshot_observed_at":"2026-08-15T17:49:33.513269Z","title":"Risk-aware robotics: Tail risk measures in planning, control, and verification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.513269Z"},"links":{"cited_paper":"/paper/2403.18972","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:e43ef070c4f682e1afe76b0e7a6bbb4f721cf0b9d4e6fa4e33bdd841f15330ed","observation_id":"70c720c5-bf2a-43f4-baea-ab58e01c7970","resolution":{"observed_at":"2026-08-15T17:49:33.513269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T17:49:33.517994Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.517994Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:4be149c1df4ffeaddfb2a345b42e07d54a292e1e3d94eb59342db0a4206c8c8f","observation_id":"9b9899c2-cdbb-4ced-b20f-eb80185a352b","resolution":{"observed_at":"2026-08-15T17:49:33.517994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.079123Z","title":"Efficient exploration via epistemic-risk-seeking pol- icy optimization,","venue":null,"work_id":"3dbd1198-e891-4b4e-8e8d-9a2b6cb223cb","year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.522248Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:b795b47f3cac97d9baf7848bc9e3caa4a902d1dfd84885ab49e1d0f3a300dc5a","observation_id":"fe3c451f-9d75-4060-a98f-7cba14fce8f1","resolution":{"observed_at":"2026-08-15T17:49:34.082938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.526315Z","title":"Alma-articulated locomotion and ma- nipulation for a torque-controllable robot,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.526315Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:fe6f3f94740203b2373612ed1e5f82bd6d17dfa88bc83fdf67e15efcd5724cfd","observation_id":"efe6425f-1a61-4090-999c-bc2bb8a36243","resolution":{"observed_at":"2026-08-15T17:49:33.526315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.530284Z","title":"A unified mpc framework for whole-body dynamic locomotion and manipula- tion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.530284Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:54a20a194a358b4fad097132d7fe4b53602a2cc7b17dd8ec7154119b4d4ef4d7","observation_id":"1188fea6-dd8a-4073-9ebd-8e93e2146fcf","resolution":{"observed_at":"2026-08-15T17:49:33.530284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.049039Z","title":"Visual whole-body control for legged loco-manipulation,","venue":null,"work_id":"cfce56fc-b57f-43a6-9aa7-a62a984ac6c9","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.534284Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:c50c46ecc6c6a073fc991cdd81437b5d810f87e7fc3a667aff76269677574502","observation_id":"1aeeaf4e-c7ed-4c60-b797-585c7898a33c","resolution":{"observed_at":"2026-08-15T17:49:34.053692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.538097Z","title":"Asc: Adaptive skill coordination for robotic mobile manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.538097Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:dc9e7b4173b69beff8cf124abe75a71b1d60af87c7a9b42c164ceef506e3755d","observation_id":"62dced55-f39d-4c06-9013-029c766d5415","resolution":{"observed_at":"2026-08-15T17:49:33.538097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01402","last_updated":"2024-05-20T12:15:56Z","snapshot_observed_at":"2026-08-16T13:55:55.388024Z","submitted_at":"2024-05-02T15:53:43Z","title":"Learning Force Control for Legged Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01402","snapshot_observed_at":"2026-08-15T17:49:33.542204Z","title":"Learning force control for legged manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.542204Z"},"links":{"cited_paper":"/paper/2405.01402","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:18e75e319f7bbb942630bb9126fbda6ca123be5cb66c54fd1948e4c43c13941f","observation_id":"cd387f18-7dd1-40fc-9101-6567c867034c","resolution":{"observed_at":"2026-08-15T17:49:33.542204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.546251Z","title":"Combining learning-based locomotion policy with model-based manipulation for legged mobile manipulators,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.546251Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:67e327d611ef71565f509ab64389f2cd33f84bb6204fc457fb0dcf65012c6fff","observation_id":"4b755553-7cd3-4a8c-a7fc-0f52b18fc355","resolution":{"observed_at":"2026-08-15T17:49:33.546251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.019349Z","title":"Gamma: Graspability-aware mobile manipulation policy learning based on online grasping pose fusion,","venue":null,"work_id":"fdc22a24-a1b0-40c4-9059-7870ddef6cd3","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.549730Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:ba6e0ed5829b1bf00245b922699516b6bd17d8f7f66530c6244c3284527c7578","observation_id":"c86684b7-bfb4-410a-a4fe-37738e68072f","resolution":{"observed_at":"2026-08-15T17:49:34.023907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20328","last_updated":"2024-08-02T16:51:52Z","snapshot_observed_at":"2026-08-16T14:05:08.214183Z","submitted_at":"2024-03-29T17:59:05Z","title":"Learning Visual Quadrupedal Loco-Manipulation from Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20328","snapshot_observed_at":"2026-08-15T17:49:33.553237Z","title":"Learning visual quadrupedal loco-manipulation from demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.553237Z"},"links":{"cited_paper":"/paper/2403.20328","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:3f1cf93ce0a575504d0b1529aa1c57b15264fa12c3d72eaa52f244740da5c66c","observation_id":"9e89c025-5e61-4bc7-abef-5f35ce5e49e5","resolution":{"observed_at":"2026-08-15T17:49:33.553237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06584","last_updated":"2024-07-09T06:31:54Z","snapshot_observed_at":"2026-08-16T13:35:54.732128Z","submitted_at":"2024-07-09T06:31:54Z","title":"HiLMa-Res: A General Hierarchical Framework via Residual RL for Combining Quadrupedal Locomotion and Manipulation","version":1},"cited_work":{"arxiv_id":"2407.06584","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06584","snapshot_observed_at":"2026-08-15T17:49:33.753254Z","title":"HiLMa-Res: A General Hierarchical Framework via Residual RL for Combining Quadrupedal Locomotion and Manipulation","venue":"cs.RO","work_id":"5a958584-fc9a-44b3-9217-a3515dfdabb2","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.557284Z"},"links":{"cited_paper":"/paper/2407.06584","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:724decf38664d0bd6a0c07c43bab4cc02f74d85503cfb53de6ee4d6cefbad569","observation_id":"5ea487d2-4a39-41cd-b1dc-d7c63f19b646","resolution":{"observed_at":"2026-08-15T17:49:33.759809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:34.006095Z","title":"Pedipulate: Enabling manipulation skills using a quadruped robot’s leg,","venue":null,"work_id":"e3d519bd-6127-481a-b579-de3c6eb928a7","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.561252Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:25b510928f6e826c47e25ee4f8a4b4dc3a502c91cf4388b0169047fad288fb9e","observation_id":"8c0c6c3d-29b4-425e-bd39-5682a1f4b1cb","resolution":{"observed_at":"2026-08-15T17:49:34.010395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.991603Z","title":"Visual manipulation with legs,","venue":null,"work_id":"be46bfd7-daaf-4bc3-b116-29b936102812","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.565233Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:7ee6cf61efbf6c40ba95cf27b3382794d43e1704a94c7e5fda2570de7734ddd7","observation_id":"a3050059-596c-46f9-8362-f9d9dcaecd6a","resolution":{"observed_at":"2026-08-15T17:49:33.996392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05291","last_updated":"2025-03-19T10:44:50Z","snapshot_observed_at":"2026-08-16T14:02:50.019122Z","submitted_at":"2024-04-08T08:29:00Z","title":"Long-horizon Locomotion and Manipulation on a Quadrupedal Robot with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05291","snapshot_observed_at":"2026-08-15T17:49:33.569331Z","title":"Long- horizon locomotion and manipulation on a quadrupedal robot with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.569331Z"},"links":{"cited_paper":"/paper/2404.05291","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:b93a050a5535c85bc81d980cea588f4e71b452c31b7a99f6e632543cfb99d338","observation_id":"bf6c9d3d-1e8c-4400-adce-9f28e20c5535","resolution":{"observed_at":"2026-08-15T17:49:33.569331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.573475Z","title":"Legs as manipulator: Pushing quadrupedal agility beyond locomotion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.573475Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:dc6b417f05a54fb514953044b39a32574cf0d443966f165816eb41eab3273059","observation_id":"6fc9c928-1615-44aa-bd89-8d917f4dd86d","resolution":{"observed_at":"2026-08-15T17:49:33.573475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05818","last_updated":"2024-03-04T01:40:57Z","snapshot_observed_at":"2026-08-16T14:44:28.887604Z","submitted_at":"2023-11-10T01:28:18Z","title":"Learning Agile Bipedal Motions on a Quadrupedal Robot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05818","snapshot_observed_at":"2026-08-15T17:49:33.577630Z","title":"Learning agile bipedal motions on a quadrupedal robot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.577630Z"},"links":{"cited_paper":"/paper/2311.05818","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:4ffd6559f7bc1c68ca26fc8db0de10e1f69b8aa23c3ad9888d845a33d37fa08d","observation_id":"1997427f-431c-45df-9d14-5f394432f0ce","resolution":{"observed_at":"2026-08-15T17:49:33.577630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17320","last_updated":"2025-03-11T12:43:09Z","snapshot_observed_at":"2026-08-16T14:06:26.778088Z","submitted_at":"2024-03-26T02:02:35Z","title":"Leveraging Symmetry in RL-based Legged Locomotion Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17320","snapshot_observed_at":"2026-08-15T17:49:33.581660Z","title":"Leveraging symmetry in rl-based legged locomotion control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.581660Z"},"links":{"cited_paper":"/paper/2403.17320","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:bb14cdc763c25180e0f340a0e16b6c5b782bc2b65490dd81a1b1a1ac03b4f021","observation_id":"ccec44d3-3ab4-4bca-9ebc-bf5ace0ea2ac","resolution":{"observed_at":"2026-08-15T17:49:33.581660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.970008Z","title":"Adaptive risk- tendency: Nano drone navigation in cluttered environments with distributional reinforcement learning,","venue":null,"work_id":"181f1ce3-9946-49a5-b274-7f674ec08a9f","year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.585931Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:8342926b69871907eed0c318d0e6ce892dcd5299e34c9f1b22207da4fff704e7","observation_id":"645d4de4-5145-48f3-b3f0-8090faa660ff","resolution":{"observed_at":"2026-08-15T17:49:33.974557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.589994Z","title":"Learning risk-aware quadrupedal locomotion using distributional reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.589994Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:3764c3727a7bb3ec9e3cc2961d95996fb91df6a3936723451ea068e98069422f","observation_id":"0879afa5-598e-4c01-87e0-b0443df217ba","resolution":{"observed_at":"2026-08-15T17:49:33.589994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.947216Z","title":"Learning locomotion for quadruped robots via distributional ensemble actor-critic,","venue":null,"work_id":"63e12d07-9486-47ea-a6ea-900d15b0446f","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.593750Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:c9d5de4f852e38c4991431d987c086204692e8aa84086fc9364c13d1c565b52d","observation_id":"5e55e670-f01b-4511-ae09-156daf683e6e","resolution":{"observed_at":"2026-08-15T17:49:33.951598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.934867Z","title":"Robust quadrupedal locomotion via risk-averse policy learning,","venue":null,"work_id":"a24bdf4c-b8b1-4cf2-81bc-10f113bd39e6","year":2024},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.597902Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:63f6e68d79601ad319b22bfb05e294d6b8e82eda0e33ee910a217999b444c0fa","observation_id":"9d63b727-e7ce-4bde-8afc-a85f53c975fe","resolution":{"observed_at":"2026-08-15T17:49:33.938665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.922036Z","title":"Learning risk-aware costmaps for traversability in challenging environments,","venue":null,"work_id":"0cf51475-bd17-416c-b668-f2e23843839e","year":2021},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.601882Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:180b29a0b7c6671fad49bab07eb408c2339e6dd94f03100e6e860261d05150ca","observation_id":"30035691-3df9-4715-a2b7-8814e4c87270","resolution":{"observed_at":"2026-08-15T17:49:33.926141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.908226Z","title":"A distributional per- spective on reinforcement learning,","venue":null,"work_id":"9d742d0e-f631-4a76-bf7d-5dcaddfba7f9","year":2017},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.605656Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:fbaeff4891e01f83a3a510c8f2447127717efc9a66046a82e178c53c2e92907a","observation_id":"b8aabb62-db8d-4769-ba15-02adca089693","resolution":{"observed_at":"2026-08-15T17:49:33.912969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.894259Z","title":"Distributional reinforcement learning with quantile regression,","venue":null,"work_id":"f59b3ff8-60a6-4a4f-bd7a-66781bb0d212","year":2018},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.609662Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:bc671a79f889b7ed02d5168d31076c451f8865c190e9c1b4b04d3b86acbef314","observation_id":"6ca3311d-f736-4631-b8c2-759ab74edfaa","resolution":{"observed_at":"2026-08-15T17:49:33.899133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.613636Z","title":"Implicit quantile networks for distributional reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.613636Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:7e1c17bc09805dbdf36b1f3dfea28410ee9791b17213b0d174a36cd5f8ff7e71","observation_id":"275dd337-58ad-4679-970c-037926c92c8e","resolution":{"observed_at":"2026-08-15T17:49:33.613636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.872433Z","title":"Efficient risk-averse reinforcement learning,","venue":null,"work_id":"8c1c69bc-49b1-43a6-9f22-5357328076af","year":2022},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.617705Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:9d260456f5ee6d946829cdba00a11cd3e370bbc26aec080154365a4329517322","observation_id":"850bba3b-f9d9-441e-a148-678d958cef31","resolution":{"observed_at":"2026-08-15T17:49:33.876785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09638","last_updated":"2020-09-09T15:44:27Z","snapshot_observed_at":"2026-08-14T16:27:50.158270Z","submitted_at":"2019-05-23T13:13:56Z","title":"Estimating Risk and Uncertainty in Deep Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09638","snapshot_observed_at":"2026-08-15T17:49:33.621676Z","title":"Estimating risk and uncertainty in deep reinforcement learning,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.621676Z"},"links":{"cited_paper":"/paper/1905.09638","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:2155e22896224ddb24021811b1c5541579f970870032d515d4d0ae042b5a6e1f","observation_id":"bf44cf6d-4e27-4fac-9b67-78a3ce6e1718","resolution":{"observed_at":"2026-08-15T17:49:33.621676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.625730Z","title":"Walk these ways: Tuning robot control for generalization with multiplicity of behavior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.625730Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:a9947341c169a1c8dd516c0165cc80232765ccb7a9ffdaf784ec10f4bf042ef4","observation_id":"cf135ad0-cde9-450c-bbc8-efcd93b68e3e","resolution":{"observed_at":"2026-08-15T17:49:33.625730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-15T17:49:33.629967Z","title":"High- dimensional continuous control using generalized advantage estima- tion,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.629967Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:92469afe8a469efbeefbc60b12605b8af3dca79aca567cee294c1a24cf71b230","observation_id":"ab3fe4c7-0102-439d-b9ac-8cdda3213086","resolution":{"observed_at":"2026-08-15T17:49:33.629967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:33.850304Z","title":"A class of distortion operators for pricing financial and insurance risks,","venue":null,"work_id":"948d73e5-24a3-4709-b999-e0e3c3dec1ae","year":2000},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.635586Z"},"links":{"citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:7562d26fdc1913b26b0c2cf0d09099bab26d973fc178415da7327f477105d0a7","observation_id":"9893c9c0-7610-4776-ad28-79bb93215591","resolution":{"observed_at":"2026-08-15T17:49:33.854778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-15T17:49:33.639683Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:33.639683Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2507.20382"},"observation_digest":"sha256:810307e98ee21662ef0f40bdf269a8997535bab0013b641fd5ceb0ddbe8a435a","observation_id":"597dd231-87bf-42bd-b861-7dce8363c3e3","resolution":{"observed_at":"2026-08-15T17:49:33.639683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20382","last_updated":"2025-07-27T18:51:34Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T04:01:45.400829Z","submitted_at":"2025-07-27T18:51:34Z","title":"Bipedalism for Quadrupedal Robots: Versatile Loco-Manipulation through Risk-Adaptive Reinforcement Learning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2507.20382."}