{"as_of":"2026-08-11T11:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c3670cf079ec194c00d6aec54b6c93e1f2cf93748d41f2032ce178b67798e09","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:26:30.721159Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21916/citation-record","integrity":"/paper/2505.21916/integrity","json":"/paper/2505.21916/citation-record.json","paper":"/paper/2505.21916"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T13:26:26.933507Z","title":"π 0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:26.933507Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:156ef0c6e593ad260983187b6f7d8674cd59278a74154b915467fe42450571df","observation_id":"dde0c067-a19c-4bb4-a90a-fc4a2df9b1dc","resolution":{"observed_at":"2026-08-07T13:26:26.933507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.511600Z","title":"Catch it! learning to catch in flight with mobile dexterous hands,","venue":null,"work_id":"8bf834a3-1fe5-46db-8c8d-0b9ff01f2063","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.044744Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:5f95c36e6ea8ada382f3eced287602b0e46f93ae676949e494c87043cfa33326","observation_id":"9f6e0cc4-f8e1-4751-be15-928630f409cb","resolution":{"observed_at":"2026-08-07T13:26:36.571364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02635","last_updated":"2026-04-23T15:06:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-04T07:56:42Z","title":"Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02635","snapshot_observed_at":"2026-08-07T13:26:27.138792Z","title":"Reinforcement learning with foundation priors: Let the embodied agent efficiently learn on its own,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.138792Z"},"links":{"cited_paper":"/paper/2310.02635","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:4d21b839d2caab1ae586c15180a37510bbdb5e3d1fa4bf0b0305bc5b07222511","observation_id":"1841f679-70c0-43e7-bdd4-f68484d81443","resolution":{"observed_at":"2026-08-07T13:26:27.138792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.322574Z","title":"Roboagent: Generalization and efficiency in robot manipulation via semantic augmentations and action chunking,","venue":null,"work_id":"1d744b6a-32e1-467a-82c3-bcc12706ecd5","year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.219525Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:bc9ffae0490a2969b35447318355aa56b38e522ad93b1bdc19e91eb0e42f1dd5","observation_id":"1abd5754-45bb-45f9-8ccb-57100baebb7b","resolution":{"observed_at":"2026-08-07T13:26:36.410113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:27.288599Z","title":"Diffusion policy: Visuomotor policy learning via ac- tion diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.288599Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:710334f8d11178e0bdb1288b261eca913313fc718e6d125ce619b841cc280f11","observation_id":"d2e3e260-18f9-4865-bca9-c236acf5b96f","resolution":{"observed_at":"2026-08-07T13:26:27.288599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10329","last_updated":"2024-03-06T00:11:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-15T21:11:50Z","title":"Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10329","snapshot_observed_at":"2026-08-07T13:26:27.372085Z","title":"Universal manipulation interface: In-the-wild robot teaching without in-the-wild robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.372085Z"},"links":{"cited_paper":"/paper/2402.10329","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:e50f1397819d49a17e37e16e246795925f18bbf4057dc5ceba804533fb387fe2","observation_id":"1a818a0e-9eb9-4d24-bcb1-cc8277653bf5","resolution":{"observed_at":"2026-08-07T13:26:27.372085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.055304Z","title":"UMI on legs: Making manipulation policies mobile with manipulation-centric whole-body controllers,","venue":null,"work_id":"f9a75d9d-711f-4cd1-833f-b2dd7183598b","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.448258Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a029e5ef68531fb5df1f9053ad016c57141d2f67f74b9ab5ea3f6b7bf2da2eb8","observation_id":"3d9c947f-18ab-4d0e-8904-b337e9c1468b","resolution":{"observed_at":"2026-08-07T13:26:36.146040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14400","last_updated":"2025-07-02T08:26:20Z","snapshot_observed_at":"2026-08-10T15:09:22.120134Z","submitted_at":"2025-01-24T11:11:53Z","title":"SKIL: Semantic Keypoint Imitation Learning for Generalizable Data-efficient Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14400","snapshot_observed_at":"2026-08-07T13:26:27.535567Z","title":"Skil: Semantic keypoint imitation learning for generalizable data-efficient manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.535567Z"},"links":{"cited_paper":"/paper/2501.14400","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:edf659e680db0c22ad6a63e4420c6456b5a5db38be984ec5b174fa7554dc33d7","observation_id":"9b125b66-afd3-4529-b500-dbfee911de7b","resolution":{"observed_at":"2026-08-07T13:26:27.535567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.831701Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":"b136dfc0-8b78-4eef-84e9-90d2fb8f8750","year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.626948Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:4afc98027d049691b264ea2af54bca7e84f5d772e0160eeaf0091447ad824041","observation_id":"93f944c3-9a32-465c-8dd2-7b02c676f962","resolution":{"observed_at":"2026-08-07T13:26:35.947994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.643509Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":"08cf28b4-582f-4b60-8037-00c0a90676b4","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.705369Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:552b9e8cd7593f548751b84be9e277935ed96a1b2930078c509fff2e6a434287","observation_id":"566b6b29-ce8c-4803-8fd9-43d9c06e3977","resolution":{"observed_at":"2026-08-07T13:26:35.717526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-07T13:26:27.782344Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.782344Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:121ef0fcf9eefb74b69a7c0fe9304e80d41065023e590b3c2260b57b8343d4e0","observation_id":"9c99f3bd-bee6-41bf-8229-358bde098955","resolution":{"observed_at":"2026-08-07T13:26:27.782344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.444665Z","title":"Copa: General robotic manipulation through spatial constraints of parts with foundation models,","venue":null,"work_id":"b795992a-7825-4446-bc94-37684fc56c35","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.870762Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:ce7bcc79f349672559d53405c4e189b3dcedbe1180381874db67fbd17d69c6af","observation_id":"3d051b29-32ce-4515-b48c-61b8d6100d8d","resolution":{"observed_at":"2026-08-07T13:26:35.542360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:27.988402Z","title":"Onetwovla: A unified vision-language-action model with adaptive reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.988402Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:506a3879d84cf7d89368af33618c5dd4d9d5df38c71e9f4968a885f6be3b2e41","observation_id":"1c315c49-60a8-468f-861c-1766ead52a0b","resolution":{"observed_at":"2026-08-07T13:26:27.988402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09160","last_updated":"2025-07-12T06:44:37Z","snapshot_observed_at":"2026-08-07T10:59:00.776993Z","submitted_at":"2025-07-12T06:44:37Z","title":"Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09160","snapshot_observed_at":"2026-08-07T13:26:28.067832Z","title":"Tactile- vla: Unlocking vision-language-action model’s physical knowledge for tactile generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.067832Z"},"links":{"cited_paper":"/paper/2507.09160","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a2ac9bdae951b09296333a8f3be8fe7ba732aee037998b086fb107e8e5f5a772","observation_id":"3b0f671b-579c-4dbe-a7d7-2a76569d55c1","resolution":{"observed_at":"2026-08-07T13:26:28.067832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.199520Z","title":"Itera- tive residual policy: for goal-conditioned dynamic manipulation of deformable objects,","venue":null,"work_id":"2477de84-2dfe-4052-9954-5d2a33086fdd","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.167940Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:1ecc790887173fe357a04025945b66e22fc6984bb97e1065ba8bf7b5fba834c0","observation_id":"54865958-4082-4bd8-b9fe-de647e0e243e","resolution":{"observed_at":"2026-08-07T13:26:35.319684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.888062Z","title":"Dynamic handover: Throw and catch with bimanual hands,","venue":null,"work_id":"fd8280f5-997d-4f78-abc9-0f2c84ec4a49","year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.264807Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:25933030246067d595aef25a49aaff2f3061d221495d22d726c3e603ff443072","observation_id":"409f3c03-2e24-4a06-b4bb-276049887685","resolution":{"observed_at":"2026-08-07T13:26:35.049367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:28.365732Z","title":"Tossing- bot: Learning to throw arbitrary objects with residual physics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.365732Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:f1b5723da6bbaf7edb9c4263e7122358758da5c69e3718e10fefa69c9e7bb1a8","observation_id":"0940180c-58d3-43f0-977a-7290a7d4d1ff","resolution":{"observed_at":"2026-08-07T13:26:28.365732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.640282Z","title":"A stochastic dynamic motion planning al- gorithm for object-throwing,","venue":null,"work_id":"2bf1fcc4-d442-4b52-a5e3-92f9d63be8d0","year":2015},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.466750Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:b76d7b46251fd0bd6bfaf115d91c984d0a5d6c2c51dc91d8bb3ba154df5d9a1a","observation_id":"ed05babb-c3e0-49b7-a7b3-7bd603461c4a","resolution":{"observed_at":"2026-08-07T13:26:34.753541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.334876Z","title":"Optimal shape and motion planning for dynamic planar manipulation,","venue":null,"work_id":"ecc8138d-c69c-469f-87d8-2ec74e2b6878","year":2019},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.614868Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:6d54db7c569806fc15f1fcaa05ceb161abb5a25a11696948cbe930898d044d61","observation_id":"41f110a7-93d0-4e8e-9ed7-82de4746097a","resolution":{"observed_at":"2026-08-07T13:26:34.496952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.058794Z","title":"Learning agile robotic locomotion skills by imitating animals,","venue":null,"work_id":"2c0d97cd-898c-4f65-98a0-c118be17ab94","year":2020},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.756928Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:543508ec9d08718358837d98a5beef1b6d2d203d160984a33e5b57bb8e0fb688","observation_id":"e30fe29a-1bf1-4fcf-9ecd-486fb5b5cd6e","resolution":{"observed_at":"2026-08-07T13:26:34.159475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:28.851555Z","title":"Tool-as-interface: Learning robot policies from human tool usage through imitation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.851555Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:d9c8a4fc01b8bdb5a1a1ce66f84f7fc35c2f3d017509af44d73c198c62975a0a","observation_id":"ab0143bf-26f3-4fc1-83fa-bcf95e4a42c8","resolution":{"observed_at":"2026-08-07T13:26:28.851555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15266","last_updated":"2024-05-24T06:50:14Z","snapshot_observed_at":"2026-07-06T18:19:08.871953Z","submitted_at":"2024-05-24T06:50:14Z","title":"Conditional Variational Auto Encoder Based Dynamic Motion for Multi-task Imitation Learning","version":1},"cited_work":{"arxiv_id":"2405.15266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15266","snapshot_observed_at":"2026-08-07T13:26:31.235498Z","title":"Conditional Variational Auto Encoder Based Dynamic Motion for Multi-task Imitation Learning","venue":"cs.RO","work_id":"ea2b7f00-c961-41d1-b06e-94747a469f5c","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.970885Z"},"links":{"cited_paper":"/paper/2405.15266","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:9631761511f67ca19d44ec5681c93042b41fd9a26100da796be592d87b052986","observation_id":"2c6da33a-1826-4123-8f81-98d0b68c35a3","resolution":{"observed_at":"2026-08-07T13:26:31.316019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05681","last_updated":"2025-04-01T02:01:17Z","snapshot_observed_at":"2026-08-08T02:27:25.068559Z","submitted_at":"2024-10-08T04:40:54Z","title":"Whole-Body Dynamic Throwing with Legged Manipulators","version":2},"cited_work":{"arxiv_id":"2410.05681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05681","snapshot_observed_at":"2026-08-07T13:26:30.990595Z","title":"Whole-Body Dynamic Throwing with Legged Manipulators","venue":"cs.RO","work_id":"04939c4a-422f-40db-8563-3582c5293ea9","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.051887Z"},"links":{"cited_paper":"/paper/2410.05681","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:7cc9e03cfc24a63b77ab33d7bf104fc1f8d6beac20b72fb3265481573a448656","observation_id":"654d17d7-a9b9-44b9-9e33-e6b0efd39dbd","resolution":{"observed_at":"2026-08-07T13:26:31.122942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.836398Z","title":"Mockus, V","venue":null,"work_id":"400d67da-52ad-413a-a4d4-a825d190f996","year":2014},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.136403Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:19ac3ec9fc5a0ebc3ae9e22750472805387df4d50fc567bd73acaaec1a98e33d","observation_id":"cc0130f0-e586-4643-85ed-78d7cda9fac6","resolution":{"observed_at":"2026-08-07T13:26:33.939466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.525930Z","title":"Gaussian processes in machine learning,","venue":null,"work_id":"e9ed98a3-3882-48bd-8d34-f6231a83443f","year":2004},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.223928Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:107aae284b7b704943b9db41e2007495e3f12c8e4c8e5911166dd8bb6d3ccb33","observation_id":"1159557e-02ba-4e8c-9fb3-29f6535b7d1e","resolution":{"observed_at":"2026-08-07T13:26:33.653150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.311744Z","title":"A ball-throwing robot with visual feedback,","venue":null,"work_id":"0b00da8c-2a71-406d-a72f-09025a9a2554","year":2010},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.308002Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a09565d6954da0be9f45264c3ec072ca8f189a4a52f3dfc8480fb07bcc5281a9","observation_id":"fe1c5f1b-6392-4471-87cd-2ab77dfa0faa","resolution":{"observed_at":"2026-08-07T13:26:33.421876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.116041Z","title":"Dynamic task execution using active parameter identification with the baxter research robot,","venue":null,"work_id":"f0a03adf-c336-45fd-b37b-68ba218d97ab","year":2017},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.455825Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:f31cca584bd877df7ab72ae096b77211e7c14891e2c20920f1aa7f615a76a73f","observation_id":"c272b6ad-0489-4fa3-be30-1fb439c7e960","resolution":{"observed_at":"2026-08-07T13:26:33.195062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:29.571907Z","title":"Dynamic movement primitives in robotics: A tutorial survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.571907Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:5c6e278502b3a62dee1b2d9d02d2d6791146b20fe46e537c4b30b8e5dddd59c2","observation_id":"e46e3e95-2ae3-419d-ab66-f82cc7c1f180","resolution":{"observed_at":"2026-08-07T13:26:29.571907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.846051Z","title":"Probabilistic movement primitives,","venue":null,"work_id":"741a1ed6-87f1-43cd-91b7-ca36825d0191","year":2013},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.656775Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:3e1a35c1787cbed8e92dbb4ab2b1111c47bc1567a58287b4550a53965d55b23a","observation_id":"ee8585f3-7a79-47e3-997e-c45826390cd3","resolution":{"observed_at":"2026-08-07T13:26:32.985900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:29.794186Z","title":"Prodmp: A unified perspective on dynamic and probabilistic move- ment primitives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.794186Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:847be1e48cc3cb9ba732521e7e2c242f42ee7a3620a25d51b4972f80cc1c21c3","observation_id":"828c0b84-50c8-4611-b4e0-f7cdfde5a8bf","resolution":{"observed_at":"2026-08-07T13:26:29.794186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.645969Z","title":"Learning table tennis with a mixture of motor primitives,","venue":null,"work_id":"a245c51b-250f-42b8-8847-d6f0ac5ab36b","year":2010},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.941186Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:07dc3c9c1c3bde65624ce633d3eaec5ef1f7f37feebab841cc8ae0abf383cca5","observation_id":"ca74b015-19e8-4212-848f-115f4d5c7298","resolution":{"observed_at":"2026-08-07T13:26:32.727050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.424526Z","title":"Residual learning from demonstration: Adapting dmps for contact-rich manipulation,","venue":null,"work_id":"a2e25d91-f3be-4744-9380-12ab13e9b04a","year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.058492Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:83d8de77fa2c6c027941a070ef4f019903e06825e6babd1e1d4f89ab45990189","observation_id":"f84174ff-b5d3-4a09-98f8-cf654d3b4dfa","resolution":{"observed_at":"2026-08-07T13:26:32.532660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03918","last_updated":"2022-03-08T08:27:10Z","snapshot_observed_at":"2026-08-07T22:31:10.252959Z","submitted_at":"2022-03-08T08:27:10Z","title":"Residual Robot Learning for Object-Centric Probabilistic Movement Primitives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03918","snapshot_observed_at":"2026-08-07T13:26:30.165854Z","title":"Residual robot learning for object-centric probabilistic movement primitives,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.165854Z"},"links":{"cited_paper":"/paper/2203.03918","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:155714c26ede83cde12dcc1ea8602c1b9f0eefa6f95ca4f9ce212df8068635d1","observation_id":"7bd44fb3-2d90-4ab9-b78a-53a7556d8720","resolution":{"observed_at":"2026-08-07T13:26:30.165854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.152123Z","title":"Optimizing robot striking movement primitives with iterative learning control,","venue":null,"work_id":"fb8df849-73db-40c5-82ee-e881fb510621","year":2015},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.241146Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:23af0989a94941a4c5f97851157f25bfae0068c39591b4e3fe29e38db17627d7","observation_id":"a33ad91e-5220-4e9c-acb6-1e5527efa933","resolution":{"observed_at":"2026-08-07T13:26:32.249735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07294","last_updated":"2025-08-17T08:03:16Z","snapshot_observed_at":"2026-08-10T02:41:08.229006Z","submitted_at":"2025-05-12T07:31:42Z","title":"HuB: Learning Extreme Humanoid Balance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07294","snapshot_observed_at":"2026-08-07T13:26:30.356430Z","title":"Hub: Learning extreme humanoid balance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.356430Z"},"links":{"cited_paper":"/paper/2505.07294","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:b6dc0baffddb1621d988b3c031d168e1a36cf057f0ffbe9d56384fd26224171a","observation_id":"c58ef950-819b-49cc-8cb6-ace9411fdcde","resolution":{"observed_at":"2026-08-07T13:26:30.356430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:31.959282Z","title":"Serl: A software suite for sample- efficient robotic reinforcement learning,","venue":null,"work_id":"2bee49cd-1016-4df7-9396-359fc3618bde","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.444239Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:c1dbb1aa801aca26c5df0fe0870bb38eba2a38ea5b787ba04888d4cdb7f5c6b5","observation_id":"bb115905-d894-472a-80c0-0855f0f53da1","resolution":{"observed_at":"2026-08-07T13:26:32.053382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21845","last_updated":"2025-03-20T09:16:05Z","snapshot_observed_at":"2026-08-09T12:35:28.394011Z","submitted_at":"2024-10-29T08:12:20Z","title":"Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21845","snapshot_observed_at":"2026-08-07T13:26:30.534038Z","title":"Precise and dexterous robotic manipulation via human-in-the-loop reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.534038Z"},"links":{"cited_paper":"/paper/2410.21845","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:1c70a12316520e54003c0fc0edf3786fbbd0bb1423568900a75a20b45f8bdbdc","observation_id":"216a3b5f-2cca-4dda-a44d-aae64872c4a7","resolution":{"observed_at":"2026-08-07T13:26:30.534038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:31.755260Z","title":"Asap: Aligning simulation and real-world physics for learning agile humanoid whole-body skills,","venue":null,"work_id":"b543c018-fbb2-4b5a-b7b8-1728f242a10c","year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.680147Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:402efb5a1ab1d4dcf5bd1474bfdae0083758c244b191fd20094d39685907b358","observation_id":"6deab804-ea55-4a5f-b512-96f082ec0cb2","resolution":{"observed_at":"2026-08-07T13:26:31.847434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-07T13:26:30.721159Z","title":"Glm-4.5v and glm-4.1v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.721159Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:79c62a170475447cf049f12ec1a513786be2594eeb5b8da33a74139a2fcc6815","observation_id":"6f8bc91c-4f66-4844-b669-7a3a93dcb7f4","resolution":{"observed_at":"2026-08-07T13:26:30.721159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T12:36:30.301930Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":21},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2505.21916."}