{"as_of":"2026-08-23T19:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b29b7d57ea0d7b6460c1249459c2f5aac2ba5c10584ad007cfabb6882d3d563","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:22:49.725006Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12063/citation-record","integrity":"/paper/2608.12063/integrity","json":"/paper/2608.12063/citation-record.json","paper":"/paper/2608.12063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.588717Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.588717Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:b12916cdd42e48ced8ffbd037b8624c3eb976c3e0e53a846cfec306a4cae3fc5","observation_id":"c17423e5-1ae5-4700-aa86-46902ad030af","resolution":{"observed_at":"2026-08-16T00:22:49.588717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.595127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.595127Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:ec628d838dfc0ee4fd6ca0f505594b53d53b763d2d72ea084aed0700f1f3951c","observation_id":"a59ad664-6a84-42a2-a3ef-2301e68c0bb3","resolution":{"observed_at":"2026-08-16T00:22:49.595127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.367139Z","title":null,"venue":null,"work_id":"df6a6d5c-5177-476e-bbd6-9fd011b4b787","year":2025},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.602125Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:b6a7cce1c95c194f2511066565db21941dacf274383994c7e4ecd9826503f88d","observation_id":"c0116cc0-90e1-42bf-9afe-9fac29291205","resolution":{"observed_at":"2026-08-16T00:22:50.372958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.350218Z","title":null,"venue":null,"work_id":"07e00c3b-aa2d-4130-bc79-4f53ba8c9880","year":2025},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.607162Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:18decd22a18c5d666b72482c10a210e45e3cfe3ebba54df22b0f2f3c9ec1ebc2","observation_id":"a87df419-0117-4b55-b245-c3c68707304e","resolution":{"observed_at":"2026-08-16T00:22:50.354554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36551","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.053993Z","title":"Bruderm ¨uller, B","venue":null,"work_id":"6c38bf36-bf23-46ff-bb8c-cee3f0a39a3c","year":2026},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.612733Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:7a6ad685b4544a330a7dc1aea4c2880db7baac4bc8979812e310a49ec97a6d3f","observation_id":"1ef7df68-0b9b-403d-a8da-e012d25e8b5c","resolution":{"observed_at":"2026-08-16T00:22:50.061195Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.333104Z","title":"Molnar, J","venue":null,"work_id":"31c5447c-57f6-4bfb-a473-2a6941fc2087","year":2025},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.617518Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:f7e65725949527c3520b4669da80c2c28e84dce82fa21fad666ece554eea97af","observation_id":"e6a50c59-7607-44f7-80e2-ff569ced1b82","resolution":{"observed_at":"2026-08-16T00:22:50.338462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.314545Z","title":null,"venue":null,"work_id":"1c6bde3e-24d5-400c-ba37-aa240c875791","year":2026},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.622497Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:9b46a9a0024b21a84ff5d0d811ae436e272062050cdf647ffc1e92a40a343db4","observation_id":"e5eb3d42-199b-4747-b4c0-557c60c1b569","resolution":{"observed_at":"2026-08-16T00:22:50.320820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.627127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.627127Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:d1d86ba939ccf19baa5d7c55037e77f02592749a25b9cb63a6b4d50323e90847","observation_id":"a158840c-ff39-410b-a124-2a10a84231e2","resolution":{"observed_at":"2026-08-16T00:22:49.627127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03442","last_updated":"2022-10-07T10:22:51Z","snapshot_observed_at":"2026-08-16T16:26:10.255364Z","submitted_at":"2022-10-07T10:22:51Z","title":"Contact Optimization for Non-Prehensile Loco-Manipulation via Hierarchical Model Predictive Control","version":1},"cited_work":{"arxiv_id":"2210.03442","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.03442","snapshot_observed_at":"2026-08-16T00:22:49.968328Z","title":"Contact Optimization for Non-Prehensile Loco-Manipulation via Hierarchical Model Predictive Control","venue":"cs.RO","work_id":"73ae4bc2-81be-4926-9288-83d0ef9018f9","year":2022},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.631225Z"},"links":{"cited_paper":"/paper/2210.03442","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:ff8d361f62fc713bab840731c6d55fe83aab9cfe81e8a19627f4211f1429e532","observation_id":"f6b1e12e-a871-4070-b132-240583e70403","resolution":{"observed_at":"2026-08-16T00:22:49.974460Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.636429Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.636429Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:7b0acb9f1a64468c467679fc11d1ecc7378bd7502d86682d0f6aadad87e4dae0","observation_id":"cdc740e4-b032-4e2a-8b6e-11d977966006","resolution":{"observed_at":"2026-08-16T00:22:49.636429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22642","last_updated":"2025-06-01T22:51:56Z","snapshot_observed_at":"2026-08-20T08:41:27.503602Z","submitted_at":"2025-05-28T17:55:26Z","title":"FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22642","snapshot_observed_at":"2026-08-16T00:22:49.641234Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.641234Z"},"links":{"cited_paper":"/paper/2505.22642","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:0c4fca7bc278d3e0f30b5012694e4cf87157882d02863daa8e4ee4fedcb71633","observation_id":"55562711-9a6d-445e-a4e3-fe6f8c32405a","resolution":{"observed_at":"2026-08-16T00:22:49.641234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.275302Z","title":null,"venue":null,"work_id":"4f1bc414-f198-43aa-a5c7-a472b61ac07c","year":2018},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.645606Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:6fb44f59f435e7b1ee7a9e28f1a80512e710b7514bd99e8da72154ff16a9cd04","observation_id":"2b85f39d-3500-45c5-8967-042dffc994ef","resolution":{"observed_at":"2026-08-16T00:22:50.280097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02198","last_updated":"2024-05-20T20:09:24Z","snapshot_observed_at":"2026-08-19T00:04:57.166891Z","submitted_at":"2023-11-03T19:03:20Z","title":"Imitation Bootstrapped Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02198","snapshot_observed_at":"2026-08-16T00:22:49.650714Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.650714Z"},"links":{"cited_paper":"/paper/2311.02198","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:9a20384674b3ba4f313dae65cb9a5a58127ddb49972688e2d0dbf3230ae98f8f","observation_id":"28489720-f5ca-4c11-92ef-ba55cfc31bec","resolution":{"observed_at":"2026-08-16T00:22:49.650714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08817","last_updated":"2018-10-08T13:38:52Z","snapshot_observed_at":"2026-08-14T20:44:55.096659Z","submitted_at":"2017-07-27T11:16:53Z","title":"Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08817","snapshot_observed_at":"2026-08-16T00:22:49.655674Z","title":"Vecerik, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.655674Z"},"links":{"cited_paper":"/paper/1707.08817","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:0148954663e8e6a8537098be9107457c9889bfb95d803adc48a1e299c3a0371c","observation_id":"0e38fb44-337c-47ee-8f27-49e3c8d7ede1","resolution":{"observed_at":"2026-08-16T00:22:49.655674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10654","last_updated":"2018-10-24T23:49:58Z","snapshot_observed_at":"2026-08-14T18:09:42.445241Z","submitted_at":"2018-10-24T23:49:58Z","title":"Sample-Efficient Learning of Nonprehensile Manipulation Policies via Physics-Based Informed State Distributions","version":1},"cited_work":{"arxiv_id":"1810.10654","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.10654","snapshot_observed_at":"2026-08-16T00:22:49.887447Z","title":"Sample-Efficient Learning of Nonprehensile Manipulation Policies via Physics-Based Informed State Distributions","venue":"cs.RO","work_id":"71b57b3e-df2d-4145-9d64-9f0ad6bc6abf","year":2018},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.660876Z"},"links":{"cited_paper":"/paper/1810.10654","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:0535ff545f5baab8f93b446175abbb39cdcd590ad7aaee46ed9a00a66423500d","observation_id":"cf92a40c-3d9f-4288-8be7-e99c48632747","resolution":{"observed_at":"2026-08-16T00:22:49.901656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.257787Z","title":"Khandate, T","venue":null,"work_id":"c4502f79-69f4-4f3c-b8d0-ce1678304849","year":2024},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.665166Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:25880e534a599d89c8d5f061554a683b204a5764294e2d5dbb5c7380681cd8a6","observation_id":"521c38d6-f29c-4a14-a302-6111b4918288","resolution":{"observed_at":"2026-08-16T00:22:50.264235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.242935Z","title":"Bruedigam, A","venue":null,"work_id":"456f9903-8e18-4f35-a5d7-dffe77aa2394","year":2024},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.669380Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:2256f3cd3e8f1a1ec506e22884124cfb3044befe2e552fbbb4d5bb0e3f7dc056","observation_id":"f2ffba9d-dd5d-4329-a37d-1a48afc9f160","resolution":{"observed_at":"2026-08-16T00:22:50.247273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.229955Z","title":"Fujimoto, H","venue":null,"work_id":"fc83458c-4ad3-46ea-8d37-9508696ff305","year":2018},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.673786Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:be7141ebcb3e7c7e8f67046302c655cc5f0437b663a245fae9ef82c126d3e69f","observation_id":"6dd64424-cb02-4dbe-a8d8-b86b3eb2a249","resolution":{"observed_at":"2026-08-16T00:22:50.234195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.678646Z","title":"Todorov, T","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.678646Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:f589766c8bd5eae4a7c2d5437f549c00fee9b1e4caaf487620b260aed6231a55","observation_id":"c5cd8395-c23a-4fc6-be60-33297649ea2c","resolution":{"observed_at":"2026-08-16T00:22:49.678646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.203302Z","title":"Zakka, Q","venue":null,"work_id":"593bab73-fd10-4e32-96ab-84363a90d58f","year":2026},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.699121Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:271bcc6cce6ff8295a1d602ee22f59b45e8726f7d31980231e885deb6895275e","observation_id":"5ab41163-6c5d-4d17-bab6-3f438bba702c","resolution":{"observed_at":"2026-08-16T00:22:50.207906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02648","last_updated":"2018-12-06T16:36:20Z","snapshot_observed_at":"2026-08-18T08:00:35.342323Z","submitted_at":"2018-12-06T16:36:20Z","title":"Deep Reinforcement Learning and the Deadly Triad","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02648","snapshot_observed_at":"2026-08-16T00:22:49.704466Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.704466Z"},"links":{"cited_paper":"/paper/1812.02648","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:4d7f4cbeb2aba8fa7935b6e7853f9ca1d73a5e987129468303e342f51f40133f","observation_id":"e50f45fc-f6f3-40b2-b30c-5e61afcb590b","resolution":{"observed_at":"2026-08-16T00:22:49.704466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.184549Z","title":"Bhatt, D","venue":null,"work_id":"2c445109-569e-4271-ab3b-b6302cdafc8d","year":2024},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.710111Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:5e882ea6a353e6a40bd89531b9d38ae1739d590e03c866e994fbb116670f37d8","observation_id":"acd20442-59fa-47a2-9db5-18178bb11976","resolution":{"observed_at":"2026-08-16T00:22:50.191352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.00541","last_updated":"2022-12-24T00:50:53Z","snapshot_observed_at":"2026-08-21T07:40:47.024782Z","submitted_at":"2022-12-01T14:47:47Z","title":"Predictive Sampling: Real-time Behaviour Synthesis with MuJoCo","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.00541","snapshot_observed_at":"2026-08-16T00:22:49.715300Z","title":"Howell, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.715300Z"},"links":{"cited_paper":"/paper/2212.00541","citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:f51e9d51fffbc5fcc7c225eb8eabadeebb5e96284eefe9e28c6730abea7c8782","observation_id":"cea261f5-55da-499b-942d-1e61e8718411","resolution":{"observed_at":"2026-08-16T00:22:49.715300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.165197Z","title":"Williams, A","venue":null,"work_id":"9e838264-eff1-47f8-a374-8f9128203aae","year":null},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.720312Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:9062ab2974fbe7916f59dacfcb319e57d1cebceb7b9bee77a9dcf2659762e99e","observation_id":"6810dc8a-dafd-4187-903a-a6b30ec56c4d","resolution":{"observed_at":"2026-08-16T00:22:50.170099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:50.151875Z","title":"11 A Extended Ablations In this section, we perform further ablations on our experiments","venue":null,"work_id":"536de509-b0ae-4f12-a0d9-991e4f851e92","year":null},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.725006Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:d492d2232f6f2de106dfa32619134844d5bce3171c54d17f0b90119069c5e64d","observation_id":"8cbe6e0b-0344-479c-b9fc-dc8c92c5bc7f","resolution":{"observed_at":"2026-08-16T00:22:50.156439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:49.692927Z","title":"doi:10.1109/IROS.2012.6386109","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL","version":1},"reference_index":5033,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:49.692927Z"},"links":{"citing_paper":"/paper/2608.12063"},"observation_digest":"sha256:758a470caf03f3ee053a90b7333743e13d37cfc6f5b4bd2c7d2919f114cdb529","observation_id":"37cf6be1-57e7-4127-9611-d7779520a858","resolution":{"observed_at":"2026-08-16T00:22:49.692927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12063","last_updated":"2026-08-12T13:48:56Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-20T23:10:03.710597Z","submitted_at":"2026-08-12T13:48:56Z","title":"Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2608.12063."}