{"as_of":"2026-08-09T01:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:00d59006f972482124703093898323518adaf4421b30db6be4f92a0e8c366e9a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:15:42.139432Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T23:57:29.181327Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2106.01345","last_updated":"2021-06-24T17:09:59Z","snapshot_observed_at":"2026-08-07T09:11:20.723647Z","submitted_at":"2021-06-02T17:53:39Z","title":"Decision Transformer: Reinforcement Learning via Sequence Modeling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T15:11:11.056013Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2106.01345"},"observation_digest":"sha256:e954ec9f6d801f468122fc3e52eb4d0415cda1f126d0c987ee1d944b506fae41","observation_id":"e67ef3e2-5dc7-4102-b3b9-af35d619c232","resolution":{"observed_at":"2026-05-18T15:11:11.314700Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T08:51:55.826747Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2108.03298"},"observation_digest":"sha256:a6ebdf2f64c1771c5ea3be98c36ea8944da55282e4336e991592ce9268d49df5","observation_id":"24ac5f17-dd9e-4fd0-82fd-598970556c8f","resolution":{"observed_at":"2026-05-13T08:51:55.958219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-06T18:15:42.139432Z","title":"Opal: Offline primitive discovery for acceler- ating offline reinforcement learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.09041","last_updated":"2025-07-11T21:36:19Z","snapshot_observed_at":"2026-08-08T12:02:56.780560Z","submitted_at":"2025-07-11T21:36:19Z","title":"Behavioral Exploration: Learning to Explore via In-Context Adaptation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:15:42.139432Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2507.09041"},"observation_digest":"sha256:ea5d39efe9a265bda5de62efa100d1261ad47aeeeeb4d7c185ec784590506e74","observation_id":"ff9dbc7f-779e-41fd-89b2-78b7f97a0a6c","resolution":{"observed_at":"2026-08-06T18:15:42.139432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-06T15:17:34.847846Z","title":"Opal: Offline primitive discovery for accelerating offline reinforcement learning.arXiv preprint arXiv:2010.13611, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.16473","last_updated":"2025-07-24T08:23:56Z","snapshot_observed_at":"2026-08-08T14:26:51.180790Z","submitted_at":"2025-07-22T11:22:58Z","title":"Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:17:34.847846Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2507.16473"},"observation_digest":"sha256:7c8d9a5ddb836d152d7f819668cb4959f4f97ed1df79b184247321868afa1b6b","observation_id":"1192f49f-ab8d-4644-805a-7744d51c4ed3","resolution":{"observed_at":"2026-08-06T15:17:34.847846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-04T08:45:47.978112Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.19528","last_updated":"2026-06-16T14:16:10Z","snapshot_observed_at":"2026-08-04T08:45:45.421057Z","submitted_at":"2025-10-22T12:32:52Z","title":"Learning Upper Lower Value Envelopes to Shape Online RL: A Principled Approach","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T08:45:47.978112Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2510.19528"},"observation_digest":"sha256:bbe909cbea87bc924b2650ddbd0eeff941380e7f50c80b124e72a17bbc2d84ae","observation_id":"fbbd8599-f619-4da0-873b-2e186e9b76db","resolution":{"observed_at":"2026-08-04T08:45:47.978112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-03T15:05:01.788849Z","title":"Opal: Offline primitive discovery for accelerating offline reinforcement learning.arXiv preprint arXiv:2010.13611, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2512.18368","last_updated":"2026-07-02T04:31:01Z","snapshot_observed_at":"2026-08-06T16:43:02.767420Z","submitted_at":"2025-12-20T13:46:08Z","title":"Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T15:05:01.788849Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2512.18368"},"observation_digest":"sha256:cd92ca28a9496a059e6729fc9666546e2285319e02967c9df52abcf442e097a2","observation_id":"384aca80-181a-45a0-93e7-fffcd6613991","resolution":{"observed_at":"2026-08-03T15:05:01.788849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2605.21822","last_updated":"2026-05-20T23:44:06Z","snapshot_observed_at":"2026-08-03T02:30:10.701058Z","submitted_at":"2026-05-20T23:44:06Z","title":"Implicit Safety Alignment from Crowd Preferences","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-22T08:28:41.652865Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2605.21822"},"observation_digest":"sha256:c2069add2bef3371352d54b7890b590c69944e6ea726844333ef276d46e561c1","observation_id":"22e07cd7-df74-4651-be1c-1af7f93bbba8","resolution":{"observed_at":"2026-05-22T08:31:16.907176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.09115","last_updated":"2026-06-08T07:11:03Z","snapshot_observed_at":"2026-08-04T22:59:05.251199Z","submitted_at":"2026-06-08T07:11:03Z","title":"Counterfactual Transport Flows for Offline Conservative Trajectory Refinement","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-27T17:33:35.857240Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.09115"},"observation_digest":"sha256:98b74310f88fe63a263966bd030c1fd89a6887f8b678f454cd597b88716aa30a","observation_id":"1fa937b6-3149-4cd3-89a4-eddf17901ccd","resolution":{"observed_at":"2026-07-02T23:57:29.182689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.29201","last_updated":"2026-06-28T05:01:27Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T05:01:27Z","title":"Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T07:49:04.825693Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.29201"},"observation_digest":"sha256:7e03dce1b5f1e6ecd270e7c83d020e5323e2c654bd45bfbd07e121398a4fce0e","observation_id":"097a2308-2c05-487d-91ef-4ae79db223c1","resolution":{"observed_at":"2026-06-30T07:54:22.212408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.31958","last_updated":"2026-06-30T17:00:33Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:00:33Z","title":"Adapting Generalist Robot Policies with Semantic Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T05:09:29.625066Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.31958"},"observation_digest":"sha256:925901c2fdaa7f750680f8500f105e5e4886a1f07843a37eae50541afa7265fd","observation_id":"01c0d124-f73a-4f69-979b-8e84014c9005","resolution":{"observed_at":"2026-07-01T10:45:42.729562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-04T19:45:26.462169Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:26.462169Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:1ab3d90c97e969bdc77e94af93ffa4d716c7a210eb13918d60ed709ee5cdcc25","observation_id":"ed133a94-6119-455a-9f1d-3b4e59acae50","resolution":{"observed_at":"2026-08-04T19:45:26.462169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2010.13611/citation-record","integrity":"/paper/2010.13611/integrity","json":"/paper/2010.13611/citation-record.json","paper":"/paper/2010.13611"},"outbound":[],"paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T03:14:46.253254Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2010.13611."}