{"as_of":"2026-08-15T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e10b6c95668b1b918d5293692644ccab9490682666824ebe7dc15b50329a553","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:17:36.257541Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T18:25:58.773053Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-12T20:17:36.257541Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.09891","last_updated":"2024-11-15T02:35:20Z","snapshot_observed_at":"2026-08-15T11:54:01.487199Z","submitted_at":"2024-11-15T02:35:20Z","title":"Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T20:17:36.257541Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2411.09891"},"observation_digest":"sha256:9ca629bc81a53b609f8ab1d55acc7300ecbd931d7542f8d60c4a974b924e31c8","observation_id":"4baa2b41-6a6a-4dce-8b3a-f3a1fef53fbd","resolution":{"observed_at":"2026-08-12T20:17:36.257541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-09T18:28:22.453591Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-11T17:50:27.070802Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.453591Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:e853afd61cf831ccbc9fe0b1f1e99bdb9b89419963b21a2ce2164fc4df83090e","observation_id":"24ef9fab-4eaf-4b8a-8ef0-7245139e09ef","resolution":{"observed_at":"2026-08-09T18:28:22.453591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-09T11:31:10.665872Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.02705","last_updated":"2025-02-04T20:40:44Z","snapshot_observed_at":"2026-08-14T04:29:53.155173Z","submitted_at":"2025-02-04T20:40:44Z","title":"Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T11:31:10.665872Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2502.02705"},"observation_digest":"sha256:87a9f245bc2a7a9c49b9342378c01d218e2efc87dfb4655f604bcde90112e29e","observation_id":"fe82fe4d-9f49-434f-9614-cfe244d6b4e6","resolution":{"observed_at":"2026-08-09T11:31:10.665872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-06T20:33:15.689811Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.02762","last_updated":"2025-07-03T16:21:49Z","snapshot_observed_at":"2026-08-09T23:42:20.121235Z","submitted_at":"2025-07-03T16:21:49Z","title":"Contextual Online Pricing with (Biased) Offline Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:33:15.689811Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2507.02762"},"observation_digest":"sha256:b73da2743154f3906b7514717c91a053e7925ce08d50d85f881466e219016d91","observation_id":"2ae15d6c-b760-4c6d-b9a5-4477e796257f","resolution":{"observed_at":"2026-08-06T20:33:15.689811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.09183","last_updated":"2026-05-16T18:02:16Z","snapshot_observed_at":"2026-08-11T09:54:28.014535Z","submitted_at":"2026-05-09T21:48:04Z","title":"Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T03:27:41.845716Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.09183"},"observation_digest":"sha256:33c00092e0844e8fdd6cfdd5ab6bc4f81e76379e8c48c42ed47e9a128e519320","observation_id":"fbdc93b2-1895-476a-9e10-6ac80450243a","resolution":{"observed_at":"2026-05-12T07:21:25.275337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.09183","last_updated":"2026-05-16T18:02:16Z","snapshot_observed_at":"2026-08-11T09:54:28.014535Z","submitted_at":"2026-05-09T21:48:04Z","title":"Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T22:04:57.245024Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.09183"},"observation_digest":"sha256:0dc8463f94cde5d42f2567886801d67e0ec9279e7c7703a6b11dcf993c6803aa","observation_id":"302631c1-d4b6-4d46-9d8b-5b090a564197","resolution":{"observed_at":"2026-05-20T22:09:07.679623Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.22376","last_updated":"2026-05-21T12:09:11Z","snapshot_observed_at":"2026-08-14T16:51:23.554857Z","submitted_at":"2026-05-21T12:09:11Z","title":"Target-Aligned Bellman Backup for Cross-domain Offline Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T08:02:27.951445Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.22376"},"observation_digest":"sha256:63da5a817fcef8315ab7f1787a1d1f2557af90979000619503741771be40bc8a","observation_id":"6e77fbad-fff3-4457-aa76-8f221709cc93","resolution":{"observed_at":"2026-05-22T08:04:43.160309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2605.24810","last_updated":"2026-05-24T01:44:57Z","snapshot_observed_at":"2026-08-12T21:57:06.083091Z","submitted_at":"2026-05-24T01:44:57Z","title":"Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-30T11:43:41.884049Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2605.24810"},"observation_digest":"sha256:017e791daacded1ed4957ad6c9bb9d325573cc7521d657593fcf724e047de10f","observation_id":"cbe75b1d-1b30-4426-92a0-0478b2639b1a","resolution":{"observed_at":"2026-06-30T11:44:37.894007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":"2006.13916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-07-01T18:25:58.773053Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers","venue":null,"work_id":"192eb94a-a473-4fe1-b9c7-86852694f0cd","year":2021},"citing_paper":{"arxiv_id":"2606.27475","last_updated":"2026-06-25T18:52:27Z","snapshot_observed_at":"2026-08-14T18:03:06.010854Z","submitted_at":"2026-06-25T18:52:27Z","title":"Support-Constrained RL Enables Real-World Policy Improvement without Real-World Experience","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T01:57:04.293058Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2606.27475"},"observation_digest":"sha256:f4a02a5985cd9b4f81b857cb07447ba1ff6def1166d41b0fd748e18b1f2bdf1c","observation_id":"62743e01-901b-44b9-a495-564f58cf32fb","resolution":{"observed_at":"2026-07-01T18:25:58.774412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-01T21:28:12.466094Z","title":"Off-dynamics reinforcement learning: Training for transfer with domain classifiers,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.16090","last_updated":"2026-07-17T16:20:08Z","snapshot_observed_at":"2026-08-14T17:31:51.606324Z","submitted_at":"2026-07-17T16:20:08Z","title":"DADiff: Diffusion-Driven Cross-Domain Policy Adaptation for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T21:28:12.466094Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2607.16090"},"observation_digest":"sha256:252d4c5ecec48f39b268c488905312b0818b01b594cc4e400807e5d7f7e4d68f","observation_id":"81679cff-648a-4f15-821a-0d5323e044cf","resolution":{"observed_at":"2026-08-01T21:28:12.466094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2006.13916/citation-record","integrity":"/paper/2006.13916/integrity","json":"/paper/2006.13916/citation-record.json","paper":"/paper/2006.13916"},"outbound":[],"paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T05:32:12.454205Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2006.13916."}