{"as_of":"2026-08-22T11:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86e96d54506e629670df6129d889a76c35133bcadbdae82c5b61ecd4c3a067b5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:17:36.266052Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T11:44:37.877586Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06662","snapshot_observed_at":"2026-08-12T20:17:36.266052Z","title":"Dara: Dynamics-aware reward augmentation in offline reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09891","last_updated":"2024-11-15T02:35:20Z","snapshot_observed_at":"2026-08-16T22:28:27.216802Z","submitted_at":"2024-11-15T02:35:20Z","title":"Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T20:17:36.266052Z"},"links":{"cited_paper":"/paper/2203.06662","citing_paper":"/paper/2411.09891"},"observation_digest":"sha256:68f7da17e2940f31e9d4c7182ebd6404e5932172faa696340a87fe9f62fc67df","observation_id":"dd32523b-2d57-48a7-a4f0-b2c20d772568","resolution":{"observed_at":"2026-08-12T20:17:36.266052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06662","snapshot_observed_at":"2026-08-09T11:31:10.691667Z","title":"Dara: Dynamics-aware reward augmentation in offline reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02705","last_updated":"2025-02-04T20:40:44Z","snapshot_observed_at":"2026-08-17T19:59:44.269774Z","submitted_at":"2025-02-04T20:40:44Z","title":"Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T11:31:10.691667Z"},"links":{"cited_paper":"/paper/2203.06662","citing_paper":"/paper/2502.02705"},"observation_digest":"sha256:0c4792786988ab2fbeebefb95fc57304fcdda28b3f9c8e3f1d17b92566010ec1","observation_id":"b420593d-7593-4074-bc39-2452b91062a2","resolution":{"observed_at":"2026-08-09T11:31:10.691667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2203.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.06662","snapshot_observed_at":"2026-06-30T11:44:37.877586Z","title":"Dara: Dynamics-aware reward augmentation in offline reinforcement learning","venue":null,"work_id":"6c5511d0-fa2a-4de6-84b6-afdc9aee0aa9","year":2022},"citing_paper":{"arxiv_id":"2605.01862","last_updated":"2026-05-08T03:23:44Z","snapshot_observed_at":"2026-08-17T03:35:49.937485Z","submitted_at":"2026-05-03T13:11:28Z","title":"QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL","version":2},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-11T01:17:48.643521Z"},"links":{"cited_paper":"/paper/2203.06662","citing_paper":"/paper/2605.01862"},"observation_digest":"sha256:68c2d751ff452d6123d39f926791eaa38e751b1ecc1cc8f91b03804cd1d565d8","observation_id":"a139c333-11bf-4b8f-a3c2-c5411759db28","resolution":{"observed_at":"2026-05-11T04:30:58.034514Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2203.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.06662","snapshot_observed_at":"2026-06-30T11:44:37.877586Z","title":"Dara: Dynamics-aware reward augmentation in offline reinforcement learning","venue":null,"work_id":"6c5511d0-fa2a-4de6-84b6-afdc9aee0aa9","year":2022},"citing_paper":{"arxiv_id":"2605.22376","last_updated":"2026-05-21T12:09:11Z","snapshot_observed_at":"2026-08-14T16:51:23.554857Z","submitted_at":"2026-05-21T12:09:11Z","title":"Target-Aligned Bellman Backup for Cross-domain Offline Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T08:02:27.951445Z"},"links":{"cited_paper":"/paper/2203.06662","citing_paper":"/paper/2605.22376"},"observation_digest":"sha256:9581009ac3512656c3eede6da31d333816f47792c3dd035c027b53e29991f03f","observation_id":"9e09a068-5c6e-47e3-b17a-84b3f3b8806d","resolution":{"observed_at":"2026-05-22T08:04:43.152118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2203.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.06662","snapshot_observed_at":"2026-06-30T11:44:37.877586Z","title":"Dara: Dynamics-aware reward augmentation in offline reinforcement learning","venue":null,"work_id":"6c5511d0-fa2a-4de6-84b6-afdc9aee0aa9","year":2022},"citing_paper":{"arxiv_id":"2605.24810","last_updated":"2026-05-24T01:44:57Z","snapshot_observed_at":"2026-08-12T21:57:06.083091Z","submitted_at":"2026-05-24T01:44:57Z","title":"Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-30T11:43:41.884049Z"},"links":{"cited_paper":"/paper/2203.06662","citing_paper":"/paper/2605.24810"},"observation_digest":"sha256:f410ec0990fef4a71753e56cb7084940aedea3077c65f358af3e14ecad7947b7","observation_id":"6f38161c-cf21-46e3-a09a-8c0369329c47","resolution":{"observed_at":"2026-06-30T11:44:37.879210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2203.06662/citation-record","integrity":"/paper/2203.06662/integrity","json":"/paper/2203.06662/citation-record.json","paper":"/paper/2203.06662"},"outbound":[],"paper":{"arxiv_id":"2203.06662","last_updated":"2022-03-13T14:30:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T17:15:00.378115Z","submitted_at":"2022-03-13T14:30:55Z","title":"DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2203.06662."}