{"as_of":"2026-08-13T11:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be71ef0a7d5a5839a14d56349ed85dae956f97fe2873a147dd5fb3e370018ed0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:44:26.359895Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:29:16.028655Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-12T12:44:26.359895Z","title":"Sample-efficient reinforcement learning via counterfactual-based data augmentation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16959","last_updated":"2025-05-20T01:17:09Z","snapshot_observed_at":"2026-08-13T09:45:22.343608Z","submitted_at":"2024-11-25T21:57:15Z","title":"RoCoDA: Counterfactual Data Augmentation for Data-Efficient Robot Learning from Demonstrations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:44:26.359895Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2411.16959"},"observation_digest":"sha256:364394af08729163ae4685938e1418b3b79d0eb846198393e2e1fb925f432f99","observation_id":"475e30ba-9c06-4a52-8048-32a76d846e70","resolution":{"observed_at":"2026-08-12T12:44:26.359895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-11T15:02:44.174575Z","title":"M.; Zhang, K.; and Schölkopf, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11410","last_updated":"2024-12-20T11:46:05Z","snapshot_observed_at":"2026-08-12T02:50:23.607566Z","submitted_at":"2024-12-16T03:25:28Z","title":"MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:02:44.174575Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2412.11410"},"observation_digest":"sha256:b4c5e6e474f08b22bcb56e2efb9ebdaec8ca20f0c239b8c38466ba811401f47f","observation_id":"6f0d2924-1a90-4a37-a9ef-430c24add48c","resolution":{"observed_at":"2026-08-11T15:02:44.174575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2502.13731","last_updated":"2026-05-22T14:43:44Z","snapshot_observed_at":"2026-08-05T08:00:49.108567Z","submitted_at":"2025-02-19T13:56:20Z","title":"Robust Counterfactual Inference in Markov Decision Processes","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T08:12:09.352914Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2502.13731"},"observation_digest":"sha256:8cab18c4e92b19026d3b877c1fb7dbd0d1513eeec51639043ff448b49acaf2bf","observation_id":"dcdf0134-dc06-4ec0-bf88-33cacf8c9b05","resolution":{"observed_at":"2026-05-25T08:15:34.051865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-06T21:38:30.899293Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.23703","last_updated":"2025-06-30T10:26:59Z","snapshot_observed_at":"2026-08-07T04:31:53.714838Z","submitted_at":"2025-06-30T10:26:59Z","title":"A New Perspective On AI Safety Through Control Theory Methodologies","version":1},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-08-06T21:38:30.899293Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2506.23703"},"observation_digest":"sha256:70a9f89521eea22fc83273eb6845db767fdf44459c85318b17927433bba1b819","observation_id":"6a00670c-198b-4091-bf9c-add0d4f96c27","resolution":{"observed_at":"2026-08-06T21:38:30.899293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2603.09030","last_updated":"2026-04-06T01:32:12Z","snapshot_observed_at":"2026-07-30T02:16:48.709523Z","submitted_at":"2026-03-09T23:58:07Z","title":"PlayWorld: Learning Robot World Models from Autonomous Play","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T14:05:32.112432Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2603.09030"},"observation_digest":"sha256:cdca2efc82f7686cf02874e542a90b184ad1c22314c984fe5b30f2c9f4c13958","observation_id":"618b05ec-1f6f-4244-83ba-f32323e17a70","resolution":{"observed_at":"2026-05-15T14:05:54.537514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2605.16054","last_updated":"2026-05-15T15:21:25Z","snapshot_observed_at":"2026-08-03T10:16:57.496693Z","submitted_at":"2026-05-15T15:21:25Z","title":"Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making","version":1},"reference_index":234,"source":"arxiv_source","source_observed_at":"2026-05-20T20:54:31.025488Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2605.16054"},"observation_digest":"sha256:7d9c2a48d57eb3fd861dfe22461c847cc2fc15385b73465d20e5e4fad9a52002","observation_id":"1106de78-35d2-4122-b58f-8cf7720dbee3","resolution":{"observed_at":"2026-05-20T20:59:01.943752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.09115","last_updated":"2026-06-08T07:11:03Z","snapshot_observed_at":"2026-08-04T22:59:05.251199Z","submitted_at":"2026-06-08T07:11:03Z","title":"Counterfactual Transport Flows for Offline Conservative Trajectory Refinement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T17:33:35.857240Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.09115"},"observation_digest":"sha256:941bb6c47da28777a80ae5cd097ceb0a9cca1e96bd4da9bf3b638bc037426f23","observation_id":"1be69628-62ac-4cfe-837a-f1bb61d3e937","resolution":{"observed_at":"2026-07-03T00:07:27.688520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.19460","last_updated":"2026-06-17T18:01:18Z","snapshot_observed_at":"2026-08-05T20:30:40.324830Z","submitted_at":"2026-06-17T18:01:18Z","title":"Scaling Generative Foundation Models for Chest Radiography with Rectified Flow Transformers","version":1},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-06-26T21:10:51.682435Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.19460"},"observation_digest":"sha256:3410e7424a5e9571f798ba40abfc48a978805bdf8d7cb3cee1d535db187fd489","observation_id":"2d8373cd-6720-4cd2-b9a7-a5a7a146cf20","resolution":{"observed_at":"2026-07-04T00:29:16.032558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.28460","last_updated":"2026-06-26T13:04:37Z","snapshot_observed_at":"2026-08-08T16:25:54.111144Z","submitted_at":"2026-06-26T13:04:37Z","title":"Counterfactual Residual Data Augmentation for Regression","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-30T01:16:27.768898Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.28460"},"observation_digest":"sha256:07cad81a9c3c06e62d42ab3f85db7aed4efb48d22eeaa100d72eb590a1cb06f4","observation_id":"97d58044-c58f-413a-b3ce-6a02db0bea04","resolution":{"observed_at":"2026-07-01T15:35:48.876222Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2012.09092/citation-record","integrity":"/paper/2012.09092/integrity","json":"/paper/2012.09092/citation-record.json","paper":"/paper/2012.09092"},"outbound":[],"paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2012.09092."}