{"as_of":"2026-08-21T13:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53b72ba5edd9b997b25905a3f8394fb314968e1d598f41187dc7b6b471ba6af4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:45:57.643423Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.09114/citation-record","integrity":"/paper/2505.09114/integrity","json":"/paper/2505.09114/citation-record.json","paper":"/paper/2505.09114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.418354Z","title":"An optimistic perspective on offline reinforcement learning","venue":null,"work_id":"54f17c8e-61d7-41be-a78e-c250e5d41a69","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.094567Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:57574c6ea133bd218028e16124030969d3d940b4fc91c1c8f3ceb0045f361307","observation_id":"d2d44b46-dde9-4eab-b10d-527630770ba2","resolution":{"observed_at":"2026-08-15T21:45:58.423117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.403513Z","title":"End-to-end balancing for causal con- tinuous treatment-effect estimation","venue":null,"work_id":"b4f40a58-79b2-4d1c-9e08-5a9a4a49e875","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.143706Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ba5af4149bb0968030f03271ad8ddfb6d2e053d1f8c3b0dbcedf16eb8e9425a3","observation_id":"117575f0-bbe8-4ae3-891b-970261120dce","resolution":{"observed_at":"2026-08-15T21:45:58.408038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.190937Z","title":"The arcade learning environment: An evaluation platform for general agents.Journal of Artificial Intelligence Research, 47:253–279, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.190937Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1a8c7b46eef236eb9d71917e27be3329eb87b88ed2ca40a1697bf85081f184e1","observation_id":"aae3d8f4-d6c4-479e-bfe1-0144185ad61a","resolution":{"observed_at":"2026-08-15T21:45:57.190937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.379594Z","title":"When should we prefer decision transformers for offline reinforcement learning? InThe Twelfth International Confer- ence on Learning Representations, 2024","venue":null,"work_id":"12032a3c-baac-41a3-a57d-0fd2b2afbe5d","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.231320Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:3f9544bf44d4959f66533987cf4b213fef8a9373ed52d922dc6fcd76b95477d1","observation_id":"ef80db08-2c0d-44f1-8fca-00ca829dc936","resolution":{"observed_at":"2026-08-15T21:45:58.384162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.275467Z","title":"Openai gym, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.275467Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:c31c27f59a965d9a02714740598f1e3f4620ca1a94e026def950a381b78eb8c9","observation_id":"5f89db0c-f541-4a7e-b2ed-3ef4b90dc460","resolution":{"observed_at":"2026-08-15T21:45:57.275467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.355088Z","title":"Decision transformer: reinforcement learning via sequence mod- eling","venue":null,"work_id":"67b08d67-365c-4ded-8118-50bceaabdf78","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.280059Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:54574476739c7a33bec992f4c3102730bde786a7bc54c047620b62a028567f28","observation_id":"800f8b0b-a043-464d-bf85-1e38c7b6d1d8","resolution":{"observed_at":"2026-08-15T21:45:58.359959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.340420Z","title":"Estimating average causal effects from patient trajectories","venue":null,"work_id":"02e04331-d724-417d-ac7b-ccaa87b6b7d5","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.285376Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:fa96f001eccb34e41ac00fb1c38e8fc6c9bd2d08f60b030013d67c46bf1cf5e9","observation_id":"792fa787-86ee-4333-bbce-5f1567ad524c","resolution":{"observed_at":"2026-08-15T21:45:58.345271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T21:45:57.289782Z","title":"D4rl: Datasets for deep data-driven reinforcement learning.arXiv preprint arXiv:2004.07219, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.289782Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:2938739fc818ab7dd7c76ac1e7ce889eee52cd8ce1187dfc4dd015b275624fec","observation_id":"c5b24c12-06f3-4219-9494-9c1d99cdf05b","resolution":{"observed_at":"2026-08-15T21:45:57.289782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.325446Z","title":"Cate meets ml: Conditional average treatment effect and machine learning.Digital Finance, 3(2):99–148, 2021","venue":null,"work_id":"45b3c04b-bcd3-4506-865b-7b81f53982d4","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.294571Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:485599114f4cbd1a9ffb742e9a1ff6987689dc595704e77d54c325f0e5f2f19d","observation_id":"76b8a92b-b8be-4f56-9582-cb6e4e83df0f","resolution":{"observed_at":"2026-08-15T21:45:58.330405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.309296Z","title":"Bounds on the expectation of the maximum of samples from a gaussian.URL http://www","venue":null,"work_id":"bbb64116-3a6e-45a7-909f-8f25e0b2da6e","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.298833Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:d2d6256b8a813cb07a21f2f1afbc7f78e1e9526b45a03dc034fc2100b6fed199","observation_id":"6fd0d163-6d05-459f-b0da-899b463d450b","resolution":{"observed_at":"2026-08-15T21:45:58.314464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.293090Z","title":"Morel: model- based offline reinforcement learning","venue":null,"work_id":"615c248f-fc6e-4035-9a3d-fa5fd599fbaf","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.302993Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ef274bf7f4c2549f9ea07fc7edf377a447082c75ce3f2b9056a9b2d15b679932","observation_id":"dcd2ef1b-2bf2-40fd-86ab-7242aececdc9","resolution":{"observed_at":"2026-08-15T21:45:58.297963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.278303Z","title":"Counterfactually guided policy transfer in clinical settings","venue":null,"work_id":"65a792f7-303f-401a-b55c-20df8dda3ff8","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.307407Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:481b02809b1955b38d84b7309c700c5466169323354bee7176f30a31be4681b9","observation_id":"9fb92675-9311-4913-9471-edefd8aa8812","resolution":{"observed_at":"2026-08-15T21:45:58.283184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03022","last_updated":"2024-05-30T07:19:34Z","snapshot_observed_at":"2026-08-18T18:52:21.453023Z","submitted_at":"2023-10-04T17:59:32Z","title":"Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03022","snapshot_observed_at":"2026-08-15T21:45:57.311727Z","title":"Decision convformer: Local filtering in metaformer is sufficient for decision making.arXiv preprint arXiv:2310.03022, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.311727Z"},"links":{"cited_paper":"/paper/2310.03022","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:6ffef574da637dda2ce27930a29829db47abf0121214052b9773b053e2ca44f2","observation_id":"373d8eaf-5c52-4747-93c2-8bb24f8b7073","resolution":{"observed_at":"2026-08-15T21:45:57.311727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.263847Z","title":"Offline reinforcement learning with fisher divergence critic regularization","venue":null,"work_id":"5955c452-8659-4931-8caf-a04d02c08274","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.316258Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:f07a08958e26e812a343a8d00038ec0dc2c578c932227365260c756a7ecd702b","observation_id":"e9771885-61dd-4e60-a5ba-fe466ed7e4c6","resolution":{"observed_at":"2026-08-15T21:45:58.268442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-15T21:45:57.320467Z","title":"Offline reinforcement learning with implicit q- learning.arXiv preprint arXiv:2110.06169, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.320467Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:5e75f9edc4b7523aaf1b54eb0a3fb1c41e4e06b255b221080372d467cfc56cfc","observation_id":"0d9c5fed-4b50-4551-9f1e-b6e1b263ad0c","resolution":{"observed_at":"2026-08-15T21:45:57.320467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.249572Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":"b7032a06-666b-4059-b5fc-fab97ce317e0","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.325327Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:3bb1153c6b9218af58ff891c3ca75d6c4943672533a1fb32e2d798e8f8caa144","observation_id":"81cf049e-4e23-47a4-898d-54f2cf1861f1","resolution":{"observed_at":"2026-08-15T21:45:58.254106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T21:45:57.329726Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.329726Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:6bb3e02d8eecb568c1ad9ee91e34861b4d1e4f7e5dcd405372aa28379de5ab4c","observation_id":"80111091-d3aa-489d-93e6-095ace55b2fc","resolution":{"observed_at":"2026-08-15T21:45:57.329726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10551","last_updated":"2020-03-23T21:08:51Z","snapshot_observed_at":"2026-08-16T07:03:49.925895Z","submitted_at":"2020-03-23T21:08:51Z","title":"G-Net: A Deep Learning Approach to G-computation for Counterfactual Outcome Prediction Under Dynamic Treatment Regimes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10551","snapshot_observed_at":"2026-08-15T21:45:57.334288Z","title":"G-net: a deep learning approach to g-computation for counterfactual outcome prediction under dynamic treatment regimes.arXiv preprint arXiv:2003.10551, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.334288Z"},"links":{"cited_paper":"/paper/2003.10551","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:9c34c4f299fb8e015506c97dad72704be3f753e2384ab67a3c15936aefee4163","observation_id":"5ee4f5b4-3374-49dd-86d2-d7b456c7f8e0","resolution":{"observed_at":"2026-08-15T21:45:57.334288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.234565Z","title":"Causal transformer for estimating coun- terfactual outcomes","venue":null,"work_id":"04657c37-29ca-47b0-bdce-2f1f3a35bdc5","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.362254Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:5fa26f9499cad9c76ef56edcc6c4d4ddb1b63b0db7824d0ff968f49fd4ec4573","observation_id":"30abaeda-e3e5-4143-b219-b4d26e6415a6","resolution":{"observed_at":"2026-08-15T21:45:58.239703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09464","last_updated":"2021-12-14T13:36:12Z","snapshot_observed_at":"2026-08-16T19:04:53.333572Z","submitted_at":"2020-11-18T18:41:44Z","title":"Counterfactual Credit Assignment in Model-Free Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09464","snapshot_observed_at":"2026-08-15T21:45:57.398711Z","title":"Counterfactual credit assignment in model-free reinforcement learning.arXiv preprint arXiv:2011.09464, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.398711Z"},"links":{"cited_paper":"/paper/2011.09464","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:9d13182f0d2921870edbab0c8164de86a22f6564088ef11643f03c690feee635","observation_id":"53a78059-1d39-4a53-9846-b2e826e45b65","resolution":{"observed_at":"2026-08-15T21:45:57.398711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.443483Z","title":"Human-level control through deep reinforcement learning.nature, 518(7540):529–533, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.443483Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:a7c06f5831dbe7747649f4f0d9105eb7d31ea34764ea0d616d7b478a0e7d5e8c","observation_id":"cda8fa68-50ec-4eed-865b-d8e98fb73bf7","resolution":{"observed_at":"2026-08-15T21:45:57.443483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.209213Z","title":"On the application of probability theory to agricultural experiments","venue":null,"work_id":"d01c8bd3-22c6-4c9e-bb21-bd4cc7103f94","year":1923},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.462227Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ce778a2d6978d4c4354b082d4eb684efcc232611fb8663ce95639454c8051994","observation_id":"f7afd36e-bbcc-4568-b05e-d94e2d14470e","resolution":{"observed_at":"2026-08-15T21:45:58.214544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.193661Z","title":"The book of why: The new science of cause and effect, 2018","venue":null,"work_id":"df9f896e-17dd-4906-bb86-0cab4ac92aa9","year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.466811Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:0d320772ecf70001afd0f2a570e31e8cbfff2c8386510e6cfb4ca9d68601c47e","observation_id":"84fab8d1-d44b-4ed5-875e-44fc3439146e","resolution":{"observed_at":"2026-08-15T21:45:58.198313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.179408Z","title":"Counterfactual data augmentation using locally fac- tored dynamics","venue":null,"work_id":"b8e281d6-46ac-4596-ae6d-b34cdfc37b07","year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.471125Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:14b5b542e76997fda2f75041223334cc8553f4c313271aad56062f145635aa0d","observation_id":"c904ce0e-e4c9-4603-b868-4fc375ab7e19","resolution":{"observed_at":"2026-08-15T21:45:58.184095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.164681Z","title":"Mocoda: model-based counterfac- tual data augmentation","venue":null,"work_id":"d190dd90-82df-4290-af97-d0b754e1638e","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.475250Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:73aea49279c3e303b722cec16e2a5a36359beb8b11c067772a62369ca2618a32","observation_id":"3c8e1634-bd2a-47e9-bbab-7ccb3ae7b8fc","resolution":{"observed_at":"2026-08-15T21:45:58.169582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.151225Z","title":"Pomerleau","venue":null,"work_id":"8e2dde5c-b57a-4e83-97b1-ee61666d5285","year":1988},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.479296Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:167b1c6855eb30736088973f1cb8d3b18decc0176bb6b9534b45be4b1aa03a58","observation_id":"081f5425-508e-46ab-a5ff-a179a5de0529","resolution":{"observed_at":"2026-08-15T21:45:58.155576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.136740Z","title":"Estimation of the causal effects of time-varying exposures.Chap- man & Hall/CRC Handbooks of Modern Statistical Methods, pages 553–599, 2008","venue":null,"work_id":"0524db2b-c379-4631-9a1c-2f112cf22825","year":2008},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.483475Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ef7c2ebc846260122db806ee063544e3f8f317bfeba3a458ea579806bdee4fc4","observation_id":"0b2613cb-3e19-45d2-bd6b-a31c54073a67","resolution":{"observed_at":"2026-08-15T21:45:58.141691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.487915Z","title":"Bayesian inference for causal effects: The role of randomization.The Annals of statistics, pages 34–58, 1978","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.487915Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:c8ad58be0a183d663848b9220a18699896dacf1daa495875a34f774886261b87","observation_id":"03b3939f-d879-4f95-8aaa-30c1b355ce3b","resolution":{"observed_at":"2026-08-15T21:45:57.487915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02875","last_updated":"2020-06-23T15:55:05Z","snapshot_observed_at":"2026-08-17T05:48:50.270608Z","submitted_at":"2019-12-05T21:10:08Z","title":"Reinforcement Learning Upside Down: Don't Predict Rewards -- Just Map Them to Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02875","snapshot_observed_at":"2026-08-15T21:45:57.492172Z","title":"Reinforcement learning upside down: Don’t predict rewards–just map them to actions.arXiv preprint arXiv:1912.02875, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.492172Z"},"links":{"cited_paper":"/paper/1912.02875","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:bd31810c301d19c063fdca3ddcf5611ee402980cbb3b10bd7a04dbf11c3762cc","observation_id":"c90fb6fe-a89a-4064-8914-eb02567d1ab3","resolution":{"observed_at":"2026-08-15T21:45:57.492172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.112566Z","title":"Causal influence detection for improving efficiency in reinforcement learning","venue":null,"work_id":"432110e1-b489-4b7a-9963-b3155138fb45","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.497165Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:5235e953a229dfeac3e6cca351f69c21f732edf8fb9c6233bf3264dc3db454ad","observation_id":"3c8225c1-5b96-47f0-9e2e-eabebce5e3a8","resolution":{"observed_at":"2026-08-15T21:45:58.117397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.097802Z","title":"Johansson, and David Sontag","venue":null,"work_id":"460aa1a1-368d-4d76-968e-7ee0e718143b","year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.501380Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:7d5df4ce78b69c2dcde704fe96d892373237f07f410233fe1426520a4dc1ae4e","observation_id":"ab0fe502-da0c-4605-a635-7795ac75d45f","resolution":{"observed_at":"2026-08-15T21:45:58.102289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.505789Z","title":"Mastering the game of go without human knowledge.nature, 550(7676):354–359, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.505789Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:cb806b213664d863891c719f5e646c5f705e918027f5542c2368441ac057667b","observation_id":"26cffe2a-0e02-441a-9a70-cdb041f8c826","resolution":{"observed_at":"2026-08-15T21:45:57.505789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02877","last_updated":"2021-09-03T22:15:10Z","snapshot_observed_at":"2026-08-20T18:07:01.716486Z","submitted_at":"2019-12-05T21:13:36Z","title":"Training Agents using Upside-Down Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02877","snapshot_observed_at":"2026-08-15T21:45:57.537078Z","title":"Training agents using upside-down reinforcement learning.arXiv preprint arXiv:1912.02877, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.537078Z"},"links":{"cited_paper":"/paper/1912.02877","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:ca5c686f6970619feee8897e922ced6ff26b3c405ec1ed5cc78e879368adde59","observation_id":"788f03c6-d461-45cc-a387-7cfd7518c8fc","resolution":{"observed_at":"2026-08-15T21:45:57.537078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.073404Z","title":"Offline imitation learning with variational counterfactual reasoning","venue":null,"work_id":"a191d6d6-c609-41e4-87f9-7b74431a7e9b","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.576934Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:c8adb687ec527ec5645ab0f313784fc30be07fac5b404a528d71f09d85301229","observation_id":"18a38568-430b-4eed-8845-312045a84f73","resolution":{"observed_at":"2026-08-15T21:45:58.077844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.057975Z","title":"Acamda: improving data efficiency in reinforcement learning through guided counterfactual data aug- mentation","venue":null,"work_id":"4d95c46f-73a8-45bf-bbf9-7be45ff40bfe","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.581009Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:e28fe81fe2e6eb7e8a335606c0402776770b07a9e674bf5e910f5978e2f9af50","observation_id":"8c9ffa66-79d4-4e7b-a58d-8b3f85d9d7dd","resolution":{"observed_at":"2026-08-15T21:45:58.062756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.585285Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.585285Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:d8f2547bd5df3846b4b68537c0297f5a7c5281bcbefd5f89d9a1ea3a8af71455","observation_id":"8d7802a0-0139-444d-bb95-0c6db934394d","resolution":{"observed_at":"2026-08-15T21:45:57.585285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.032148Z","title":"Learning robot in-hand ma- nipulation with tactile features","venue":null,"work_id":"5ee121ad-b1d2-4081-b1c7-6b37d5a3d347","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.589707Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:d505d3d13791f1f544f711a74ce351c5a5f70a7c69b163c6f3810f6e07e13163","observation_id":"1a907807-91c0-4d72-a5cc-88604ac52edd","resolution":{"observed_at":"2026-08-15T21:45:58.036826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.016377Z","title":"Attention is all you need","venue":null,"work_id":"5ec40768-b64e-4e91-bdf8-f3b07ee9b23c","year":2017},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.594046Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:f262a6fc089f9eb71d6fac6400686188e39079b182b0916e85849c582336ed1f","observation_id":"2bba606a-837c-46ac-97e5-a0675e19700f","resolution":{"observed_at":"2026-08-15T21:45:58.021676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:58.001076Z","title":"Supervised reinforcement learning with recur- rent neural network for dynamic treatment recommendation","venue":null,"work_id":"3c09e6f9-dd70-44a8-88dd-f82c3ac04f76","year":2018},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.598527Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:8fd6dc9a4a8aca7ac2a5644b9f767a2d89f21f0352f6cea81eeed4cd6a79118a","observation_id":"447929a3-fb5e-47d1-ba6f-093e71007064","resolution":{"observed_at":"2026-08-15T21:45:58.005796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.985996Z","title":"Elastic decision transformer","venue":null,"work_id":"5c6d21bc-54f4-496b-a0ce-b4869ac03e83","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.602820Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:1c79a2d14b94c75c3d240435a760081f289f49409f21402da5571266574c5a12","observation_id":"9d5b7f94-dbd1-4198-8158-d5ac34177a98","resolution":{"observed_at":"2026-08-15T21:45:57.990473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.970430Z","title":"Bellman-consistent pessimism for offine reinforcement learning","venue":null,"work_id":"86084638-784f-43b8-9103-4f820844316d","year":2021},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.607052Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:d004e1b25b35139bdbb6a3ab9befa4e92e8e5d97ec3fa39dee9232665540c33d","observation_id":"7f73737c-82dc-46d7-8423-974ae99abc2e","resolution":{"observed_at":"2026-08-15T21:45:57.974995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.954963Z","title":"Future-conditioned unsu- pervised pretraining for decision transformer","venue":null,"work_id":"ec3a0e86-aab3-444e-b2a0-d01ddbe065de","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.612101Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:520f39b06c8e920c3441b75bbe8108cf32b4f9fe58f7a6c70eb05fe143a7afe8","observation_id":"2b0eb0a3-fda8-4f6d-b918-df5934bfc2c2","resolution":{"observed_at":"2026-08-15T21:45:57.960032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.940477Z","title":"Q-learning decision transformer: Lever- aging dynamic programming for conditional sequence modelling in offline RL","venue":null,"work_id":"98284f09-8485-49a9-8db4-8600f231fa85","year":2023},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.616374Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:b132ef11da51aee8508ba9bd1c82b080a76a6701a7d24c15022184414485de94","observation_id":"bc6dcabf-305c-4f47-a233-877c2d51f59b","resolution":{"observed_at":"2026-08-15T21:45:57.945139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.621224Z","title":"Mopo: model-based offline policy optimization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.621224Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:889d7d2a176269b3e148e826535e121a003717e2f2b94b2d1450f79c77bf4319","observation_id":"f5e44b26-1a25-4dc2-8555-8daf95979b88","resolution":{"observed_at":"2026-08-15T21:45:57.621224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10393","last_updated":"2025-07-10T10:09:40Z","snapshot_observed_at":"2026-08-19T06:07:47.222168Z","submitted_at":"2024-04-16T08:48:46Z","title":"Offline Trajectory Optimization for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10393","snapshot_observed_at":"2026-08-15T21:45:57.625464Z","title":"Offline trajectory generalization for offline reinforcement learning.arXiv preprint arXiv:2404.10393, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.625464Z"},"links":{"cited_paper":"/paper/2404.10393","citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:367636ce7a1116491680a1ee3e4555f39abe18c54d8ba35b0c83bb957ccbdf3d","observation_id":"a66a1016-3a64-4027-8c4a-a5677185ffe1","resolution":{"observed_at":"2026-08-15T21:45:57.625464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.916898Z","title":"Online decision transformer","venue":null,"work_id":"82224add-ea85-463c-ba99-84ffd6a87b57","year":2022},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.630023Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:a295906a4643edcc3d3f78ecfb75eeac40345fbb39281752dc368809efc9b339","observation_id":"27117b51-9884-4b1c-9596-3d9ac30c2f32","resolution":{"observed_at":"2026-08-15T21:45:57.921419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.902355Z","title":"A boosting algorithm for estimating generalized propensity scores with continuous treatments.Journal of causal inference, 3(1):25–40, 2015","venue":null,"work_id":"d1be3d94-acce-418a-b59d-9cb5187241bb","year":2015},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.634564Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:237658f558919670e1a5031b3d4d65e8c341b1d9f614bf591ee95603f777d2f9","observation_id":"c874b844-8409-4b4b-b8d2-368e6a73cf04","resolution":{"observed_at":"2026-08-15T21:45:57.907281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.887068Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","venue":null,"work_id":"07a27185-8b6c-4681-be7a-2ac373ff667e","year":2024},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.638848Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:cd6d851e72efbccdb134406ca8d0795810d186e1df00d69feb248a2dd3470b5a","observation_id":"396a3fce-0880-40d8-8aff-9a97f9e207ea","resolution":{"observed_at":"2026-08-15T21:45:57.892018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5108.8109","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:45:57.739165Z","title":"Pearl-style231 counterfactual reasoning","venue":null,"work_id":"337f307d-78b4-4668-a126-d41a89433afc","year":null},"citing_paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:57.643423Z"},"links":{"citing_paper":"/paper/2505.09114"},"observation_digest":"sha256:30a1d48eaf29656d2348ba1fbecadf5449952022cfd5f1266b0e28e6c5eb3eab","observation_id":"58e902b8-989a-495f-8b13-a2bfbeac4b7d","resolution":{"observed_at":"2026-08-15T21:45:57.748566Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.09114","last_updated":"2025-05-14T03:45:16Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-20T18:05:35.196920Z","submitted_at":"2025-05-14T03:45:16Z","title":"Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2505.09114."}