{"as_of":"2026-08-15T16:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55de7e048e04e3e04ef6a4b1bc6fc06c4a60558b9a036f66b6fc63a2333e90e0","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:57:03.522756Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.20417/citation-record","integrity":"/paper/2506.20417/integrity","json":"/paper/2506.20417/citation-record.json","paper":"/paper/2506.20417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.713004Z","title":null,"venue":null,"work_id":"ec477cfe-7783-415b-a4e5-0701c1653abc","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.633395Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:0e97c773a151b32d9f977b52ea4f064f5bf0c8e99cd8958c53f793a02dd7118a","observation_id":"7a38e721-871f-43b6-ac90-ea2910f6d4af","resolution":{"observed_at":"2026-08-06T22:57:05.715618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.705483Z","title":null,"venue":null,"work_id":"38705356-9900-4409-9fc2-768630ddb308","year":2009},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.810272Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3249df0c6fe9a99f9abd591bfba85f1fc025c7c00fe586ef6fdc1c2ae62bfc45","observation_id":"1797a8df-eb06-4410-bcf8-af5ea3d3cdb3","resolution":{"observed_at":"2026-08-06T22:57:05.708002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.697115Z","title":null,"venue":null,"work_id":"bcbeaca6-ccac-4414-8227-2f0875fcd60c","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:57.989631Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:42d6c28a50747ec0f83a7a7c0314f3ce8892050c38c9e94ebf254331eb0dadb8","observation_id":"13450a5c-d853-4bc1-a57c-6fd0d29aa131","resolution":{"observed_at":"2026-08-06T22:57:05.699994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.689058Z","title":null,"venue":null,"work_id":"da114514-72ff-4d28-bd67-e974b04fc3ff","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.126029Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c05e7a09e0cda30edb12fec89333831c2479fecea63bff1408242c1329fa45a5","observation_id":"57a79dfb-ef3a-4307-a7af-b87352a9f1dd","resolution":{"observed_at":"2026-08-06T22:57:05.691760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15332","last_updated":"2024-12-20T09:20:16Z","snapshot_observed_at":"2026-08-12T23:59:02.416522Z","submitted_at":"2024-05-24T08:13:16Z","title":"Cross-Validated Off-Policy Evaluation","version":4},"cited_work":{"arxiv_id":"2405.15332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15332","snapshot_observed_at":"2026-08-06T22:57:04.120752Z","title":"Cross-Validated Off-Policy Evaluation","venue":"cs.LG","work_id":"5f8f3f18-2732-47ac-9860-eb9f07817d8f","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.295624Z"},"links":{"cited_paper":"/paper/2405.15332","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:90a7888cb382e2384cb0a82688648e94bb8af8d439695d0dda7776dab60a4d30","observation_id":"6920de63-2a90-485d-a252-e05d8850b738","resolution":{"observed_at":"2026-08-06T22:57:04.256505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.680811Z","title":null,"venue":null,"work_id":"e352cf42-270a-4705-8c61-275968ef638a","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.433736Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:37ebd08fdfc28e6f6cf64d4869e4964433b271093af3bd40f20a2d585aaf94c8","observation_id":"7d2039fa-6850-4858-8616-feca19337c44","resolution":{"observed_at":"2026-08-06T22:57:05.683711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:58.549891Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.549891Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:98071d4abf02390326363cabffa65a3caea2fddc3388a97356324d1a51e830fb","observation_id":"513edc90-41ba-450d-b7e3-dec5c407efdd","resolution":{"observed_at":"2026-08-06T22:56:58.549891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.667420Z","title":null,"venue":null,"work_id":"fcddbd61-a9b6-4791-b194-3e25f4c289bc","year":2011},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.713995Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:1ffa7416060df4cdaef03acc02e56232a9582047154bf29228dbdde419e08a0d","observation_id":"fffb9fdd-9ae7-42ee-a6d8-d00dd5341ef1","resolution":{"observed_at":"2026-08-06T22:57:05.670350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:58.832672Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.832672Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:02263fc76683dbebe4ad1f03b5ce0021181b1428a869a54028519aedf6d6db7b","observation_id":"1a8c6af5-dbbd-46b2-95d1-df8978b08d68","resolution":{"observed_at":"2026-08-06T22:56:58.832672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18022","last_updated":"2024-11-09T19:06:18Z","snapshot_observed_at":"2026-08-12T23:34:51.044900Z","submitted_at":"2024-06-26T02:34:48Z","title":"Automated Off-Policy Estimator Selection via Supervised Learning","version":2},"cited_work":{"arxiv_id":"2406.18022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18022","snapshot_observed_at":"2026-08-06T22:57:03.802338Z","title":"Automated Off-Policy Estimator Selection via Supervised Learning","venue":"cs.LG","work_id":"ce1ed56b-c69b-449e-a0d4-678353862acd","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:58.998267Z"},"links":{"cited_paper":"/paper/2406.18022","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:779f627fea43d5a13f47be2c54a1b246b4df1d78275dad28c750f207d1b67c3c","observation_id":"9eb99c06-21db-452b-a734-7f91be1bb0be","resolution":{"observed_at":"2026-08-06T22:57:03.921229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.125604Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.125604Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:e0e08e0693db61a036d0af35ed8ff5c6ee241b20403ba61b53709a6b7f59d3fc","observation_id":"e6fa3fcc-de25-4553-b9bc-7f9e48374958","resolution":{"observed_at":"2026-08-06T22:56:59.125604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.649350Z","title":null,"venue":null,"work_id":"c257ec9d-e859-4bc5-aaab-c8e14884bb1e","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.244227Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:9262a531652235c2279e5d6e5c533978e7dd0dffd1430722c4cd6b60cc8be933","observation_id":"8e463d8c-b6ca-4614-b687-f5b7ab8085f9","resolution":{"observed_at":"2026-08-06T22:57:05.652138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.515223Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.515223Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3c97ca6b3f972ed089bb1ffffa794e06d23a8d018e619c2ed1be7896c69c968d","observation_id":"3841481f-b8d6-4e40-85eb-14e1c123fd65","resolution":{"observed_at":"2026-08-06T22:56:59.515223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.627557Z","title":null,"venue":null,"work_id":"fa977c38-7807-4caf-8a5a-0457e7298547","year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.693597Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a5a8e0e344285b7b54f3b3799484414e9b9953813e7f4b9dbfa47dcd2eb6966e","observation_id":"ac7e9870-5179-4ffd-859e-8c4267110d56","resolution":{"observed_at":"2026-08-06T22:57:05.630603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:56:59.894459Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.894459Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:91f9ca42d0fa847d50fef1afa3a3b75bb5784810db4b9ce0b66f3308e936bd30","observation_id":"7e475c0c-da1f-4d98-a90d-7ec85f7f7701","resolution":{"observed_at":"2026-08-06T22:56:59.894459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.614274Z","title":null,"venue":null,"work_id":"a34a9510-cdab-4cdd-a6db-440331826115","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.090532Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:139553b6b53147343affb5f77740f2236af496e8bafe75ba6626a876484449b8","observation_id":"c0a246a2-f96b-4f77-9ec5-f1fbdb4325b1","resolution":{"observed_at":"2026-08-06T22:57:05.617187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.606419Z","title":null,"venue":null,"work_id":"22c457dd-5a51-453d-9ffc-738a2bb853e4","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.200325Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:51e88c2eee3016ed14b942f218978696f2940e40709e070235c7733d5cf8bfc2","observation_id":"65255918-bc4a-4142-9466-f406fce52be7","resolution":{"observed_at":"2026-08-06T22:57:05.608866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.598581Z","title":null,"venue":null,"work_id":"6aa80fad-5736-4f67-81fd-059c6e342450","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.320728Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:f48209268507c0acdbb9934b5ca55f4301dee39e70702e9f823975afc25c13a1","observation_id":"54d46434-14cd-4144-88c8-9f2254ef44ec","resolution":{"observed_at":"2026-08-06T22:57:05.601347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.475158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.475158Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d8b5924945158920df5b7da4f2e6190fcbf430cd1cdc30814d06aa0f85c3ab41","observation_id":"6d31b4b8-46b9-449e-89fb-b1aef7746119","resolution":{"observed_at":"2026-08-06T22:57:00.475158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.582426Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.582426Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:0f78485926d0422e408fa872eca4b6e29d1ce2812694fa7f46dddbda406b5426","observation_id":"7a7379a9-39fa-4113-bb56-7684bacfad56","resolution":{"observed_at":"2026-08-06T22:57:00.582426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:00.654383Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.654383Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d29cc3e00149e0d5483603b4c60cfee51783ba98eb74b9202cc7568c0fefe2e3","observation_id":"c94dddf8-91a3-4600-bad7-79d50a71ba34","resolution":{"observed_at":"2026-08-06T22:57:00.654383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.574974Z","title":null,"venue":null,"work_id":"8f6aa965-4d6a-48e4-99c8-14ddd37dc4ee","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.710113Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:e04d572e3c30a14b6764a5e2773c938b001805294ff640589ee62b40131c6460","observation_id":"245faf78-2d3e-4a15-bcbf-e643103507e9","resolution":{"observed_at":"2026-08-06T22:57:05.578009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T22:57:00.795708Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.795708Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:9b6181b47c763151c073d88fa2b8c6df5c0ad9e44e13be1e8da8d61f83c0c027","observation_id":"fc193ca9-8e19-49df-bb06-14df702d675a","resolution":{"observed_at":"2026-08-06T22:57:00.795708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01707","last_updated":"2025-01-03T23:17:28Z","snapshot_observed_at":"2026-08-13T16:30:09.932401Z","submitted_at":"2022-03-03T13:30:28Z","title":"Testing Stationarity and Change Point Detection in Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2203.01707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01707","snapshot_observed_at":"2026-08-06T22:57:03.568486Z","title":"Testing Stationarity and Change Point Detection in Reinforcement Learning","venue":"stat.ML","work_id":"0eb4fe3d-96aa-4b65-8a51-c51713627eb2","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.903644Z"},"links":{"cited_paper":"/paper/2203.01707","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:09295e70a3ec87116262c3e2883f34e437246354a31712a52988ebb9f42be98f","observation_id":"b046382f-2629-4764-824b-c02e8f13d550","resolution":{"observed_at":"2026-08-06T22:57:03.677587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11431","last_updated":"2023-04-26T22:49:15Z","snapshot_observed_at":"2026-08-13T13:16:52.311898Z","submitted_at":"2022-12-22T00:47:40Z","title":"Local Policy Improvement for Recommender Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11431","snapshot_observed_at":"2026-08-06T22:57:00.977506Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:00.977506Z"},"links":{"cited_paper":"/paper/2212.11431","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3e3a44053d18627fa369ed4adbba7fe414967e244aab16f981897bce2ea2ebc7","observation_id":"e8ec04c3-8ef5-42d4-bead-b231f39e9ca2","resolution":{"observed_at":"2026-08-06T22:57:00.977506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.092625Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.092625Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d3e26a757ee95c904c1b258d52349837ce78cd22222fedd7f6b49066c26c386d","observation_id":"f1da69d0-e516-4dec-ab2d-276f32c8fd83","resolution":{"observed_at":"2026-08-06T22:57:01.092625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.560420Z","title":null,"venue":null,"work_id":"ceff7c08-a5d0-4dc5-b4f8-00d8980f9a28","year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.172573Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a32c9d0224b43c80b9b2a7e469f014d240f439114423e206016f9e30bd2223ed","observation_id":"1cf3c544-0743-4307-8f1d-364003c8273b","resolution":{"observed_at":"2026-08-06T22:57:05.563972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.246452Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.246452Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a059d90e44cbc00021b7cd3b66c0d174f24915b1c0f505cdbedb6090020cd0e1","observation_id":"5ef6d503-7703-49ab-9b8a-fad721dba071","resolution":{"observed_at":"2026-08-06T22:57:01.246452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.314297Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.314297Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:0dc713f747dd61699658969f94ba3948eac794d321086b82017efdd7a46c6e97","observation_id":"2155d7b1-120e-4279-a21e-1dd69aa3f505","resolution":{"observed_at":"2026-08-06T22:57:01.314297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.541973Z","title":null,"venue":null,"work_id":"5f42a283-b616-4395-a0e9-96d2dde53a35","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.391181Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:2ca6b50f6afb6764beae92309763cabbad1ee21611c7d1c02da5be78ab05c0b0","observation_id":"71f424e0-70fe-42fb-a7ae-4fd0ddfae6e3","resolution":{"observed_at":"2026-08-06T22:57:05.544804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.533739Z","title":null,"venue":null,"work_id":"3ddc8ac7-5b49-4676-aecd-5d0abe808953","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.453082Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:b8a95a448eaec8380c9e53f8a1765703e25d54b0fe38fc0ad0d569fc74cbaa98","observation_id":"30070b5a-40fa-4438-aaaa-51c7456a865d","resolution":{"observed_at":"2026-08-06T22:57:05.536544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.543532Z","title":"Sutton, and Satinder P","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.543532Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:453c6a2af171dc0365a6999022f3d812ab1ae638217be55c23d7d5897523a8e8","observation_id":"a4564b96-805a-4ca4-bd8f-b7d8cec09bd9","resolution":{"observed_at":"2026-08-06T22:57:01.543532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.520215Z","title":"inverse probability","venue":null,"work_id":"a8c045ed-e1c5-4b0a-a173-cfe96d4086d3","year":2007},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.638449Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:6ddd0ee3f4f5ee63b00fd972f395e3315cfa97fbdc56bf5df57c55b5c047d155","observation_id":"d91747d7-f820-4545-9302-9b501ccaf606","resolution":{"observed_at":"2026-08-06T22:57:05.523544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.721600Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.721600Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:709e4555d35dbfa672b32303e3bd61f9f96d22cccd1e63999b726abd5182ad73","observation_id":"653475e5-b502-4992-9590-b8f810e18c13","resolution":{"observed_at":"2026-08-06T22:57:01.721600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.791366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.791366Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:877d2f9452a9dc57d3cecea786994cebdd3d092dd02cd48523020e41729c9eb8","observation_id":"d6bf71bf-de55-46d4-8072-044ee656579a","resolution":{"observed_at":"2026-08-06T22:57:01.791366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.912242Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.912242Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:7922c8dc0da958f36c3e77e069261db0fd9c519762bf578664455b591abb4197","observation_id":"1ab34c7c-65a1-4ab6-8b5c-52264937b0ee","resolution":{"observed_at":"2026-08-06T22:57:01.912242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:01.997347Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.997347Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:cc5f8e360b92ce0b41001d5f9cef83f2183b4aa0c553fe8c21df1d57b623f5e3","observation_id":"05d63646-3ca7-4843-bac6-c9bc9fefe076","resolution":{"observed_at":"2026-08-06T22:57:01.997347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.082541Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.082541Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a177493975a00a7c1fa4e38840de405d7c7913d6c81d1f994394de75e285b3d8","observation_id":"f4a368c6-48b0-4142-a0f7-906dda4579ec","resolution":{"observed_at":"2026-08-06T22:57:02.082541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.145542Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.145542Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:400a2d921864400188ae173536358e6930714830f241b1e03eed9193ec7651c4","observation_id":"8949826d-6691-4fe8-8980-95a1136c89b5","resolution":{"observed_at":"2026-08-06T22:57:02.145542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.471823Z","title":null,"venue":null,"work_id":"7b41bb27-21e0-46d3-b7ae-5d5c120706fa","year":2023},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.273232Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:d88ff0108275fbc562dfab487a22f890116cf6054af91e20db464a3d3c30ad34","observation_id":"fe2e02e4-cb91-4ed3-ba53-303543d61207","resolution":{"observed_at":"2026-08-06T22:57:05.475414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06151","last_updated":"2024-02-09T03:01:13Z","snapshot_observed_at":"2026-08-13T04:22:53.035277Z","submitted_at":"2024-02-09T03:01:13Z","title":"POTEC: Off-Policy Learning for Large Action Spaces via Two-Stage Policy Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06151","snapshot_observed_at":"2026-08-06T22:57:02.351653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.351653Z"},"links":{"cited_paper":"/paper/2402.06151","citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:85f7ecd374fc2e6ac8476849efdd1ab5bcf965f95f27fe51303f2dcd5ffffcc0","observation_id":"a92756f7-96e3-4e62-83da-710d9825610c","resolution":{"observed_at":"2026-08-06T22:57:02.351653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.461807Z","title":null,"venue":null,"work_id":"7158096f-dd87-4f93-85a3-322fe3b8a342","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.413584Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:655c0909c20648ace67a481ec6b3f690f78ed88c8d93738f43390a61f4377127","observation_id":"ad851038-0e81-41bc-9dc3-bc6a6024aafc","resolution":{"observed_at":"2026-08-06T22:57:05.466278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.498869Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.498869Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:42739c9f8ee411b197c36b68508ee0097147a9c4df3afeabdbbca1c4cda8d586","observation_id":"a1b2ba21-75bc-4f9f-aa35-ba428afdb874","resolution":{"observed_at":"2026-08-06T22:57:02.498869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.448341Z","title":null,"venue":null,"work_id":"a8362a04-9581-495d-92fa-dc6ad3e3c71b","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.574009Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:c7b3ccc552e0c85a37155c81335b48490cb7d03b30815241d8f5c93e02b533cc","observation_id":"bc435e51-f6c6-4561-b086-0e7b2d5c8b35","resolution":{"observed_at":"2026-08-06T22:57:05.450909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.707484Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.707484Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:5dd4d80d85bd7bd9bd91660306fe877054efae9c821e92d05f602d72602f2b36","observation_id":"188fabf3-9293-4ece-8719-9a41ad25a02f","resolution":{"observed_at":"2026-08-06T22:57:02.707484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:02.777345Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.777345Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:040a3ccaf9701f71919e7a9cbcd2c511bf39d76b1c7758a47241b9dc84f55892","observation_id":"577d14ae-95f2-4160-bec8-ccca0ace4820","resolution":{"observed_at":"2026-08-06T22:57:02.777345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.429231Z","title":null,"venue":null,"work_id":"21919e8e-664f-4251-be58-28102336aee0","year":2016},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.876364Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:8f328b4ad9f83b7b29a1c074159ae92db3c33a59a1dce2bf17907140b73905a5","observation_id":"1ffecbbf-d644-436d-b68f-2369436c1f23","resolution":{"observed_at":"2026-08-06T22:57:05.432061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.420328Z","title":null,"venue":null,"work_id":"f6dd7da7-7841-4afa-8898-28a6e2d3c768","year":2017},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:02.943163Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:1fd320324363974339d63d29913a509063af934169c3eab793d90075d92f67eb","observation_id":"c1d47038-761e-4d1d-b19d-e2af3d0908ec","resolution":{"observed_at":"2026-08-06T22:57:05.423259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.410847Z","title":null,"venue":null,"work_id":"9095d493-1968-46b3-a415-2534d801c884","year":2021},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.016528Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3603f90752305054af1a4b226dfb7437b1035f55a66750e88b340ddcabdc7cb3","observation_id":"76418d30-3e10-43dd-b951-133556f01d89","resolution":{"observed_at":"2026-08-06T22:57:05.414813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.402468Z","title":null,"venue":null,"work_id":"63947aa3-49e8-4ae9-b6c1-b8fc8f5a61ff","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.094153Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3ba523f80b1cc77aff7ebeb480da379ec49ec41918538e77409b89c9b271a0d4","observation_id":"f974a6ae-0a21-4d3c-974a-75461d65131f","resolution":{"observed_at":"2026-08-06T22:57:05.405166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.921060Z","title":null,"venue":null,"work_id":"c12b6216-aaa8-49b7-9ffa-2e7febe00dea","year":2020},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.270347Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:802499d73ec4d561f138a0fa75aadbac31fe4bc972f48b6089bc7b30084ac508","observation_id":"ff9a95c1-5dc3-4de2-8bf9-9c4e0951a7ed","resolution":{"observed_at":"2026-08-06T22:57:05.017822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:03.346359Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.346359Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:b425e5e01555b0298b0d72bc0b2f930033e6e768e1827041c06b70e5b55ec3a8","observation_id":"73effc61-ca3a-4722-bae5-7dc6feee567e","resolution":{"observed_at":"2026-08-06T22:57:03.346359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.623294Z","title":"\" Is it applicable to abrupt non-stationarity?","venue":null,"work_id":"b7b83b31-baf8-4348-b450-a91379ac993f","year":2022},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.428079Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:3e21e44a430ac7b844fc2c81a5ce856138f6826877f5f04d8a6c3dc15700d57d","observation_id":"6fed49a8-a581-48e0-ae14-5e6575a8e5d4","resolution":{"observed_at":"2026-08-06T22:57:04.754232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:04.400336Z","title":null,"venue":null,"work_id":"2500519a-5bfd-4594-b291-88a3f7c84735","year":2025},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.522756Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:6cc94bc5dc630d35ebfe3e620bb19911f32f6072fcf5cf8e4852ced796814b83","observation_id":"71747ba9-66b0-4b09-a5fe-9f64daf8d7ea","resolution":{"observed_at":"2026-08-06T22:57:04.553602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.640739Z","title":"InInternational Conference on Artificial Intelligence and Statistics","venue":null,"work_id":"fa83a346-0bed-4ab3-a4b6-21ac4b42075e","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T22:56:59.382834Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:a22e69420d2a06ffe926c0bc372a847e6cdf2b43b86980c9c85bc45f00cff2e7","observation_id":"f670b0fb-7e4f-449b-bbd4-b098449d78c5","resolution":{"observed_at":"2026-08-06T22:57:05.643855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.150026Z","title":"InProceed- ings of the AAAI Conference on Artificial Intelligence, Vol","venue":null,"work_id":"7b9e3702-78dd-427c-b8ef-91bcca3f5e70","year":null},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:03.177109Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:5c820eab873483ac236feeca671d33856666d9ac032f2390785bebb204dcd8af","observation_id":"a782623a-5343-4a44-b302-1a49613acc72","resolution":{"observed_at":"2026-08-06T22:57:05.271540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:57:05.501585Z","title":"In Proceedings of the ACM on Web Conference 2024","venue":null,"work_id":"795b30a5-6494-4901-ac2e-028938364f75","year":2024},"citing_paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:01.838358Z"},"links":{"citing_paper":"/paper/2506.20417"},"observation_digest":"sha256:762846cc1fc2838275d0e3b639a9397773c6e021018a667dd9c94a2d07e5acc3","observation_id":"760a0fa8-59c9-40f1-bc5c-b6a9b5c8ab94","resolution":{"observed_at":"2026-08-06T22:57:05.504191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.20417","last_updated":"2025-06-25T13:31:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T13:17:46.603988Z","submitted_at":"2025-06-25T13:31:46Z","title":"Off-Policy Evaluation and Learning for the Future under Non-Stationarity"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2506.20417."}