{"as_of":"2026-08-14T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:40cb2065b4eb78e22ba5464c7d5a2abca56a58ba1900c9dee7d9503eb3b5f9eb","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:51:17.118027Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:02:48.665612Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:06:15.410216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"cited_work":{"arxiv_id":"2506.07140","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07140","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1269c04b-42ff-4273-a6fd-c9262a21b7ca","year":2017},"citing_paper":{"arxiv_id":"2605.09257","last_updated":"2026-05-10T01:51:31Z","snapshot_observed_at":"2026-08-02T20:41:00.898458Z","submitted_at":"2026-05-10T01:51:31Z","title":"Regularity, Phase Transitions, and Uniform Inference for Proximal Counterfactual Quantile Processes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T02:02:48.665612Z"},"links":{"cited_paper":"/paper/2506.07140","citing_paper":"/paper/2605.09257"},"observation_digest":"sha256:e440c678fc7abbcddbbe4eceff94b21f7f14ab1f4e5c02f3b32989300ef6aca2","observation_id":"37653c6b-fdfb-4c59-9efa-b6b8e24d0322","resolution":{"observed_at":"2026-05-12T02:06:15.411610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07140/citation-record","integrity":"/paper/2506.07140/integrity","json":"/paper/2506.07140/citation-record.json","paper":"/paper/2506.07140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:16.740209Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.740209Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:356bbaff493b265c8c8a7bd2abbf1f4cc8ef05ac5fc669d1f626d59064c6849d","observation_id":"e43ef8d8-78c9-4505-aa12-3b365f109743","resolution":{"observed_at":"2026-08-07T05:51:16.740209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.518443Z","title":"write newline","venue":null,"work_id":"57281f2c-1b50-454b-80f9-d26041e31084","year":null},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.746624Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d1469efbb7dee8065151f518329cfdc5d3801802168be4c55f2b0284163d5d86","observation_id":"0c655088-b405-41d2-a98e-a72645514d4f","resolution":{"observed_at":"2026-08-07T05:51:18.524389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.491561Z","title":", Angrist, J","venue":null,"work_id":"8b02cc1b-4c87-4211-aa40-91e2aab51eb3","year":2002},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.755622Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8392e8952ffda9de15528e3ca1900533c020cc8546224935ef2dbe172c34908e","observation_id":"fffd8a54-763e-4cce-a690-a032516c9b89","resolution":{"observed_at":"2026-08-07T05:51:18.497368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.471657Z","title":"and Chen, X","venue":null,"work_id":"978a340a-e69e-48dd-9255-57c60db0f4a1","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.762672Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:4e0d590780706965b11a2055e7876ef050b7084f091402cbeeeaa7e52015241a","observation_id":"8869a0cf-c647-46c0-838a-0df477497bd0","resolution":{"observed_at":"2026-08-07T05:51:18.477417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.451900Z","title":"and Chen, X","venue":null,"work_id":"f6c15b34-4fc2-4fef-b37e-26ab16f2af87","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.768740Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:5d6e66511b8b4e18fed429198317caa053436af26b5571b027e69213c493c8e7","observation_id":"1839a281-0a9c-44df-96bb-eca0c3cb6527","resolution":{"observed_at":"2026-08-07T05:51:18.457828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.430477Z","title":null,"venue":null,"work_id":"cda17919-e5c5-4f09-83fe-ed666ff00d16","year":1996},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.774644Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:4d669788bd9e2f3fa8df57e4a30ccb0ae74d3c9ed2ac3be3f95136b9ef5368e0","observation_id":"cab3b94c-54ca-4d57-bab0-8357f6e11aa2","resolution":{"observed_at":"2026-08-07T05:51:18.437199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.408611Z","title":", Cheng, J","venue":null,"work_id":"28b13bc2-b063-49a0-89b7-b12fd8a73ee5","year":2014},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.780007Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d11b6e7e32ebfd69ce07b8ea8185e85cb1ee647b8d6bf1c7e74703603183a13a","observation_id":"6db69a2c-5936-429f-9444-c5f983d7b298","resolution":{"observed_at":"2026-08-07T05:51:18.416783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06799","last_updated":"2020-11-29T05:58:30Z","snapshot_observed_at":"2026-08-13T15:36:54.206118Z","submitted_at":"2020-09-15T00:18:34Z","title":"The Importance of Pessimism in Fixed-Dataset Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06799","snapshot_observed_at":"2026-08-07T05:51:16.785857Z","title":", Gelada, C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.785857Z"},"links":{"cited_paper":"/paper/2009.06799","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:736a30b5fd823369eed99d8c98fa8e1adaf355509b9ec3b57388690a3d36fc10","observation_id":"e01cbdfc-7f12-4fc1-af45-611365c03802","resolution":{"observed_at":"2026-08-07T05:51:16.785857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.387703Z","title":", Mannor, S","venue":null,"work_id":"22b2af79-366e-4bb6-978f-e28ee8768cb5","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.792519Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b04c1eb6814d8560fdbb952a232c0c3369e1268afacfebc602715bed4442f983","observation_id":"f87c0544-051a-444b-8efc-346af51fb5e3","resolution":{"observed_at":"2026-08-07T05:51:18.393771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.369608Z","title":null,"venue":null,"work_id":"bba6b158-b60d-4bfb-b8a1-020527a278f7","year":1992},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.797750Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:38bd8c0048a18ccb6a5c435284f8a898de563f436faafaaeb9d1ad8e1dd4c565","observation_id":"cb5ccfa0-b6e6-46c9-8c19-d1154cce134b","resolution":{"observed_at":"2026-08-07T05:51:18.374970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11187","last_updated":"2023-03-20T15:17:31Z","snapshot_observed_at":"2026-08-13T12:20:40.762852Z","submitted_at":"2023-03-20T15:17:31Z","title":"A Unified Framework of Policy Learning for Contextual Bandit with Confounding Bias and Missing Observations","version":1},"cited_work":{"arxiv_id":"2303.11187","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11187","snapshot_observed_at":"2026-08-07T05:51:17.388639Z","title":"A Unified Framework of Policy Learning for Contextual Bandit with Confounding Bias and Missing Observations","venue":"cs.LG","work_id":"990b5795-c7aa-4982-b712-d051926651f9","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.803341Z"},"links":{"cited_paper":"/paper/2303.11187","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:21a553237aeb15254913dacb3b3bccd813f35cd922be95407b1fa3ea09dc73e0","observation_id":"7f803d79-cad1-4edd-b9fe-82957dcc1991","resolution":{"observed_at":"2026-08-07T05:51:17.395290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.352441Z","title":", Chernozhukov, V","venue":null,"work_id":"cd148a95-5b9f-4b6c-8b32-83a0887ea440","year":2014},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.808963Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8c36d1941da1895272d9886efb56df19282df6bf172a3f43177da096346005c5","observation_id":"c9364c13-5c72-44dd-8ab8-81d351f62c1e","resolution":{"observed_at":"2026-08-07T05:51:18.357854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.333351Z","title":", Linton, O","venue":null,"work_id":"8ae195c8-f939-44ca-b0f6-f6f81ed10b8b","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.814576Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:37a95243c6d3ddbb55e33e646d18f96bfa2803016e7fc6e0f12fad6e61c9359c","observation_id":"366acb26-fb4b-4a09-bbaf-54e43754c498","resolution":{"observed_at":"2026-08-07T05:51:18.339395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.312594Z","title":"and Pouzo, D","venue":null,"work_id":"101b083c-9195-465a-96da-03acf36b76d0","year":2009},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.820283Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7fba7d1f4870589e4038d0bda4f9a5ac2a70dfeaeff88b1685db4e3e62a8b34c","observation_id":"ee6575db-12ff-49e8-8947-bb194833b396","resolution":{"observed_at":"2026-08-07T05:51:18.318310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.293551Z","title":"and Pouzo, D","venue":null,"work_id":"3ffc2c69-4234-4cdd-83e5-61c59ac6e8cf","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.825416Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:49542316d46cf4ec44ee53aa2237fb279e4bb5d55af7e523bfe0c78daf5849a8","observation_id":"88926071-d22c-411b-854d-970681221b71","resolution":{"observed_at":"2026-08-07T05:51:18.300303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.274080Z","title":"and Pouzo, D","venue":null,"work_id":"b8af8828-fde5-49d8-8bd2-ba3dca1fd5b1","year":2015},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.830976Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:88350acde6ef36b0414c8342c5a617d65458800399da019d8b545ba533e7b365","observation_id":"04ccebed-557a-40ea-a1a6-67053b2cad86","resolution":{"observed_at":"2026-08-07T05:51:18.279914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.256700Z","title":"and Hansen, C","venue":null,"work_id":"e7162b63-5deb-4d6b-ba9c-78afa090abfd","year":2005},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.836761Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:73619107e566a9d25ffe91c4184a1f2aa1a4c6625083a5eaa030bf27ef0567d3","observation_id":"04f8c4a3-5d5b-463b-b3ca-417a0ac17dfd","resolution":{"observed_at":"2026-08-07T05:51:18.262221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.238792Z","title":"and Hansen, C","venue":null,"work_id":"0ab3bd8b-5cc7-41fe-8915-57ab1d0e99e8","year":2008},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.842100Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e30f783723c90d45112302496e8208d512b7663f15e487a5a88369365502d892","observation_id":"ba8a9208-fb2f-4778-997c-bf41b4541005","resolution":{"observed_at":"2026-08-07T05:51:18.244543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.219632Z","title":null,"venue":null,"work_id":"75cb3c2d-5652-46de-9119-1d2fd27edc7f","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.847693Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1d113ae4fc84410caf429224dd4c52f9cb3382b6f66ab68a98594f0614cac668","observation_id":"f8d422a6-a91e-45b9-af35-73894ad6f5e2","resolution":{"observed_at":"2026-08-07T05:51:18.225134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.198545Z","title":", Lewis, G","venue":null,"work_id":"6f767013-5131-4597-81fb-7b390b3d1bee","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.854063Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:47bdf614eee1b3ae1187bdef2a225f0efdbc9097a28e4a88abd92f0c6f2433ae","observation_id":"9c3076b9-2b3e-4e4c-91a4-a05bb582a5ac","resolution":{"observed_at":"2026-08-07T05:51:18.205455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.180512Z","title":null,"venue":null,"work_id":"2446c573-2207-4cc4-af6a-4e574ac9d677","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.859323Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:46ba2fa64c5ce028ec8267ae17f815737ee9665ede5bbdd0a937a21f4757b90c","observation_id":"1ea87cef-ba75-4daf-a2a1-baa9a2e6f8e9","resolution":{"observed_at":"2026-08-07T05:51:18.186175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.160078Z","title":"and Blake, D","venue":null,"work_id":"6e5febc4-ee87-44cb-87cf-b3869f357f19","year":2006},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.864599Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:5ac335d050b549d2d7cb452ee1e2e69646896598ef4d6f47d210302bf64d30cd","observation_id":"73541d60-a410-4729-b476-0962632f61da","resolution":{"observed_at":"2026-08-07T05:51:18.167542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.141223Z","title":null,"venue":null,"work_id":"ba34dccd-99e1-4238-9a8c-6f54d1c63279","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.869625Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2fb861d6547eaafafb42042fc4b7f35f53d3c02c4b0bc25c55e834be224a8a10","observation_id":"fbb1d2d8-3f4b-4a9b-b20d-ccf06397ccfe","resolution":{"observed_at":"2026-08-07T05:51:18.146763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.122169Z","title":"and Scaillet, O","venue":null,"work_id":"a4d68bae-42de-4e1f-b93d-5f43d1a83049","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.875102Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:c2ebaceeb64ee058c27f29a8d48008f3ef2737eddf2401525fcd45e052da22da","observation_id":"a99c8a00-c4c7-4961-83ba-c44981b154df","resolution":{"observed_at":"2026-08-07T05:51:18.127915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.104065Z","title":", Lewis, G","venue":null,"work_id":"36310a5f-8c97-4d29-a7d3-f71b8b76fe81","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.880386Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:08b9086031a2d7c2d7a837b406889ec6546c5fe6ff4491fbca696a1c863c84c6","observation_id":"d92d8e66-bcfa-41e9-aedb-405d52d09af2","resolution":{"observed_at":"2026-08-07T05:51:18.109662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.085957Z","title":null,"venue":null,"work_id":"ba42fbeb-0667-4199-989e-09049921a059","year":2016},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.885577Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:412ac618741f994c5bfad48ff4b8a8a634b5b92dea3871e2888f661764406bbd","observation_id":"7c515e51-1ef4-444b-959a-da983404c304","resolution":{"observed_at":"2026-08-07T05:51:18.091487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.067539Z","title":null,"venue":null,"work_id":"5399a290-9cb6-4b8c-9b70-711e625c4752","year":2007},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.890781Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2eb5d0310458cf90025a07c0ad036da9f3f88a8d454671a44796641a79c05a0e","observation_id":"5086773d-8baf-4608-9472-09383957f247","resolution":{"observed_at":"2026-08-07T05:51:18.073210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.06892","last_updated":"2020-02-01T04:58:57Z","snapshot_observed_at":"2026-08-07T06:14:35.067533Z","submitted_at":"2020-01-19T19:58:43Z","title":"Sharp Rate of Convergence for Deep Neural Network Classifiers under the Teacher-Student Setting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.06892","snapshot_observed_at":"2026-08-07T05:51:16.895896Z","title":", Shang, Z","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.895896Z"},"links":{"cited_paper":"/paper/2001.06892","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:aa0695f187de1995ac3e837e2fc59bd2f33d4dd1233bf120b9f970592ab88702","observation_id":"fd8ab0ad-65b4-4e64-b2b5-361db9b093f0","resolution":{"observed_at":"2026-08-07T05:51:16.895896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.049893Z","title":", Yang, Z","venue":null,"work_id":"bf1027cc-7340-47af-8a89-8b5703f859c9","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.901484Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:43dcfa078bc63ff89554a39f6357a8c43952397afd6588ca68bfdb1bed145f8c","observation_id":"058d10b6-80b6-4195-950e-e45671e9bed3","resolution":{"observed_at":"2026-08-07T05:51:18.055260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14029","last_updated":"2022-10-09T07:31:03Z","snapshot_observed_at":"2026-07-06T10:53:28.085825Z","submitted_at":"2021-03-25T17:59:19Z","title":"Causal Inference Under Unmeasured Confounding With Negative Controls: A Minimax Learning Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14029","snapshot_observed_at":"2026-08-07T05:51:16.906667Z","title":", Mao, X","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.906667Z"},"links":{"cited_paper":"/paper/2103.14029","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:ca95a63657fa3e1001d4ecaf105255c556de8fe45467bd2ba30b58bae8899dc5","observation_id":"7421a8ff-184a-4c54-9447-f0d65dd299c0","resolution":{"observed_at":"2026-08-07T05:51:16.906667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.031836Z","title":", Rajeswaran, A","venue":null,"work_id":"1c6a1f2a-a72b-4be3-b6b8-6b554c85d0fd","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.912761Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2baf044800b6d8e464f6f9bde0d24b857018cc633b6333bb30ebcd3db1a19f20","observation_id":"2da34668-e462-4271-be47-0fdd4a03f570","resolution":{"observed_at":"2026-08-07T05:51:18.037229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:18.012211Z","title":", Zhou, A","venue":null,"work_id":"e842a1dd-b675-471f-bc7c-b6a15bedd145","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.917830Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e64e4cda19d43666309369e189f2a0deba2395ec9de959639389408d503d6b1d","observation_id":"ee794ef3-3879-4480-90cb-a63c624f42f3","resolution":{"observed_at":"2026-08-07T05:51:18.018282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.992177Z","title":null,"venue":null,"work_id":"65b9baec-6c8e-4fd1-a1dd-470bcf45f2eb","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.923155Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:316db3f631beb43a2af657205e2b692b947b482840df0d5bc54e43355e272211","observation_id":"24fc6148-6f9c-4fe2-bb43-36d15a18f894","resolution":{"observed_at":"2026-08-07T05:51:17.998704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.973181Z","title":", Jeon, W","venue":null,"work_id":"163ced71-2117-43f7-b929-934e243403ed","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.928244Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:3fa421b484401a804655cd5aa80724c81e684c11819f89cf74d01bb6386eefeb","observation_id":"8ae07b01-6e43-449e-9d3a-966b73059bab","resolution":{"observed_at":"2026-08-07T05:51:17.978766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.955881Z","title":null,"venue":null,"work_id":"e51b5056-0593-43c5-b9a7-edaf7f5020cd","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.933536Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:1c8311c5664ea9c39d96f7437be8750a4830304eb7c4d9ac94cbfcf1e425fbfa","observation_id":"cc22c84f-1bf6-4b20-9f20-5c562b75fb22","resolution":{"observed_at":"2026-08-07T05:51:17.961198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-07T05:51:16.940185Z","title":", Kumar, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.940185Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:129f52e0a51977fde1ed626b6a56119801d4d08420211f587393c926d73a6a7f","observation_id":"3fdf0eea-fb9b-4230-9e24-3420629a2527","resolution":{"observed_at":"2026-08-07T05:51:16.940185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.934758Z","title":null,"venue":null,"work_id":"0c6273ff-d579-4c55-9f74-d85f4c6e2d78","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.946354Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:fc6b973947fe7d270a1579c07280b351a31f7c4c9991bbdd296d6d0da189f6b5","observation_id":"f2d2bbd4-d4de-403d-b00c-68f4a6482941","resolution":{"observed_at":"2026-08-07T05:51:17.942709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.915532Z","title":", Chu, W","venue":null,"work_id":"e04834b7-d2f2-4f68-bc70-0c6d9ff213bf","year":2012},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.951505Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:2e69209603a1ff8ab22129a0999fb10425b474f847d295142700753911e71594","observation_id":"69037bf8-ce07-4f3b-ab22-6aafa1916248","resolution":{"observed_at":"2026-08-07T05:51:17.921204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.897214Z","title":null,"venue":null,"work_id":"4571b8ec-6301-4c1a-8b1c-96738cdcf365","year":2017},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.956603Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a07a8dbc76beb2555553ce4ba9713a0a64191c58dac330b8f9f332d766dc550c","observation_id":"03546536-f045-414f-9783-6d93b4edb1bb","resolution":{"observed_at":"2026-08-07T05:51:17.902850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.878438Z","title":", Tchetgen, E","venue":null,"work_id":"29f8f1e5-79ed-4f5b-9a8b-da7d805542e2","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.961747Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7d928531d92f12be1bfb6558d3ca857c2a2f898e896eb0bd70f781468f3b6219","observation_id":"2a8bdf9e-e309-4f43-963e-92864b686a28","resolution":{"observed_at":"2026-08-07T05:51:17.884036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.860823Z","title":", Ding, L","venue":null,"work_id":"c3eb5bac-aaa7-4764-b497-2f3b004117fd","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.966667Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b9cd0bec176dad2a80b1e2871b796245bf06af3b02d2f6b161741ecac886d549","observation_id":"28d7138a-476a-4384-873e-6addef48ad0e","resolution":{"observed_at":"2026-08-07T05:51:17.866293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.841623Z","title":", Chen, Z","venue":null,"work_id":"245848f2-f8d5-4f7f-8321-f356c624ad5e","year":2024},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.971939Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:7452c457e7fb0a7c23cca251af097a2d89ad70fc704d07381122514ebefedbb9","observation_id":"2da4b452-5a18-4915-b71f-8bcb2f73c6b3","resolution":{"observed_at":"2026-08-07T05:51:17.847818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13589","last_updated":"2024-04-01T04:49:15Z","snapshot_observed_at":"2026-08-13T15:35:46.587410Z","submitted_at":"2022-05-26T19:13:55Z","title":"Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes","version":3},"cited_work":{"arxiv_id":"2205.13589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.13589","snapshot_observed_at":"2026-08-07T05:51:17.302596Z","title":"Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes","venue":"cs.LG","work_id":"6df38efd-b98f-4e96-bbd7-5932b0a08863","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.976996Z"},"links":{"cited_paper":"/paper/2205.13589","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:42657f1a5e5e2aa15e4a16ba5084e356070ae18d3f3dfb59b6da15c668de974e","observation_id":"b328ad02-32ce-4bd7-9c48-2608fc63ea58","resolution":{"observed_at":"2026-08-07T05:51:17.309010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.818418Z","title":", Giguere, S","venue":null,"work_id":"0e8af91b-6a34-4a8f-afea-86dd99b376d7","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.982280Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:8f08abe617d4aea89ef71aa6d872a624be5bd136fefd5a4359c6771b45dda104","observation_id":"d3af1a60-e1b2-45d5-a3c7-86b6bbd3c750","resolution":{"observed_at":"2026-08-07T05:51:17.825411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12670","last_updated":"2023-02-24T14:50:47Z","snapshot_observed_at":"2026-08-14T16:35:14.503541Z","submitted_at":"2023-02-24T14:50:47Z","title":"Personalized Pricing with Invalid Instrumental Variables: Identification, Estimation, and Policy Learning","version":1},"cited_work":{"arxiv_id":"2302.12670","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.12670","snapshot_observed_at":"2026-08-07T05:51:17.275462Z","title":"Personalized Pricing with Invalid Instrumental Variables: Identification, Estimation, and Policy Learning","venue":"stat.ME","work_id":"fa33cc3c-aa4c-4cc7-9a5d-8be50aa3b9a5","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.987229Z"},"links":{"cited_paper":"/paper/2302.12670","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:19b0f6a2d56197a15801f16152102663792245600d1b2b4bbbbad8bfa0af70b1","observation_id":"c38bc1ff-9686-4a63-8025-a748a21bf3d3","resolution":{"observed_at":"2026-08-07T05:51:17.282072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.797419Z","title":", Geng, Z","venue":null,"work_id":"76a9127f-8cbf-413b-8595-a112ed6ef279","year":2018},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.992428Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:cf027519db97e877450ada5d3ddf534686b6fc989244a7526b3fcc0e254dac6a","observation_id":"74137254-38aa-4334-91b1-411203cc2088","resolution":{"observed_at":"2026-08-07T05:51:17.803865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.775482Z","title":null,"venue":null,"work_id":"dc1a4f39-ca47-4894-8557-0aca26c3f520","year":2003},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:16.997139Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:51a354124355352f97976cfe2f385bc0912964f5c3e844fa4726b8e164640ee2","observation_id":"02a46e5d-0a6e-4ebd-aaa5-ab624ba9e57c","resolution":{"observed_at":"2026-08-07T05:51:17.781889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.756405Z","title":null,"venue":null,"work_id":"046b5b76-758e-4f34-a121-e081a09569e8","year":1995},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.002334Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d8239d23f7f344d24462ca23f313af2b6b03fe6f35efd38a1e1a95d3bfdb67af","observation_id":"9ff314fa-6074-4e63-80b4-4f0d55bd79c9","resolution":{"observed_at":"2026-08-07T05:51:17.761931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.737018Z","title":", Jagannathan, K","venue":null,"work_id":"1f7a6340-c1dc-4eba-aca1-8f3fe15a0b07","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.008135Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:e0212b3079b5d27fe6ff55508ef09727c255d11b063011c4c8f65cdec02d460b","observation_id":"76758fb6-eddf-4bee-aac8-5d171933d4b0","resolution":{"observed_at":"2026-08-07T05:51:17.742655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.715455Z","title":null,"venue":null,"work_id":"c88b3af5-0880-4228-b086-7cb12e4770a7","year":2023},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.013078Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:dc1609eaeb1abbef21303d20708abe2c4cbfeeeb40112dc0d7e6fdda09a5bc5f","observation_id":"d2ce39d1-40c2-4fd9-b839-4e5107989ace","resolution":{"observed_at":"2026-08-07T05:51:17.723023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.695589Z","title":", Zhu, B","venue":null,"work_id":"85121887-ff7f-4671-a272-9d4f5a4a7fe0","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.018375Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:f4ede28b019a5d59d682f972aa1758391ab5f37ccdfc84b2f7d339b64eee7041","observation_id":"814bafd3-eb96-4692-aedd-209d686bd653","resolution":{"observed_at":"2026-08-07T05:51:17.701676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00716","last_updated":"2022-11-01T19:28:48Z","snapshot_observed_at":"2026-08-13T22:32:09.324756Z","submitted_at":"2022-11-01T19:28:48Z","title":"Optimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00716","snapshot_observed_at":"2026-08-07T05:51:17.024238Z","title":", Zhu, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.024238Z"},"links":{"cited_paper":"/paper/2211.00716","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d42b0426a921e8ac710d2c98d752b7a612f67f9cb6882c42af643836e1dbbcff","observation_id":"cf44ae55-dfab-4780-9bb2-ca7787dda7d9","resolution":{"observed_at":"2026-08-07T05:51:17.024238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.673701Z","title":null,"venue":null,"work_id":"fd51e628-19b5-4dea-8159-8090c462e2a2","year":1983},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.029947Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:805044a603d4010947f48b4bf02f583be73fcc36a8a2647914c1573cb1d8df3b","observation_id":"34de41d3-5753-4c82-9289-212b7faf0f4b","resolution":{"observed_at":"2026-08-07T05:51:17.680247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.651925Z","title":null,"venue":null,"work_id":"60d4cb30-0a6e-4ce6-bbbd-816beaab0d1b","year":1974},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.035151Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:32def6bc93e10ce06df091bb4c8cbc15eb28c39a094d9775c988cddff58d4002","observation_id":"d367a164-7463-40d2-8bc2-17bd5b1570e8","resolution":{"observed_at":"2026-08-07T05:51:17.659753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10982","last_updated":"2020-09-23T07:46:53Z","snapshot_observed_at":"2026-08-13T21:32:16.595182Z","submitted_at":"2020-09-23T07:46:53Z","title":"An Introduction to Proximal Causal Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10982","snapshot_observed_at":"2026-08-07T05:51:17.040316Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.040316Z"},"links":{"cited_paper":"/paper/2009.10982","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:360bed1d71fc5094fccc45f711c7889cc87743e320fd76f196f9ee83850dcdd7","observation_id":"70ec07fa-16df-4bd1-adff-b0fedb3f863b","resolution":{"observed_at":"2026-08-07T05:51:17.040316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.02981","last_updated":"2022-07-24T23:49:47Z","snapshot_observed_at":"2026-08-13T20:19:16.660478Z","submitted_at":"2021-02-05T03:20:39Z","title":"Finite Sample Analysis of Minimax Offline Reinforcement Learning: Completeness, Fast Rates and First-Order Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.02981","snapshot_observed_at":"2026-08-07T05:51:17.046132Z","title":", Imaizumi, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.046132Z"},"links":{"cited_paper":"/paper/2102.02981","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:62686da4afaf5540d480f7688f5b205cbe8decbd1797897b2536f3a261b9a852","observation_id":"c2a4d6b5-cc7d-4173-b27f-2db3205d3a47","resolution":{"observed_at":"2026-08-07T05:51:17.046132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.631855Z","title":null,"venue":null,"work_id":"42fe97eb-0463-4b58-a7c0-cff061a54ce4","year":2009},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.052253Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:b333ab514665b5329696f8f8b43a2e646dc0c4e88acde93ae199fa13a33a67ee","observation_id":"d5e856ad-dc17-46bd-b303-084496c712e6","resolution":{"observed_at":"2026-08-07T05:51:17.637846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.609612Z","title":"and Wellner, J","venue":null,"work_id":"2c3d37ae-85bf-4069-924f-bbdcc1b88bfe","year":2013},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.057373Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d24e0cbf8843959c905ec0cebee8ab330f42dd6e330df8b662b7128cbb72bccb","observation_id":"7e33f4d8-53ec-42d1-9c00-240ef3826f37","resolution":{"observed_at":"2026-08-07T05:51:17.616811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.589379Z","title":null,"venue":null,"work_id":"3d919442-7608-4571-986b-4a09438a4334","year":2000},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.062538Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:d07c9dfc29a3ee286612cb364e791377ac789e486d7a796ee513579890fe384f","observation_id":"b0657abe-73b3-46e3-bd31-0364d8f81738","resolution":{"observed_at":"2026-08-07T05:51:17.595628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.568520Z","title":null,"venue":null,"work_id":"a1e8cbfd-1210-4e4f-bcd3-a824eb67135f","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.067732Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:a7464ab993f0472f59b116944fcb9f2d5de518f18675d6679de6d05e6263e744","observation_id":"e3613471-1d66-4a13-b36d-7085cb99d19d","resolution":{"observed_at":"2026-08-07T05:51:17.574740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.549696Z","title":", Yang, Z","venue":null,"work_id":"21110f5c-1e08-4641-9516-28565cb584b6","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.072919Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:875db67a7945b4871b352a0eb5eedf02befdfaf7281edd28ef215d584d2fc2cc","observation_id":"c9c8390d-2a99-4bed-8e59-403486d9dbb6","resolution":{"observed_at":"2026-08-07T05:51:17.555534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.526407Z","title":null,"venue":null,"work_id":"028a22ba-fc01-483f-a980-db1981d1989c","year":2018},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.077912Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:5c749ec78a492dc89a5a244804a595c0686ef2d4fdace3b6f4c39c38340bd9ad","observation_id":"6070efcd-79f5-4eff-94e5-6bf44d6f0588","resolution":{"observed_at":"2026-08-07T05:51:17.533492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.502913Z","title":null,"venue":null,"work_id":"270f4a5b-5405-48b6-b887-117b5b88a9e1","year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.083315Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:690e3ff6cee4381f2e0566873da6b5a1f94a02ed5d9942c446253b0b6834a37b","observation_id":"8372cff0-b2f5-4736-8a60-4964e0af34c3","resolution":{"observed_at":"2026-08-07T05:51:17.508326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.484743Z","title":null,"venue":null,"work_id":"eb626576-8656-4543-a0a6-757022475d0d","year":2010},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.088394Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:66e9bac0050f642ec4bc5e7817c565f518c467c217dd2088c763e5e687b5df6c","observation_id":"669b6dc0-8234-404c-a32a-0d1033a79fd2","resolution":{"observed_at":"2026-08-07T05:51:17.490296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.467429Z","title":", Cheng, C.-A","venue":null,"work_id":"2eca9a1b-d271-477a-9c96-90b618e9ce3a","year":2021},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.093450Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:ffc45ca1e875d7030889ba691b2d05603b29ae39517fcd24023ad87cfe2d2c49","observation_id":"a22ab56f-9e72-4b03-85a5-621fad4037cc","resolution":{"observed_at":"2026-08-07T05:51:17.472646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.08646","last_updated":"2019-07-19T18:52:35Z","snapshot_observed_at":"2026-08-14T08:22:51.610602Z","submitted_at":"2019-07-19T18:52:35Z","title":"Fair quantile regression","version":1},"cited_work":{"arxiv_id":"1907.08646","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.08646","snapshot_observed_at":"2026-08-07T05:51:17.182730Z","title":"Fair quantile regression","venue":"math.ST","work_id":"fbcd7d21-882b-4f5c-8c1a-9a4effd2bfec","year":2019},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.099106Z"},"links":{"cited_paper":"/paper/1907.08646","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:f92a6f49f35273f127b3bd6e970a064d7b7af07efd66ac60bffd59a71129c437","observation_id":"dd2ac210-710e-4917-9727-a439012c6f20","resolution":{"observed_at":"2026-08-07T05:51:17.189931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05804","last_updated":"2022-03-11T09:00:12Z","snapshot_observed_at":"2026-08-14T10:05:11.696047Z","submitted_at":"2022-03-11T09:00:12Z","title":"Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05804","snapshot_observed_at":"2026-08-07T05:51:17.105267Z","title":", Duan, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.105267Z"},"links":{"cited_paper":"/paper/2203.05804","citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:86102901f1758af040cbb1d617ba2081dc9f50685658581b19a801679c4a41a1","observation_id":"f8fd36ff-4ce6-4f2f-bf7d-a6798274c259","resolution":{"observed_at":"2026-08-07T05:51:17.105267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.448357Z","title":", Thomas, G","venue":null,"work_id":"dca73904-e6f8-4be6-82ee-e061d1e59ee1","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.111707Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:9a1996b4fa81451f64fb8230778d15dc1ea0d214807ea8d162625832d8601fa4","observation_id":"aa4654b4-3f15-4e4b-9c7f-4384b58a9e0c","resolution":{"observed_at":"2026-08-07T05:51:17.454424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:51:17.429589Z","title":"and Tan, V","venue":null,"work_id":"5b666a5b-3a83-4341-b882-d87339da6d57","year":2020},"citing_paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T05:51:17.118027Z"},"links":{"citing_paper":"/paper/2506.07140"},"observation_digest":"sha256:9fad97d7c9679c30303921d7b6929b1f5b7f11d369a92eeb986086cb1f41185e","observation_id":"bd873078-17e5-4815-bd59-1cd13b5a66dd","resolution":{"observed_at":"2026-08-07T05:51:17.435076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07140","last_updated":"2025-06-08T13:37:38Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-09T10:50:01.902594Z","submitted_at":"2025-06-08T13:37:38Z","title":"Quantile-Optimal Policy Learning under Unmeasured Confounding"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":4,"verified_fuzzy":34},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2506.07140."}