{"as_of":"2026-08-11T15:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:87f55e045b80563586a014e322c541ad8ba74d6ed72ba62ca14bb003a53793af","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:07:12.937177Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25241/citation-record","integrity":"/paper/2607.25241/integrity","json":"/paper/2607.25241/citation-record.json","paper":"/paper/2607.25241"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.620266Z","title":"Operations Research , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.620266Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:005b088230af91a39cbdfd700f1539f80b76b67650a097a9cd6556afa986a99a","observation_id":"74b36b28-600f-45cb-847b-8373db3b5a71","resolution":{"observed_at":"2026-08-01T03:07:12.620266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-09T23:24:21.399948Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-01T03:07:12.626588Z","title":"arXiv preprint arXiv:1606.01540 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.626588Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:4f73e3e4bbf9704579048ac118b0b670271bea2bbb145ba2a10e8f38a340c0cd","observation_id":"16504edf-aedc-4bc4-8a63-b6891140d8c0","resolution":{"observed_at":"2026-08-01T03:07:12.626588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.631141Z","title":"Journal of the American Statistical Association , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.631141Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:f03666dfbeb17794eebd0c4f058b1ebffa7cd3a8f66de182c3cb094897504588","observation_id":"aa10ebba-2752-4036-a830-6016475a7e14","resolution":{"observed_at":"2026-08-01T03:07:12.631141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.635399Z","title":"The Annals of Statistics , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.635399Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e2c817a84003ba54c910f1dbd0357f7bd7c4c269ba90609c9465e97921697127","observation_id":"35e8b136-785b-4ae8-8a4a-b69449a2ed0d","resolution":{"observed_at":"2026-08-01T03:07:12.635399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.639485Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.639485Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:fc294cee3d31ea8fb712a4887920858a57c2eb45239ffa6dbf2d6445d058370c","observation_id":"a37c90a5-04ad-49c4-a4be-79d32d4792b1","resolution":{"observed_at":"2026-08-01T03:07:12.639485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.643972Z","title":"The Annals of Statistics , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.643972Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e7e539308aaaa22c59e8ab53ba8d16ebc70097a3819ecab8e63585a7bbe6103b","observation_id":"06cb2dc1-20c3-4df8-9117-851cd660f659","resolution":{"observed_at":"2026-08-01T03:07:12.643972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.648662Z","title":"Machine learning for health , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.648662Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:3f3b5bc80e1bd3c2dbcfeeb1464f30c71b6d4a829a6c2ee9003925c00e112ccd","observation_id":"8ddd6244-7096-4684-b235-29e4eaf274c7","resolution":{"observed_at":"2026-08-01T03:07:12.648662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.653362Z","title":"Scientific data , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.653362Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:37109df28745295f9ab6f63b9fe74850b952f46eb4cb27541abcfb75e8f5d889","observation_id":"a6da5979-2a5e-4e59-908a-4c26fc6f1970","resolution":{"observed_at":"2026-08-01T03:07:12.653362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.657175Z","title":"Biostatistics , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.657175Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c0be7b4a709822704c9f003e2971814dd7c4fe0f31115a0090117ee663eb0f7c","observation_id":"82a06fa7-c188-45d0-90fb-fe8e08b1a907","resolution":{"observed_at":"2026-08-01T03:07:12.657175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.661388Z","title":"Journal of the American Medical Informatics Association , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.661388Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:dcdd28f5edbf01426834322df4f0576cc71ffe760af0591e45022c5314330661","observation_id":"3f7fa73d-8a18-4054-af71-841094812fa7","resolution":{"observed_at":"2026-08-01T03:07:12.661388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.665379Z","title":"Frontiers in Artificial Intelligence , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.665379Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:ef6adedf94c93ffbe44447cc70a29303b961c703293ca28afd95c2103a347c3b","observation_id":"e318500a-6ff7-422d-90c7-7f05d47e6614","resolution":{"observed_at":"2026-08-01T03:07:12.665379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.669379Z","title":"is” and “is documented","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.669379Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:8a65c328d2cbe6bcf440731645311d2fe6025d5640d3a1291a7058cea49c626a","observation_id":"bcb56483-1dae-4664-9436-5d9042ddb5b2","resolution":{"observed_at":"2026-08-01T03:07:12.669379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.673609Z","title":"2014 , publisher=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.673609Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:3ae7dfe9f983ce2d8774995282e6156ec875ef79591ff30f747f30102f529df3","observation_id":"e9cab77e-118f-4ec8-a2eb-785d9cc72b18","resolution":{"observed_at":"2026-08-01T03:07:12.673609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T03:07:12.677999Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.677999Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:39a240564ed840d5127f663aa7a9598cbcd11381c777690c8124b675ad003b96","observation_id":"531b7ff8-7323-4e9d-ac39-386c2bbe3482","resolution":{"observed_at":"2026-08-01T03:07:12.677999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.682440Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.682440Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:a28ba0ad2f1a698d8166d8abf3b86c102ff52b1b24be95e577b42543004e0d73","observation_id":"289f57ea-1e25-42c9-bafb-522c9e48a58f","resolution":{"observed_at":"2026-08-01T03:07:12.682440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.686567Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.686567Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:37ffa4d088bdc4d8362b8f51ec4ce806b90f14e66280085481b1aae83b83d192","observation_id":"e7aa6ea2-c694-456e-ba15-77746586c71a","resolution":{"observed_at":"2026-08-01T03:07:12.686567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.690527Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.690527Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:0cb4f747ebfaadf3a54f20759e142bf73a66aca227802ec8d3d47f7a32c2172e","observation_id":"4dc11d2c-cabe-4ae5-addb-3ceb3e4ef69b","resolution":{"observed_at":"2026-08-01T03:07:12.690527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.694771Z","title":"Epidemiology , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.694771Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:897b5e41b151acc9c6f592fb8f2315f75fe243722604b378965d8fb8fc721fc5","observation_id":"bc14af46-ee5d-45d6-b9cc-bbf2afbe6845","resolution":{"observed_at":"2026-08-01T03:07:12.694771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.699328Z","title":"The Annals of statistics , pages=","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.699328Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:95b7e9e24e970177f860c7a31d4853960dac20e0e8630a247acb397ee10fbea6","observation_id":"117b9bbf-1741-46bf-a224-692531a0a3a6","resolution":{"observed_at":"2026-08-01T03:07:12.699328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.703308Z","title":"Journal of the American statistical Association , volume=","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.703308Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:721c749638aeb3986f4ef0759bc75ff51b12407f79c014147ba413452010e87d","observation_id":"631a0229-e31a-4164-a04f-dfc680a409b5","resolution":{"observed_at":"2026-08-01T03:07:12.703308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.707333Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.707333Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:8f700e2e0457a8ce8c9df8adc1fa402a84680928954075b78705e95c3f8c0fee","observation_id":"6b09ed94-d8da-4576-958e-a4542b3e4b54","resolution":{"observed_at":"2026-08-01T03:07:12.707333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.711177Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.711177Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:2766e498a6389d9553f531c3d61d78b0016c28c37b66879fa225857650017ed6","observation_id":"5fd21b60-6c8e-4bee-bfe1-ce2d232ea5b9","resolution":{"observed_at":"2026-08-01T03:07:12.711177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.715013Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.715013Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:eab912a8a345c529bf4eb93a68b4aba06e82334369a6fa919344af7be288af5c","observation_id":"37d72f1c-db14-408e-bd7c-002e27b9b4a4","resolution":{"observed_at":"2026-08-01T03:07:12.715013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.719086Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.719086Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:ed16a16e14f9c249d122fc8c5157c0d485e6b3751c5b2d984b42c006e5fbdd7f","observation_id":"4cf742bf-56ce-47e9-9835-a335d8dd0660","resolution":{"observed_at":"2026-08-01T03:07:12.719086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.722730Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.722730Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:71c0586dad8288f71903960629bb1e401cd119083dd6c861f5a2123907e6aed4","observation_id":"87653872-941a-4d52-9237-03b3f1d3267f","resolution":{"observed_at":"2026-08-01T03:07:12.722730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.726836Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.726836Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:6ec7148abb3309c3b6052b8644bc7bf20a67905d6ca75aa4a52e4e070eeb0610","observation_id":"be415b78-53a7-4c2b-951f-0de5e36e1333","resolution":{"observed_at":"2026-08-01T03:07:12.726836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.731123Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.731123Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c6b96a2d462faa0478f62995d5dd51d542351edb441d4d8313cab4f917106b00","observation_id":"79bb46a4-8868-4b45-8511-d75a17f90e8e","resolution":{"observed_at":"2026-08-01T03:07:12.731123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.734970Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.734970Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:eb2fafd5e3787d396253cd24bbadfa6becef2d6d35df2dca2b24c676544233c7","observation_id":"4fc63eac-e63e-446e-b7af-64185f714bfd","resolution":{"observed_at":"2026-08-01T03:07:12.734970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.738649Z","title":"Biometrics , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.738649Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e34cd5bf0257c27354528fd1acde5d4ef0eeb0abacff21abaffffae4d70df55a","observation_id":"b5be65b3-241b-4850-ad67-b9d98057cbca","resolution":{"observed_at":"2026-08-01T03:07:12.738649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.742549Z","title":"Statistics in Precision Health: Theory, Methods and Applications , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.742549Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e685c382f5222c86f52b46bbbb7e0f51afab3fd4bb0fe4657fbf45b22cd6bd7a","observation_id":"f082032a-7ef6-4b5a-b29e-0d7843a38918","resolution":{"observed_at":"2026-08-01T03:07:12.742549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.746655Z","title":"arXiv preprint arXiv:2510.20404 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.746655Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:32f8ba10e5d3b63476bcbeffa493ca0c2445d754f7feb8d03992969b46e8ac99","observation_id":"8b23dc8c-6880-439b-88b9-711664e46c4f","resolution":{"observed_at":"2026-08-01T03:07:12.746655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.750474Z","title":"2015 , publisher=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.750474Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:b6fd7c7789f75600cdcd34f7cc5ac2548389a06fac64d887c9a4e206bab53a93","observation_id":"d0d0fc6e-d062-492c-afec-9f98e2214170","resolution":{"observed_at":"2026-08-01T03:07:12.750474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.754324Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.754324Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:dd2aa88e32e7a05f18a5a02eed7717fa64744dbc007287d94ed1f87678131e1b","observation_id":"7b234b64-3e2c-41ef-a1ef-fb9e640d3dd8","resolution":{"observed_at":"2026-08-01T03:07:12.754324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.759097Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.759097Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:4b6e2f764ba9a57218d1fb29efb55ea807b3c2c3820fabeae6587b4002c45baa","observation_id":"256d8120-53bb-47ce-b9ae-97d41b0117aa","resolution":{"observed_at":"2026-08-01T03:07:12.759097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.762909Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.762909Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c455d8dd8b9e25f070532e05b18d63379c06a50793df631e850da27f1781fceb","observation_id":"e81d1c91-223d-4811-96f9-946d6686a5aa","resolution":{"observed_at":"2026-08-01T03:07:12.762909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.766627Z","title":"Operations Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.766627Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c4018c59c8e3ad6f791eda4b7d7e2281cb4eed87b6bdf4a24d00dc2e24604acf","observation_id":"c60ad8de-9681-46ad-9e5a-d1cdfaf427ec","resolution":{"observed_at":"2026-08-01T03:07:12.766627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.770373Z","title":"Journal of the Royal Statistical Society Series B: Statistical Methodology , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.770373Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e18d64545674cce8721ef502bfde77a291a5978c65c59a8a2d2b65986437ff39","observation_id":"59569f50-fe25-44e6-bed6-b61ddb1a528a","resolution":{"observed_at":"2026-08-01T03:07:12.770373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06355","last_updated":"2022-12-13T03:38:57Z","snapshot_observed_at":"2026-08-06T02:47:43.502360Z","submitted_at":"2022-12-13T03:38:57Z","title":"A Review of Off-Policy Evaluation in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06355","snapshot_observed_at":"2026-08-01T03:07:12.773917Z","title":"arXiv preprint arXiv:2212.06355 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.773917Z"},"links":{"cited_paper":"/paper/2212.06355","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:e3c281dd04152f23a1635332d5a42202743535a9e999d27f5971d237444aeb10","observation_id":"fa3aa8a5-109a-4a65-81eb-688dc7111db7","resolution":{"observed_at":"2026-08-01T03:07:12.773917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.777959Z","title":"Computer Science Department Faculty Publication Series , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.777959Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:d6f72769a3a4e340e51f1edfe9227190e1c4268fee4c4e870b16a561a0bf1a04","observation_id":"4fdce808-f170-4a15-8d4c-1703ba809810","resolution":{"observed_at":"2026-08-01T03:07:12.777959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.782029Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.782029Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:38ebff39627865298f29f287fe4f387d7ee9d34bdc86597f79b22cf6bb211461","observation_id":"5f5a1031-400f-48af-be42-4bc429dcee80","resolution":{"observed_at":"2026-08-01T03:07:12.782029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.785719Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.785719Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:f255d63a19d0fd0ae2d07fdfb3f43ba85c6d2c63d47a10144b4fb62e2337deb0","observation_id":"14709c5a-f08f-4076-a187-5c20ed1240bd","resolution":{"observed_at":"2026-08-01T03:07:12.785719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.789768Z","title":"Surveys in operations research and management science , volume=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.789768Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:09547a0ff6b6fa7bb803bbafd08f2bfbe8cc1beb25d86e92ca023588b791fcfc","observation_id":"c3066c63-3670-42e0-a6e7-1602c669124d","resolution":{"observed_at":"2026-08-01T03:07:12.789768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.793463Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.793463Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:ccee26e6807e69fc10c6dc2d56466644757233ebb524beffcd11036eb3505500","observation_id":"1dc5c2b5-0cf8-4020-9f05-898d4c3139f2","resolution":{"observed_at":"2026-08-01T03:07:12.793463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.797037Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.797037Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c09a41d7c6f72965d46ad964a777a2310d2cd4b47b96e7fe940a9dc8ad42b704","observation_id":"cbe9ff09-55e3-4802-a4e7-d275ac43614f","resolution":{"observed_at":"2026-08-01T03:07:12.797037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.800874Z","title":"Biometrika , volume=","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.800874Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:661371399b57cf2065def0aa41f520046820d46318a826d5904e19ea40d09798","observation_id":"87b285c3-b774-46ed-b01d-f2bad62c0608","resolution":{"observed_at":"2026-08-01T03:07:12.800874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09080","last_updated":"2026-06-22T15:33:33Z","snapshot_observed_at":"2026-08-06T19:48:07.825076Z","submitted_at":"2024-05-15T04:09:30Z","title":"Causal Inference with a Hidden Treatment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09080","snapshot_observed_at":"2026-08-01T03:07:12.804849Z","title":"arXiv preprint arXiv:2405.09080 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.804849Z"},"links":{"cited_paper":"/paper/2405.09080","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:0ca49d568dd5e73f7fdcd48495e7f139f1f3bdfff71acc32e3b425efeefc2e4d","observation_id":"506a80ba-7ea2-4425-a816-156739002a7d","resolution":{"observed_at":"2026-08-01T03:07:12.804849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.808957Z","title":"2006 , publisher=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.808957Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:9e92b5cb9b06395232b9d1725c2255962c936a065519adb2ff323de088c2ae9e","observation_id":"6f04fc5a-213a-42e1-ab4f-d143ba01e62a","resolution":{"observed_at":"2026-08-01T03:07:12.808957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.812833Z","title":"2009 , publisher=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.812833Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:8a72acfb966a25d62b5bda5fefff851d7ed03ce588356939a256b9ea1a02137d","observation_id":"33e28494-9124-4ab7-bebc-3ac99450d287","resolution":{"observed_at":"2026-08-01T03:07:12.812833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.816592Z","title":"Journal of Econometrics , volume=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.816592Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:66ef74a54845c6aa085145368b65d3f62bd93c00c32099c0df8db61b97c353b2","observation_id":"6f8521d3-33cc-43e9-bae2-e18e5743b9e6","resolution":{"observed_at":"2026-08-01T03:07:12.816592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.820673Z","title":"Biometrics , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.820673Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:4d7f7e0fc0662f47078ad4dc943a650a5a169a0dcc18bd1a109639e4d2f38903","observation_id":"ee770b97-266c-4dd5-affc-a634fbc41704","resolution":{"observed_at":"2026-08-01T03:07:12.820673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.824481Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.824481Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:a1c72b5002cb17841e4d8edc8c1d429b126d15c9661d7cf3d48c351e2612bd41","observation_id":"7e15c72b-8ed3-4321-a0ce-0417f00e8000","resolution":{"observed_at":"2026-08-01T03:07:12.824481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.828138Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.828138Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:71edca12ffc1442a622f0f30b7988007037541adb5f48533c659b716eb8a06fb","observation_id":"4c8b575e-fe5d-4e8d-bee2-94f75f25b2e1","resolution":{"observed_at":"2026-08-01T03:07:12.828138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.831915Z","title":"Biometrics , volume=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.831915Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:876f039e9127f45549e5c6904f20b7604f7fd898acb1f39188bc29b572f2a1d9","observation_id":"82cc19b4-c547-4071-b713-0adacf5f3f15","resolution":{"observed_at":"2026-08-01T03:07:12.831915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.835875Z","title":"Proceedings of the Second Seattle Symposium in Biostatistics , address =","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.835875Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:bfed83b5b2bd711974e962e70e59f29d20dd7a6f6a5ccdb784dc8c233f7d6809","observation_id":"9b603b59-92fc-418d-9341-db279f89d490","resolution":{"observed_at":"2026-08-01T03:07:12.835875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.840040Z","title":"Annals of statistics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.840040Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:96b1b137fee0a2dc964d1090ff541ad846d54ff609ebc79b939dc23f47f72fd5","observation_id":"b24e5dee-e05a-4324-8fbc-73e7961ed669","resolution":{"observed_at":"2026-08-01T03:07:12.840040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.844077Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.844077Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:d475b64dbb06463ac2531bf0b4a4ed8b943352221fa9e570f1d66ec336c527d1","observation_id":"e12b7621-55d3-4403-a46f-9e9b5cf94bd4","resolution":{"observed_at":"2026-08-01T03:07:12.844077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.847986Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.847986Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:b8f5d89e71b137805a28eb7fb0c376e5dbbe8563c47dcf84e5e637bbf12110d0","observation_id":"e8f1ec78-c976-4c2a-be99-6c5ae7637e0e","resolution":{"observed_at":"2026-08-01T03:07:12.847986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.852032Z","title":"Annals of statistics , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.852032Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:f7a4f4b14d74395eb431b8385ebdcd1b7595c094210b9dcb7aacb643a56ca0ab","observation_id":"b3238686-572a-4d21-b331-757a01681cf9","resolution":{"observed_at":"2026-08-01T03:07:12.852032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.855991Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.855991Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:6274fefbeaf46f9639eb3140a3c355ac60e07fabfc954d7882d9ab1afeb4e8b3","observation_id":"3c199060-d0d5-420d-92c9-0a11cbaa741d","resolution":{"observed_at":"2026-08-01T03:07:12.855991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T03:07:12.859843Z","title":"arXiv preprint arXiv:2005.01643 , year=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.859843Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:52bd23797b3c6e10cb715e4476413a35eecce8cbc3b218eee7461b5e8cd1f827","observation_id":"c82d5c97-39f4-4654-8ca3-7b823e32c80f","resolution":{"observed_at":"2026-08-01T03:07:12.859843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.864167Z","title":"The Annals of Statistics , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.864167Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:7bc82222e28f21d0dd0d4deea3e519b8b172b2fa8941e03e01f19fcb7ccd9b03","observation_id":"39a3a0c0-cf75-4575-9c05-e62cd44e4af4","resolution":{"observed_at":"2026-08-01T03:07:12.864167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.868009Z","title":"Journal of the Royal Statistical Society: Series B , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.868009Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:f7eeca8b910d986e1cad689f2e5bf331d70d0970d363f0705c09c1841122dba6","observation_id":"0c75f36f-97ff-41f4-872d-262320f2e539","resolution":{"observed_at":"2026-08-01T03:07:12.868009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08126","last_updated":"2026-05-21T14:13:15Z","snapshot_observed_at":"2026-08-05T22:56:59.857728Z","submitted_at":"2024-11-12T19:09:41Z","title":"A Tale of Two Cities: Pessimism and Opportunism in Offline Dynamic Pricing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08126","snapshot_observed_at":"2026-08-01T03:07:12.871970Z","title":"arXiv preprint arXiv:2411.08126 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.871970Z"},"links":{"cited_paper":"/paper/2411.08126","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:ff642d2f107f4af84184b17148853614088797ddec29d089d5e11a3011f47ec8","observation_id":"54caa76b-2f15-4b72-8057-e317226475be","resolution":{"observed_at":"2026-08-01T03:07:12.871970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.876067Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.876067Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:4f7ef0f7cd5dfe678b43d23a5be625eb933d713f1316fcd9935f449a1f2b7169","observation_id":"f8af26ea-22bb-4832-8641-6c0bea2be094","resolution":{"observed_at":"2026-08-01T03:07:12.876067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.879675Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.879675Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:0a63025d08c83ecc9307d42341546252bb60f6bf27aea46c1f13b8469b5b1367","observation_id":"f2565fe2-bf28-4a3f-b6a5-e71700a59e58","resolution":{"observed_at":"2026-08-01T03:07:12.879675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T03:07:12.883842Z","title":"arXiv preprint arXiv:2004.07219 , year=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.883842Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:5b2617566b74124157d4704be5def76959197eed4b2fcf3d25cd49ed9e6d69e1","observation_id":"dd77ab5d-0755-4400-9f28-0ed808ed852d","resolution":{"observed_at":"2026-08-01T03:07:12.883842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.887675Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.887675Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:386b689f0b8d7035601f2098d407a2e34a92a74a61574be6bc748911af06a7f2","observation_id":"c796fc11-6d51-4961-b03e-2c4b7186a5fb","resolution":{"observed_at":"2026-08-01T03:07:12.887675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.891485Z","title":"Journal of the American Statistical Association , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.891485Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:03b21ed8478777c14928d98e0b2f02cfe8de17e298c48560dee432307add51d9","observation_id":"338577e6-989a-4478-bd46-3de483ca983d","resolution":{"observed_at":"2026-08-01T03:07:12.891485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.895267Z","title":"Journal of the American Statistical Association , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.895267Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:40cfe66222a8d234d7244b75d1839acd0dd03b777e3d51cc68a7e57a5436e5d7","observation_id":"af1d7333-c292-4979-87c9-3347e04803e5","resolution":{"observed_at":"2026-08-01T03:07:12.895267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.899078Z","title":"Journal of the American Statistical Association , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.899078Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:b3733ee7b81fc31765b70a4902c20e4dd881e33b572941ea77cc080a26aea76b","observation_id":"50cb1ba2-7855-4453-bffa-208d1e9a395f","resolution":{"observed_at":"2026-08-01T03:07:12.899078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.903147Z","title":"Maximum likelihood from incomplete data via the","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.903147Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:2a0510d2b8c5c1dd75e693aa2ff58d051a0d78822b3aeb63793479c73449e63d","observation_id":"7dcd2155-241a-4914-bad6-397a278f3941","resolution":{"observed_at":"2026-08-01T03:07:12.903147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.907067Z","title":"Statistical Science , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.907067Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:8a77de8a25d94d2f8afcde369a1079223475ff496a87f65195e99510eade7499","observation_id":"7302a4ca-f343-4252-aefe-5377c3ce549f","resolution":{"observed_at":"2026-08-01T03:07:12.907067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.910769Z","title":"the Annals of Probability , volume=","venue":null,"work_id":null,"year":1974},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.910769Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:9d8257c8b5edc4cc20b3ab282d5dfa2110e1caee3d665d4d4f4b9272eb4e393f","observation_id":"4717fc61-4c8a-49d5-9244-8a8f7665e9fc","resolution":{"observed_at":"2026-08-01T03:07:12.910769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.914693Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.914693Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:21304f0d8870e18ca506613ce077663acabe8fb98d7cee9c5eff2014f05a7862","observation_id":"68bfb51c-1a49-4e3d-8d01-dfa306b1538c","resolution":{"observed_at":"2026-08-01T03:07:12.914693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.918401Z","title":"Jama , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.918401Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:16e7fb502bf832375d8e0e4282666ab58c4da91c6bce699205c230954de9b326","observation_id":"3a0e8983-7814-4b76-b849-719ddd5fce57","resolution":{"observed_at":"2026-08-01T03:07:12.918401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.922065Z","title":"Intensive care medicine , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.922065Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:c28b8a16780ad12ab771a7a3442b65f686998fdbe462bed59f21e26f81777924","observation_id":"d3600df7-bba4-42ac-ba66-bd219245d2aa","resolution":{"observed_at":"2026-08-01T03:07:12.922065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.925719Z","title":"Critical care medicine , volume=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.925719Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:7a4f5ab8ecf4614c78e34a469f2f54b81ff94d475329043845f2d5a44909ba51","observation_id":"d1490538-0a79-4d46-90c9-7f509d19bdcd","resolution":{"observed_at":"2026-08-01T03:07:12.925719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.929328Z","title":"Current Epidemiology Reports , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.929328Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:b6441f373b0216ade70cc5da504ea7649eb8496e4a134f250e4c300a83dd6df4","observation_id":"c3cd245b-5c9f-4829-9e68-eb428c5eff4b","resolution":{"observed_at":"2026-08-01T03:07:12.929328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.933200Z","title":"Proceedings of the Thirty-Eighth Conference on Uncertainty in Artificial Intelligence , series =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.933200Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:07724cf20b4ba28f3f422303675b8820b6667221bfb1b34bb3b58272ddeff2c6","observation_id":"8d078790-86bb-4e74-b059-8cf5192a80b5","resolution":{"observed_at":"2026-08-01T03:07:12.933200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:07:12.937177Z","title":"The Annals of Statistics , pages=","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:12.937177Z"},"links":{"citing_paper":"/paper/2607.25241"},"observation_digest":"sha256:1d4c80af1ece448945b9dbbe50aefa0fd1cb20672c6c88913814b97a6400d46f","observation_id":"95df149f-bae5-44c8-bded-10af338f998e","resolution":{"observed_at":"2026-08-01T03:07:12.937177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25241","last_updated":"2026-07-28T03:32:31Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-06T15:07:39.028853Z","submitted_at":"2026-07-28T03:32:31Z","title":"Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":80,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2607.25241."}