{"as_of":"2026-08-09T17:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88b059143322eb9c4ca5062847c14064972572a8c801f9d0ba243a289e6c0de9","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:15:15.250548Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19199/citation-record","integrity":"/paper/2607.19199/integrity","json":"/paper/2607.19199/citation-record.json","paper":"/paper/2607.19199"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:09.877817Z","title":"Agarwal, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:09.877817Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:98ca209d5fdecc773676efee842f39feb6be041b34aca3e30ceadf37664551d3","observation_id":"ae19f9cb-51bc-4ef8-9152-99bfafbec76d","resolution":{"observed_at":"2026-08-01T13:15:09.877817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:09.930483Z","title":"Akrour, M","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:09.930483Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:8d035c7012f90c9316fbd1546cf07bc8abdae13b83d70372002349b21169f884","observation_id":"0d3f7ffb-872a-454e-9873-733c51d2522f","resolution":{"observed_at":"2026-08-01T13:15:09.930483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:10.071123Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.071123Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:5684945d745958b68a077b2b4933ebb93a388e31fc2fde0674553084f966878b","observation_id":"6f750057-1c3a-42aa-863c-a3e9a66859bf","resolution":{"observed_at":"2026-08-01T13:15:10.071123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:10.151145Z","title":"Basu and S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.151145Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:9957b9ba7c23f830339157f216224b4ce9794b6188086443c9f4f2233e28f0f8","observation_id":"d7143877-c5a9-46ff-953e-e74fdd407b2e","resolution":{"observed_at":"2026-08-01T13:15:10.151145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11802","last_updated":"2022-11-21T19:10:27Z","snapshot_observed_at":"2026-08-07T21:15:26.031417Z","submitted_at":"2022-11-21T19:10:27Z","title":"Improving TD3-BC: Relaxed Policy Constraint for Offline Learning and Stable Online Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11802","snapshot_observed_at":"2026-08-01T13:15:10.238096Z","title":"Beeson and G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.238096Z"},"links":{"cited_paper":"/paper/2211.11802","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:87ddf43d16cfa1edae518a54320924d5da5590872a8a9482967757f5c9ceed68","observation_id":"e8b156a5-d68f-4183-94d1-4b025ca79bcd","resolution":{"observed_at":"2026-08-01T13:15:10.238096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06267","last_updated":"2022-08-21T12:48:07Z","snapshot_observed_at":"2026-08-07T13:59:06.179916Z","submitted_at":"2021-12-12T16:00:31Z","title":"DiVA: A Scalable, Interactive and Customizable Visual Analytics Platform for Information Diffusion on Large Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.06267","snapshot_observed_at":"2026-08-01T13:15:10.341102Z","title":"Brandfonbrener, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.341102Z"},"links":{"cited_paper":"/paper/2112.06267","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:7b61ae043ee66c7d34fd6d6b129b4ef4cf03c87a12d950823ef1961ee606f182","observation_id":"1aca5f0d-42b4-48b4-9940-ec44076ea414","resolution":{"observed_at":"2026-08-01T13:15:10.341102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:10.446480Z","title":"Busa-Fekete and E","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.446480Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:db16fd8260d110a7702541fcd73ec5822256e385f8d01900dec1c70c93185ba6","observation_id":"d99d1b6c-5399-47f0-880b-20fbb7a6a2e5","resolution":{"observed_at":"2026-08-01T13:15:10.446480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:10.614463Z","title":"Busa-Fekete, B","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.614463Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:9939f2ed4106491ba52e0bdc1234044daae7740a4318d28c0b5c502479dbe385","observation_id":"d6c76d20-f40f-45cd-9444-e3dbe2e4ac5c","resolution":{"observed_at":"2026-08-01T13:15:10.614463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:10.726576Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.726576Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:1f954327f2c3965de3fe50a81931bbe6841deb3e68bf0ef10d4eb621599e14a3","observation_id":"0050e487-cf46-48b3-b0c3-844e6dc2df72","resolution":{"observed_at":"2026-08-01T13:15:10.726576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00667","last_updated":"2023-07-02T21:05:42Z","snapshot_observed_at":"2026-07-06T15:49:27.454558Z","submitted_at":"2023-07-02T21:05:42Z","title":"Morse Neural Networks for Uncertainty Quantification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00667","snapshot_observed_at":"2026-08-01T13:15:10.880580Z","title":"Dherin, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:10.880580Z"},"links":{"cited_paper":"/paper/2307.00667","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:446a957c764e85e15f76cdb021abccb72db430f7c3c857fb30280159da30235e","observation_id":"4ccc7596-88ab-4c3b-9f79-12dcfdecc1ed","resolution":{"observed_at":"2026-08-01T13:15:10.880580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:11.039502Z","title":"Ernst, P","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.039502Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:a5821a042102065cda0c7695f301871c7fc4a5923d7d4c6567eb4796ed3f640b","observation_id":"c26e8cb3-1bb4-47cd-b03f-990eb02157b3","resolution":{"observed_at":"2026-08-01T13:15:11.039502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T13:15:11.167709Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.167709Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:d302532eba860613eb0c37e70445db90a849e9377d2e7d8cf1024ada75ec8363","observation_id":"ed555a58-1eac-4b82-ab1a-cf1ce2a39eb3","resolution":{"observed_at":"2026-08-01T13:15:11.167709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06860","last_updated":"2021-12-03T18:58:09Z","snapshot_observed_at":"2026-07-06T11:18:40.627866Z","submitted_at":"2021-06-12T20:38:59Z","title":"A Minimalist Approach to Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06860","snapshot_observed_at":"2026-08-01T13:15:11.305436Z","title":"Fujimoto and S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.305436Z"},"links":{"cited_paper":"/paper/2106.06860","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:ca6a400cd54d4e2ec2c18afce221e59f7171a73939425d1cb4c17d7498551723","observation_id":"28d6258e-19ea-4d11-b988-7dcafbc0e075","resolution":{"observed_at":"2026-08-01T13:15:11.305436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02900","last_updated":"2019-08-10T03:36:31Z","snapshot_observed_at":"2026-07-06T07:19:45.696706Z","submitted_at":"2018-12-07T04:03:25Z","title":"Off-Policy Deep Reinforcement Learning without Exploration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02900","snapshot_observed_at":"2026-08-01T13:15:11.461088Z","title":"Fujimoto, D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.461088Z"},"links":{"cited_paper":"/paper/1812.02900","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:baee6f85f5385308141b4a81232bba2e076a1cc7b012c58a8adf1acb9bbc466c","observation_id":"2c6f62e2-ea4c-4def-abbd-e319c799d8e8","resolution":{"observed_at":"2026-08-01T13:15:11.461088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:11.545804Z","title":"Fürnkranz, E","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.545804Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:84847a22aee3395806912a877dd698fe0982da39366a53382cbfc8a4a163a0ed","observation_id":"73e7ab48-4585-40ad-9567-b885a3fa6ef8","resolution":{"observed_at":"2026-08-01T13:15:11.545804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.00456","last_updated":"2019-07-08T17:21:46Z","snapshot_observed_at":"2026-07-06T08:03:53.351060Z","submitted_at":"2019-06-30T20:53:19Z","title":"Way Off-Policy Batch Deep Reinforcement Learning of Implicit Human Preferences in Dialog","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.00456","snapshot_observed_at":"2026-08-01T13:15:11.673518Z","title":"Jaques, A","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.673518Z"},"links":{"cited_paper":"/paper/1907.00456","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:719ebe3a0d471dd875df1fd4691893092fefeda547adea72a89baacb9c142cbd","observation_id":"8b8023b1-ec3a-4895-9443-359d5f702330","resolution":{"observed_at":"2026-08-01T13:15:11.673518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:11.771736Z","title":"Kidambi, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.771736Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:8f4ee984862bfb8f16804d73bfa4814d4d5eb5cbad10e119c72dc2cac5b3b953","observation_id":"862f9fbc-0ac7-4f34-9756-022942bca912","resolution":{"observed_at":"2026-08-01T13:15:11.771736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:11.932222Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:11.932222Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:faa5a697fb3a342c21f31f5c4ea15e39f3f71ce10b6d185ebe43c7bc4c0e0e9d","observation_id":"d095d839-71c7-455e-a28f-9da2cd10c668","resolution":{"observed_at":"2026-08-01T13:15:11.932222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:12.069688Z","title":"Kostrikov, R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.069688Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:d736ba4deb0cb14d88222eb0af8cc1ac46d2d87b292ce3f9ded595f50d1fea8f","observation_id":"4f8fab85-8259-4756-bc8b-a171ba12d024","resolution":{"observed_at":"2026-08-01T13:15:12.069688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-01T13:15:12.168902Z","title":"Kostrikov, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.168902Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:52575d63fe0e7c94492c885261f4236582814cd6204d437d765cd9bb0da877f4","observation_id":"3ced2344-733d-4114-8bd1-e04e13a6ca25","resolution":{"observed_at":"2026-08-01T13:15:12.168902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:12.311270Z","title":"Kumar, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.311270Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:8d617305073038aa1521bfd379a65da64f96238386b60e62fcddfffd0fb838c7","observation_id":"aff47d4f-fbb3-431c-9050-398d992cec4d","resolution":{"observed_at":"2026-08-01T13:15:12.311270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:12.492998Z","title":"Kumar, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.492998Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:7f0b62617c6f6f0542d5a081907f573ccac85bac4ff3e451dc8593b0ff13e81f","observation_id":"56319a69-6245-4bd5-a9ca-f713e55668c9","resolution":{"observed_at":"2026-08-01T13:15:12.492998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T13:15:12.658632Z","title":"Levine, A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.658632Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:49bdeffded6587fe1c9f5e4bee45551594f3e5e03be0b00d265daedfcc65d967","observation_id":"718a45fa-f66b-4c88-8e43-cf00f092a65e","resolution":{"observed_at":"2026-08-01T13:15:12.658632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:12.766887Z","title":"Luo, M.-K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.766887Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:f2a85755c4ac67baba47cecadec3cbeb56cd24e171ca37dfabf3fe43f603872a","observation_id":"5ead7f89-2999-451e-b3ad-c23c9b21614b","resolution":{"observed_at":"2026-08-01T13:15:12.766887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03647","last_updated":"2020-06-23T16:54:09Z","snapshot_observed_at":"2026-08-07T05:24:51.039556Z","submitted_at":"2020-06-05T19:33:19Z","title":"Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03647","snapshot_observed_at":"2026-08-01T13:15:12.876755Z","title":"Matsushima, H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:12.876755Z"},"links":{"cited_paper":"/paper/2006.03647","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:012aebe983b9707d789746839c33aca2cff7c284fe6a4b65388536e7f0f195ef","observation_id":"e4251852-46bc-4169-b96e-50a8bcd33e7f","resolution":{"observed_at":"2026-08-01T13:15:12.876755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02074","last_updated":"2019-12-04T16:06:10Z","snapshot_observed_at":"2026-08-05T10:28:32.357062Z","submitted_at":"2019-12-04T16:06:10Z","title":"AlgaeDICE: Policy Gradient from Arbitrary Experience","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02074","snapshot_observed_at":"2026-08-01T13:15:13.026138Z","title":"Nachum, B","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.026138Z"},"links":{"cited_paper":"/paper/1912.02074","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:77a62083b35dcd7efa4657ed415a69c8512059e2ad9f97dee80720ae3a1b01a4","observation_id":"b99b10e1-b87a-4a00-ac19-a794a8110f1e","resolution":{"observed_at":"2026-08-01T13:15:13.026138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-01T13:15:13.152805Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.152805Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:0b44ba6b92e07801d103f09e61ad106c0175b66edd4dd2c30216348397ecad19","observation_id":"9239dbd0-843a-4405-8379-cf205af60e5c","resolution":{"observed_at":"2026-08-01T13:15:13.152805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11092","last_updated":"2023-01-30T11:30:19Z","snapshot_observed_at":"2026-07-06T14:20:54.903780Z","submitted_at":"2022-11-20T21:48:25Z","title":"Q-Ensemble for Offline RL: Don't Scale the Ensemble, Scale the Batch Size","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11092","snapshot_observed_at":"2026-08-01T13:15:13.289352Z","title":"Nikulin, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.289352Z"},"links":{"cited_paper":"/paper/2211.11092","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:743fef87223a215d61a365370975bd343a1540b0488a38efe75ffa3c468f02d2","observation_id":"612f72d6-63cb-4e19-b33e-2441c80f0a9a","resolution":{"observed_at":"2026-08-01T13:15:13.289352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-01T13:15:13.395398Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.395398Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:107abc493a01712fe2a4cc049cdd910acc5452b72c4d72d950fdab7727ffd628","observation_id":"b57cbe30-8da2-42a6-bc94-65cad2b08702","resolution":{"observed_at":"2026-08-01T13:15:13.395398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:13.504715Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.504715Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:52a45e3e52bbe940800f0cd65c17a8cb60a8ed9c547147d0e2f58910af88674e","observation_id":"96efd3e4-4411-41ff-984e-66f7f9197bd0","resolution":{"observed_at":"2026-08-01T13:15:13.504715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:13.644125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.644125Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:870e708728bd3dfa88f9a2a57b0fa55a6a4c1a17db2777b76f07fb1262b1cbe9","observation_id":"2ffa1901-e327-4aeb-95de-f7e7cbc08388","resolution":{"observed_at":"2026-08-01T13:15:13.644125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:13.749769Z","title":"Singh, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.749769Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:4ca3b5b657e82203e7e73d26ba089528c14456381cf5d59750abe805901f532f","observation_id":"6c66f788-c0ea-415d-8b09-c269db1c3ed0","resolution":{"observed_at":"2026-08-01T13:15:13.749769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16399","last_updated":"2024-07-27T07:13:30Z","snapshot_observed_at":"2026-08-06T10:20:36.890922Z","submitted_at":"2024-04-25T08:22:47Z","title":"Offline Reinforcement Learning with Behavioral Supervisor Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16399","snapshot_observed_at":"2026-08-01T13:15:13.836237Z","title":"Srinivasan and W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.836237Z"},"links":{"cited_paper":"/paper/2404.16399","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:ee81d32d7270a56bd3f788cfb1d6b07b6e107bc4c56b7d0a12bfa41c086a27ae","observation_id":"34c02bf5-422b-4379-878a-c91040b18664","resolution":{"observed_at":"2026-08-01T13:15:13.836237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:13.972877Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:13.972877Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:9ce8b7da76a797aa81e5737c940ef2b3fedf464475cdcc292064838f7f3ce0ab","observation_id":"051efff9-44b1-40eb-89af-30d9db8d71b6","resolution":{"observed_at":"2026-08-01T13:15:13.972877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.094205Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.094205Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:55f5218699451b8d2f550d97825ca4e1215db7de24ac23970bcc38696a51af01","observation_id":"3500cbe1-ff2a-477f-91c3-27e1cbb7bb66","resolution":{"observed_at":"2026-08-01T13:15:14.094205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.226393Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.226393Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:115aef962745aca98329896867a88ad44fe1b24c72e0a1c6a2f1e6bec871c54d","observation_id":"1af28027-dfa9-4433-a0b5-ebc3bf5cb9c4","resolution":{"observed_at":"2026-08-01T13:15:14.226393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.306255Z","title":"Wilson, A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.306255Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:7b0beae59adda027e6e2247bbda4bb104df67cd56ca555db8261803c03ae20f1","observation_id":"5c685564-d344-404e-a740-62024d974655","resolution":{"observed_at":"2026-08-01T13:15:14.306255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.418930Z","title":"Wirth and J","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.418930Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:df0a14344aa0a9d6f347519b41f183bc671cd3c7357eb126e1de0075f3f8e468","observation_id":"983e3000-2f9c-4533-977c-b319e6a7cde6","resolution":{"observed_at":"2026-08-01T13:15:14.418930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.525787Z","title":"Wirth, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.525787Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:a4f851d3ccbd009e88a301783eec44ce9ccf941a1ec59ab12ef1acbdc6060240","observation_id":"1791ed1e-f643-4524-9c55-610ad5bb460b","resolution":{"observed_at":"2026-08-01T13:15:14.525787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-07-06T08:39:58.361914Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-01T13:15:14.620583Z","title":null,"venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.620583Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:dad29f0cb1a62a1cbb24d3a21fda9cbb483dfd07091da469d1ec273ee74ec296","observation_id":"f7116211-d4db-4c72-baab-b38f3a602b08","resolution":{"observed_at":"2026-08-01T13:15:14.620583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.730554Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.730554Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:496519343df4f3673a44cebd5f20cc161b2cf8b3bf2c1ce0c48a8b3b0e5e20ee","observation_id":"cf0faaeb-0705-46ad-93c6-2d8c9d01adef","resolution":{"observed_at":"2026-08-01T13:15:14.730554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:14.832008Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.832008Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:0a161d9177c5b7557ebd1e6c2da82eeeb2f717c2defe22689f5e77c26b199d86","observation_id":"f04b3c87-0968-4629-b08e-d53fcccf0fc8","resolution":{"observed_at":"2026-08-01T13:15:14.832008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08363","last_updated":"2022-01-27T01:08:41Z","snapshot_observed_at":"2026-08-05T09:11:42.032958Z","submitted_at":"2021-02-16T18:50:32Z","title":"COMBO: Conservative Offline Model-Based Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08363","snapshot_observed_at":"2026-08-01T13:15:14.942999Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:14.942999Z"},"links":{"cited_paper":"/paper/2102.08363","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:b77ad8e55c58e631a2f932e399eafbbc379564b9459cb018a3e72e0cec52aa0d","observation_id":"0fae590c-a5ff-4246-b8ba-8695c07942f0","resolution":{"observed_at":"2026-08-01T13:15:14.942999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.09072","last_updated":"2020-02-21T00:27:52Z","snapshot_observed_at":"2026-07-06T08:58:58.705887Z","submitted_at":"2020-02-21T00:27:52Z","title":"GenDICE: Generalized Offline Estimation of Stationary Values","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.09072","snapshot_observed_at":"2026-08-01T13:15:15.039392Z","title":"Zhang, B","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:15.039392Z"},"links":{"cited_paper":"/paper/2002.09072","citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:12aa50d9c8455038a648533faa715d747833265cdc3ba28c07ea5350f7eae2ac","observation_id":"29eff230-c9a5-4e76-b81a-2c0122193695","resolution":{"observed_at":"2026-08-01T13:15:15.039392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:15.145469Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:15.145469Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:26b4f81bdb946fb8cd1badbaaefe1609a1be22d4cfab76b0950a6bf60406ae30","observation_id":"d56869be-3671-4443-a9e9-9ce90c2b0ace","resolution":{"observed_at":"2026-08-01T13:15:15.145469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:15:15.250548Z","title":"Zucker, J","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T13:15:15.250548Z"},"links":{"citing_paper":"/paper/2607.19199"},"observation_digest":"sha256:ebbcbcce27f716c06ca480f473e8ffa66e2f46f44b199beb21b454b93b1c4a62","observation_id":"6d2386c8-ac91-4855-8727-b21a01859aeb","resolution":{"observed_at":"2026-08-01T13:15:15.250548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19199","last_updated":"2026-07-21T15:34:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:56:19.255296Z","submitted_at":"2026-07-21T15:34:06Z","title":"Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2607.19199."}