{"as_of":"2026-08-15T11:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff90470ea4f945210d4cc54a2ec2ddb2faa808ff89aefee0dd03025ca2074961","coverage":[{"denominator":162,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:15:15.850895Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T10:46:25.335756Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14444","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-08-13T15:54:57.859654Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2507.14444","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:df686ab1b67d96839765cab2f127ce5f9cd0bad3ff8d3fdfd571cbb8a5474823","observation_id":"b012529b-b82f-4ebe-bc86-7eedd4dd0722","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14444/citation-record","integrity":"/paper/2507.14444/integrity","json":"/paper/2507.14444/citation-record.json","paper":"/paper/2507.14444"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.568377Z","title":"CS Dept., UW Seattle, Seattle, WA, USA, Tech","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.568377Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:cc4170720e7809be06d38b0a264eb912120afa09e204eaf84fe1d460eeee60ba","observation_id":"12693451-7cd5-408e-802e-84f3cd7406ac","resolution":{"observed_at":"2026-08-06T16:15:15.568377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.572431Z","title":"Advances in neural information processing systems 33:20095–20107","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.572431Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1b193ced5e0a0c601151a0103d1e481682a81b49658e7475d0f483465b7c5c71","observation_id":"2fe14251-ff17-4bc4-8c1c-dd0d81d322b4","resolution":{"observed_at":"2026-08-06T16:15:15.572431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.575782Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.575782Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5db553eb97d3d50ed0655b31e15ac7edd5687453b29883367289ab2e424d447b","observation_id":"1a1d39a8-6379-45e1-8724-3890a2d9e279","resolution":{"observed_at":"2026-08-06T16:15:15.575782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.579021Z","title":"Journal of Machine Learning Research 22(98):1–76","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.579021Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:43beb3fd3d7423e4a9e8dbd44d66dd31ff3dcabd7b2bfd356493178996454486","observation_id":"b58f16cd-094b-42d3-8857-eaf9469b8cba","resolution":{"observed_at":"2026-08-06T16:15:15.579021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.582596Z","title":"Advances in neural information processing systems 19","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.582596Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e94fc55ef1bff21bf92d67650d26a490f6e6075069ca2f592575d4579eeb20e9","observation_id":"218e35f8-f1b0-4007-8213-c796eb9579e0","resolution":{"observed_at":"2026-08-06T16:15:15.582596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.585913Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.585913Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0932697820a53e00618c82d5f3d72349331c07532c972e2751e7d51a65e3533b","observation_id":"164cdbcc-c8bf-408d-9b11-c58544263029","resolution":{"observed_at":"2026-08-06T16:15:15.585913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.589749Z","title":"International Conference on Machine Learning , 263–272 (PMLR)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.589749Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5d10c0a3402602ed676b9d86a80a35540c3070f608870f6719f63dc2f27643bf","observation_id":"3c93fe29-13c3-4d98-9759-9ca2f9be3364","resolution":{"observed_at":"2026-08-06T16:15:15.589749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.592467Z","title":"Systems & control letters 61(12):1203–1208","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.592467Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2e7ed33b561587deba6f6de31689748ad1516d21599005c96cb24e0e9bf91b99","observation_id":"ac69a5cc-b15f-47a4-a5f4-68c53b0d3277","resolution":{"observed_at":"2026-08-06T16:15:15.592467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.595603Z","title":"Proceedings of the National Academy of Sciences of the United States of America 38(8):716","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.595603Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:f5ece218e7bfbe1f1db5f8996b55d45059efa9c3cd1edaab792d3422beb8badc","observation_id":"45717872-6b3d-4d15-85ee-92d39de1db7d","resolution":{"observed_at":"2026-08-06T16:15:15.595603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.598900Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.598900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:7a88be111424edebc882ef222b40b99ebbf305d29ba2c52a33df53534e0dc94c","observation_id":"c10e113f-0523-4bf7-a256-8d9be687dd17","resolution":{"observed_at":"2026-08-06T16:15:15.598900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.601779Z","title":"Mathemat- ical Programming 167(2):235–292","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.601779Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d0d6b61b3ee34c1fb84fe2697e861b6a7c472b255fb9bdf7e39581a16015e1c0","observation_id":"c1ccb9a8-96e6-4b7f-8424-9ce10fcd2a67","resolution":{"observed_at":"2026-08-06T16:15:15.601779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.604774Z","title":"Management Science 65(2):604–618","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.604774Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a889046e3dd6a82f21a0a1d1bec893a0f67af9115f01e77408ee3d90d45f77e3","observation_id":"619c8f36-1be3-42f9-8a02-fa61d17b76c7","resolution":{"observed_at":"2026-08-06T16:15:15.604774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.607513Z","title":"International Conference on Artificial Intelligence and Statistics , 2386– 2394 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.607513Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:42346ddb85e67275840131256a2a4a7433d9fc865cd281d800623246a2fe1267","observation_id":"5573b5ee-9447-4ea7-adf7-bd74db139714","resolution":{"observed_at":"2026-08-06T16:15:15.607513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.610598Z","title":"Operations Research 72(5):1906–1927","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.610598Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:58561552b811d72e7c633583f7258631cfbed940462099df624e6617708ebbe6","observation_id":"ce827f2d-70fa-45a4-8dfc-88488d2f0656","resolution":{"observed_at":"2026-08-06T16:15:15.610598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.613430Z","title":"Operations Research 69(3):950–973","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.613430Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d209ecb25a16757ce92e4fd9e7334eaaf2cc3226d840baf9d7137ef850328976","observation_id":"38973305-f761-42f6-a3af-6a7f523857a4","resolution":{"observed_at":"2026-08-06T16:15:15.613430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.616000Z","title":"Mathematics of Operations Research 44(2):565–600","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.616000Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0d059d911750652bce9b7befb188894893c215b0e2bfc845884f75548606d816","observation_id":"0b98b1da-9ce1-45e8-9cd0-0fac68ea4ee0","resolution":{"observed_at":"2026-08-06T16:15:15.616000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.618901Z","title":"International Conference on Machine Learning , 1056–1066 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.618901Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:574a27c7c7b02da877f207755c68215394de56b37179c4da056bdb8ae3fb8936","observation_id":"f12e40e0-a906-487f-8a2f-8834cf4e48cb","resolution":{"observed_at":"2026-08-06T16:15:15.618901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.621807Z","title":"the method of paired comparisons","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.621807Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:571b994ec3462b51dd8e4f2c9230999c3c490c1144b3d739eed09ac19bbc5541","observation_id":"e5f4bb39-e95a-4a5e-92c9-e9163c58fb12","resolution":{"observed_at":"2026-08-06T16:15:15.621807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.624549Z","title":"2022 IEEE 61st Conference on Decision and Control (CDC) , 2833–2838 (IEEE)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.624549Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:109d04b08d7a4052bf329238815ba25d603d341857b3452e537a0e86bab3e35e","observation_id":"5c900be5-fdee-45a8-bf66-a84061a09017","resolution":{"observed_at":"2026-08-06T16:15:15.624549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.627194Z","title":"Operations Research 70(4):2563– 2578","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.627194Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:71323ac42584ab17b88bf641478658ccc009035bcc90af2c0a26c298e13bf948","observation_id":"4aa3a470-cb49-4e0c-81d6-19c269613c8f","resolution":{"observed_at":"2026-08-06T16:15:15.627194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.630359Z","title":"The Eleventh International Conference on Learning Representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.630359Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:acf2fcacf379c39de1a250c620ce246e3954806b5cb57dda6cf25f30477677a9","observation_id":"17a364c8-80c2-4674-ba99-80716f2b0381","resolution":{"observed_at":"2026-08-06T16:15:15.630359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.633188Z","title":"The Thirteenth International Conference on Learning Representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.633188Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:09dbb07145afc7b9efa047e57daa214c45b9908dcf2d608ab78e07c86c5803e3","observation_id":"bc4cfaa9-d03e-40ab-9887-1a87081dfdd6","resolution":{"observed_at":"2026-08-06T16:15:15.633188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.636473Z","title":"Journal of Machine Learning Research 25(4):1–48","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.636473Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e468ca4f59499533fe137f36de5888de873990fd64f5fa21c840e216a52396c2","observation_id":"48b82d19-3fb8-4c84-9469-4077e9b9aa8a","resolution":{"observed_at":"2026-08-06T16:15:15.636473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.639126Z","title":"Advances in neural information processing systems 30","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.639126Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1befb691e2bef25bd80e5a21e31d114508d2860759b75bdf7dbcb1789f9e3218","observation_id":"77042f5f-0b78-404d-a29c-ea7c816de9fd","resolution":{"observed_at":"2026-08-06T16:15:15.639126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.641900Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.641900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:31bcf32a1c743af0a4cba6a35735d3c5b77284b7af5b374ab5706e76502064cf","observation_id":"5b3b6c3f-76ee-442d-833c-852d9512156a","resolution":{"observed_at":"2026-08-06T16:15:15.641900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.645160Z","title":"The Annals of Statistics 53(1):426–456","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.645160Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:9795c52f7b54d03afc7e534acc01fb4951cd76b612314b6b206088d3ee0de1f1","observation_id":"dcb15948-03b4-4caa-861f-8901ab6364a3","resolution":{"observed_at":"2026-08-06T16:15:15.645160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.647900Z","title":"International Conference on Machine Learning , 1042–1051 (PMLR)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.647900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:7990aeecf36f734719ff23ab646eb930ab5bc2e825e71c90f59fb47960b7c794","observation_id":"65d94137-b842-411f-88cb-6cd8608abd07","resolution":{"observed_at":"2026-08-06T16:15:15.647900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00874","last_updated":"2021-06-30T13:09:14Z","snapshot_observed_at":"2026-08-13T23:36:09.334741Z","submitted_at":"2020-02-03T16:42:01Z","title":"Finite-Sample Analysis of Stochastic Approximation Using Smooth Convex Envelopes","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00874","snapshot_observed_at":"2026-08-06T16:15:15.650820Z","title":"arXiv preprint arXiv:2002.00874","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.650820Z"},"links":{"cited_paper":"/paper/2002.00874","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:76e7cb9fe00c7f40a9d637a91bb9862955c54221647ad044fb87e06aefd07193","observation_id":"7cc32cb6-b0b1-4ecb-baf2-41192b31f171","resolution":{"observed_at":"2026-08-06T16:15:15.650820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-08-13T18:04:15.355452Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-08-06T16:15:15.653672Z","title":"arXiv preprint arXiv:2102.01567","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.653672Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:9085252153fdd378c49eeb514b11f119ef4f020f65789db9bc56957344089838","observation_id":"067d16b7-c757-4fb4-ad9c-3064f461fe02","resolution":{"observed_at":"2026-08-06T16:15:15.653672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14208","last_updated":"2025-02-20T02:39:37Z","snapshot_observed_at":"2026-08-13T18:02:25.893642Z","submitted_at":"2025-02-20T02:39:37Z","title":"A Non-Asymptotic Theory of Seminorm Lyapunov Stability: From Deterministic to Stochastic Iterative Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14208","snapshot_observed_at":"2026-08-06T16:15:15.656586Z","title":"arXiv preprint arXiv:2502.14208","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.656586Z"},"links":{"cited_paper":"/paper/2502.14208","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2f0fc468ecf9826a2ad881d876b0da1e8ca57d3ce32757e903c360c0a8c07642","observation_id":"ddfc3f08-603d-42f4-be74-81ef18d9c46b","resolution":{"observed_at":"2026-08-06T16:15:15.656586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.659874Z","title":"Advances in Neural Information Processing Systems 37:1750–1810","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.659874Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:684ea86251dba0586da4244f9a0980c94070bd1fd76b37be6db9f41283de671f","observation_id":"00e68bf7-7e69-460b-8d0d-056198a81de3","resolution":{"observed_at":"2026-08-06T16:15:15.659874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.662819Z","title":"Thirty-seventh Conference on Neural Informa- tion Processing Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.662819Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ae75b36b1aec03d3f1986cd7c9b8991c2ff33ff40f14209945540ae082daf2a7","observation_id":"68a30ee7-11c0-4080-b444-3ca23fa47e20","resolution":{"observed_at":"2026-08-06T16:15:15.662819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.665426Z","title":"Algorithmic Learning Theory , 578–598 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.665426Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8258b4f1030966802b310b3f9d3c948fb6a7f453fcf652412bfb65e3efb0d97b","observation_id":"bd11732f-6a12-4c64-9a47-248a3901ee7c","resolution":{"observed_at":"2026-08-06T16:15:15.665426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09311","last_updated":"2019-09-27T02:09:54Z","snapshot_observed_at":"2026-08-14T17:25:25.872797Z","submitted_at":"2019-01-27T03:44:42Z","title":"Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP","version":2},"cited_work":{"arxiv_id":"1901.09311","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.09311","snapshot_observed_at":"2026-08-06T16:15:16.199680Z","title":"Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP","venue":"cs.LG","work_id":"54822cea-2269-49e2-b852-713076c8b770","year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.669216Z"},"links":{"cited_paper":"/paper/1901.09311","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:18b2e110be9c8253993c7d3acf3a260403472f6639952fba4bdc33ce3c8ac8af","observation_id":"adca8aff-9532-4ec8-85aa-12f2d1a0e8a3","resolution":{"observed_at":"2026-08-06T16:15:16.203077Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10897","last_updated":"2021-07-11T22:29:02Z","snapshot_observed_at":"2026-08-13T19:55:06.344838Z","submitted_at":"2021-03-19T16:34:20Z","title":"Bilinear Classes: A Structural Framework for Provable Generalization in RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10897","snapshot_observed_at":"2026-08-06T16:15:15.672091Z","title":"arXiv preprint arXiv:2103.10897","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.672091Z"},"links":{"cited_paper":"/paper/2103.10897","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:73c7613a6dd6d52f3e4aedc6d6a4e5bbd6d185cebb10a5129ffad3055d3bed1d","observation_id":"c0d3bcea-a478-43e1-8754-535767a3c107","resolution":{"observed_at":"2026-08-06T16:15:15.672091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.675019Z","title":"The Annals of Statistics 49(3):1378–1406","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.675019Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:23c729322d347012a3d1dd8ac3b741e9707b4eb4e4176b724f3976071fcc5b08","observation_id":"120fdbc4-e8eb-46f1-aa2a-bac11f48c4c3","resolution":{"observed_at":"2026-08-06T16:15:15.675019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.677860Z","title":"Journal of machine learning Research 5(Dec):1–25","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.677860Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:708417c362be092328cf4682458faa6ce93f031e78b38522ba5b530ccc08c713","observation_id":"c68b7e45-697b-4470-a7a9-4fa2a735d3f6","resolution":{"observed_at":"2026-08-06T16:15:15.677860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.680580Z","title":"International conference on machine learning, 1467–1476 (PMLR)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.680580Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:10b0111deee7f9ac57f4057fbf69bf74214c48f509c5e5d165d19b991e4d15ad","observation_id":"0980d5a1-9f25-4414-b556-a09c96c08a38","resolution":{"observed_at":"2026-08-06T16:15:15.680580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13487","last_updated":"2023-07-11T16:47:42Z","snapshot_observed_at":"2026-08-13T17:08:25.517069Z","submitted_at":"2021-12-27T02:53:44Z","title":"The Statistical Complexity of Interactive Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13487","snapshot_observed_at":"2026-08-06T16:15:15.683085Z","title":"arXiv preprint arXiv:2112.13487","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.683085Z"},"links":{"cited_paper":"/paper/2112.13487","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1c39c42c83d9ac0fea72d113d7e23773ebccd3cd527b0e386324bf5ab1b2a0ad","observation_id":"87b205ca-c24e-4ca0-8376-572f95508cd7","resolution":{"observed_at":"2026-08-06T16:15:15.683085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.685895Z","title":"Operations Research 71(6):2291–2306","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.685895Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:6eeb5a9d1d445f1dc9dd70186d6f528cf1d0495aa9684ea3ca76b73b73a30f36","observation_id":"ee3a6a52-4683-45a7-8b86-9a2b453bf786","resolution":{"observed_at":"2026-08-06T16:15:15.685895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.688671Z","title":"Advances in neural information processing sys- tems 23:2613–2621","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.688671Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:05a816890081c6fe6c427c3cd42d89b02085eb9fc20c9adc9f7412fae791559c","observation_id":"1833bfe8-ebd1-4a3b-a8c4-f0616d57827a","resolution":{"observed_at":"2026-08-06T16:15:15.688671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.691313Z","title":"International Conference on Machine Learning , 12790–12822 (PMLR)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.691313Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:3193564ca3f99e0f3c5d6c93d9535a1d4dfdd0e1805332c4af0486621f7fbd53","observation_id":"b0cd9721-5fbf-45a1-990b-56f3627f5469","resolution":{"observed_at":"2026-08-06T16:15:15.691313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.693866Z","title":"Mathematics of Operations Research 30(2):257–280","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.693866Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8de95018096c0dd8a6bf88c1815b2f9204a9f5ee9d28f378f89c08bc23bacca2","observation_id":"a2356951-8c33-4ec8-8520-daec7a9f2595","resolution":{"observed_at":"2026-08-06T16:15:15.693866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.696679Z","title":"Journal of Machine Learning Research 11:1563–1600","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.696679Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5c06b932907fc5ceb58a0f617e6e2c6082edb4fc4b628e585e105ab4234171a2","observation_id":"3644e780-3a6e-426a-9fc4-c14cb33110c6","resolution":{"observed_at":"2026-08-06T16:15:15.696679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.699236Z","title":"Advances in neural information processing systems 36:80674–80689","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.699236Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a613e06afb1ad649a1615e6bbc0e3b016853dc7a0fd30f55b4f122dee2b9ca3d","observation_id":"c08b3e32-668a-4811-b53c-961dcb296400","resolution":{"observed_at":"2026-08-06T16:15:15.699236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.702414Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.702414Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:07adf7815a75380792d26c84d636f83f9546db5ac6b7b8aa83ac89f52c4aa9bf","observation_id":"cbd95dce-b202-43c5-a955-c69a785c2fc8","resolution":{"observed_at":"2026-08-06T16:15:15.702414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.704872Z","title":"International Conference on Machine Learning , 4870–4879 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.704872Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:99ed6cf7bb0e2378fbf676a7863fadc4e78695351bc4064c9fe027be2f4bd7cc","observation_id":"7c41e9f2-608d-4238-85d4-bb11ea4971dc","resolution":{"observed_at":"2026-08-06T16:15:15.704872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.707540Z","title":"Advances in neural information processing systems 34:13406–13418","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.707540Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:afdd6edaeb052b93d004a99b5d45820a88507aa95a35707001c75774b69bd657","observation_id":"6429a0f9-983a-42cb-8f49-402fd2420247","resolution":{"observed_at":"2026-08-06T16:15:15.707540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.710001Z","title":"Conference on Learning Theory , 2137–2143 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.710001Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0671aa155f534b0ee2f25025d8334034d76647cd18267b132782327d8b7ae079","observation_id":"33f1fb05-9c22-4701-925e-4a7118ceb632","resolution":{"observed_at":"2026-08-06T16:15:15.710001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12952","last_updated":"2024-05-21T17:28:06Z","snapshot_observed_at":"2026-08-13T18:02:23.240643Z","submitted_at":"2024-05-21T17:28:06Z","title":"Truncated Variance Reduced Value Iteration","version":1},"cited_work":{"arxiv_id":"2405.12952","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12952","snapshot_observed_at":"2026-08-06T16:15:16.168099Z","title":"Truncated Variance Reduced Value Iteration","venue":"cs.LG","work_id":"a6fb707f-2dfa-426d-9d1b-f31d5490a059","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.712851Z"},"links":{"cited_paper":"/paper/2405.12952","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5301218f7a86e9898ecdaa3ff4a52d0361b708bb1792c2678c73b7084ddb61bd","observation_id":"677e47ea-b9fb-4f06-bf79-4917285a202e","resolution":{"observed_at":"2026-08-06T16:15:16.171403Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09900","last_updated":"2025-06-05T01:50:31Z","snapshot_observed_at":"2026-08-13T13:18:35.409457Z","submitted_at":"2022-12-19T22:43:08Z","title":"Policy learning \"without\" overlap: Pessimism and generalized empirical Bernstein's inequality","version":4},"cited_work":{"arxiv_id":"2212.09900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.09900","snapshot_observed_at":"2026-08-06T16:15:16.154853Z","title":"Policy learning \"without\" overlap: Pessimism and generalized empirical Bernstein's inequality","venue":"cs.LG","work_id":"c7bda10d-3663-4a5d-9010-b07e13d9d6cc","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.715810Z"},"links":{"cited_paper":"/paper/2212.09900","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ba13fa6f16376cce9a04de3d73776d79d6a5a3f89ade431c0bc9e6a5baf4096c","observation_id":"f949fb1b-dc6e-4789-859f-63169b561092","resolution":{"observed_at":"2026-08-06T16:15:16.158454Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.718629Z","title":"International Conference on Machine Learning , 5055–5064 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.718629Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:bdff626ad929864b093a54244f58e768f41bd5d9ac3143d8981805d8622933c2","observation_id":"1e43d55b-b08e-401e-88d1-76b69a147cd2","resolution":{"observed_at":"2026-08-06T16:15:15.718629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.721328Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.721328Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8d320f084ed799595cb2be5d2ac25152e282caf4845fc1ced125837761d16fe4","observation_id":"5554fea2-2587-4baf-9d57-0f1080817287","resolution":{"observed_at":"2026-08-06T16:15:15.721328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.723876Z","title":"Advances in neural information processing systems , 315–323","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.723876Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b1bad181e26e22894cc6c99816204c49b5acd5b698baf903ef6a79025182b4e8","observation_id":"b28c4f96-27c9-4490-8466-9fcd0e7c932c","resolution":{"observed_at":"2026-08-06T16:15:15.723876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.726348Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.726348Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2625bea9e577df05ec9588964f7871065b82b8380f7b5aef4feaacb0c95f066f","observation_id":"f8510dad-89c5-495d-9802-f7cebb0342b4","resolution":{"observed_at":"2026-08-06T16:15:15.726348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.729125Z","title":"Advances in neural information process- ing systems , 1531–1538","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.729125Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:678286e68a9456ae918be358ea736a607cc5adf3e0ff4c58bf6cb5d8ae3bc6a8","observation_id":"58efa114-0175-4882-bc56-0db3b904a02a","resolution":{"observed_at":"2026-08-06T16:15:15.729125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.731783Z","title":"Advances in neural information processing systems , 996–1002","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.731783Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:f2b6b3614f1267474e4029c9766cd08465b7de50330e43fde19c6d9074ca93db","observation_id":"db0b6f4c-6d30-438d-89ff-066c277f0666","resolution":{"observed_at":"2026-08-06T16:15:15.731783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.734332Z","title":"SIAM Journal on Math- ematics of Data Science 3(4):1013–1040","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.734332Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b0e23e9c35e3933aaa1db5329cfd26c471fa1e9884f591e2aa08f3bbc1f568ea","observation_id":"7eb07294-e04f-419d-8d46-6c16c57f585d","resolution":{"observed_at":"2026-08-06T16:15:15.734332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.736951Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.736951Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:fb2dd78df1b02bc22c2c266387a55eb02cfba4bd3fdd141f5c2a493b209c7d71","observation_id":"6d59be80-373a-41e6-b7bf-2f842b4560c3","resolution":{"observed_at":"2026-08-06T16:15:15.736951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.739408Z","title":"IEEE Transactions on Automatic Control 27(1):137–146","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.739408Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:9a32188b8ac7ebbc8eecc90fe6581f3826c8fbf6745ae553c869bd7730ce826f","observation_id":"231935af-ec32-4e6a-8ec6-05a9549586f4","resolution":{"observed_at":"2026-08-06T16:15:15.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.741940Z","title":"Advances in applied mathematics 6(1):4–22","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.741940Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:63fa45ac783d6b171717f3d361079f3de8ad31d90e5a99ddf9970de80601049e","observation_id":"d3cf1e35-b9f5-456b-801d-61730d3ed36b","resolution":{"observed_at":"2026-08-06T16:15:15.741940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.744401Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.744401Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:bdb99b11b1b2df1ced25fd72dc6070030ba792c8f6c5613fc6ac0f71d6134f1a","observation_id":"2d65c4ff-4309-4e1b-9d06-4e960aee8b1b","resolution":{"observed_at":"2026-08-06T16:15:15.744401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.747001Z","title":"Reinforcement learning, 45–73 (Springer)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.747001Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0bdd28f82f4a6884bb3cbcb7c236e0b9a7195ca90160f31cad9d679942755698","observation_id":"8b0b23a6-1835-4e94-9189-a25968bffa40","resolution":{"observed_at":"2026-08-06T16:15:15.747001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.749643Z","title":"International Con- ference on Algorithmic Learning Theory , 320–334 (Springer)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.749643Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:6afb4e019d81e952058122f344955e6a1a6be60f29974907299d821747f2def1","observation_id":"1f0efe3a-3d01-4f72-a226-185d11a3fd50","resolution":{"observed_at":"2026-08-06T16:15:15.749643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.752335Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.752335Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:12d67e7f9681983ba5d187292758748b041af11a581158787c571786e0ed52ce","observation_id":"7ae971a1-eb4e-4184-b555-a817de7eb4ba","resolution":{"observed_at":"2026-08-06T16:15:15.752335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T16:15:15.754970Z","title":"arXiv preprint arXiv:2005.01643","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.754970Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8192a44ef0b4bf618bb4f9621d5dfdcf84ef3187c613e37ecb5b8a1333b41229","observation_id":"29d3c5a0-3d60-47ff-9d3e-98def9604053","resolution":{"observed_at":"2026-08-06T16:15:15.754970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.757950Z","title":"Operations Research 72(1):222–236","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.757950Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:468c333111694da45cbfbea358bcf9d1e19a54808606c23d472e565ac2a57d24","observation_id":"76e99e63-077b-4b42-a938-e929252dc9e3","resolution":{"observed_at":"2026-08-06T16:15:15.757950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.760540Z","title":"Advances in Neural Information Processing Systems , volume 35, 15353–15367","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.760540Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:35a89ee64e58d6ba64b23c727b54ab9b7c41126f1edb6ed8e3c539b0cca1fc70","observation_id":"365b5c58-e2d5-4bbc-bdd7-a4452d0be9f9","resolution":{"observed_at":"2026-08-06T16:15:15.760540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.762992Z","title":"The Annals of Statistics 52(1):233–260","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.762992Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:aa5ae5e2ee8e0199c2dc6668f96a4cd288368feafe06772502890df12296466f","observation_id":"16202a1e-bc48-4efc-be55-a7f6c3b4a16b","resolution":{"observed_at":"2026-08-06T16:15:15.762992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.765580Z","title":"Advances in Neural Information Processing Systems 34","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.765580Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:59c6006f6d6a359e8b9be8e9f2467a62abefa6526b7399ce3588f54548e88cf1","observation_id":"43384b55-aee6-4b60-88a2-fa7b73a8955a","resolution":{"observed_at":"2026-08-06T16:15:15.765580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.768171Z","title":"Mathematical Programming 1–96","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.768171Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5a8cb7dc86840bd2481ea364383d730037290b7ecd2a1f7c5f12ed600b4f0512","observation_id":"889b26fb-6ef1-4c17-9f19-be97bcce130d","resolution":{"observed_at":"2026-08-06T16:15:15.768171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.770763Z","title":"Operations Research 72(1):203–221","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.770763Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e613f53d066fdb74c366e41d2fb84f40864c16a50bf2871efd2c25c3e510c118","observation_id":"5afca019-fc67-43b4-846a-d16463f74b49","resolution":{"observed_at":"2026-08-06T16:15:15.770763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.773621Z","title":"Advances in neural information processing systems 33:12861–12872","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.773621Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c234fefd0cf95a4fab5149705bc1ff90626eba28b76af4bb46f0a1af3158ec9d","observation_id":"2676757a-1ae5-4152-89f1-aa9038b4a097","resolution":{"observed_at":"2026-08-06T16:15:15.773621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.776421Z","title":"IEEE Transactions on Information Theory 68(1):448–473","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.776421Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a64f23e281c54d121d1f63e6af04499f0eabade16eee5130d5a048b5386c00a3","observation_id":"41f19b95-c669-42da-9205-b65746c4e5b2","resolution":{"observed_at":"2026-08-06T16:15:15.776421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.779018Z","title":"The Thirty Seventh Annual Conference on Learning Theory , 3431–3436 (PMLR)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.779018Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ff123124c88634026894da0cdcd6d4659a43b7974077f399632a90e1c431c13d","observation_id":"c894203d-872e-4178-a99e-5c11c8ca0cd6","resolution":{"observed_at":"2026-08-06T16:15:15.779018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.781667Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.781667Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ad42e0a48026d5030d62db6ef8be0e8e7c6976f6c1bf0bab24f638082e2827b5","observation_id":"0b224d95-7049-47cb-a3d2-680bede3cb6a","resolution":{"observed_at":"2026-08-06T16:15:15.781667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.784390Z","title":"International Conference on Machine Learning , 6248–6258 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.784390Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:40b8dcbc8104af9fb9f4545277ce4d43296866baa11df84e4c5a8a5db1d95257","observation_id":"c4385664-923b-41a0-9d53-f1c24af0a41c","resolution":{"observed_at":"2026-08-06T16:15:15.784390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.787425Z","title":"Games and economic behavior 10(1):6–38","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.787425Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:bc9b8aebe6f46285acbe88a1290f8eeed070f15d3a929e95c18551a2134332ce","observation_id":"6e9afc94-0d5e-4aca-86c8-c30dc179330a","resolution":{"observed_at":"2026-08-06T16:15:15.787425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.790417Z","title":"International Conference on Machine Learning , 6820–6829 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.790417Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0ff599a7044ba6911234f95776cf35a1b2299cc2fc90be942b9fb31e39d22f35","observation_id":"86485cd9-1eb1-4e62-b2e9-a36ef0a60f4a","resolution":{"observed_at":"2026-08-06T16:15:15.790417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.793166Z","title":"Conference on Learning Theory, 2947–2997 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.793166Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a018e449f1083e2c5a363ef01babf27f22f50245b79f6c519e56dae3b87b143b","observation_id":"cfeff9aa-4b04-4544-a3db-bba947385458","resolution":{"observed_at":"2026-08-06T16:15:15.793166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.795858Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.795858Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:66bdbc5595deb91276e7fb7c03081a78dacdb0dc1de9ffdca65b71019ad3f9dc","observation_id":"f0fcbd82-6ce0-4076-9479-5f58eeac5fba","resolution":{"observed_at":"2026-08-06T16:15:15.795858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.798817Z","title":"Operations Research 53(5):780–798","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.798817Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8f02554438f31f32ae32d4090bea329c861c9e925ff7ef616eb3838ed9fcc587","observation_id":"d72d4ffb-933b-4980-9b1f-c809a5f249d4","resolution":{"observed_at":"2026-08-06T16:15:15.798817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.801688Z","title":"(2022) Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.801688Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:4ff3c18cbe0e1a64f74c9d079208a887221341e0a09dc6f346ee411e1205a8af","observation_id":"40774393-8e86-4690-b0fa-52b10eef868c","resolution":{"observed_at":"2026-08-06T16:15:15.801688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.804449Z","title":"International Conference on Artificial Intelligence and Statistics, 9582–9602 (PMLR)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.804449Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:547acc506210fb3dfdcd9ccacc10a511c7c0ae5741c8dec75b3786c7af65e9a0","observation_id":"7f96ae58-f510-49b4-9af8-4c014d53ea7c","resolution":{"observed_at":"2026-08-06T16:15:15.804449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.807408Z","title":"IEEE Transactions on Information Theory 67(1):566–585","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.807408Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5621d1a952c1fbb3ed98c09505e8c16a09f8bb623d34a3a343a5e9048b1e06d6","observation_id":"480562cf-e498-4aed-b5a0-4e3156a11dba","resolution":{"observed_at":"2026-08-06T16:15:15.807408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01387","last_updated":"2023-04-19T00:30:20Z","snapshot_observed_at":"2026-08-13T17:05:50.238915Z","submitted_at":"2022-03-02T20:05:11Z","title":"A Survey on Offline Reinforcement Learning: Taxonomy, Review, and Open Problems","version":3},"cited_work":{"arxiv_id":"2203.01387","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01387","snapshot_observed_at":"2026-08-06T16:15:16.130645Z","title":"A Survey on Offline Reinforcement Learning: Taxonomy, Review, and Open Problems","venue":"cs.LG","work_id":"c9c28b61-fdd7-4ef3-ad18-c69865d85e87","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.810157Z"},"links":{"cited_paper":"/paper/2203.01387","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:be03a5f4200ab320bcd7b4a7c7fa0dd09e50ebecf57a15b184b574b8297644f5","observation_id":"29a58c46-9992-482f-9d3c-f74b71cdbdf2","resolution":{"observed_at":"2026-08-06T16:15:16.134078Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.812922Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.812922Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:998e64027ab17784f72b380e8de1b673939e9207256756a46a1b785b38992369","observation_id":"2e51058d-276c-4991-9ef1-1241da4fe643","resolution":{"observed_at":"2026-08-06T16:15:15.812922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.816021Z","title":"Conference on Learning Theory 3185–3205","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.816021Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:05fe4c17ef3b6550271a4fb6d877be8396f86f40b26b91bf773a31d109224621","observation_id":"30e65d9d-c35e-48cd-a829-0a74a531f6cf","resolution":{"observed_at":"2026-08-06T16:15:15.816021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.818702Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.818702Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:4b64e41c818af0b2aa4b739e509e434d4c7d22ed8192046cddcbceb26cab7fef","observation_id":"3b8033e1-1767-48d8-ac46-09c54e5dc3f4","resolution":{"observed_at":"2026-08-06T16:15:15.818702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.821727Z","title":"IEEE Transactions on Informa- tion Theory 68(12):8156–8196","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.821727Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ffef26891c86f4c8b80b547dc19722f1aad0cd14dc823441dbb1841ef0ad2220","observation_id":"b98d7279-ee7e-410b-b6eb-7c56223f2ad9","resolution":{"observed_at":"2026-08-06T16:15:15.821727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.824494Z","title":"Proceedings of the 35th International Conference on Neural Information Pro- cessing Systems, 15621–15634","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.824494Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a14ed5eb23469cb105e8e4549650c473770d16b3b3e83f6bd556695263f5c710","observation_id":"8c46f309-995d-4c84-9d8d-ee287d1eb483","resolution":{"observed_at":"2026-08-06T16:15:15.824494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.827171Z","title":"The Annals of Math- ematical Statistics 400–407","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.827171Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1d4d30dc6a436e6f52207f3af45ffe525d3da6240b7a3d6948a14efff3f66f2f","observation_id":"a6617798-7f47-455d-882a-528aaa128892","resolution":{"observed_at":"2026-08-06T16:15:15.827171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.864231Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems","venue":null,"work_id":"fb5412aa-72cb-490c-bd26-3b7513ba644e","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.830079Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:3f292d8fb27681f809aa491fc41a1bb34f7d65ff3d3022dbae6bef654b4c7eae","observation_id":"011c3f51-53b2-446a-ac6a-2aad727abf49","resolution":{"observed_at":"2026-08-06T16:15:16.867130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.855699Z","title":"The Thirty Seventh Annual Conference on Learning Theory , 4511–4547 (PMLR)","venue":null,"work_id":"025c62be-4ff4-4c0a-8341-476dde471a1d","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.832787Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8ac042d6b5d4a32efffbed987e72b0c184d8fec554ff672792a056ab4d68ad52","observation_id":"c2a0dbfe-341e-4840-8cde-895f6b06e181","resolution":{"observed_at":"2026-08-06T16:15:16.858474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.847094Z","title":null,"venue":null,"work_id":"48f00741-ed01-4942-aa5e-627fcf1ca376","year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.835923Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:496b183fb1b6d7768cc1f65c28b36cbc1a950cdff0ee6843e45655d03bd24330","observation_id":"71c57e02-a541-4377-b28d-d307580ff2a6","resolution":{"observed_at":"2026-08-06T16:15:16.850078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.838757Z","title":"Journal of Machine Learning Research 25(200):1–91","venue":null,"work_id":"dae3be45-d39d-4faa-9b0e-14a5c99bb7ae","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.839243Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ffd84f9de33728862527e7c73cca05919ed6301e3d678282b6f613a89790acc3","observation_id":"d4ed827c-e1e5-4db4-8080-34e1ab6f1ca1","resolution":{"observed_at":"2026-08-06T16:15:16.841650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.829966Z","title":"International Conference on Machine Learning (PMLR)","venue":null,"work_id":"7e56b0d3-1a45-48e8-9c8f-5eb895ea1ff2","year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.842026Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:82809ddd9ee0aa6305b22c63e7adca8e09cb01ed671f59dc282893330acbe7cf","observation_id":"9af1ae1b-f334-4b7a-99f9-71de1e318321","resolution":{"observed_at":"2026-08-06T16:15:16.832857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.821559Z","title":"International Conference on Machine Learning 19967–20025","venue":null,"work_id":"659520e3-0989-425a-950d-2705a1b464ca","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.844965Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c918d23717182cb666438f69cfc90956cad72ed502ea398ae27174a0fee1194c","observation_id":"3af75634-3043-425f-a06d-6d45a12613eb","resolution":{"observed_at":"2026-08-06T16:15:16.824681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.812829Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":"c60d4937-4acc-4cc0-ae6a-89eeaed30e28","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.848230Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:6282efc52ee313b72a613f88d334732ceb5914f083699cd13b1eabf7c33d92bd","observation_id":"0755f1ff-6864-4c27-8071-4821c2eb2d8e","resolution":{"observed_at":"2026-08-06T16:15:16.815809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.803793Z","title":"International Confer- ence on Machine Learning , 44909–44959 (PMLR)","venue":null,"work_id":"fbf4e022-096d-44b0-a925-47650e949690","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.850895Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:efcc7e5da10f53cea35df94cc65dc18ca55bfeee7e0c3eb61444951472cf4d70","observation_id":"5f5a39a2-8ae0-45d6-8cd3-5aaf5ba905ff","resolution":{"observed_at":"2026-08-06T16:15:16.807059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-14T15:14:45.544908Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":89,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":162},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 162 outbound references and 1 inbound Pith citation observation for arXiv:2507.14444."}