{"as_of":"2026-08-22T02:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc2339971e65416c5c93c7b7598fccedfbad352f33558cca53dd513a902b0563","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T22:54:25.056198Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:44:36.738417Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.378535Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04297","snapshot_observed_at":"2026-08-15T16:44:36.738417Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T19:12:48.289997Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.738417Z"},"links":{"cited_paper":"/paper/2502.04297","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:c6dec24979bf5368f4537eb88353c63b1030ff1bb4a7f55efe3a99547c323628","observation_id":"e4051267-c4d5-497c-8c65-eecdcd60cc37","resolution":{"observed_at":"2026-08-15T16:44:36.738417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"cited_work":{"arxiv_id":"2502.04297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04297","snapshot_observed_at":"2026-07-04T16:49:58.378535Z","title":"arXiv preprint arXiv:2502.04297 , year=","venue":null,"work_id":"18d3dd0b-dc2e-4ca4-b4e5-934f40bfae13","year":null},"citing_paper":{"arxiv_id":"2606.24999","last_updated":"2026-06-23T16:04:43Z","snapshot_observed_at":"2026-07-06T23:59:32.831481Z","submitted_at":"2026-06-23T16:04:43Z","title":"A Zeroth-Order Deep Learning Method for Fully Nonlinear Parabolic Partial Differential Equations with Unknown Coefficients","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-26T00:10:26.127062Z"},"links":{"cited_paper":"/paper/2502.04297","citing_paper":"/paper/2606.24999"},"observation_digest":"sha256:9155816e1435f4352ad75ce34208e25a353a9b8537a22d5166d3c3a209dc47a7","observation_id":"bc64ca52-46d5-4a31-86f6-2579e210d50a","resolution":{"observed_at":"2026-07-04T16:49:58.380636Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04297/citation-record","integrity":"/paper/2502.04297/integrity","json":"/paper/2502.04297/citation-record.json","paper":"/paper/2502.04297"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.085773Z","title":"Adamczak","venue":null,"work_id":"594a6279-7c00-45e4-8687-9595aab9ec14","year":2008},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.840193Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:9034d394cebe5329e9b7d105efd15a43b44f1263961883fb0bc303f1d50d1e4f","observation_id":"230d1686-d63e-494c-9139-c4d3be192c8a","resolution":{"observed_at":"2026-08-08T22:54:26.090733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.070526Z","title":null,"venue":null,"work_id":"825a7df9-9e63-4e00-8b47-04356c61b8ff","year":1996},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.845452Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:06c55a95da8428ff5ec0a637c89ed27fde1e540ce51e7514a727e053332d48e0","observation_id":"a93c62be-5abe-42ab-ad54-7e6ec2c063f0","resolution":{"observed_at":"2026-08-08T22:54:26.075294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.053660Z","title":"Bakry, F","venue":null,"work_id":"3cbd0352-48a6-4b9f-b056-e164abb2f78d","year":2008},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.849954Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:2ceee3bc713552f6801f4bc572827a6818ea1cc1ef8770cbff7c965535f38e22","observation_id":"c0c2cfc0-8735-4964-89e2-9a9088cb989b","resolution":{"observed_at":"2026-08-08T22:54:26.059292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.036376Z","title":"Bakry and M","venue":null,"work_id":"a0bbbacd-b4ad-403c-9225-b18ab566f9b4","year":1983},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.855149Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:0915578750f0c4af690f26d5bb04a32e0554fd30e2f8b1e6a0f2a79072a91b9b","observation_id":"0eee9270-c9d9-4078-8ab2-44002e4956e1","resolution":{"observed_at":"2026-08-08T22:54:26.041411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.020238Z","title":null,"venue":null,"work_id":"2353bfee-b89d-4a34-8b42-f9c8b985c0c1","year":2002},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.859522Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:02dd85de2d192760338a62b901da2e3e70e24a280615250d26aa24e6fe162882","observation_id":"ad1bd87d-ec58-416a-8e02-5e51db1b9a73","resolution":{"observed_at":"2026-08-08T22:54:26.025175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:26.003521Z","title":null,"venue":null,"work_id":"0e317dcb-7519-480b-bec2-3e56f75dcdc7","year":1995},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.864226Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:979c3cfdd2cb07c769eef8bb566ceddba91439df856aba004669420417c2fa7e","observation_id":"b48cecd1-1bda-4a44-aa0a-3310cfe44d50","resolution":{"observed_at":"2026-08-08T22:54:26.008768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.986857Z","title":"Duoandikoetxea","venue":null,"work_id":"62bf2eff-a3e0-4108-8bc5-9b97f65d65d8","year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.869075Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:4c4c65a0244d61322fe92e3737be50404613c55d3f8cd40d128b4532bec37999","observation_id":"90fa4593-d828-4ea1-be7c-4ed325972d2d","resolution":{"observed_at":"2026-08-08T22:54:25.991842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03899","last_updated":"2022-11-07T23:15:25Z","snapshot_observed_at":"2026-08-21T08:02:48.039594Z","submitted_at":"2022-11-07T23:15:25Z","title":"Policy evaluation from a single path: Multi-step methods, mixing and mis-specification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03899","snapshot_observed_at":"2026-08-08T22:54:24.873399Z","title":"Policy evaluation from a single path: Multi-step methods, mixing and mis-specification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.873399Z"},"links":{"cited_paper":"/paper/2211.03899","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:4e13b67bbf26082099f6b4a83502e65945af873ae3500e738279ffb07a46330a","observation_id":"fea6e0b5-15de-470b-a4f0-bd67a7d75d6e","resolution":{"observed_at":"2026-08-08T22:54:24.873399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.970197Z","title":null,"venue":null,"work_id":"6a33ce41-ac7f-4417-91bc-8280836cef35","year":1981},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.878479Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:7c31820f6801c399b049fc355f66f778a58648ace76b5d4a9af2c75c06c31f1e","observation_id":"ce6721f4-72c5-420c-8c5b-f05afe289a3e","resolution":{"observed_at":"2026-08-08T22:54:25.975173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-19T03:58:04.427381Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"cited_work":{"arxiv_id":"2412.18164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18164","snapshot_observed_at":"2026-08-08T22:54:25.513562Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","venue":"cs.LG","work_id":"dd85871c-c38c-4cc2-b76e-9a0f626654f0","year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.883208Z"},"links":{"cited_paper":"/paper/2412.18164","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:b961af966e26d69ea1d1eb41855a066cda553635e23ada4335297bfbf2e91cbc","observation_id":"f14339bd-36ae-4dd6-914c-2cd9e7c7f5ac","resolution":{"observed_at":"2026-08-08T22:54:25.519427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:24.888059Z","title":null,"venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.888059Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:81331e50504855b8f859839acedcb71d7109f288b478febf86af12cb3c2204a8","observation_id":"399eda29-bfe4-4ccb-ac75-af8f9acf4ad7","resolution":{"observed_at":"2026-08-08T22:54:24.888059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.943816Z","title":null,"venue":null,"work_id":"738472ae-20cc-43fc-922b-e77d936425a8","year":2018},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.893150Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:170c41301b41daf27bf2d8301ebdf86b75139d2a19a2683ebb34d27d0a972f57","observation_id":"a88a1315-79cd-4ca3-9ab3-b4e2eef8ba9a","resolution":{"observed_at":"2026-08-08T22:54:25.948417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.929453Z","title":"Jia and X","venue":null,"work_id":"cc35a383-3d50-43c0-a616-36777992b5f3","year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.897602Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:0c8a6a98b6d5da4a3964e7bfc094fc3f4bce5e10c0640273d16a77d5d057cce3","observation_id":"59aaa2dd-8ce3-439a-b589-cb3e70fef47b","resolution":{"observed_at":"2026-08-08T22:54:25.934173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.913815Z","title":"Jia and X","venue":null,"work_id":"3d2e87c3-9eea-45aa-9fbc-52e35ca06331","year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.902211Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:5324474fd11d7ad8757ad0a96d66b2c8aae2aab11c918a5ae863fd1aae251a29","observation_id":"b582198c-a6e1-4111-838e-00393962c9c3","resolution":{"observed_at":"2026-08-08T22:54:25.918590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.898949Z","title":"Jia and X","venue":null,"work_id":"fc85ce11-eb4c-4ef9-9ad7-658acea8480c","year":2023},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.906515Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:9c9e266920df4a0d911070d0fd330d0f9ba3d645f06939d88ce8954deeb45923","observation_id":"f981d9b2-7d4b-4729-8f0e-cd0d1e4be140","resolution":{"observed_at":"2026-08-08T22:54:25.903470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.884458Z","title":null,"venue":null,"work_id":"558708f3-aa9e-4d39-ab3c-cf83b36a440a","year":2001},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.911110Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:6f02ef84e751df7fd2469b9e26035b7d1244ce74827b811e4c6cf323f389dd17","observation_id":"eba74d97-50e8-4bba-ad22-b4370a60ed06","resolution":{"observed_at":"2026-08-08T22:54:25.889035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.869349Z","title":"Kobeissi and F","venue":null,"work_id":"e6e80fc5-03a7-4c33-91b5-0d35f86dc2f5","year":2023},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.915656Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:05d5c8476800aeb27b88247ba7e154211d7ac17ad787e17e5e9282aff2a780dc","observation_id":"9a479bcf-a7e2-4898-bc72-803e630ba399","resolution":{"observed_at":"2026-08-08T22:54:25.874023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.854425Z","title":"Konda and J","venue":null,"work_id":"b8466bce-ec3b-42b2-be42-7b3820d3d0a9","year":1999},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.920119Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:289b30bd626c01b1ccbf295db3ab045d20f7382c6756e807bb58e9a99505d5f7","observation_id":"914b9ea0-8502-4e14-9c69-d4d24e4132fe","resolution":{"observed_at":"2026-08-08T22:54:25.859204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1305.4825","last_updated":"2016-09-17T09:42:53Z","snapshot_observed_at":"2026-08-15T00:17:08.643949Z","submitted_at":"2013-05-21T14:02:51Z","title":"Learning subgaussian classes : Upper and minimax bounds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1305.4825","snapshot_observed_at":"2026-08-08T22:54:24.924833Z","title":"Lecu \\'e and S","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.924833Z"},"links":{"cited_paper":"/paper/1305.4825","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:4396d5675cd539533ca5568b85a228d927a84c31e2393b06fb3950e5e9eac958","observation_id":"4dce5a64-e32c-436e-b8e0-01b49296c123","resolution":{"observed_at":"2026-08-08T22:54:24.924833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.13104","last_updated":"2024-05-07T17:59:55Z","snapshot_observed_at":"2026-08-16T16:29:39.619400Z","submitted_at":"2022-09-27T01:40:16Z","title":"A Neural Network Approach for Stochastic Optimal Control","version":3},"cited_work":{"arxiv_id":"2209.13104","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.13104","snapshot_observed_at":"2026-08-08T22:54:25.470748Z","title":"A Neural Network Approach for Stochastic Optimal Control","venue":"math.OC","work_id":"fc8adc3b-3281-4506-b1a1-81d487ad0f5d","year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.930193Z"},"links":{"cited_paper":"/paper/2209.13104","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:e37a1470b51b0eaa73e502e832bf1d6604b27954249f9590265678996f0b587b","observation_id":"42cf9aad-3bc5-42cb-9c17-1ab8a686aef4","resolution":{"observed_at":"2026-08-08T22:54:25.478284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04991","last_updated":"2025-08-08T02:46:14Z","snapshot_observed_at":"2026-08-16T13:20:27.883250Z","submitted_at":"2024-09-08T06:05:51Z","title":"Estimates of the numerical density for stochastic differential equations with multiplicative noise","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04991","snapshot_observed_at":"2026-08-08T22:54:24.935061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.935061Z"},"links":{"cited_paper":"/paper/2409.04991","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:c8e10de815b093e9ed3a8349be470d12ec6009dfcaae9f3a5cab389a5f55a6bb","observation_id":"9d709c63-f08e-4e09-aba7-b73b511e9277","resolution":{"observed_at":"2026-08-08T22:54:24.935061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.838993Z","title":"Mendelson","venue":null,"work_id":"a2fe3352-934b-4880-8db0-4a2ee383d3fb","year":2015},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.940034Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:a62ce7d2cacda3249fd1991d4e7e248fbfe98989659613351a5a44bc5a2a8e46","observation_id":"0e7e2f04-e310-4619-a2d2-5a3e21293374","resolution":{"observed_at":"2026-08-08T22:54:25.843979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.824668Z","title":null,"venue":null,"work_id":"cfed347e-2c2a-4c2f-85ab-1d792c4c0fc0","year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.944627Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:69454e0b9b19cbed5a24c03aaa21d8024c9ba03d84a4abdd6ef63d78b62df482","observation_id":"3b923348-3e35-44be-90e7-9993565c1da7","resolution":{"observed_at":"2026-08-08T22:54:25.829217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.809769Z","title":null,"venue":null,"work_id":"99f7c198-972f-489f-a5e7-cf6947573cae","year":2023},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.949289Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:6a6248296ea3d1ba9e33b99155a70c4c51016e85fa1cd61cb6d18d422bc62695","observation_id":"f74986be-9f41-43c8-baca-2821f139dbb8","resolution":{"observed_at":"2026-08-08T22:54:25.814657Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.794640Z","title":null,"venue":null,"work_id":"d2433355-bc96-4c4b-890f-f35c482114a1","year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.953897Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:61f5fd20dd7b5ecfa64103c2a893202585c996811317546f7183df7e82cd2988","observation_id":"b2463f73-e8fd-40e9-a7c4-48a4e6c9409d","resolution":{"observed_at":"2026-08-08T22:54:25.799328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.779356Z","title":"Menozzi, A","venue":null,"work_id":"25b640fb-a07a-495d-9395-6998519dca2d","year":2021},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.958469Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:dcfa436107ab3f09c887ee008858cb32ab3187815de783f1655a3438311a9930","observation_id":"e0b2e113-d12c-4cd7-99d3-b0bc75334f23","resolution":{"observed_at":"2026-08-08T22:54:25.784273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.763849Z","title":"Marinelli and M","venue":null,"work_id":"d469fe5f-d881-4d80-8bd9-3bf7de6b65f9","year":2016},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.963159Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:f35c2ebbc3dc25df95699b4eeb2a1c5576456c2c783d466ae65b0be9204c3241","observation_id":"3cb19114-a1e7-4a24-897f-68aec9fe8ae9","resolution":{"observed_at":"2026-08-08T22:54:25.769007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05966","last_updated":"2024-07-08T14:05:03Z","snapshot_observed_at":"2026-08-16T13:36:09.446614Z","submitted_at":"2024-07-08T14:05:03Z","title":"On Bellman equations for continuous-time policy evaluation I: discretization and approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05966","snapshot_observed_at":"2026-08-08T22:54:24.968030Z","title":"Mou and Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.968030Z"},"links":{"cited_paper":"/paper/2407.05966","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:4adcd037e0036ff9fedf465015aa4e29b789583473d898848fd4ba9ce1fb1e61","observation_id":"d8f86f74-1241-4013-97e0-63bfc346e4a5","resolution":{"observed_at":"2026-08-08T22:54:24.968030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.747593Z","title":"Neeman, B","venue":null,"work_id":"375f8e1e-17d1-448f-90a9-dc675f9e0726","year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.972947Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:2de9aca3995b8b8871bfb2b9ab2d944cdee73d4a5dd8899921555965be21add7","observation_id":"e3e1485a-c84c-4946-80eb-dce2612416ef","resolution":{"observed_at":"2026-08-08T22:54:25.752596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-08-13T14:13:07.807518Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-08T22:54:24.977702Z","title":"Dota 2 with large scale deep reinforcement learning","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.977702Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:180eaa8bd7163c9d8f7b78752973cf7be2189b9a29bbd49476f8d8c666737f46","observation_id":"2c77a5ed-d608-426a-b16f-6b7d920c1492","resolution":{"observed_at":"2026-08-08T22:54:24.977702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.732155Z","title":null,"venue":null,"work_id":"8bdb406f-479c-40b1-9d35-7c89f8f8d09e","year":2019},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.984805Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:81e564acb22f571ce62a0dc6ab1f74188f005a06e1de9ad9a4599ff65d42c0e3","observation_id":"b291c0b7-5704-4e37-87f7-3a547c8aaf90","resolution":{"observed_at":"2026-08-08T22:54:25.737040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.716518Z","title":"Ruthotto, S","venue":null,"work_id":"bd0faee5-0c20-4a72-ac16-7dd3e7668d07","year":2020},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.989140Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:024f9fada3a9ef0f1c3791fae4d8fed791134007718a5a9ee2e7c8e658d13ecd","observation_id":"94f683a3-5b48-4deb-9cc6-725451f012fd","resolution":{"observed_at":"2026-08-08T22:54:25.721726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.701256Z","title":null,"venue":null,"work_id":"5445c390-fa26-496d-bbba-948d4441fb7a","year":2018},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.993454Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:550784f2c9ecc980b4597d97f0e54a272021526e975e8ce4e364fff7a70d1aab","observation_id":"8f1ba5cd-ea5c-4ab5-901e-5d731f26c101","resolution":{"observed_at":"2026-08-08T22:54:25.706137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.686128Z","title":null,"venue":null,"work_id":"f69f1a41-ab20-4088-bc19-07d65b1d1e0c","year":1988},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.997933Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:737fca9772ba117939413b48eff04ac2f088775887435b6aaa741f643febfa29","observation_id":"a19a3845-e278-4260-9483-36896893c894","resolution":{"observed_at":"2026-08-08T22:54:25.690861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.671779Z","title":"Srikant and L","venue":null,"work_id":"3ae7ec9f-068e-439d-aa7a-bb5a2706f6dc","year":2019},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.002678Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:e5cf0e6a29a370ebcd6961dc5da907ef82ffbef49de970b77e137586f914d253","observation_id":"8683176f-c4be-47b2-b1f9-fcb5b4da8dd3","resolution":{"observed_at":"2026-08-08T22:54:25.675933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.657388Z","title":"Szepesv \\'a ri","venue":null,"work_id":"4225b0d9-d979-4f5a-8409-f93013056f4d","year":2022},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.007551Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:0f918200389550aa35b29563a2ed3cc9f374ea27aa27f67c43d5f6e2b3ff9a51","observation_id":"1256de82-cdbb-4ef3-b095-dc4786aa259d","resolution":{"observed_at":"2026-08-08T22:54:25.662008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.012099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.012099Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:fe07f9cad91475294ae19c44e6a397f03e235dccf0176bcf154e84a40a2bf2cc","observation_id":"66da2734-9fb7-44d8-9da1-7749e3833efa","resolution":{"observed_at":"2026-08-08T22:54:25.012099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.642999Z","title":null,"venue":null,"work_id":"e88f1733-e7cf-4e5e-89f3-f6886b021747","year":2011},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.016134Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:e2c2b24200b8e9b04f5f55583dc80f93084822134414b7200980c7375e3b4aa3","observation_id":"93195fad-5cb3-486a-83ca-0b14a4c89031","resolution":{"observed_at":"2026-08-08T22:54:25.647437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.626536Z","title":null,"venue":null,"work_id":"582af63f-135c-4581-8e30-217b2a45f9b6","year":2008},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.020266Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:5a40838bdb83ff662db840f77b756eeca7a19758f6536bfcd3affa0dd5530a5e","observation_id":"a707d3fe-b73f-4a04-9cca-4fa0d0f0988d","resolution":{"observed_at":"2026-08-08T22:54:25.631792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.609866Z","title":null,"venue":null,"work_id":"8ef0db0d-227e-466e-b606-c02ea5f6b0b4","year":1997},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.024793Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:3a617633e423477f18f766d4c1df9ce6945c42cda567abb8f315ef29672c2113","observation_id":"6d628af0-9d7e-4f1c-8fda-72437bd24e65","resolution":{"observed_at":"2026-08-08T22:54:25.614728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-20T07:42:16.420034Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-08T22:54:25.028899Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.028899Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:4a9a3446c57b2c0b05ba7ee6ca291a0b63353391a7dc6a122cac0e0a3c993c74","observation_id":"4dc077ae-75a6-43dc-b3e4-6a18e360a941","resolution":{"observed_at":"2026-08-08T22:54:25.028899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13734","last_updated":"2024-07-18T17:35:32Z","snapshot_observed_at":"2026-08-19T19:21:54.959926Z","submitted_at":"2024-07-18T17:35:32Z","title":"Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13734","snapshot_observed_at":"2026-08-08T22:54:25.033377Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.033377Z"},"links":{"cited_paper":"/paper/2407.13734","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:9d9a4d0f6c2ad126fe971e7a904b69bbc898a85d62f79f09a5998485d6de4a7d","observation_id":"6edd473f-1f6b-47c2-aac6-d26d194b4dad","resolution":{"observed_at":"2026-08-08T22:54:25.033377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.593971Z","title":null,"venue":null,"work_id":"4b0840ce-f4c6-4e82-baa3-6b86327d4776","year":2005},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.037515Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:58080b22bb38e69310427ef556ba8672f7762287a8b56089e09fcc4457778fb5","observation_id":"76c78918-78bb-4bb9-8541-683c4766ffa0","resolution":{"observed_at":"2026-08-08T22:54:25.599183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.578839Z","title":"Wang and X","venue":null,"work_id":"4df6ac92-2f42-40c3-9815-354780fd69f9","year":2020},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.041905Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:c3d1ac1181e54ac164e84b51f049705fe14f6817ad860c6f9b177b89ac8e165b","observation_id":"8ef48b8b-d7a3-4c4c-90a6-ebf64914fafd","resolution":{"observed_at":"2026-08-08T22:54:25.583486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.563548Z","title":null,"venue":null,"work_id":"6c8022b4-6ca2-462a-bace-b3f5e3252cbc","year":2020},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.046509Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:f099a686d15485eba9ed17217e2db8a7ffe2e085d1653f9f39c5c007feb00b05","observation_id":"92faa555-29a8-4587-92f6-a7c85af1c342","resolution":{"observed_at":"2026-08-08T22:54:25.568160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08400","last_updated":"2024-09-12T21:12:21Z","snapshot_observed_at":"2026-08-20T12:00:32.378968Z","submitted_at":"2024-09-12T21:12:21Z","title":"Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08400","snapshot_observed_at":"2026-08-08T22:54:25.051374Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.051374Z"},"links":{"cited_paper":"/paper/2409.08400","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:3843053a5b3d6ba6f74cad9f68f2bc5bc9bd98dd53f264ba41d25d551eef1e90","observation_id":"df08fc17-80f3-468f-8507-5af48db0deb1","resolution":{"observed_at":"2026-08-08T22:54:25.051374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:54:25.548546Z","title":null,"venue":null,"work_id":"b4076f84-e65c-448f-b69d-459d9a2c30c1","year":2021},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:25.056198Z"},"links":{"citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:5b10c2498ad6ffb28103b8fd035fbfcb19e483983558768e6a995c0a6cca4fa1","observation_id":"295ad4b1-6211-455d-bdaa-c4dcdbed9aad","resolution":{"observed_at":"2026-08-08T22:54:25.553143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2502.04297."}