{"as_of":"2026-08-15T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef237626bae3a7a2ccf5e5359a5b878ad412b90f0e91f2e211cc400b57c766e5","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:58:30.177720Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T22:34:05.838427Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T22:34:09.275036Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"cited_work":{"arxiv_id":"2501.19254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19254","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear Q-le arning does not diverge: Convergence rates to a bounded set","venue":null,"work_id":"d3cbeeab-7132-4b26-b865-76b988b161fa","year":2025},"citing_paper":{"arxiv_id":"2510.16132","last_updated":"2026-04-03T19:00:32Z","snapshot_observed_at":"2026-08-14T08:50:23.111350Z","submitted_at":"2025-10-17T18:19:00Z","title":"A Minimal-Assumption Analysis of Q-Learning with Time-Varying Policies","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T05:47:47.782246Z"},"links":{"cited_paper":"/paper/2501.19254","citing_paper":"/paper/2510.16132"},"observation_digest":"sha256:dcdc707ec3ea399d7cf1efdc613e39c271ca654cfa6ea3e3a0d8ddf04af8996b","observation_id":"b42121ae-070b-4859-85e6-37be898e1cdc","resolution":{"observed_at":"2026-05-18T05:50:57.163269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"cited_work":{"arxiv_id":"2501.19254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19254","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear Q-le arning does not diverge: Convergence rates to a bounded set","venue":null,"work_id":"d3cbeeab-7132-4b26-b865-76b988b161fa","year":2025},"citing_paper":{"arxiv_id":"2605.11021","last_updated":"2026-07-03T05:54:34Z","snapshot_observed_at":"2026-08-15T08:08:54.159769Z","submitted_at":"2026-05-10T16:21:31Z","title":"A Switching System Theory of Q-Learning with Linear Function Approximation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T06:16:23.809510Z"},"links":{"cited_paper":"/paper/2501.19254","citing_paper":"/paper/2605.11021"},"observation_digest":"sha256:054df245cd2753f11bbd5cc9d93f181d8cfc1a4dec9fffc916a5c1023c372aa9","observation_id":"94bc028b-1789-43f7-b855-2690b0f69a4c","resolution":{"observed_at":"2026-05-13T06:17:22.850655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"cited_work":{"arxiv_id":"2501.19254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19254","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear Q-le arning does not diverge: Convergence rates to a bounded set","venue":null,"work_id":"d3cbeeab-7132-4b26-b865-76b988b161fa","year":2025},"citing_paper":{"arxiv_id":"2605.11021","last_updated":"2026-07-03T05:54:34Z","snapshot_observed_at":"2026-08-15T08:08:54.159769Z","submitted_at":"2026-05-10T16:21:31Z","title":"A Switching System Theory of Q-Learning with Linear Function Approximation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:05.838427Z"},"links":{"cited_paper":"/paper/2501.19254","citing_paper":"/paper/2605.11021"},"observation_digest":"sha256:f6cf756581467f755a9e5e97d5c99baec91276b4177a68031c690809ed65f726","observation_id":"827a4c9f-7183-4d24-a336-a71cb2bad00d","resolution":{"observed_at":"2026-05-20T22:34:09.281243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.19254/citation-record","integrity":"/paper/2501.19254/integrity","json":"/paper/2501.19254/citation-record.json","paper":"/paper/2501.19254"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:29.390261Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.390261Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:449166230c96106a22ea99bd13c908c1b62d412ad437e4bedff2721707b44eac","observation_id":"36993655-962a-4d50-9df2-2f42138b16d9","resolution":{"observed_at":"2026-08-09T20:58:29.390261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.326951Z","title":null,"venue":null,"work_id":"37486436-86d0-42a2-bd20-93e6d216d42c","year":1995},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.496381Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:8fde494a0ec77bb112d7c9fc9e35277521ddfaaa1a136ed23858686b5658be8d","observation_id":"ca0f78ec-4fd1-4ba3-829f-25503527166e","resolution":{"observed_at":"2026-08-09T20:58:32.332945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:29.530301Z","title":"First-order methods in optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.530301Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:8971e7b4394172db81f0c0e204c3f77a6995864ddd4fa26cd2ce7a91cd4850c8","observation_id":"0cf194cd-20f1-4293-8500-e43a9462d597","resolution":{"observed_at":"2026-08-09T20:58:29.530301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.296853Z","title":"A Markovian decision process","venue":null,"work_id":"161acec4-5e7c-414f-b8e4-4e53baa37052","year":1957},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.535413Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:bbe9e59b245f2ecde840fd938807bbba2929319c8a34bdd46ebd6c6e769be51a","observation_id":"21f23488-367d-429e-9ee2-49433e08f2d6","resolution":{"observed_at":"2026-08-09T20:58:32.302788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.275040Z","title":"Adaptive Algorithms and Stochastic Approximations","venue":null,"work_id":"8d1f420b-7484-4161-9078-9a44a609929c","year":1990},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.543242Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:fdd875df473ad871532366d29a8fa680720e5a95a2343e165aacf49f71ef87b8","observation_id":"74714a0b-bcff-446d-b52c-f2664339746b","resolution":{"observed_at":"2026-08-09T20:58:32.282169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.255347Z","title":"Stochastic approximation: a dynamical systems viewpoint","venue":null,"work_id":"f18d7cdf-b561-48ed-a308-bab91718f994","year":2009},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.549783Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:6669473c9663e9753363bc0c8c17d8a92b1aec52ec5372bb2a145d3f68df847e","observation_id":"22e9fad4-e53d-4e1d-b15b-d1738b0bf16d","resolution":{"observed_at":"2026-08-09T20:58:32.261902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.237860Z","title":"The ODE method for asymptotic statistics in stochastic approximation and reinforcement learning","venue":null,"work_id":"a6bc5200-f4c0-429a-837c-ddfd29774db8","year":2025},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.556360Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:66e6e3be7f64528de3e6add3cade8569218409fbd986a01437f0ece900b9c0b3","observation_id":"be507291-899f-4fe1-b39d-81fa98b0a64e","resolution":{"observed_at":"2026-08-09T20:58:32.243181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.219867Z","title":"D., and Wang, Z","venue":null,"work_id":"df2968f8-d904-431a-94ab-f6d9831b692b","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.563163Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:224f5f7b2438cec6c9ac4a0885b3128684a717501f8556266393e14ee66afb31","observation_id":"f523b574-2638-46fe-823f-fb200063030b","resolution":{"observed_at":"2026-08-09T20:58:32.225964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.153882Z","title":"S., and Santos, P","venue":null,"work_id":"9702bc1c-a831-4a74-bfce-e84f8555b519","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.570563Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:9a0309ee3bdddf024838ed0b70c5494283d94ee703ca322d9438bda7c39e8664","observation_id":"8e655a9c-0dd4-4419-8e84-2830d3ec41d4","resolution":{"observed_at":"2026-08-09T20:58:32.191334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:32.017937Z","title":"and Zhao, L","venue":null,"work_id":"f7bedbbc-314b-44a9-bbd8-5a1c47c433d0","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.576330Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:75c031e4b3f5d970d319864541fc708caba28724a803ee1ee8c5a06956bc4020","observation_id":"e4df219c-019c-4c79-a391-498b63dda8e8","resolution":{"observed_at":"2026-08-09T20:58:32.099214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.862272Z","title":"T., Shakkottai, S., and Shanmugam, K","venue":null,"work_id":"1bcd99c9-f546-4929-9664-7b1107849504","year":2021},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.581772Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:7a776f9b00859af64911e34da4d6d1971da817c51ad6c5dad2a8badf5e94aff2","observation_id":"b3f740b2-af26-4a5d-95e9-fae02cfed326","resolution":{"observed_at":"2026-08-09T20:58:31.964475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.822397Z","title":"T., Maguluri, S","venue":null,"work_id":"f0d2c4e8-5fc4-48f7-a438-4430d4ed7f79","year":2022},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.586922Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:fa93865dd7343593b929c55f73ce57d4ea6bab0458318310c5fbac2e6dea4363","observation_id":"94dade05-3c28-47fe-912b-ebcba9b1d1dd","resolution":{"observed_at":"2026-08-09T20:58:31.828721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.800561Z","title":"P., and Maguluri, S","venue":null,"work_id":"e3df060e-bdb5-4ee0-bc4f-29bfc79faac5","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.592659Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:3767f8376ab3aec85dc6c5de8f4b57b2b432a8d19719f2f50e51afef4c35586e","observation_id":"147eeda4-a667-4d21-b5d8-2e685798b24b","resolution":{"observed_at":"2026-08-09T20:58:31.806526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.775337Z","title":"T., and Zubeldia, M","venue":null,"work_id":"039dd4cd-e3e6-4cde-a0a3-92843b29bc4c","year":2025},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.597792Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:1f45fbd16e007be5bce588953254b50efcda2d087779c620784fd4bc250414c4","observation_id":"e3597ec1-2087-432a-ba1d-6caf3d63e160","resolution":{"observed_at":"2026-08-09T20:58:31.783135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.751919Z","title":null,"venue":null,"work_id":"34760c82-cc6b-4d2c-adc8-b2c0b682d06e","year":2022},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.603381Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:02ec04bd6fdb795932ea95d982f3eebfd0f3f13a7fdf434c96e27d9fc4004222","observation_id":"097a0c5c-d6c2-496a-b271-0a673294059e","resolution":{"observed_at":"2026-08-09T20:58:31.757980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.732461Z","title":"Learning rates for Q-learning","venue":null,"work_id":"67e24fe9-e489-4a2f-9417-d5760f38a852","year":2003},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.608375Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:041d8279442bb75ac00df2c19d7329a052ca3679832f04f204dcb2a3ea90c104","observation_id":"e49b25aa-5768-4420-8d29-fe28c3fa3505","resolution":{"observed_at":"2026-08-09T20:58:31.737817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.711828Z","title":"A theoretical analysis of deep Q-Learning","venue":null,"work_id":"8ddd8ad7-ed92-4955-9e8e-9112d72db10d","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.613242Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:68bc5a9f17aac7a429928869636c92e3c4ccb417722e4a238d1a2de1f9142195","observation_id":"50e030d0-6e9a-437f-999a-63e28936ddd0","resolution":{"observed_at":"2026-08-09T20:58:31.717377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.693855Z","title":"and Thoppe, G","venue":null,"work_id":"088ca572-2a6a-46be-9b2a-bdc3f5e02b42","year":2022},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.618420Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:93728c71789c50f24fed6a05b727f741ef2d9e3d598fbe9c917acd313fc8c9da","observation_id":"30024e98-be1f-4070-b1a6-65b4403d43f6","resolution":{"observed_at":"2026-08-09T20:58:31.699415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.673108Z","title":"Boundedness of iterates in Q-learning","venue":null,"work_id":"91afed68-4161-4193-b9d5-2bc339844ae3","year":2006},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.623231Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:165e41ee48b839bf96bb7556a52a3c86a023fdd15c30d877aff39ab44ffc4f5a","observation_id":"cf449a89-630a-4e74-89f9-e759d6ed5071","resolution":{"observed_at":"2026-08-09T20:58:31.679866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.653036Z","title":"and Donghwan, L","venue":null,"work_id":"1e362c0b-e57a-4708-9073-5527f8ca4413","year":2024},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.629140Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:ff20d126c9cc8b823c64bcfcc81f0d618b874cc5066a29cdf65f3ee4009f741c","observation_id":"ab2de571-7c9a-41f0-8742-7e7a1f2c8191","resolution":{"observed_at":"2026-08-09T20:58:31.659209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.636036Z","title":"Convergence of stochastic iterative dynamic programming algorithms","venue":null,"work_id":"e0a73cb4-7d80-4380-bac9-a9c2a36392ec","year":1993},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.635962Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:46571539527d31b1f8bcdc905c26cd3170e828cfe4751dcabdf58debed5830fd","observation_id":"2abc488c-6815-4fd9-acd7-2fc770dcfc56","resolution":{"observed_at":"2026-08-09T20:58:31.641631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.617329Z","title":"Exponential hardness of reinforcement learning with linear function approximation","venue":null,"work_id":"7444d198-648b-4e20-8293-a7319a1c8c1f","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.641535Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:69cb31c79ffe3ef6a5e0f9cf08ced39f8365af5ce97d89aaf4bbb44b54edf0e0","observation_id":"af605be1-789c-4f4c-bcb7-40ab2e86f5a4","resolution":{"observed_at":"2026-08-09T20:58:31.622732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.487562Z","title":null,"venue":null,"work_id":"d8f8273e-ed31-4952-acb3-700e7b694773","year":2002},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.646863Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:d60938ecd91539f38548ea815c5139e91910125008f64d1dac233cab8403deea","observation_id":"ac00abf5-f772-4bcd-bbd4-8dacaeef6af5","resolution":{"observed_at":"2026-08-09T20:58:31.542458Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.364448Z","title":null,"venue":null,"work_id":"c115b4be-3c34-41a4-b034-19dbb8d00676","year":1999},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.652892Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:a52e0b9fb2133c3d70d79883aac7784c2fe432bcfea9c55ff3f7b54f16ff4f35","observation_id":"6af5b5c5-1147-434d-96e9-48c17f3b1a0d","resolution":{"observed_at":"2026-08-09T20:58:31.436348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.254844Z","title":"and Yin, G","venue":null,"work_id":"51066a63-55e5-470d-9340-edb49ea979bb","year":2003},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.658470Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:0f981b699b8bf57525ba1dc06626ec49d19ad9145b35ddcbb0272bb0e52b5401","observation_id":"61401d30-56de-455b-8acb-013d1d23378c","resolution":{"observed_at":"2026-08-09T20:58:31.275608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.232661Z","title":"and He, N","venue":null,"work_id":"82853591-ec5a-441f-beb3-184e90477c47","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.666504Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:1f1dfd895516e9b39ab9ecfede829ce4ddf47d1f6908ca05ffbb6c52d2dc3dd6","observation_id":"86a32984-15b8-4566-b662-518aa055615a","resolution":{"observed_at":"2026-08-09T20:58:31.239096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.211138Z","title":"Is Q-learning minimax optimal? a tight sample complexity analysis","venue":null,"work_id":"756f2206-86d6-4ff8-a929-8a5bc3d1b0b6","year":2024},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.672969Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:8e344e9fdde18d07df1d98d9cb6b136db7db3806128b7dc064bffa56b3d0d75a","observation_id":"735f8e06-d9d0-4a82-b6ca-5b5f14708115","resolution":{"observed_at":"2026-08-09T20:58:31.217145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.190715Z","title":null,"venue":null,"work_id":"66cbfb25-9129-4672-8803-2a20e254e0a7","year":1992},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.678067Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:1d0211c8774d4f749ea83075e1204a75b21968eca9c3ed88ba2dc926a2305a60","observation_id":"586ba490-444e-4b60-9e33-2ac17e9460ac","resolution":{"observed_at":"2026-08-09T20:58:31.197787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.159517Z","title":null,"venue":null,"work_id":"fb0b5b10-fdd7-40b6-9b6f-bcbeaf494a49","year":1996},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.684277Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:2755eed2fd083a486db4ee8b2611ca545ccb62b2e865ea1043bd4dfb96dbcacb","observation_id":"3d0236e0-685c-43c6-80c3-a0d3a2f45425","resolution":{"observed_at":"2026-08-09T20:58:31.170326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.139585Z","title":"The ODE method for stochastic approximation and reinforcement learning with markovian noise","venue":null,"work_id":"85f33465-9bea-400a-baca-0beef8f6a9af","year":2025},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.689700Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:7c47e49d86bdd5b2a521bd0690b7908f80722f5b3794f6afc1ffa89ccbbae364","observation_id":"91d28fff-0ec5-4729-87ef-b5883f8c0ce9","resolution":{"observed_at":"2026-08-09T20:58:31.145455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.114631Z","title":"and Tsitsiklis, J","venue":null,"work_id":"d43fdbdd-9988-4c14-8063-eb882a5e0e28","year":2001},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.694822Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:fac306f8b4c8dcfe971be0d6949b1bd2b56341a422e138211cd741b99dfccfe6","observation_id":"d353bbdf-7db6-42d9-8054-da0396cfdaec","resolution":{"observed_at":"2026-08-09T20:58:31.124280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.092540Z","title":"S., Meyn, S","venue":null,"work_id":"1774c56a-c85c-44b9-a032-baf23cc0131e","year":2008},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.699755Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:e4045660812cee792ce604f7915ac0c57e7fa4cebcad5e192b1fc85f8eb86b3b","observation_id":"25d3d80d-462a-4c8b-bf90-2d5b3f0ff733","resolution":{"observed_at":"2026-08-09T20:58:31.098987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:31.012428Z","title":"The projected bellman equation in reinforcement learning","venue":null,"work_id":"a88219c4-e800-44f3-a3ba-008bb3638803","year":2024},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.730600Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:197dfcf8a603cd5a4b0cfe19390391871666a1f6e470444f90fc5302cd865333","observation_id":"2abb70ce-03c6-4999-ae83-c49b3790b1c1","resolution":{"observed_at":"2026-08-09T20:58:31.076321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:29.797237Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.797237Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:f55aee2363802443728c09f7a3745ca5c23dd83380d07a1e2fd98aa61e93a732","observation_id":"93ecb8cc-cd3f-466f-ba2b-79f345a76951","resolution":{"observed_at":"2026-08-09T20:58:29.797237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.857471Z","title":"and Gharesifard, B","venue":null,"work_id":"ecd56aa4-74e6-4a79-a966-9c852e2d3270","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.829769Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:c70f7bedbf1496f10dd4cba1130f1464da05faa63f18475d1d1f6f9da6751998","observation_id":"3135a3b8-9ff9-43c0-881c-a461fe61bd84","resolution":{"observed_at":"2026-08-09T20:58:30.914278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.735591Z","title":"Almost sure convergence rates and concentration of stochastic approximation and reinforcement learning with markovian noise","venue":null,"work_id":"90d0e856-88ee-418c-985a-d3166ba3dbab","year":2024},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.888380Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:e33988b104b3a9aaf991107958b3fbec5569183e840ad81c09c1281487fd7a04","observation_id":"10df2676-522a-4a07-a883-b352416d928a","resolution":{"observed_at":"2026-08-09T20:58:30.797136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.670523Z","title":null,"venue":null,"work_id":"fb4dccd0-9727-42f6-9b4f-208053f0b6d0","year":1994},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.922180Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:aa90ec020b4d7d6e3662c9a8d5ed0fa9347c72f7d8afdfc47fc6c2f549ad5ffd","observation_id":"91a537ef-454f-41f3-957b-7f6f17892b11","resolution":{"observed_at":"2026-08-09T20:58:30.694645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.654388Z","title":null,"venue":null,"work_id":"298ce64e-ebb8-45cb-994b-17219673244f","year":2018},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.971995Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:65aa0880acf520f27de1597ae38f2313dade5c1e722ea3c25d4d71b560425a49","observation_id":"48b790ea-a766-46f5-a630-5c0803fe35b9","resolution":{"observed_at":"2026-08-09T20:58:30.659539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.637049Z","title":"The asymptotic convergence-rate of Q-learning","venue":null,"work_id":"794b2152-7742-4e5c-84f7-f5afd097a795","year":1997},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:29.997454Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:32fa6eee0ddf279a76c1318efcb80e5a4e0c072db5a7238c0afe1462240547a5","observation_id":"b7f7c519-4037-4712-91a1-5ea044dc45e4","resolution":{"observed_at":"2026-08-09T20:58:30.642271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.618556Z","title":null,"venue":null,"work_id":"69e50828-ef64-4143-b47d-f1eaeb2cef31","year":1994},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.078504Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:93a3d315b337b791cf9c21afed19a326aa3be2b28db3b39a279e5927875733d5","observation_id":"a44c37db-d70e-4e71-8cc1-574dd8c7b253","resolution":{"observed_at":"2026-08-09T20:58:30.624256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.599204Z","title":null,"venue":null,"work_id":"0cfb0159-4a54-43f9-9f18-3c8ab6adc29b","year":1992},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.087584Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:e65f83ce6f188ad516f7cf13895e48279cc135ef90b5090b0db46571bd1de996","observation_id":"db4ebd1a-0cb3-4be6-9bd7-ae655731f9a9","resolution":{"observed_at":"2026-08-09T20:58:30.606665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.581608Z","title":null,"venue":null,"work_id":"5aec8244-27f2-473c-baf2-acb020ade699","year":1989},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.100942Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:bbe59615cbcf545f85aef94a0d08ab845eb0596e3eed4b250d57d68694d94b74","observation_id":"f2c0bf0b-ba49-463e-b799-fb40a67a6088","resolution":{"observed_at":"2026-08-09T20:58:30.588206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.560834Z","title":"A finite-time analysis of two time-scale actor-critic methods","venue":null,"work_id":"ef0b29ba-6015-4f1d-9530-f793d8643ea9","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.109221Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:1ed751d67db34b1fa3341ee32763603a11b40860c5af2c7dc542fd02ea55f045","observation_id":"25726b4e-0b1b-4379-8dab-857216be19cd","resolution":{"observed_at":"2026-08-09T20:58:30.568048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.543834Z","title":"and Gu, Q","venue":null,"work_id":"4a36ab59-3af3-42df-b216-4fd05761e308","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.115028Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:482f7b1d5d64a0ef95ebb1c2c239ecbd13c00f186aad727ed6574ac74e34893c","observation_id":"97c06f47-f27e-4604-af1e-454b8882815f","resolution":{"observed_at":"2026-08-09T20:58:30.549325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.526527Z","title":"Provably convergent two-timescale off-policy actor-critic with function approximation","venue":null,"work_id":"e1ac2ff4-5b4a-44d3-8610-41c7fc02921f","year":2020},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.122062Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:bfdd27a0487b90e686bcc5b20066bfbd5879cb617f944c66af7bce2fddd68804","observation_id":"a6697c8a-c688-44d6-86b2-06108e35c5ec","resolution":{"observed_at":"2026-08-09T20:58:30.532477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.360226Z","title":"Breaking the deadly triad with a target network","venue":null,"work_id":"9470dc9e-9d2f-4fd8-a96a-ff1581dc47e3","year":2021},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.131992Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:6b33e95179d2b38d8bf7c61f698d65b932b77d3b4cf49e94337687d45cb2912a","observation_id":"a3138edf-0121-4d6d-b436-10662e8720bf","resolution":{"observed_at":"2026-08-09T20:58:30.476178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.332605Z","title":"Global optimality and finite sample analysis of softmax off-policy actor critic under state distribution mismatch","venue":null,"work_id":"ea072358-5f8b-471a-9a39-90bd69b7c86c","year":2022},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.142792Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:9a1ba01e503288c80482ab7ef04cccb70a9d1dac3f80f0aba419fb51105b0d2e","observation_id":"c163ce65-0e5d-47f4-8744-bba20c400e72","resolution":{"observed_at":"2026-08-09T20:58:30.343119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.309036Z","title":"T., and Laroche, R","venue":null,"work_id":"aaf030d1-2907-4d00-a6ac-614416741e72","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.152536Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:0443ae161558bfe280ac0ecb823a3f39e89a27fe38d4fde7511b53eced0c13f3","observation_id":"ebf40e84-ab56-4b01-9aad-90382fe31612","resolution":{"observed_at":"2026-08-09T20:58:30.315884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.285653Z","title":"On the convergence and sample complexity analysis of deep q-networks with -greedy exploration","venue":null,"work_id":"98182fef-b5c8-440b-9c0c-385f538a015c","year":2023},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.159097Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:6138f30d66e1ba7cdcd02d679be38ef5a10caf712711dcf2da0def58921251ca","observation_id":"843744d8-6dd9-4332-8b3d-d730a85110ab","resolution":{"observed_at":"2026-08-09T20:58:30.292104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.262699Z","title":"and Xie, Q","venue":null,"work_id":"24a34e0a-5cf2-4f98-b09e-c1a1b4b1e909","year":2024},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.171211Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:a8055c4bf1a492cd5fa7ba996e8267510afe3f69e5d14c48d48d1d2506ea8875","observation_id":"5cd36632-0109-4d69-a2ed-d0fda9ef87fe","resolution":{"observed_at":"2026-08-09T20:58:30.269383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:58:30.229082Z","title":"Finite-sample analysis for SARSA with linear function approximation","venue":null,"work_id":"f1e8e65a-f36d-4204-b81c-50a360c0ec71","year":2019},"citing_paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T20:58:30.177720Z"},"links":{"citing_paper":"/paper/2501.19254"},"observation_digest":"sha256:36ab83391e7edb636bcdfd46f230b0c59226a083a1fc90353178164898367757","observation_id":"44efca40-5a04-470f-8d0e-0b08cb185131","resolution":{"observed_at":"2026-08-09T20:58:30.241760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.19254","last_updated":"2025-05-27T16:10:41Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T20:45:43.685040Z","submitted_at":"2025-01-31T16:10:50Z","title":"Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 3 inbound Pith citation observations for arXiv:2501.19254."}