{"as_of":"2026-08-10T00:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0807347a1ddde77e8999174351bf6bf2a020c4967361fe24f01e4aba0af49e8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:15:15.653672Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T02:18:44.885808Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2404.14442","last_updated":"2026-05-11T13:49:35Z","snapshot_observed_at":"2026-08-02T21:40:55.937181Z","submitted_at":"2024-04-20T01:16:27Z","title":"Toward a Unified Lyapunov-Certified ODE Convergence Analysis of Smooth Q-Learning with p-Norms","version":7},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T02:16:04.596951Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2404.14442"},"observation_digest":"sha256:7c9cb6194e51bb45073fe351b5d311cc56c8365d659c1f4f211249432ad57de8","observation_id":"886d6936-c725-4e7f-8730-96008331033e","resolution":{"observed_at":"2026-05-24T02:18:44.890270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-08-06T16:15:15.653672Z","title":"arXiv preprint arXiv:2102.01567","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.653672Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c04f52e423299b0ff3d9011c41860bc855eefe867679dbcbfd69427fbaaca31e","observation_id":"067d16b7-c757-4fb4-ad9c-3064f461fe02","resolution":{"observed_at":"2026-08-06T16:15:15.653672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2509.18964","last_updated":"2026-04-20T11:35:29Z","snapshot_observed_at":"2026-07-06T22:30:31.933240Z","submitted_at":"2025-09-23T13:16:14Z","title":"Central Limit Theorems for Asynchronous Averaged Q-Learning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T14:55:49.034505Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2509.18964"},"observation_digest":"sha256:7dbad89ccec453d08cd2490a5cb99154273ca3ae04fcf240f691ad69f7950e0b","observation_id":"504916bd-aa98-4ab5-81db-a0103d7ecc21","resolution":{"observed_at":"2026-05-18T14:56:30.379155Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:6b55edbdb6a10c76a3006aaa786f8ca98c238896903ced4993645a12c1dd3aff","observation_id":"55c7007f-6f0c-49e4-925b-76cfe072e2b1","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2604.04394","last_updated":"2026-04-06T03:48:42Z","snapshot_observed_at":"2026-08-02T09:04:25.615806Z","submitted_at":"2026-04-06T03:48:42Z","title":"Finite-Time Analysis of Q-Value Iteration for General-Sum Stackelberg Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:49:31.844061Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2604.04394"},"observation_digest":"sha256:7f943c9d5f6205005d9548a97a9513bb28bb1afd2e11ddc52fc923ca92c3f74e","observation_id":"a67af2fe-7a3d-441c-9e6e-90de4947eaeb","resolution":{"observed_at":"2026-05-10T22:30:50.085352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2604.19569","last_updated":"2026-06-30T06:39:04Z","snapshot_observed_at":"2026-07-06T23:06:12.542013Z","submitted_at":"2026-04-21T15:22:42Z","title":"Lyapunov-Certified Direct Switching Theory for Q-Learning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T02:24:29.722541Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2604.19569"},"observation_digest":"sha256:c0ae979713a5e8bbf8fd71020581586e0304f6a49f3257501b0bb1d3a47875c0","observation_id":"02176971-3da5-4684-95e8-c211ba9b87ed","resolution":{"observed_at":"2026-05-11T13:06:02.465577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2605.08053","last_updated":"2026-05-08T17:41:48Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:41:48Z","title":"Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:22.846629Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2605.08053"},"observation_digest":"sha256:8fab2b685757261b85a744610f0c134136be35bf4a7a2472365ced3f4fe9478d","observation_id":"2ac93f8b-a011-4a4a-8a12-3801873cf073","resolution":{"observed_at":"2026-05-11T03:50:57.361222Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2605.11021","last_updated":"2026-07-03T05:54:34Z","snapshot_observed_at":"2026-08-07T08:06:09.443225Z","submitted_at":"2026-05-10T16:21:31Z","title":"A Switching System Theory of Q-Learning with Linear Function Approximation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T06:16:23.809510Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2605.11021"},"observation_digest":"sha256:484a21e1b0d24f211ecc2617261c917080e82eb250a2cd110e6f7cf026665761","observation_id":"0fb8ab85-932c-437f-a653-053f80fc5d41","resolution":{"observed_at":"2026-05-13T06:17:22.853925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2605.11021","last_updated":"2026-07-03T05:54:34Z","snapshot_observed_at":"2026-08-07T08:06:09.443225Z","submitted_at":"2026-05-10T16:21:31Z","title":"A Switching System Theory of Q-Learning with Linear Function Approximation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:05.838427Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2605.11021"},"observation_digest":"sha256:ddcae397064d56c6bbc3c9351d3c673f90d079e54a9f4b7389f84dc33ff712b9","observation_id":"3a59870b-a982-4202-a0ae-7432229b9f58","resolution":{"observed_at":"2026-05-20T22:34:09.258848Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2605.16103","last_updated":"2026-07-05T23:03:13Z","snapshot_observed_at":"2026-08-08T05:22:14.016214Z","submitted_at":"2026-05-15T15:54:35Z","title":"Sign-Separated Asymmetric Finite-Time Error Analysis of Q-Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T18:06:25.278993Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2605.16103"},"observation_digest":"sha256:3dcdc76268dcc64ea097a85c84258c96d6b0c073e95ff0225aa7b8311d141a30","observation_id":"8805dc15-5c74-4b07-939a-21c19f122d0d","resolution":{"observed_at":"2026-05-20T18:08:50.710327Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":"2102.01567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A L yapunov theory for ﬁnite- sample guarantees of asynchronous Q-learning and TD-learning va riants","venue":null,"work_id":"bd38b0b4-16c7-4276-935e-bae98b7f23c2","year":2021},"citing_paper":{"arxiv_id":"2605.20999","last_updated":"2026-05-20T10:38:08Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T10:38:08Z","title":"Concentration of General Stochastic Approximation Under Heavy-Tailed Markovian Noise","version":1},"reference_index":206,"source":"arxiv_source","source_observed_at":"2026-05-21T02:27:24.989781Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2605.20999"},"observation_digest":"sha256:2e296fe0d11fe9e844885e084926bc5d4ea192e443e060a73b1bbe2fa5ac5f83","observation_id":"f2d90220-2bda-4215-a106-3bf936689f5e","resolution":{"observed_at":"2026-05-21T02:29:25.065553Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-08-04T18:22:18.999794Z","title":"arXiv preprint arXiv:2102.01567 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01917","last_updated":"2026-08-03T08:50:07Z","snapshot_observed_at":"2026-08-06T23:34:20.504322Z","submitted_at":"2026-08-03T08:50:07Z","title":"Finite-Time Analysis of Discounted Exponential-Utility Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T18:22:18.999794Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2608.01917"},"observation_digest":"sha256:c15d044ffc0f931eca79dec107f17d6dc7175f04730c06cab83b53924e48bf59","observation_id":"76bf0df5-3a2a-401e-a94f-0243c08c8e9c","resolution":{"observed_at":"2026-08-04T18:22:18.999794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2102.01567/citation-record","integrity":"/paper/2102.01567/integrity","json":"/paper/2102.01567/citation-record.json","paper":"/paper/2102.01567"},"outbound":[],"paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2102.01567."}