{"as_of":"2026-08-17T13:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be3c93bd9aef1b703910d6074337f80a2035e052e2c5a4ce668602d652a8428b","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:50:08.527402Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T06:45:38.442849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T07:46:45.596273Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":"2505.03706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-02T07:46:45.596273Z","title":"Policy Gradient Adaptive Control for the","venue":null,"work_id":"aa5ec350-249c-4ed5-afd3-d9e00a496d1a","year":2025},"citing_paper":{"arxiv_id":"2511.08236","last_updated":"2026-04-15T13:24:47Z","snapshot_observed_at":"2026-08-11T14:29:05.806578Z","submitted_at":"2025-11-11T13:35:10Z","title":"Stability of Certainty-Equivalent Adaptive LQR for Linear Systems with Unknown Time-Varying Parameters","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T23:57:37.299127Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2511.08236"},"observation_digest":"sha256:803e1eefe19e4f632c670ccd36155f098b289793139e2dd7036b87810bb0417e","observation_id":"01be5d16-edf7-4620-b66e-5ae49c8aea9b","resolution":{"observed_at":"2026-05-18T00:00:31.571050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":"2505.03706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-02T07:46:45.596273Z","title":"Policy Gradient Adaptive Control for the","venue":null,"work_id":"aa5ec350-249c-4ed5-afd3-d9e00a496d1a","year":2025},"citing_paper":{"arxiv_id":"2512.03764","last_updated":"2026-08-02T11:12:45Z","snapshot_observed_at":"2026-08-09T04:20:43.623330Z","submitted_at":"2025-12-03T13:13:35Z","title":"Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T02:35:57.661008Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2512.03764"},"observation_digest":"sha256:e17945a8244347967f9439d3c9927955b7b41d667d3ac6d1bfd4b80d8c173cf4","observation_id":"d8f09bf2-027c-43d8-ad5a-45320c53b051","resolution":{"observed_at":"2026-05-17T02:38:53.954364Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-08-04T06:45:38.442849Z","title":"Yaghmaie, F.A., Gustafsson, F., and Ljung, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.03764","last_updated":"2026-08-02T11:12:45Z","snapshot_observed_at":"2026-08-09T04:20:43.623330Z","submitted_at":"2025-12-03T13:13:35Z","title":"Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression","version":3},"reference_index":5014,"source":"pdf_text","source_observed_at":"2026-08-04T06:45:38.442849Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2512.03764"},"observation_digest":"sha256:4e42221936ccf00c56e65dec8403748e073fb620f990a8c1acc1e3b552761565","observation_id":"fea2e6a9-c1f7-462e-8c3c-11b0ed6ba680","resolution":{"observed_at":"2026-08-04T06:45:38.442849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":"2505.03706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-02T07:46:45.596273Z","title":"Policy Gradient Adaptive Control for the","venue":null,"work_id":"aa5ec350-249c-4ed5-afd3-d9e00a496d1a","year":2025},"citing_paper":{"arxiv_id":"2604.22138","last_updated":"2026-04-24T00:59:54Z","snapshot_observed_at":"2026-07-06T23:08:37.811548Z","submitted_at":"2026-04-24T00:59:54Z","title":"Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T11:25:06.725383Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2604.22138"},"observation_digest":"sha256:95e9b42ae5df279a93e0e8049f09b872449136617c11207eba5c5b363982eea7","observation_id":"969faada-9e6f-422a-932d-b8aaccc294d4","resolution":{"observed_at":"2026-05-11T19:36:15.031170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":"2505.03706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-02T07:46:45.596273Z","title":"Policy Gradient Adaptive Control for the","venue":null,"work_id":"aa5ec350-249c-4ed5-afd3-d9e00a496d1a","year":2025},"citing_paper":{"arxiv_id":"2605.15563","last_updated":"2026-05-15T03:10:13Z","snapshot_observed_at":"2026-08-16T05:59:25.061398Z","submitted_at":"2026-05-15T03:10:13Z","title":"Direct Data-Driven Linear Quadratic Tracking via Policy Optimization","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-20T19:47:30.108992Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2605.15563"},"observation_digest":"sha256:01581ea4164a2cd6e3c052c5d1eeb85612ac9fd2a669ccdb477ffd0c97cae7c7","observation_id":"dd5455a6-cb58-4481-8c66-79f057739f43","resolution":{"observed_at":"2026-05-20T19:48:57.395173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":"2505.03706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-02T07:46:45.596273Z","title":"Policy Gradient Adaptive Control for the","venue":null,"work_id":"aa5ec350-249c-4ed5-afd3-d9e00a496d1a","year":2025},"citing_paper":{"arxiv_id":"2607.00644","last_updated":"2026-07-01T08:59:31Z","snapshot_observed_at":"2026-08-07T10:02:43.573704Z","submitted_at":"2026-07-01T08:59:31Z","title":"A Data-Enabled Primal-Dual Approach for Policy Learning with SDP Formulations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T07:39:47.486139Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2607.00644"},"observation_digest":"sha256:3342385699b0d4901620bb5e9227020d325f636e59a55cec01b955cdfa5596bc","observation_id":"5d1047a6-a758-4c11-b5b9-f20a3b89c917","resolution":{"observed_at":"2026-07-02T07:46:45.597817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03706","snapshot_observed_at":"2026-07-12T03:48:44.349867Z","title":"Policy gradient adaptive control for the LQR: Indirect and direct approaches.arXiv preprint arXiv:2505.03706, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03251","last_updated":"2026-07-03T12:11:31Z","snapshot_observed_at":"2026-08-13T05:03:34.132038Z","submitted_at":"2026-07-03T12:11:31Z","title":"Adaptive Linear Quadratic Control of Unknown Linear Time-Varying Systems via Policy Gradient Methods","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T03:48:44.349867Z"},"links":{"cited_paper":"/paper/2505.03706","citing_paper":"/paper/2607.03251"},"observation_digest":"sha256:0d213b09d2884e775eb4cba1bf3f95d066a34ab8618bf6fd8ba774a7e263606f","observation_id":"fb1bd19f-a6e3-440c-8130-5a04fd783a0a","resolution":{"observed_at":"2026-07-12T03:48:44.349867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03706/citation-record","integrity":"/paper/2505.03706/integrity","json":"/paper/2505.03706/citation-record.json","paper":"/paper/2505.03706"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.161944Z","title":"A historical perspective of adaptive control and learning,","venue":null,"work_id":"67cd053b-4f19-4e57-9fe4-62b6269161eb","year":2021},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.332465Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:6f243dec54f1302f0e456fce683b153c30bbfd18fa9740a14482630e18947318","observation_id":"40635779-7f77-48ac-8285-0b737af7a6e8","resolution":{"observed_at":"2026-08-15T23:50:09.166600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.146265Z","title":"Adaptive control and intersections with reinforce- ment learning,","venue":null,"work_id":"b7f846bb-d2ea-4005-97d6-06abd2cd8d46","year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.337313Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:f37faae265e900f10c90813eebdde18fcb746ae2501a72034582f9deca5b3901","observation_id":"79d64ad0-f90c-4a45-a8e8-623470f8671b","resolution":{"observed_at":"2026-08-15T23:50:09.151575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.128708Z","title":"Adaptive servomechanisms,","venue":null,"work_id":"42b4feda-b0fc-4dd7-ae48-57b67c4e1387","year":1957},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.341131Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:98371afb38085620b1b7af5260106a08f19585a6d21d9b324e16ce047b491bf4","observation_id":"1e1ca215-34cc-4ae8-bd92-4919ecda4fba","resolution":{"observed_at":"2026-08-15T23:50:09.134123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.109249Z","title":null,"venue":null,"work_id":"5655e46c-158b-49f3-859d-1537ecbbbf38","year":1996},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.345879Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:bbd4b7fc90dfefdea485e6af6877970b5f6742a9efb45bf10ac2e726a652863f","observation_id":"6754dfeb-50c7-4375-8cbf-623e35b59b05","resolution":{"observed_at":"2026-08-15T23:50:09.114356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.351708Z","title":"On model-free adaptive control and its stability analysis,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.351708Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:bcf41ce3155d6c3ac3e1d8da0556bf17cc3828ff59e558c0b00d9f1d052830ee","observation_id":"d1872603-5e5e-4a0a-a4e8-e36e3d04c776","resolution":{"observed_at":"2026-08-15T23:50:08.351708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.082071Z","title":"Adaptive control: Towards a complexity-based general theory,","venue":null,"work_id":"3d63f62a-5661-42b3-a4dd-18d8fc8892be","year":1998},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.357035Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:dac6edf7f358b5e2599d6cbee2124f26345961ea2e6d2179890069233e2d26bc","observation_id":"a2795558-2437-4e4b-9395-12b01fdbd048","resolution":{"observed_at":"2026-08-15T23:50:09.087539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.363919Z","title":"Reinforcement learning and adaptive dynamic programming for feedback control,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.363919Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:b7dc6db6c4e1427407a23b8bd553792521855c66289fecbc406a875ee17db64c","observation_id":"d8923231-7d62-4183-8032-bcb0bc97e4de","resolution":{"observed_at":"2026-08-15T23:50:08.363919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.369044Z","title":"Value iteration and adaptive dynamic pro- gramming for data-driven adaptive optimal control design,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.369044Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:00dee4e89a2b05efa232b0a82fed00fb795f316fb75051f4b791c18ab51c7caa","observation_id":"3a0b3cab-4804-4a66-abe0-8e87fb0f257f","resolution":{"observed_at":"2026-08-15T23:50:08.369044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.043353Z","title":"Certainty equivalence is efficient for linear quadratic control,","venue":null,"work_id":"dab84ce6-ae59-4d86-a8bf-6dd234856a00","year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.373945Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:81ec218be820f0dcfd1a1d00e3ec7f9f9195abd698d6aa43780b80d8412645aa","observation_id":"8090c747-8c58-41cc-9560-edd4635f196c","resolution":{"observed_at":"2026-08-15T23:50:09.048285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.027044Z","title":"Almost surely √ T regret bound for adaptive LQR,","venue":null,"work_id":"a36131a2-7671-4ae6-a11b-b8bde7c5073a","year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.379323Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:c7b4d14338b354588b26976eecf679b2f085154c34441a09fb463041afc3b9fe","observation_id":"4fa18f40-493e-411b-8341-725c61ef617c","resolution":{"observed_at":"2026-08-15T23:50:09.033011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:09.010453Z","title":"Naive exploration is optimal for online LQR,","venue":null,"work_id":"1179ce6c-77ce-4e9f-bad6-fef6afd23e2c","year":2020},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.383232Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:704b847c8d53ad3606198eeef61e9442d5cd3b9342510abb75a3b6002a6f6204","observation_id":"daaa9b28-d4ef-45d3-8697-379a637fde1b","resolution":{"observed_at":"2026-08-15T23:50:09.015119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.993438Z","title":"Learning linear-quadratic regu- lators efficiently with only √ T regret,","venue":null,"work_id":"1ef68535-0f62-43e6-ae0c-7a310e3eb2b1","year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.387634Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:d9bf8a99ad91619fae22e7600ad0bdfb3193d30a25dbd2c7edff9b996c90457e","observation_id":"7a8461ba-5587-4f5b-bfc8-85b41f51998a","resolution":{"observed_at":"2026-08-15T23:50:08.999150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07746","last_updated":"2026-07-22T17:49:59Z","snapshot_observed_at":"2026-08-17T08:47:28.608618Z","submitted_at":"2024-06-11T22:04:59Z","title":"Any-Time Regret-Guaranteed Algorithm for Control of Linear Quadratic Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07746","snapshot_observed_at":"2026-08-15T23:50:08.392249Z","title":"Fully adaptive regret-guaranteed algorithm for control of linear quadratic systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.392249Z"},"links":{"cited_paper":"/paper/2406.07746","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:cc1751e75d09f70d42ac353ec0afb37b86d1de9f303099ca3e20ed80bbd8fa3e","observation_id":"348c57c0-fa5d-4ce6-b5ec-3ba56bfb08ad","resolution":{"observed_at":"2026-08-15T23:50:08.392249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.975469Z","title":"Adaptive control by regulation-triggered batch least squares,","venue":null,"work_id":"ef46a52c-f053-4f6c-8d1b-b94a79e0ee96","year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.397500Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:39f56dbd371234b88077e6045043cfac0354bdb277e51f1dbac9a12d452a6b1c","observation_id":"c7654087-cec3-456b-823c-d1be04f43458","resolution":{"observed_at":"2026-08-15T23:50:08.981265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07627","last_updated":"2025-04-11T08:08:30Z","snapshot_observed_at":"2026-08-16T12:42:25.547208Z","submitted_at":"2025-04-10T10:24:13Z","title":"Robustness of Online Identification-based Policy Iteration to Noisy Data","version":2},"cited_work":{"arxiv_id":"2504.07627","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07627","snapshot_observed_at":"2026-08-15T23:50:08.670693Z","title":"Robustness of Online Identification-based Policy Iteration to Noisy Data","venue":"eess.SY","work_id":"5e75c6b2-4a5d-4443-9d06-1c06a06a3ce0","year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.402209Z"},"links":{"cited_paper":"/paper/2504.07627","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:53ed84411e4354b5c32447c673ca394e500c90b8ac8da08d6c0d473cfdc1bf42","observation_id":"c84d02ea-3bf1-48b7-8f0a-a174a266f252","resolution":{"observed_at":"2026-08-15T23:50:08.675938Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.955999Z","title":"Failures of adaptive control theory and their resolu- tion,","venue":null,"work_id":"6f60018d-402e-4450-953b-a01932061154","year":2005},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.407502Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:7407df0db43f9b058c2cbb9110b996694c1a1d3c0e959a36408892773f399497","observation_id":"5e14a8e5-93cd-4d30-8066-96a8a8b50635","resolution":{"observed_at":"2026-08-15T23:50:08.961342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.936727Z","title":"Toward a theoretical foundation of policy optimization for learning control policies,","venue":null,"work_id":"6ea9570f-98dc-4111-81cd-7c24180c2f60","year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.412487Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:8da0dba6a97ab2deb2b677ecc18d1df96cae3a6638cfa993377ccae548ac22e5","observation_id":"796cf92e-fe24-4d46-88d7-4c93094a36af","resolution":{"observed_at":"2026-08-15T23:50:08.942729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.917250Z","title":"Global convergence of policy gradient methods for the linear quadratic regulator,","venue":null,"work_id":"772e7fbb-2e10-4239-8571-cc1f4fe1f00f","year":2018},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.417713Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:3818f1dc0c7a06e19092b54bd93e0b0f3e8f531773f82bcce3a371a1bd153c07","observation_id":"5135def5-221d-4347-bd5e-403192e40d49","resolution":{"observed_at":"2026-08-15T23:50:08.922626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.900148Z","title":"Convergence and sample complexity of gradient methods for the model-free linear quadratic regulator problem,","venue":null,"work_id":"db53530f-eec9-4fb1-ba5a-02353b3921b6","year":2022},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.422090Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:bf5536925135e84260c946ab01cbbd07bc1a1e676f63578666924044e7c3e675","observation_id":"d707ee08-2849-42bd-b133-ac35137a74ac","resolution":{"observed_at":"2026-08-15T23:50:08.905794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.883235Z","title":"Global convergence of policy gradient primal-dual methods for risk-constrained LQRs,","venue":null,"work_id":"f0d1ca7e-96f9-416a-b031-446cb6415678","year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.426472Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:afead1b5b0df2d52f82a2f9d29bb40608f27f4709a37f9427f611c70224b74a6","observation_id":"f79ea46b-8c5e-446b-be6e-9408fab373e3","resolution":{"observed_at":"2026-08-15T23:50:08.888349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14871","last_updated":"2024-10-04T07:17:37Z","snapshot_observed_at":"2026-08-16T14:24:14.592669Z","submitted_at":"2024-01-26T13:58:35Z","title":"Data-Enabled Policy Optimization for Direct Adaptive Learning of the LQR","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14871","snapshot_observed_at":"2026-08-15T23:50:08.430560Z","title":"Data-enabled policy optimization for direct adaptive learning of the LQR,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.430560Z"},"links":{"cited_paper":"/paper/2401.14871","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:56a1b2c9fc7d34ece4b0b39b1ce31ed5f18f13aa7978a04936100f28989d45e5","observation_id":"d52bcd24-bd87-42ec-8238-a01305777e41","resolution":{"observed_at":"2026-08-15T23:50:08.430560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.867023Z","title":"Integration of adaptive control and reinforcement learning for real-time control and learning,","venue":null,"work_id":"937fda21-958a-4876-90b2-00f383be89a8","year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.435104Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:84da4a3c4458319b3791d303744680c925ee726fc53014e14c446e329c887369","observation_id":"d6121874-dc5e-4ae3-b462-0d7ebd8caf1d","resolution":{"observed_at":"2026-08-15T23:50:08.872404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.439339Z","title":"Behavioral systems theory in data-driven analysis, signal processing, and control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.439339Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:e48ae2312e529c897fddd03f9db4549b86f5126657d7f254b946f64148a3d8e3","observation_id":"8a1a81c1-a71c-4b3c-a4b8-a2bac70e6bed","resolution":{"observed_at":"2026-08-15T23:50:08.439339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.842777Z","title":"Data-enabled predictive control: In the shallows of the DeePC,","venue":null,"work_id":"16f41648-3f20-4781-b828-c32aa157bdbc","year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.443588Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:0de4cb95f8b790475790bc337536e5bd6516b9f7dadf59d1b69eb84827ecc938","observation_id":"f570d65e-6893-4076-8c94-cbd937175c08","resolution":{"observed_at":"2026-08-15T23:50:08.847891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.447741Z","title":"Formulas for data-driven control: Stabilization, optimality, and robustness,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.447741Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:c2a467cde492c734f67c21f6795fcbcac256dbd74f61904dc08f289195f6cde7","observation_id":"818c93c5-e96d-49fa-9dab-c9ad41cd42bd","resolution":{"observed_at":"2026-08-15T23:50:08.447741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.816378Z","title":"On the certainty-equivalence ap- proach to direct data-driven lqr design,","venue":null,"work_id":"b2f0408c-0e2e-488f-89c3-2ae1853b9653","year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.451654Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:eec8057c34fa6551623cd565001b8e0d218046bda70f7d288ce4414c7009d8da","observation_id":"5ec8e207-be91-42ab-9bd8-ddde9a111726","resolution":{"observed_at":"2026-08-15T23:50:08.821067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.802250Z","title":"On the role of regularization in direct data-driven LQR control,","venue":null,"work_id":"ead5ef99-17c4-4fbf-af37-6ed5a1a2c623","year":2022},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.456028Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:e788ab3206db166fabc81e35fe048b65766c12adfe583e4792a3f8b64581d826","observation_id":"858d59ee-37f8-43b7-b344-d1ff981ef716","resolution":{"observed_at":"2026-08-15T23:50:08.806460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.461355Z","title":"Harnessing uncertainty for a separation principle in direct data-driven predictive control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.461355Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:e37da01a8be47b507561a2c0cf5733f78fbc8938f47f2a63f3c5d7ea4c60f5d8","observation_id":"2fa8fff5-26c4-41b6-8d06-67e9f97c5b64","resolution":{"observed_at":"2026-08-15T23:50:08.461355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.466469Z","title":"Data-enabled policy optimization for the linear quadratic regulator,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.466469Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:a484b69ca32ce3a72f817ca6073e8a4ec6e00d9af2ea6efd03bce8121ed29ab1","observation_id":"fb0afc44-f3a2-4c0f-a157-39274face45e","resolution":{"observed_at":"2026-08-15T23:50:08.466469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03909","last_updated":"2025-04-08T14:34:17Z","snapshot_observed_at":"2026-08-17T13:04:26.944999Z","submitted_at":"2024-11-06T13:38:34Z","title":"Direct Adaptive Control of Grid-Connected Power Converters via Output-Feedback Data-Enabled Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03909","snapshot_observed_at":"2026-08-15T23:50:08.471807Z","title":"Direct adaptive control of grid-connected power converters via output-feedback data-enabled policy optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.471807Z"},"links":{"cited_paper":"/paper/2411.03909","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:82829e6be5313f31ed88d1dec46424e9ca349c1be76dcb0af2eca042b2ffc4e7","observation_id":"3aaee222-5001-4e26-a4b5-d4f173986bc7","resolution":{"observed_at":"2026-08-15T23:50:08.471807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.766710Z","title":"Unified aeroelastic flutter and loads control via data-enabled policy optimiza- tion,","venue":null,"work_id":"19d106d3-9da9-442f-bf23-35ee479045bd","year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.477278Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:786bf5f0f189d99a1f747fa9be45401a6a33a5aa8ce5b314025e00578998b975","observation_id":"39141363-9792-455c-a12d-dd50f425848a","resolution":{"observed_at":"2026-08-15T23:50:08.771986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13676","last_updated":"2025-02-19T12:33:53Z","snapshot_observed_at":"2026-08-16T12:57:00.778444Z","submitted_at":"2025-02-19T12:33:53Z","title":"An Adaptive Data-Enabled Policy Optimization Approach for Autonomous Bicycle Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13676","snapshot_observed_at":"2026-08-15T23:50:08.482040Z","title":"An adaptive data-enabled policy optimization approach for autonomous bicycle control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.482040Z"},"links":{"cited_paper":"/paper/2502.13676","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:02ebaf68d7a994fd6dab51de169cf092ad08248480125956894663e47f7619d9","observation_id":"769d165f-8ce3-44ba-bc7b-86e719bf7405","resolution":{"observed_at":"2026-08-15T23:50:08.482040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.487421Z","title":"An iterative technique for the computation of the steady state gains for the discrete optimal regulator,","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.487421Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:a3d3dbb05e21dfafe2532b0aafdf3c39d174eb5e4d3610973d95f0c9bdfb9293","observation_id":"046c9ba2-af68-4cb8-b29c-06052b16fea5","resolution":{"observed_at":"2026-08-15T23:50:08.487421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02985","last_updated":"2025-03-04T20:22:57Z","snapshot_observed_at":"2026-08-16T12:53:04.825618Z","submitted_at":"2025-03-04T20:22:57Z","title":"Regularization for Covariance Parameterization of Direct Data-Driven LQR Control","version":1},"cited_work":{"arxiv_id":"2503.02985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.02985","snapshot_observed_at":"2026-08-15T23:50:08.596248Z","title":"Regularization for Covariance Parameterization of Direct Data-Driven LQR Control","venue":"eess.SY","work_id":"dfd9d58b-0309-4057-bd17-09bf412401e6","year":2025},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.492398Z"},"links":{"cited_paper":"/paper/2503.02985","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:d682de034b214a1a7344899e5f9ec669599cb13d64e95fe22ea37bd878a590c4","observation_id":"0498b88e-123e-497d-b064-109e6af19fe3","resolution":{"observed_at":"2026-08-15T23:50:08.603614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.497648Z","title":"On the sample com- plexity of the linear quadratic regulator,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.497648Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:001e1183966f8358a6482a157e39ed8000b2ac9561fb7dd205ecc692c867bd57","observation_id":"e9bcef5c-0a59-4723-a4f4-1515719219ca","resolution":{"observed_at":"2026-08-15T23:50:08.497648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.503348Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.503348Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:a86bd8dbc7e23ec8760a1eb549ab69099a65ed981ab8393cd4ac7813fe3fea94","observation_id":"ea4545a8-3e5b-48f3-9fa6-0b576276e096","resolution":{"observed_at":"2026-08-15T23:50:08.503348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.508573Z","title":"A note on persistency of excitation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.508573Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:4e6a9d0ce3e73ed336adccb7dbff3a87b46089815ccbef0ad80dc914ca5840a0","observation_id":"44bd1052-5b6d-4799-a175-07fd004fd393","resolution":{"observed_at":"2026-08-15T23:50:08.508573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.513091Z","title":"The informativity approach: To data-driven analysis and control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.513091Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:7cc334b9c24b70a52b1ae1ae95c7f1a4b2eb11b3ca9aed080429192b6846af99","observation_id":"5f762dbb-cd0f-45bf-b362-50bbd39dca49","resolution":{"observed_at":"2026-08-15T23:50:08.513091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:50:08.704586Z","title":"A quantitative notion of persistency of excitation and the robust fundamental lemma,","venue":null,"work_id":"cb8d940f-c28d-4621-8143-bac276f71a4e","year":2022},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.517946Z"},"links":{"citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:a7dce6c3e2715c71eb113021b06cfe5cd3a5008d1544c2bbd27d4ab64cf732a8","observation_id":"611fa837-4fbe-4d4f-ba9c-56f369aee887","resolution":{"observed_at":"2026-08-15T23:50:08.709079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.08921","last_updated":"2019-07-29T20:26:16Z","snapshot_observed_at":"2026-08-14T16:04:02.994968Z","submitted_at":"2019-07-21T06:36:43Z","title":"LQR through the Lens of First Order Methods: Discrete-time Case","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.08921","snapshot_observed_at":"2026-08-15T23:50:08.522490Z","title":"LQR through the lens of first order methods: Discrete-time case,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.522490Z"},"links":{"cited_paper":"/paper/1907.08921","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:c1573bccdd81f7db4e74c8d4f6014eefdc34bb7b2a54eb470924e8f462db507a","observation_id":"c7215d5a-ae1b-4e40-9a12-5562565f8ae0","resolution":{"observed_at":"2026-08-15T23:50:08.522490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19705","last_updated":"2024-12-27T15:59:42Z","snapshot_observed_at":"2026-08-16T03:09:12.735713Z","submitted_at":"2024-12-27T15:59:42Z","title":"Noise Sensitivity of the Semidefinite Programs for Direct Data-Driven LQR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19705","snapshot_observed_at":"2026-08-15T23:50:08.527402Z","title":"Noise sensitivity of the semidefinite programs for direct data-driven lqr,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:50:08.527402Z"},"links":{"cited_paper":"/paper/2412.19705","citing_paper":"/paper/2505.03706"},"observation_digest":"sha256:e019a719ef7c48f0e77b135061f05aa3540e939c21edca8ff2151077c77eeb92","observation_id":"786554f1-64b4-453d-a84c-6c3e2fce4fd9","resolution":{"observed_at":"2026-08-15T23:50:08.527402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.03706","last_updated":"2025-06-13T12:31:19Z","latest_version":2,"primary_category":"math.OC","snapshot_observed_at":"2026-08-16T21:05:36.820509Z","submitted_at":"2025-05-06T17:26:04Z","title":"Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":20},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 7 inbound Pith citation observations for arXiv:2505.03706."}