{"as_of":"2026-08-20T05:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:adfaf01f05490fac7c0985f436256d8e075f7e5e5a95567c64cfcf777867a076","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T11:25:12.822765Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:52:37.070457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:30:53.567417Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07059","snapshot_observed_at":"2026-08-11T15:52:37.070457Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-20T03:48:42.719882Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.070457Z"},"links":{"cited_paper":"/paper/2209.07059","citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:62f443318b763f1827b06039b6154430fdb53a9592d525a7a2040b6dde096e62","observation_id":"515f29ec-a540-42de-864a-95f813e05948","resolution":{"observed_at":"2026-08-11T15:52:37.070457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"cited_work":{"arxiv_id":"2209.07059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.07059","snapshot_observed_at":"2026-08-07T05:30:53.567417Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","venue":"math.OC","work_id":"dae07b5b-1bec-4659-b017-1d20ce1db66c","year":2022},"citing_paper":{"arxiv_id":"2506.08121","last_updated":"2026-07-13T21:00:23Z","snapshot_observed_at":"2026-08-17T07:50:06.413076Z","submitted_at":"2025-06-09T18:20:21Z","title":"Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence","version":2},"reference_index":8510,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:53.529461Z"},"links":{"cited_paper":"/paper/2209.07059","citing_paper":"/paper/2506.08121"},"observation_digest":"sha256:1fb936bddbaf09dcdb58f05f5ca5fcfc9e519e7b29bbb222c546fbd5d2b0b24b","observation_id":"d2e2057b-20b1-4630-8632-f97c71617ab8","resolution":{"observed_at":"2026-08-07T05:30:53.573835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2209.07059/citation-record","integrity":"/paper/2209.07059/integrity","json":"/paper/2209.07059/citation-record.json","paper":"/paper/2209.07059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Second order elliptic equations and elliptic systems, volume 174 of Trans- lations of Mathematical Monographs","venue":null,"work_id":"f1072ef2-a8cd-43ef-a864-a39edb2dd4f2","year":1998},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:fabd64a99fbee35eb978908743c4b7d162e1b9fec41d273c608ad3377f097378","observation_id":"c21db4c5-ae56-4c38-b755-d15e2c0a2151","resolution":{"observed_at":"2026-05-24T11:26:09.217603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning equilibrium mean-variance strategy","venue":null,"work_id":"1150f776-7019-47b4-b0fe-0a3c342fe2e6","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:8b26c7c2f77155928a9ff5d0bc9ab296f11ebb9a1bfbd24625dae1f52d01628c","observation_id":"9eb77077-ee9a-4560-ac47-0d357e567849","resolution":{"observed_at":"2026-05-24T11:26:09.153180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83f0f5f5-e3ff-443d-9dfe-c76f4136e2fc","year":1998},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:5e85f9c387aacc3121298c007edb2fc76072405f050abf75ace7c7b6e76e1c19","observation_id":"d94b767f-a519-42a9-ace3-fc64780a318a","resolution":{"observed_at":"2026-05-24T11:26:09.163985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploratory LQG mean field games with entropy regularization","venue":null,"work_id":"f379dcfa-0363-4706-b800-f30aeb15399a","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:b67f58cd73a4fc3558485c86586592ddbcc6671de8d552f539f0cd025343dafe","observation_id":"394a5215-505d-431b-969b-a03390425b50","resolution":{"observed_at":"2026-05-24T11:26:09.240206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taming the noise in reinforcement learning via soft updates","venue":null,"work_id":"c0a4596d-2510-47c5-b753-84e33d1f57f0","year":2016},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:2e718ecb5a68af2451bd8d4958e0b74e7bc0947ea0c5a400f6dd5efa47bb567c","observation_id":"98050124-d32b-48e2-acad-658b994783a8","resolution":{"observed_at":"2026-05-24T11:26:09.246705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trudinger","venue":null,"work_id":"c62db29b-aa10-41c2-b3eb-325d879747c8","year":2001},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:4e8e5f9300fcd276ff4bfdc91a8c4de2b73567049588b6d987aef91deb20ade0","observation_id":"3c103ba0-2e30-4dfc-bf0c-e4a2d8d2ebb2","resolution":{"observed_at":"2026-05-24T11:26:09.202064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entropy regularization for mean field games with learning","venue":null,"work_id":"dc7c018f-eceb-4ab7-a3d2-0741bf5709be","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:b9e8163b2c4173841f37ebcad93f22220ea76fb1b420eb810c4ce6af82271092","observation_id":"b0c7577d-06ce-4d79-9ff3-d08d2312b5e4","resolution":{"observed_at":"2026-05-24T11:26:09.146960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":"e2ec7293-c195-4f77-889c-565369bc87ca","year":2017},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:c79be3902705157a2941ab4cf4fc3e41311d30f43a5aa70d5814aae28984037e","observation_id":"2531fded-2d8f-40ba-818a-776c6ef5cdfb","resolution":{"observed_at":"2026-05-24T11:26:09.232513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"98b0fa1b-ab0f-49cb-b0c9-6e534f56fa86","year":2018},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:8c23da8ef828f19b596bd6f286ba7fa4ea63e3a8ad38eae026cedca3d0b49fb4","observation_id":"6d969779-70cf-402b-b603-9dc3e556422f","resolution":{"observed_at":"2026-05-24T11:26:09.224900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jacka and Aleksandar Mijatovi´ c","venue":null,"work_id":"8c611034-21f5-474a-8d7c-3d7ac1d334db","year":2017},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:f6329b900687363f53c48d47487f43e4d31223db8f65d151c9b55785b7f192d6","observation_id":"7ee46a17-1f7d-4d20-8550-129021c20016","resolution":{"observed_at":"2026-05-24T11:26:09.167727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3788fad5-a3e7-45dc-aa6e-e6b7a402faab","year":1957},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:1f0c84d930ef114e73aae85518c1c0530bee5c0603596dd2a2fbec669b5552e8","observation_id":"df8a86c2-e2bf-4f59-a05e-b4d533172a61","resolution":{"observed_at":"2026-05-24T11:26:09.236857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"97bd50ee-e2f5-480e-aecd-71f08a2882b7","year":1957},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:c4c61a121987ecb83bc2750e93d3c56d5ba2829e2461ca298f72ec685a2c7e05","observation_id":"385fdfac-bede-4493-a528-e9c26c281144","resolution":{"observed_at":"2026-05-24T11:26:09.176502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"q-learning in continuous time","venue":null,"work_id":"7be64d7b-165a-436a-9082-630eea3ddcd8","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:1a7138e793be1324de0f444b678c7cb26be3f064fb22ca92c8186a0ba450de04","observation_id":"4811f6d9-e3bd-4642-8d3c-0ad973a3c75b","resolution":{"observed_at":"2026-05-24T11:26:09.232890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"719d283c-a6ab-466f-8807-626b3140f261","year":1991},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:6d5c08fca82c1b1ed1b6194dd8dd65a16077085c353c73fbbd714e983b9377f3","observation_id":"94e53293-c1d9-43b9-aaa9-d3ef331ce335","resolution":{"observed_at":"2026-05-24T11:26:09.242907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kerimkulov, D","venue":null,"work_id":"afd3497e-baa3-49ad-b55a-54d670895729","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:27d6a8d6e1c75277f5444fdf24b9774f96acd160f1b02d0f537620be6e895934","observation_id":"c105a17b-02b9-49df-96a5-eacf875b0f3c","resolution":{"observed_at":"2026-05-24T11:26:09.236215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exponential convergence and stability of Howard’s policy improvement algorithm for controlled diffusions","venue":null,"work_id":"60c07836-6b26-4b4c-9b58-4f6555b93ecf","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:791936c4eb180644ca1e3f25cc79b8f304d38cf4abd8b8ee55223217273c46b0","observation_id":"abb087c2-99ac-48ff-9021-700f50d94391","resolution":{"observed_at":"2026-05-24T11:26:09.220497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Policy iterations for reinforcement learning problems in continuous time and space—fundamental theory and methods","venue":null,"work_id":"b40df3b0-5143-4fdb-9f96-0aa85e2a0e57","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:c70e3ee8cf81ab43efab170d992dde0ce600f83e2664d788951eba3d11776a96","observation_id":"cf0bef36-12f0-446c-a26d-b991c1564ab5","resolution":{"observed_at":"2026-05-24T11:26:09.186718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04682","last_updated":"2021-05-10T21:40:56Z","snapshot_observed_at":"2026-08-16T18:25:43.066272Z","submitted_at":"2021-05-10T21:40:56Z","title":"Value Iteration in Continuous Actions, States and Time","version":1},"cited_work":{"arxiv_id":"2105.04682","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04682","snapshot_observed_at":"2026-07-02T02:46:29.413053Z","title":"Value iteration in continuous actions, states and time","venue":null,"work_id":"d7acbd1b-d819-4f76-aea7-ff6d83b8669c","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"cited_paper":"/paper/2105.04682","citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:079c7903c1fd21862a42975ab5b977e8de5cd1726677ebbbcc7a7f35a23a63f3","observation_id":"184c3cd6-3214-45db-a1a2-7f4fa125436b","resolution":{"observed_at":"2026-05-24T11:26:09.005905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Higher chain formula proved by combinatorics","venue":null,"work_id":"72dcd78b-a878-4238-a00b-0051aa5f1976","year":2009},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:700c86cb6cac2b2fff479e162b11a77e3d0af8f53e12aff01b2d43fab6cb7c5e","observation_id":"f554acd8-3220-49de-8d23-195d447c70f1","resolution":{"observed_at":"2026-05-24T11:26:09.239670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"568639b9-ecd4-4c7a-a328-6350e1265b88","year":1981},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:4272547a283e2010bad5da8bd7363ad7ebc5a1fb0c963d338dda10dadc360e07","observation_id":"8144c54c-9df6-4d9c-9a4d-10050f192096","resolution":{"observed_at":"2026-05-24T11:26:09.215950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regularity and stability of feedback relaxed controls","venue":null,"work_id":"c7e68f01-b2e7-4951-8ffd-9a42e7353422","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:302c0490b292f905ffff1a95f85d0bbfc922362d1186e16e645c28b95ebe870a","observation_id":"556a6338-a26e-4640-aa46-ebcbd6355afc","resolution":{"observed_at":"2026-05-24T11:26:09.213788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e86e16e-5278-4cbe-8a44-7e0f0c3eddc9","year":1948},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:9e138162ed812525818eb1e9ad29149d933d31720f1c72a27cf3789ea15861e4","observation_id":"3b8c6086-367b-4fde-b741-f5e766181509","resolution":{"observed_at":"2026-05-24T11:26:09.206427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00419","last_updated":"2025-04-09T20:32:37Z","snapshot_observed_at":"2026-08-16T16:04:59.608573Z","submitted_at":"2023-01-01T15:07:22Z","title":"Policy iteration for the deterministic control problems -- a viscosity approach","version":2},"cited_work":{"arxiv_id":"2301.00419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.00419","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Policy iteration for the deterministic control problems–a viscosity approach","venue":null,"work_id":"ee45c008-59c3-4024-b5c3-7c9363fb1d80","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"cited_paper":"/paper/2301.00419","citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:4e3e7ae0c1e38f927a6c94f6457e440d8679e870da7cf08bf01151fa75ef25fa","observation_id":"3c9b46e0-4dc8-42bc-96db-63ed5a8c38f4","resolution":{"observed_at":"2026-05-24T11:26:08.991619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploratory hjb equations and their convergence","venue":null,"work_id":"cf963417-2963-4fd8-8014-a602940707ab","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:84fd0144c96fe881ce1fdb95e6526938d612ffcf964280ec7f077194df51df7d","observation_id":"db841bae-6f80-44e9-8320-57b46e065a59","resolution":{"observed_at":"2026-05-24T11:26:09.229034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous-time reinforcement learning control: A review of theoretical results, insights on performance, and needs for new designs","venue":null,"work_id":"c89a856b-e978-49fa-a2b8-45022a530985","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:36b6a61dfde83fbc931ad0c6cdf4ab78ccaa8656479ec7ac4e0add08d0819ba0","observation_id":"7282fa5a-4398-4db2-8cd0-e1b8769f71dd","resolution":{"observed_at":"2026-05-24T11:26:09.160372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning in continuous time and space: a stochastic control approach","venue":null,"work_id":"4433e4cd-b762-49ea-93f4-704ed2e3fb3e","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:03a0883f50155cb6b97fe46bf6ba3d131f84b7e8c60e5cf05b3e7f15329c1ddf","observation_id":"a6e86ab9-f662-4571-b749-8bf30913d064","resolution":{"observed_at":"2026-05-24T11:26:09.243588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous-time mean-variance portfolio selection: a reinforcement learning framework","venue":null,"work_id":"ae9d56f7-ac48-4af9-a82c-147ba21b27cd","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:e0dd52514ee1e578fbf31cf5289ca594b2520f66cd91382a0d76e1c0480190aa","observation_id":"07ab9f59-b436-4839-b75f-6bbf4dbcb1b4","resolution":{"observed_at":"2026-05-24T11:26:09.211783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziebart, J","venue":null,"work_id":"26928b05-32ab-44fa-b6d9-a82007dfeb30","year":2010},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:9ffc0ba235937aecfb7a81edfad8d20eddb8adf63242113da52e0e4d338062d6","observation_id":"a9de8540-d1ad-4efa-b18c-664f5e3b8aa6","resolution":{"observed_at":"2026-05-24T11:26:09.224593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziebart, Andrew L","venue":null,"work_id":"c00708d9-e9e5-4d48-a554-3dacf1a6c6d8","year":2008},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:bd5370dca913a1b4e6106fa51505a09eb10de8b402f77e04fcbc39a061bcaf16","observation_id":"9011900a-b31c-4c85-a773-828d553a3769","resolution":{"observed_at":"2026-05-24T11:26:09.207878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","latest_version":5,"primary_category":"math.OC","snapshot_observed_at":"2026-08-18T22:00:09.464157Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":21},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2209.07059."}