{"as_of":"2026-08-10T12:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ccc0a53d0f685b2c13f634ee3416bbc802f9e1ea1aa33257bb3d3396b224a46","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:25:56.452058Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05894/citation-record","integrity":"/paper/2506.05894/integrity","json":"/paper/2506.05894/citation-record.json","paper":"/paper/2506.05894"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.556722Z","title":"Value iteration algorithm for mean- field games","venue":null,"work_id":"60c2b300-5279-4370-a547-ace19b298db6","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.554219Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4c4fd083fa53ff3f8d4265011e49e6101fe537cc55ab76bc7b4df03ae5e1e4ab","observation_id":"785a7eff-dc7e-424c-afed-7efebc62578f","resolution":{"observed_at":"2026-08-07T10:25:58.559605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.548924Z","title":"Unified reinforcement q-learning for mean field game and control problems","venue":null,"work_id":"9eff4e09-94fa-4b7d-8166-1164b666da3f","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.639583Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:6d2983356687d6f772b610482a3665ac46d1ed98288e7c7498b3f1b71e07a972","observation_id":"7db36181-eddf-4575-8802-3f5cdfca4e99","resolution":{"observed_at":"2026-08-07T10:25:58.551580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.541065Z","title":"Stochastic graphon games: II","venue":null,"work_id":"bb9059de-6c9f-4571-b087-ee47ed503f3d","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.790981Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d5d1fc3e2ebe9070297492e38fd8fbb313f79994f046acd28c9c3a006f8a2a18","observation_id":"efcfd009-787b-483b-b5fe-2e6069da6fb5","resolution":{"observed_at":"2026-08-07T10:25:58.543561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.532904Z","title":"Berahas, Liyuan Cao, Krzysztof Choromanski, and Katya Scheinberg","venue":null,"work_id":"546c995b-fb81-4afb-bbcf-9f09d4ba615c","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.928649Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:04a4d4639d89b4c7bb31fb61cffedc4da561aebda10f1b0fc5b1e5a368b68613","observation_id":"a2c3fda2-815f-492e-a65d-f853df8b6ba4","resolution":{"observed_at":"2026-08-07T10:25:58.535643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.524821Z","title":"An Lp theory of sparse graph convergence i: Limits, sparse random graph models, and power law distributions","venue":null,"work_id":"4bf1475f-c6f3-40d2-b98e-2ec17432c633","year":2019},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.035037Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:9de8240f5c378370ec6718b32f74790e77eee972f1486410ebe6d614738bc443","observation_id":"a0e11cf2-e17c-418f-8c40-8cd5655da34e","resolution":{"observed_at":"2026-08-07T10:25:58.527738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.516780Z","title":"Chayes, Henry Cohn, and Yufei Zhao","venue":null,"work_id":"1a7d1871-dd8f-4ad4-b56c-298e92ea217f","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.119793Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:15af787e4c75dea1e5158dc3fdc21302faaea85beb5837e8be357d5475178821","observation_id":"123f7447-30c8-42d1-97e2-3bb0285ef568","resolution":{"observed_at":"2026-08-07T10:25:58.519563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.508603Z","title":"Functional Analysis, Sobolev Spaces and Partial Differential Equations","venue":null,"work_id":"b7346e6b-2d38-4011-96bd-577ffeb55aac","year":2011},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.175222Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:f19e0fcf30e43315340374752b1d08676536358e84a4f55216ffeb745ac20397","observation_id":"3542a397-2415-4f04-afee-fc70ea509587","resolution":{"observed_at":"2026-08-07T10:25:58.511383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09178","last_updated":"2020-06-12T23:23:50Z","snapshot_observed_at":"2026-08-09T01:40:10.447809Z","submitted_at":"2020-06-12T23:23:50Z","title":"Policy Gradient-based Algorithms for Continuous-time Linear Quadratic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09178","snapshot_observed_at":"2026-08-07T10:25:50.242646Z","title":"Policy gradient-based algorithms for continuous-time linear quadratic control","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.242646Z"},"links":{"cited_paper":"/paper/2006.09178","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:fa7289eafc80dc995b169fb8ea97de56c35c90350936cd9527bb1b9c813195e0","observation_id":"268cc0c8-0e71-4c4f-8d2b-eff23765fff7","resolution":{"observed_at":"2026-08-07T10:25:50.242646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.500422Z","title":"Caines and Minyi Huang","venue":null,"work_id":"edd3a408-d753-41dc-9aac-a314d0abf136","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.336317Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:481e6a7aa5601bec4b7c974b231d5a6dc9202d1f9d7cd5b92dbb4f14b7434c0d","observation_id":"7175448f-8be3-4a07-9c46-f35e44628ed0","resolution":{"observed_at":"2026-08-07T10:25:58.503030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.492404Z","title":"Financial Mathematics","venue":null,"work_id":"d36d198e-bee6-4cbf-9a03-1b65fb7a5dbb","year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.443526Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:62408e49e8683aee17a82d92b8f8925438863c1bf7315ee922a14c24e4491186","observation_id":"ebf7009f-a1af-48e6-a049-0a496c937c73","resolution":{"observed_at":"2026-08-07T10:25:58.495330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.484791Z","title":"Cooney, Christy V","venue":null,"work_id":"ac5ebf3f-112d-4452-9732-61877ff401b2","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.539531Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0eb87b607343cf6762c9b41ffea3928226ae129269265908f6130e34699b6ad5","observation_id":"07a7c107-9089-4b83-9fbb-b66acd672b52","resolution":{"observed_at":"2026-08-07T10:25:58.487337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.476489Z","title":"Deep learning for mean field games and mean field control with applications to finance","venue":null,"work_id":"2f736326-09fe-425e-9795-ef849bcc5300","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.619486Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b5cdaeab9f40be12f67a6e71ee8d29143c0b129671a3991ae1dc55e3204f92fd","observation_id":"e669e92f-5b9c-46d4-bd91-2aff43417c13","resolution":{"observed_at":"2026-08-07T10:25:58.479292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04295","last_updated":"2025-04-28T23:55:02Z","snapshot_observed_at":"2026-07-06T08:28:15.985260Z","submitted_at":"2019-10-09T23:19:39Z","title":"Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04295","snapshot_observed_at":"2026-08-07T10:25:50.732625Z","title":"Linear-quadratic mean-field reinforce- ment learning: Convergence of policy gradient methods","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.732625Z"},"links":{"cited_paper":"/paper/1910.04295","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:29274c8fdfad053235e700774316b9e89a732249a8e9862022990ca10018c4f7","observation_id":"eec5f744-7b5d-4f39-9d94-85ca914afc08","resolution":{"observed_at":"2026-08-07T10:25:50.732625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.468421Z","title":"Approximately solving mean field games via entropy-regularized deep reinforcement learning","venue":null,"work_id":"817dc493-7092-4ab9-aebb-3a82f42cc0be","year":1909},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.868633Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:513c48258d4e430dfc9b951651b0915cfce736f879bb77903cf520b886d37c77","observation_id":"1004d101-8bb8-45d1-be4c-5d1933abb5e1","resolution":{"observed_at":"2026-08-07T10:25:58.471147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.460701Z","title":"Learning graphon mean field games and approximate Nash equilibria","venue":null,"work_id":"72c2c885-47ba-47f4-9b28-6622043946a0","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.023614Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:7e936afebacada733fe5466955e62d545d4e5c484eed61be9d030e38177b23f6","observation_id":"78277913-cbb5-471b-b07c-d73702318517","resolution":{"observed_at":"2026-08-07T10:25:58.463392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.452309Z","title":"Dechevski and Lars Erik Persson","venue":null,"work_id":"08e1956e-010d-4029-aebd-ffef17e488a3","year":1994},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.198586Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:9d926787346a11ce5a14f577c2d52f38f7e992202f8e32e802eed6925119299a","observation_id":"d9107452-ab73-4e50-975e-d078c9c77215","resolution":{"observed_at":"2026-08-07T10:25:58.455466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.443790Z","title":"On the convergence of model free learning in mean field games","venue":null,"work_id":"8d633c43-3b37-469b-9bd7-f11cba8ea1c7","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.317948Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:16607c572d557720521fc197a2679d84f430cae9a47ee66e25cde03e710da0ea","observation_id":"11d9b855-377c-420a-828b-ad632b70dc71","resolution":{"observed_at":"2026-08-07T10:25:58.446518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.435272Z","title":"Learning sparse graphon mean field games","venue":null,"work_id":"a9828e02-96e3-4bff-b2d2-622ee2a7a756","year":null},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.437786Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:c0789a7a15840a0932e98595f11f3512d14b4d27fbb818035a7756c13f3dffdd","observation_id":"50967019-6c8a-4d3c-b346-641383314127","resolution":{"observed_at":"2026-08-07T10:25:58.438140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.426920Z","title":"Global convergence of policy gradient methods for the linear quadratic regulator","venue":null,"work_id":"e84760b8-9cb8-418a-9c43-9693c0ccda16","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.590918Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4ab50dadd728f69ccf65ad0a0a48013fc8cf9771708fefe26d1e83e22ce5217e","observation_id":"5b96362f-5e25-461f-9226-f9eaae412486","resolution":{"observed_at":"2026-08-07T10:25:58.430093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02489","last_updated":"2024-08-05T14:11:51Z","snapshot_observed_at":"2026-08-06T15:55:12.024773Z","submitted_at":"2024-08-05T14:11:51Z","title":"Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02489","snapshot_observed_at":"2026-08-07T10:25:51.664862Z","title":"Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.664862Z"},"links":{"cited_paper":"/paper/2408.02489","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:35df9642a966d7eada72c5b2d81e2b76066356c3df2df4c0a2ad62b447066ae8","observation_id":"3f191497-aaaa-4169-b700-ae468df838aa","resolution":{"observed_at":"2026-08-07T10:25:51.664862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.419186Z","title":"Caines, and Minyi Huang","venue":null,"work_id":"3bc58fa4-13de-42ee-b961-1cac84d08557","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.764041Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4e6a722124bb94b6626bb5a02750b3e9b3e7140520ccf2873513c02ce357c79f","observation_id":"ed498024-705a-41c7-9624-ad7968ee1dc1","resolution":{"observed_at":"2026-08-07T10:25:58.421695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.411118Z","title":null,"venue":null,"work_id":"913d5724-4b21-4ec1-b4a8-edd4f77109d6","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.831285Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:aa5a91780d4d3521f7374baa57f046bf9f34f600ce8a1dd1d2abcd21ad969923","observation_id":"6e630b54-f70a-4e26-bdb3-8a924e38c07d","resolution":{"observed_at":"2026-08-07T10:25:58.413846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.402686Z","title":"Convergence of policy gradient methods for finite-horizon exploratory linear-quadratic control problems","venue":null,"work_id":"73c5c5ec-a3d4-42eb-967c-60ac9dfd1c14","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.925261Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:ffaf55085ba65514af8209146ba3428507795574928140482d8d1a6b40ac11d7","observation_id":"e710deb9-6db8-4643-b121-a361319ae50d","resolution":{"observed_at":"2026-08-07T10:25:58.405448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.394788Z","title":"Volterra Integral and Functional Equations","venue":null,"work_id":"c1c43dca-0fab-42a8-84ad-2a5adefc53a3","year":1990},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.040532Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:c8e13bf0ec130ae4ac7886399ca1cc20663b162a22b19ee0c710f03d0d0b804a","observation_id":"4428bf96-8c76-4a93-b366-ee0bc5c299ba","resolution":{"observed_at":"2026-08-07T10:25:58.397411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.386847Z","title":"Learning mean-field games","venue":null,"work_id":"4519ebcf-a493-4376-ae86-314e11abb66b","year":2019},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.121901Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:6504418bded7a931db60ceee608c35e926339e5c30b67d1068ea1a3ff747fef8","observation_id":"d7e87767-315b-4220-ae25-0eb85ec081a4","resolution":{"observed_at":"2026-08-07T10:25:58.389457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.378400Z","title":"Policy gradient methods for the noisy lin- ear quadratic regulator over a finite horizon","venue":null,"work_id":"1971e9cb-6474-46fb-83b7-764307db9063","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.207116Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:62de1ab7a66dded8cad95a1d397bd0df10c7c52d85c8b1410ef04b3eab5bffb6","observation_id":"7367bb92-5693-49f8-989d-86d41753bcb4","resolution":{"observed_at":"2026-08-07T10:25:58.381270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.369899Z","title":"Policy gradient methods find the nash equilib- rium in n-player general-sum linear-quadratic games","venue":null,"work_id":"e69211a5-de57-494d-9774-1e841b5a395b","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.308626Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:f1eec8c438e6f8c835ddb6cd6cec7886d641459fa1702ef23fa37e4b0fe6c594","observation_id":"7b08fa9a-7303-454a-82f9-e396cc4d831c","resolution":{"observed_at":"2026-08-07T10:25:58.372977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00282","last_updated":"2025-09-03T03:18:07Z","snapshot_observed_at":"2026-08-10T08:03:47.152725Z","submitted_at":"2024-05-01T02:19:31Z","title":"MF-OML: Online Mean-Field Reinforcement Learning with Occupation Measures for Large Population Games","version":2},"cited_work":{"arxiv_id":"2405.00282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00282","snapshot_observed_at":"2026-08-07T10:25:56.824919Z","title":"MF-OML: Online Mean-Field Reinforcement Learning with Occupation Measures for Large Population Games","venue":"math.OC","work_id":"5144fe8a-e700-4e94-903a-fc226da1e07a","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.453170Z"},"links":{"cited_paper":"/paper/2405.00282","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:1fefc0c5176dea97bb7ebe9fd3c53bd13bb5ef7568a037f11f5b5b2e1816c90f","observation_id":"7ab5e38b-98e3-41a0-b27d-789487e3e0b5","resolution":{"observed_at":"2026-08-07T10:25:56.883606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.361082Z","title":"Model-based RL for mean-field games is not statistically harder than single-agent RL","venue":null,"work_id":"dd2eabf6-dca0-4620-a25a-f52cee558e98","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.547369Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:ec0b2f78317210fa77aa822f8f7d23358aa7955c201e4b0b4fdced12e45bf092","observation_id":"f9743ba9-84a0-4d46-a4d1-769d8d2caa33","resolution":{"observed_at":"2026-08-07T10:25:58.364277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.352955Z","title":"On the statistical efficiency of mean-field reinforcement learning with general function approximation","venue":null,"work_id":"7d1d6fa7-6e3e-4874-9677-ea5aafd993dc","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.656118Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:c8921a55c11d775402d34a8ad6d7af8bee021f86e86849e2ce6f722824c944b4","observation_id":"f5a3cbd0-5d59-42d6-8dde-eb4278c8ae55","resolution":{"observed_at":"2026-08-07T10:25:58.355754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.344849Z","title":"Malham´ e, and Peter E","venue":null,"work_id":"9a51579d-c9a7-42b6-9e26-d3606f8885e2","year":2006},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.806221Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:09e95e1975e65ab2edc2917c73777b6e7c1edaa2739297df844b9cbaa22eb3dc","observation_id":"95c6d6a1-48f8-4431-a192-d11babe7cdce","resolution":{"observed_at":"2026-08-07T10:25:58.347534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16326","last_updated":"2023-10-25T03:14:48Z","snapshot_observed_at":"2026-07-06T16:38:09.978805Z","submitted_at":"2023-10-25T03:14:48Z","title":"Reinforcement Learning for SBM Graphon Games with Re-Sampling","version":1},"cited_work":{"arxiv_id":"2310.16326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.16326","snapshot_observed_at":"2026-08-07T10:25:56.635163Z","title":"Reinforcement Learning for SBM Graphon Games with Re-Sampling","venue":"cs.GT","work_id":"97be704f-9c47-436c-a057-bad14653f64f","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.929133Z"},"links":{"cited_paper":"/paper/2310.16326","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b1111b0a4dfaa85c1805d9d3521641beceb39295a02c40b0fcfc4084ba00056b","observation_id":"d97d0940-69cf-4b85-b549-70b4643ccd2c","resolution":{"observed_at":"2026-08-07T10:25:56.722759Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.336599Z","title":"Real-time bidding with multi-agent reinforcement learning in display advertising","venue":null,"work_id":"1fa48137-6904-4ab0-8d33-727f05f007c3","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.031245Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:dc560d4dafa1faf273b658439e22b78a20f3065021d9db9890fa85976de29984","observation_id":"f49b81b1-5b32-4582-a3a9-742c8bc91cd0","resolution":{"observed_at":"2026-08-07T10:25:58.339344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.328771Z","title":"A natural policy gradient","venue":null,"work_id":"b29bc0fd-b2c1-4da5-833a-49e21faedb60","year":2001},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.182249Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:733307d3b086356884a375e8acad89bb342a596705c4418410c557b6a246c4e5","observation_id":"7ed1f384-d10b-4eb2-b5cf-2add752210e1","resolution":{"observed_at":"2026-08-07T10:25:58.331341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02951","last_updated":"2025-06-06T12:01:07Z","snapshot_observed_at":"2026-08-04T14:28:32.395939Z","submitted_at":"2023-10-04T16:41:36Z","title":"A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02951","snapshot_observed_at":"2026-08-07T10:25:53.289607Z","title":"A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in polish spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.289607Z"},"links":{"cited_paper":"/paper/2310.02951","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:5edfac1a52384fc8b35b5fcb6c9b19627a0e65e0214be7227f288e3056d506f1","observation_id":"6de26ac7-ccc6-42f6-924e-b4f45d1856cd","resolution":{"observed_at":"2026-08-07T10:25:53.289607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.320563Z","title":"Actor-critic algorithms","venue":null,"work_id":"f1a73d8e-cbf2-4a71-932d-90e3475dc9ee","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.374843Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:8580ce2530aa4f75f726f7f0122464fb4fd79030d7119643add2a0467da95ff6","observation_id":"62c2cc9f-ef5f-495d-ac4e-0dee4c654e42","resolution":{"observed_at":"2026-08-07T10:25:58.323352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.312062Z","title":"A label-state formulation of stochastic graphon games and approximate equilibria on large networks.Mathematics of Operations Research, 48:1811–2382, 2022","venue":null,"work_id":"97942030-02d0-4857-bf87-41af54b38972","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.459363Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:28223df70dc105f64d52a00ae7e63474fcc583acfaf7253000d27b9b498882ee","observation_id":"858b1adf-c7f9-4d50-8379-7af58a46ea6c","resolution":{"observed_at":"2026-08-07T10:25:58.314990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.304129Z","title":"Mean field games","venue":null,"work_id":"c57c3595-1979-4e82-b17c-f6f1ce15a53b","year":2007},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.577904Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b5daedeb5fc6ede862cd2092ae59fad62947588f6a4e2cfb4dda171861284307","observation_id":"13e0aa9e-5bce-43cd-8a38-1ac86aa8ce23","resolution":{"observed_at":"2026-08-07T10:25:58.306776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12944","last_updated":"2024-07-26T18:20:46Z","snapshot_observed_at":"2026-08-08T09:40:53.697167Z","submitted_at":"2022-05-25T17:49:37Z","title":"Learning in Mean Field Games: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12944","snapshot_observed_at":"2026-08-07T10:25:53.713354Z","title":"Learning in mean field games: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.713354Z"},"links":{"cited_paper":"/paper/2205.12944","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4a767af213d159e9b29aab4606a45c070b5f6792f448d1f0eb1eaf85f96ecb9c","observation_id":"a1055e9f-55a4-4063-b2be-b4f652e0f15e","resolution":{"observed_at":"2026-08-07T10:25:53.713354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.293775Z","title":"American Mathematical Society Col- loquium Publications","venue":null,"work_id":"e7dccb5d-edd0-414a-ad08-02836942af39","year":2012},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.816578Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:7d30489becc58cf62e7b6d09c3843a39407f8eafc2fe0bfb808269aef6d4c48a","observation_id":"acc9d4f3-cd17-48f8-8725-88b75e370f2f","resolution":{"observed_at":"2026-08-07T10:25:58.296721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.285389Z","title":"On the global con- vergence rates of softmax policy gradient methods","venue":null,"work_id":"e690359d-4f15-4727-9e6d-3e65c238e324","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.946606Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:292a90510c860e0f0610bc99029fbe17f2493989208f893f56a41cb8a96d6b14","observation_id":"1efd3b1b-a6e1-41c3-b455-ca7b01153109","resolution":{"observed_at":"2026-08-07T10:25:58.288192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05896","last_updated":"2024-11-08T15:29:03Z","snapshot_observed_at":"2026-08-09T05:00:21.824749Z","submitted_at":"2024-11-08T15:29:03Z","title":"Stochastic Graphon Games with Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05896","snapshot_observed_at":"2026-08-07T10:25:54.024854Z","title":"Stochastic graphon games with memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.024854Z"},"links":{"cited_paper":"/paper/2411.05896","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:8fb06253598b236a926fa40925fc4002dc5a13d0262110d09e523e5cac5757f1","observation_id":"21362dd4-02e6-4ad6-a1d4-04b54f59df70","resolution":{"observed_at":"2026-08-07T10:25:54.024854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-07T10:25:54.194986Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.194986Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:bd052d4c5047df0f80da3a89a5c2a654131aa2e6ea0bc76aa4324adcccabc05b","observation_id":"4bb99848-22c8-4cac-90d6-99b885720120","resolution":{"observed_at":"2026-08-07T10:25:54.194986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.277274Z","title":"Graphon games: A statistical framework for network games and interventions","venue":null,"work_id":"6a083b1f-e8b0-4d22-8c07-73beda99c3d2","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.367333Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0cf364853e5b3230e30ed6801c7486bd80151b90a23daf326e080778e4045eb1","observation_id":"c916ef8f-1cbe-44b6-98c1-b40aead4983d","resolution":{"observed_at":"2026-08-07T10:25:58.280044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.268233Z","title":"Time discretization-invariant safe action re- petition for policy gradient methods","venue":null,"work_id":"13c6aa22-b9fe-4259-bd82-41e54db27c45","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.597645Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:3da977dc4b3287270b5bfda15ad4f9f7aecb300b539d8b233f07b88fd68133be","observation_id":"06ae224f-521a-4a7a-af7f-51273bf7b88e","resolution":{"observed_at":"2026-08-07T10:25:58.271175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20250","last_updated":"2025-03-24T13:37:48Z","snapshot_observed_at":"2026-07-06T18:22:53.072592Z","submitted_at":"2024-05-30T17:02:18Z","title":"Entropy annealing for policy mirror descent in continuous time and space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20250","snapshot_observed_at":"2026-08-07T10:25:54.770111Z","title":"Entropy annealing for policy mirror descent in continuous time and space","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.770111Z"},"links":{"cited_paper":"/paper/2405.20250","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:c936cd027ce8264e8da98bd9f62791d81cd10b9c1aec9bf81c70e31439b22865","observation_id":"8086cd2c-b1bb-41a8-b175-f2c040dfb26c","resolution":{"observed_at":"2026-08-07T10:25:54.770111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-07T10:25:54.893054Z","title":"Safe, multi-agent, reinforce- ment learning for autonomous driving","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.893054Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:f2df359e483023429172a89e9ebb2771fcc0fb333ae80fffc2e066385c2fb00c","observation_id":"e8ae0642-33bf-4a24-be32-f7021115328a","resolution":{"observed_at":"2026-08-07T10:25:54.893054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.259933Z","title":null,"venue":null,"work_id":"ca524479-e48e-4c1e-ba00-0aa3a80dcc01","year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.993284Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:88b2136be5dc44c5f6534d0b8ab6db133da2719cafd7eb662aebaae9a0aba353","observation_id":"12d16d47-64f4-4f3d-be60-99f0e6d88012","resolution":{"observed_at":"2026-08-07T10:25:58.262557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.251816Z","title":"Deterministic policy gradient algorithms","venue":null,"work_id":"8120915e-55b3-4b1d-ba5a-8ed850d97002","year":2014},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.118458Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:2a931495329d94df2c56a3c5720c342ef3c049595dc77a36b4f2c4760f7b65ee","observation_id":"38e1ed21-e657-4664-abba-9b397c27886b","resolution":{"observed_at":"2026-08-07T10:25:58.254608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.243306Z","title":"Sutton and Andrew G","venue":null,"work_id":"ec766dd9-86bb-428b-b084-20a594260112","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.217096Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:70db02e43485bc31bc2128daf20ac8819fb21096324ce0623126457ba27554e5","observation_id":"3c8ff049-5a9f-4a34-b805-ee9926f1a9fe","resolution":{"observed_at":"2026-08-07T10:25:58.246089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.234917Z","title":"Policy gradient methods for reinforcement learning with function approximation","venue":null,"work_id":"42e126d0-98ea-47d8-8fad-b83f407c47fe","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.288745Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:018477d36c8514232a2a44d22da41eba87422c96489553409496c3fb8594889c","observation_id":"67698907-189d-49f5-9b7e-8f15530d809c","resolution":{"observed_at":"2026-08-07T10:25:58.237861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.226508Z","title":"Caines, and Minyi Huang","venue":null,"work_id":"6d999879-ea4a-438f-b861-d389ed36fcd2","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.380324Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:a22cb598cc6bed9f2dc4dfd58387aaa862ceeaff8800816cfb68f374a3c7c03d","observation_id":"83bd1352-65d0-40a7-8246-706c1de4042e","resolution":{"observed_at":"2026-08-07T10:25:58.229525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.217678Z","title":"Ordinary Differential Equations and Dynamical Systems, volume 140 ofGradu- ate Studies in Mathematics","venue":null,"work_id":"c1d11374-5659-400e-987b-4cd2cc2284f0","year":2012},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.502383Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:edccd302cb2780683220cba1088df54f955fc62616f7ec7700916860e680e8bf","observation_id":"72bcac30-3a04-4b6b-8cae-edf56c682601","resolution":{"observed_at":"2026-08-07T10:25:58.220709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.208432Z","title":"Global convergence of policy gradient for linear-quadratic mean-field control/game in continuous time","venue":null,"work_id":"f961a06b-ebc1-4407-bec5-5903a9328f43","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.600933Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:923cddc0ff323fe6c2df1e19af3b4dfaefeb717be2cf49cd2b86a39ead02bae6","observation_id":"76ebe283-1d2d-43dd-afb8-5bd04ea4373a","resolution":{"observed_at":"2026-08-07T10:25:58.211525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.199552Z","title":"Learning while playing in mean-field games: Convergence and optimality","venue":null,"work_id":"73aa30fe-bbcb-4c0f-abdf-9c8951fdcd27","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.699378Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:11fcff07d85ff00d79168e1f47981ba1b623cf5ae8e4aa9ac812aedf1983ad72","observation_id":"24536580-ed8b-408c-ad84-9579b75df894","resolution":{"observed_at":"2026-08-07T10:25:58.202300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09030","last_updated":"2025-07-02T03:33:28Z","snapshot_observed_at":"2026-08-08T21:01:29.337875Z","submitted_at":"2024-01-17T07:55:52Z","title":"Linear-Quadratic Graphon Mean Field Games with Common Noise","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09030","snapshot_observed_at":"2026-08-07T10:25:55.825786Z","title":"Linear-quadratic graphon mean field games with common noise","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.825786Z"},"links":{"cited_paper":"/paper/2401.09030","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:65bc5fca9b29d5d961bf2e484db3b8b73479eab0a12b3acdbc824551a0ff3320","observation_id":"20296ccf-e8b7-4bc3-9617-ba463e04787a","resolution":{"observed_at":"2026-08-07T10:25:55.825786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.190959Z","title":"Policy mirror ascent for efficient and independent learning in mean field games","venue":null,"work_id":"a98530cc-ffea-4f9b-8571-85937571b77d","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.922529Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:2d3c7724bbda79f4136406c4fd1ea9b3aa75c66e1428c9f74780cea0c0d8c359","observation_id":"4b5344fa-0afc-4adc-a7d2-c3c2938c86ad","resolution":{"observed_at":"2026-08-07T10:25:58.194028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.181547Z","title":"When is mean-field reinforcement learning tractable and relevant? In Proceedings of the 23rd International Conference on Autonomous Agents and Multiagent Systems , page 2038–2046","venue":null,"work_id":"057de6dc-6139-4d4a-a8d3-197716bbdf67","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.991887Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:1ecd8793afc7ae017a9b5212251dee8b28704f7a70155a0c1e7b2d573e34a4a9","observation_id":"ff24be89-593a-455b-8716-f8dcd5f494b8","resolution":{"observed_at":"2026-08-07T10:25:58.184842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.867756Z","title":"Stochastic Controls: Hamiltonian Systems and HJB Equations","venue":null,"work_id":"835fa864-ca68-428e-bc9b-0dc33cb2058d","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.087561Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:08dbcc46e24f4f97dea186c73f875715a82a33aa14085e43771343bfb53b1c81","observation_id":"c9ce61b0-55e5-4ec9-8000-0390774079cd","resolution":{"observed_at":"2026-08-07T10:25:58.041054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.563588Z","title":"Learning regularized monotone graphon mean-field games","venue":null,"work_id":"7f33080e-e878-45a0-8017-89224165969e","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.207569Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:bcfb4f7bd57236db9d3b0561d234475875310c37f312b6d391e8fc1ab5691847","observation_id":"aeac5648-6171-4005-80f5-15a06d9647db","resolution":{"observed_at":"2026-08-07T10:25:57.702449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.309298Z","title":null,"venue":null,"work_id":"b5654a62-b4c8-40b1-9295-7b5ed757a142","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.268960Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:26d0c03d4780f34ebec8dcd3b053ebcf15d1c47bd8910b052e169fc4735faf8a","observation_id":"63aba5c9-8a33-473d-ae08-5410e8861d43","resolution":{"observed_at":"2026-08-07T10:25:57.444249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.068022Z","title":"Convergence of policy gradient for stochastic linear quad- ratic optimal control problems in infinite horizon","venue":null,"work_id":"34c2a7c2-bbc1-4f00-ad88-7cd628090f52","year":2025},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.358470Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:bb69566bb401e9cf8a94b6fd94f417b43f2b99acbda0ec1ed0da8ff8a47459a7","observation_id":"bef945bd-b82f-4aea-b744-4dc9ce4270aa","resolution":{"observed_at":"2026-08-07T10:25:57.137627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:56.952530Z","title":"Graphon mean field games with a representative player: Analysis and learning algorithm","venue":null,"work_id":"b7ed667d-85ad-4305-8575-0da7aa79fac3","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.452058Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:2304daad93fd2ffc8953688d0092f320a918ec7fa4aac93d93cc0410ac5ab822","observation_id":"dcf4c283-7e19-4b07-8b49-44d3999aefae","resolution":{"observed_at":"2026-08-07T10:25:57.055423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-08-09T15:39:17.826413Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":48},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2506.05894."}