{"as_of":"2026-08-10T04:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f88b7b957a5a8d86b6bf63c6f062ba1ff5eb06712c57fd3de1ff67b396d50c59","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T07:42:38.840826Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.11005/citation-record","integrity":"/paper/2607.11005/integrity","json":"/paper/2607.11005/citation-record.json","paper":"/paper/2607.11005"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Acciaio, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:7b6e13af42eb3efe7acba99c33c6e513cd0ecd577b894e40d7535010f0a589a3","observation_id":"5375bcad-502a-4d92-a485-d3afb2f25dc4","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Bayraktar, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:1d59af630226b6ca9d57f7338b2b0a7863c6f35f9d516d9bb0800acc19fa55a9","observation_id":"d1a9fca9-d940-47ba-8029-2e0fba5c3e8b","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20718","last_updated":"2026-05-20T05:19:53Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T05:19:53Z","title":"Policy Gradient for Continuous-Time Mean-Field Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.20718","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Bayraktar, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2605.20718","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:fdd250dd753109372b741d1388a6644099e64eb24b4a5c45cea1bb928fc6a00f","observation_id":"4ad6043e-c0ec-4375-9534-e26bdd39c1c0","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Buckdahn, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:018f48e8538dcfa25d8da16f37f0e2787be22af534ebc87646c543036e1cb42d","observation_id":"e8982fd5-4dce-4319-a141-317a7f1fce65","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Carmona and F","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:d8fd1971e8927c876b17a028b1f59b1b99c1ad33b3342e1de8c5d56054c65ce3","observation_id":"c9ea50b1-b2a1-4fc4-98f7-b8ced11a1e30","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Carmona, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:e1bf5d398452381d6c16cd9af083212181942c46ad1d6e7734c7e5633c3cfffa","observation_id":"99d0c93f-30c6-44c7-9625-c1dcc81f7472","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Cheng, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:11db8c66d6bf4fcf6fff418fd0746d10a30126bded8376387d864c4581dc2ead","observation_id":"78c95fe1-bdca-4119-b751-15bb89e35612","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Cosso, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:d151aa32ab472a181c4914ee83fe32a00758f90055cf8c896df551b5bd8807d3","observation_id":"d50acd84-9887-42a9-891c-2ab2bce0f321","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Cucker and S","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:744a6daf110dcc3413e4487c20f5ec984b4b557d7addcba44d5bd77d1c25fba9","observation_id":"7e40a0be-d371-465d-8b2f-e3849a6ef7e8","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Foerster, I","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:3ef1832199b34d648b6f393296bef5f6f6b197cfbd821a4c1a72967f30e351ff","observation_id":"e5267e5f-a79f-4c74-8289-d1fd86a121ea","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Frikha, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:d5142d35ca538902fb6c2fe57d865fd80ddf09aa69ae355e3cf3735465685dce","observation_id":"d7cbaeaa-c582-4158-9037-c533e5df2753","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Germain, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:85a2b60296b7a4728680e1bbc4c3e3fde4cc6fc03cb4ca4b6ebb9fc1faa5d8b6","observation_id":"baeb2eb9-3928-4b49-b6a2-3798d7e2ccb9","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:266d6edbe1f8854db1f9a1fdeb4c6d8edbb5dcd4a70d678413af57f6aa092244","observation_id":"3aadbf94-6bc0-446d-8607-243f3015e058","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:c44bcaef6323904f6d57dfa976b64fa22d88fc466e24a22d563332697932d470","observation_id":"c2764666-883a-414b-b452-4ba4340c06a8","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11798","last_updated":"2026-06-10T08:31:54Z","snapshot_observed_at":"2026-08-09T17:58:30.963747Z","submitted_at":"2026-06-10T08:31:54Z","title":"Deterministic Policy Gradient for Learning Equilibrium in Time-Inconsistent Control Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.11798","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2606.11798","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:32db5fd61a9d67ad69db38121982a075704df6d75778f71049532d62d5a9758d","observation_id":"974fc73e-9aee-4825-803f-56725dd22c15","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:bdec5db4361e02f62939283f8e65e7459921598066bb76e4cc6804eaecd4d865","observation_id":"7d3301c7-da88-405f-bbe1-85c866f22971","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:00b8037fdd4ea6d9897131579a40499f182fa82bd4accbaa7d63186deb20f0dc","observation_id":"fca99118-b25e-4659-84b8-950adeb750f6","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:a779a2cd10654c103b8b0f191352a7cb62db2821079c8107294c643bbadd9c93","observation_id":"849f67fc-797f-4708-960f-45e0a30e7b97","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Jia and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:e1365b7bd7d031a374fb669b2cfb41abf298fa288e46f15e22cc935e78f7917b","observation_id":"a19508f6-a803-484a-b729-7edfa7ecc81b","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:88dc23a0ba4cb012e092ced466722e84d665222ee586f80caf9a63e1bbe4f9d7","observation_id":"8c012339-399e-4eb2-bd4f-b060ef77ba48","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:5dc5822a25f2497cc1e1a8ba8ad1d9ffa9b967a0cfe00f650b8f2991a6bf27e2","observation_id":"76df1628-ab00-4c26-ac84-9c7cce3499b3","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Ma and Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:c4eef1be53a8bf272552952e7d572b1321b39d570bd6d112ce12de3bf4d9ad2d","observation_id":"e25bad26-bca5-4243-9c3c-770956277078","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Mekkaoui, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:1fb8f5a46988d81215e08ecacb7ce4fb038c68eabfb0a48900d0051c89641c91","observation_id":"8e44df71-e0c2-41af-b284-45d1c6c6ccd8","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Meunier, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:e0098270722019ee5af7ff233896687c07273c523f25b00d3076e92230967df1","observation_id":"f015a511-5fdb-46ac-9187-a7e3077c3aa7","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Motte and H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:dcd5a54c228cfc6f6ddc8db35e1c22c73dc5ab9e0950b806cb36f2a27cd27a72","observation_id":"99bf36ef-9b7e-4930-bf06-5e82e786d9fe","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Nourian, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:8f253bf20e3623dde0715ef27bf85adff626cea76d69973743756b7f5d7e24a7","observation_id":"e4b7d644-3fad-4e05-9407-478a69088561","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Pham and X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:4f0af3658a3f4cbf1b0dcf0cffd20991d95e33fc9d3e0e400ceca4c5672d10d0","observation_id":"a7b4900b-c1cf-4442-995a-bba37881a06e","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Pham and X","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:1aeaaa7c63553e4c787e34cc5201775cce20379ef2b4ef04091961efa6e9e710","observation_id":"e0a2e433-dab9-493c-a377-79888a05c993","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Picarelli, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:00d3015d295996994a768d7fa4352ad6c850072e2dbf030620f53a3fb69fa8bc","observation_id":"f77cc759-2a76-4dd4-8982-fc873ff51602","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.01905","last_updated":"2018-01-31T09:05:10Z","snapshot_observed_at":"2026-08-06T12:54:16.561808Z","submitted_at":"2017-06-06T18:09:29Z","title":"Parameter Space Noise for Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.01905","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Plappert, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/1706.01905","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:8ff39496938998f7e04f7ab85538a242cdc9b112867f0fab7cdccc0683e5a5a2","observation_id":"563e4688-43f0-4532-aa61-9a8108829ca2","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00904","last_updated":"2025-08-31T15:34:24Z","snapshot_observed_at":"2026-08-05T13:11:42.300909Z","submitted_at":"2025-08-31T15:34:24Z","title":"Convergence Rates of Time Discretization in Extended Mean Field Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00904","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Reisinger, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2509.00904","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:784b9077eaefd0d41f4b7b0a485cd0dcdae5983e73235e846321e0d4404e8440","observation_id":"b1e3a1fd-c791-46ad-bcb8-9fedc7f7da27","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Reisinger, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:664263062409f51bc907a12e77afa9f1905746b721b4b525f5cb1cdfcf4f4da9","observation_id":"0d0447bb-054b-4794-9e3b-bedcb00df9af","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27372","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2604.27372","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:5715f977bb515fd784685dae3ce0317711beda4bd0280e1f3d519ee8ff418094","observation_id":"0d636a37-c4e2-4b31-bb78-42f6375f2cf1","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27378","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2604.27378","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:53a5d46f8f574aea7ae19f616490ec6cbd1846acdc57d956645fe1b1c6acc2bb","observation_id":"3a4d0c93-e8b0-4a88-91fa-cce5ffa2ac22","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Sethi, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:da237098ba398fb3af739d0c3bd8e3f8d80e0b937fba991b87ef5fc441398e0f","observation_id":"a0920f0e-e541-4023-8053-d8e14484607f","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17869","last_updated":"2025-03-22T22:07:59Z","snapshot_observed_at":"2026-08-07T16:43:53.349092Z","submitted_at":"2025-03-22T22:07:59Z","title":"Learning algorithms for mean field optimal control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17869","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2503.17869","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:d2336f846098eccbde2aa1077a144d43d1e31eca32d86c5c20193fb23531545c","observation_id":"51b1dfa0-d23b-44aa-b097-0f5fa31eaab2","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Szpruch, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:a30906863653bf22282c0dc5b4bb541dd22ac22586859f0eaa1e74b8c5cb1b7d","observation_id":"a5ef2507-ff80-4166-b505-c7086445f99a","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":"Wei and X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:bd99cc2b72034d1a9988d6ae99c92570c4799b30de2205c792480b52c6ba3951","observation_id":"e3223c35-ffb5-40f3-8d09-443fa6f94233","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:c2f2c7b2b347450df0c08317e9980fffd9cae3dcf93d5f72230ff25becb44ee9","observation_id":"e190c20e-3e92-417d-a814-5e480010f742","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:9b0c58346aa0cf590e38b603852f19c6c23ba55ba19d23d23f280f86fbc872e0","observation_id":"ca88ac6c-0470-406c-a758-7b293ae54755","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.11005."}