{"as_of":"2026-08-09T17:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c4120350bb1d5a42e0a9591a41551619d2e4661c91fcbaca5adaf3830e19ae3a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:10:28.752877Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T05:29:35.430337Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T19:10:28.752877Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.02769","last_updated":"2026-07-17T01:56:39Z","snapshot_observed_at":"2026-08-08T10:01:42.287037Z","submitted_at":"2025-12-02T13:49:13Z","title":"Reinforcement learning for irreversible reinsurance problems: the randomized singular control approach","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T19:10:28.752877Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2512.02769"},"observation_digest":"sha256:6f04b638c5b385242dae41ab7467b3b58528b1a195f0c16c57c1ae7825270e62","observation_id":"32e51f64-0ad9-453d-898a-af79da466bd3","resolution":{"observed_at":"2026-08-03T19:10:28.752877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T18:40:33.633478Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04697","last_updated":"2026-07-30T02:52:31Z","snapshot_observed_at":"2026-08-08T07:29:46.503525Z","submitted_at":"2025-12-04T11:48:07Z","title":"Continuous-time reinforcement learning for optimal switching over multiple regimes","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T18:40:33.633478Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2512.04697"},"observation_digest":"sha256:d3051c09e7587993bb9332760faf4f914e78f2dfff01a74d9209ff2f2c07308c","observation_id":"bc47abb3-348a-4f1d-a86b-46ddfa7d5c89","resolution":{"observed_at":"2026-08-03T18:40:33.633478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:25e04a163a11e099796f435df92ad2f16bef5f4b0b8bf03cd458011eca8202d1","observation_id":"421db338-8c3d-4d5c-bda5-86e94e73713c","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:a1893e978ad7759021578816dc6f9e0a8839028a96f5922c4108788869c77be4","observation_id":"af00bf24-b6b7-4ed5-8720-a9996e0f244a","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2605.20718","last_updated":"2026-05-20T05:19:53Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T05:19:53Z","title":"Policy Gradient for Continuous-Time Mean-Field Control","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-21T04:15:32.156380Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2605.20718"},"observation_digest":"sha256:c03476d0d28107aa2291b71af6a44b162d562c63bd767701c8b255c8082c9908","observation_id":"e5db062e-971d-4d5a-86c4-ebd664ea8d69","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2606.20356","last_updated":"2026-06-18T15:20:00Z","snapshot_observed_at":"2026-08-09T06:29:58.990741Z","submitted_at":"2026-06-18T15:20:00Z","title":"Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-26T15:59:25.061726Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2606.20356"},"observation_digest":"sha256:df8c99642d4b275b598f3b5c2cacbda259ac0e7793adc3e65d3908127b3c2d91","observation_id":"18570b28-fa09-4239-bb98-1d9200438611","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-09T07:49:21.814844Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:c2f2c7b2b347450df0c08317e9980fffd9cae3dcf93d5f72230ff25becb44ee9","observation_id":"e190c20e-3e92-417d-a814-5e480010f742","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-01T11:22:20.724649Z","title":"Unified continuous-time q-learning for mean- field game and mean-field control problems.arXiv:2407.04521, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19928","last_updated":"2026-07-22T09:00:00Z","snapshot_observed_at":"2026-08-07T13:13:10.072128Z","submitted_at":"2026-07-22T09:00:00Z","title":"Continuous-Time Reinforcement Learning for $N$-Player Stochastic Differential Games with Exploratory Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T11:22:20.724649Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2607.19928"},"observation_digest":"sha256:e2b849cafc865e85058988bc9f3a2aa809828beebc09503422586c0c66dca0d7","observation_id":"63e59b80-236e-4bb3-bdd5-36974a329498","resolution":{"observed_at":"2026-08-01T11:22:20.724649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.04521/citation-record","integrity":"/paper/2407.04521/integrity","json":"/paper/2407.04521/citation-record.json","paper":"/paper/2407.04521"},"outbound":[],"paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","latest_version":3,"primary_category":"math.OC","snapshot_observed_at":"2026-08-06T03:14:08.152047Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2407.04521."}