{"as_of":"2026-08-15T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21d447a5203ae824fcd27188f42aae5d8a71325fc94846e05c3a27686941b6d6","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:10:18.922778Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.03761/citation-record","integrity":"/paper/1908.03761/integrity","json":"/paper/1908.03761/citation-record.json","paper":"/paper/1908.03761"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.723533Z","title":"A survey on reinforcement learning models and algorithms for trafﬁc signal control,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.723533Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:b6612311a6939342c28ed797887bcb72e69f57b52069ebffb7185bc90fbd52df","observation_id":"862c70f3-6737-415e-b002-0ab4058aeedb","resolution":{"observed_at":"2026-08-14T14:10:18.723533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.581606Z","title":"Optimal bidding strategies in electricity markets using reinforcement learning,","venue":null,"work_id":"d676374f-352c-46aa-8eac-bb34ab3e1a10","year":2004},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.729438Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:1638280ac01864093037b3ff29c7efe6fa3ae02030a32128ed4877d7c571cd51","observation_id":"0743ed74-8e87-492c-b770-dd00bc0deb2e","resolution":{"observed_at":"2026-08-14T14:10:19.585856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.568252Z","title":"Trafﬁc network micro-simulation model and control algorithm based on approximate dynamic program- ming,","venue":null,"work_id":"1dcd5345-3f5d-48ea-8c2f-1ff2df6c6ccf","year":2016},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.733737Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:cc262db02e0610d7742da78b6d108b34368e2e459d081bd07ea620b542b331cd","observation_id":"fae89b98-f757-4268-88ef-bbf13c6eae91","resolution":{"observed_at":"2026-08-14T14:10:19.573039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.554495Z","title":"Trafﬁc signal timing manual","venue":null,"work_id":"c7af5205-8216-4f68-943d-dd3d47466dd3","year":2008},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.740325Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:199232810db0c3d8288cdf37f1307de5f5434affa5da6cbcdfac20f48c0c989c","observation_id":"8b561d9e-f253-4155-ae5c-6439ba2305ba","resolution":{"observed_at":"2026-08-14T14:10:19.559146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.539578Z","title":"Trafﬁc signal timing optimisation based on genetic algorithm approach, including drivers routing,","venue":null,"work_id":"742d8181-e918-4fd3-8426-0dd9cdb540ab","year":2004},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.744990Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:0dfa4dada4142d3ff3fdc0e977fda68fb2e469906590a1e36d6bce434699bdda","observation_id":"eb3252df-5987-4089-84c0-47b99324c6d5","resolution":{"observed_at":"2026-08-14T14:10:19.544908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.525178Z","title":"Swarm intelligence for trafﬁc light scheduling: Application to real urban areas,","venue":null,"work_id":"cb926372-6d3c-4562-b8df-6b4cab3127ee","year":2012},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.749358Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:c01f0e4c80dc2f38c4ece3732e6254311f6ea07aa66e11e35428e6ff64eedd29","observation_id":"2c6a11f6-e648-44f7-bd01-5f7bf02cfc1a","resolution":{"observed_at":"2026-08-14T14:10:19.529730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.512089Z","title":"Two-stage fuzzy logic controller for signalized intersection,","venue":null,"work_id":"21b2d3dd-ef59-45cb-b19b-63419f134b32","year":2010},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.754168Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:e53ea9097f42bf23d43eff4e74955195ec17554adfc5b1b05d9f1cbb2f5729e8","observation_id":"2f31f8c9-463a-4bb5-ae10-c283bd6e23d8","resolution":{"observed_at":"2026-08-14T14:10:19.516403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.496488Z","title":"Neural networks for real- time trafﬁc signal control,","venue":null,"work_id":"c1c73f40-5096-4a99-9fff-8f410e9ce45a","year":2006},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.758282Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:7f2c131d63061762a807bf2b56750336dd13240313da5c94da5980d0777219fd","observation_id":"497d1143-ece7-4eb0-8d0d-cf2e8762ce90","resolution":{"observed_at":"2026-08-14T14:10:19.502035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.762303Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.762303Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:cf298202106692ffae4847c26e75e0b5cf4ee2e9f482213ca057f252441ff09f","observation_id":"2e336541-7ad3-4b39-9e89-f76d41316e33","resolution":{"observed_at":"2026-08-14T14:10:18.762303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.476813Z","title":"Intelligent trafﬁc light control,","venue":null,"work_id":"9e779a8c-bfbc-4c69-b961-07309480b9d1","year":2004},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.766202Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:89724576de44c62d3223348f8d8187553ddc07822bca1b3acf71822d20e76eae","observation_id":"da685d31-04c6-4739-bd87-1c629057b9a9","resolution":{"observed_at":"2026-08-14T14:10:19.481003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.464166Z","title":"Reinforcement learning with function approximation for trafﬁc signal control,","venue":null,"work_id":"e3468e00-bd03-41bf-bade-3daafa7a2d78","year":2010},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.770405Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:2df48d395ad0977f847a8404ee8d94744ddc21dd9f3ac31a41eb353b2ee3c150","observation_id":"cbd5402d-b3cf-437f-9ccd-8b2f0bb7d6ea","resolution":{"observed_at":"2026-08-14T14:10:19.468406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.774827Z","title":"Deep learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.774827Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:1b89ff4a0c75115b7a3f2b4e64be4872b5eb360305eaee0875d754d08df99093","observation_id":"364456ff-24e4-42c2-84b3-3a626efff3c0","resolution":{"observed_at":"2026-08-14T14:10:18.774827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.778960Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.778960Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:64c3745a92a7381f940259ce9110691e2cbb52363cd3c018e90967d4987d523a","observation_id":"8c5e1a01-e3e2-47e9-b93b-deace2bdc213","resolution":{"observed_at":"2026-08-14T14:10:18.778960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-15T12:04:28.662048Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T14:10:18.782886Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.782886Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:51bc2fcc2b758176cb866cf642a0020e72880502a0e4da297e47cc145349e131","observation_id":"ab14d659-08be-4580-b0c9-9ff1b0a94387","resolution":{"observed_at":"2026-08-14T14:10:18.782886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.436507Z","title":"Intellilight: A reinforcement learning approach for intelligent trafﬁc light control,","venue":null,"work_id":"da04abe7-bd51-42af-87a5-07dbd08189a5","year":2018},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.786802Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:6d2ce995d0f564730a9f53c2d53af832bb8b1a758ef1806caa7f3ee0f87b11b1","observation_id":"0ae5d25a-afb5-4e36-ade1-02e8ed350072","resolution":{"observed_at":"2026-08-14T14:10:19.441150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.09035","last_updated":"2017-08-02T15:15:51Z","snapshot_observed_at":"2026-08-14T21:09:52.756618Z","submitted_at":"2017-03-27T12:40:14Z","title":"Deep Deterministic Policy Gradient for Urban Traffic Light Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.09035","snapshot_observed_at":"2026-08-14T14:10:18.790452Z","title":"Deep deterministic policy gradient for urban trafﬁc light control,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.790452Z"},"links":{"cited_paper":"/paper/1703.09035","citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:20f150c87dbc3dcf0ed448bceb7615dbd946a2a26624721212332a58d33122fe","observation_id":"1e01c356-8b7a-4d73-886a-6c0f64910947","resolution":{"observed_at":"2026-08-14T14:10:18.790452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.794331Z","title":"The dynamics of reinforcement learning in cooperative multiagent systems,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.794331Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:96d17903377dd61542243e2c87524c4a040777a4befe0ac168bc29eb838b445e","observation_id":"02a3cf30-6870-42f6-a414-8bd32077d9c5","resolution":{"observed_at":"2026-08-14T14:10:18.794331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.415397Z","title":"A distributed approach for coordination between trafﬁc lights based on game theory","venue":null,"work_id":"ba1b7202-5a49-4c2e-81d8-e8ae7c210cab","year":2012},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.798585Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:24c674b4a4150c8ab4eb79a1fb3e76e47dc5f2dbb02b4b8bca77edacdc1f1320","observation_id":"ae7a9682-bbc2-4d89-980d-0d42b2c68df3","resolution":{"observed_at":"2026-08-14T14:10:19.420105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.402972Z","title":"Reinforcement learning-based multi-agent system for network trafﬁc signal control,","venue":null,"work_id":"a3083c94-00e0-4df4-87b5-497ed364829e","year":2010},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.802228Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:342ac96e9dc599276da832fce05b9e3e4217c101c86c940e9e8fba6b4bc13dde","observation_id":"f836fbc8-3693-4b4d-b336-a0ab1675ea5f","resolution":{"observed_at":"2026-08-14T14:10:19.407295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.389359Z","title":"Trafﬁc light control in non-stationary environments based on multi agent q-learning,","venue":null,"work_id":"ca84adcb-096a-4584-ba16-bc9d7a911e8c","year":2011},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.806137Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:e02d061f89ff8846af828d65ab47853db24cbf70f4d7c55b06faed6765a7eb45","observation_id":"2396dc4d-aad2-4bc3-b9f2-395c65d0ae4a","resolution":{"observed_at":"2026-08-14T14:10:19.393708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.810031Z","title":"Multi-agent reinforcement learning: Independent vs. cooper- ative agents,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.810031Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:9d4b54e1682db4ee85f4d84fce3c2f93785914efb4ecf7971c8ec75c15c67da5","observation_id":"3fdde02c-6389-4454-a10b-c694ed59834d","resolution":{"observed_at":"2026-08-14T14:10:18.810031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.813622Z","title":"Multiagent rein- forcement learning for urban trafﬁc control using coordination graphs,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.813622Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:195596f928fa9c715f907acc78fde0271fd553c460293eccd4473733de5916de","observation_id":"82d79b6f-06c2-41b9-a932-657bbaf5838c","resolution":{"observed_at":"2026-08-14T14:10:18.813622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.818266Z","title":"Multi-agent deep reinforcement learning for large-scale trafﬁc signal control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.818266Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:62eb3052a11146c4478dcaeedd8ff20009c86eb0ccfa3c4ef6f5001eb980feac","observation_id":"61fabeb4-c0da-4f8a-b317-e212c81b5d4b","resolution":{"observed_at":"2026-08-14T14:10:18.818266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.354406Z","title":"Double q-learning,","venue":null,"work_id":"73d517db-c2f4-43d6-b419-e19202a2f904","year":2010},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.821954Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:d2bb7f1fd57775009e06b823b8afabcd03c07f468435ef96c18cb2a05e339796","observation_id":"c570c8fe-b17d-49ce-8fa1-2c7a225282e8","resolution":{"observed_at":"2026-08-14T14:10:19.358925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.826452Z","title":"Finite-time analysis of the multiarmed bandit problem,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.826452Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:ff30777d80fc595d04a6a8d003320ff6a4792800e34232611125c803ef260172","observation_id":"475937c2-5a97-4ea2-bb67-2a414718a093","resolution":{"observed_at":"2026-08-14T14:10:18.826452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.333928Z","title":null,"venue":null,"work_id":"198e77fc-f99c-46dc-825e-4c5e0f45878f","year":1971},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.831574Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:e75205114004c568d392d77a475b0919d51f911d31d50ba6cf2aa89c8c9813f2","observation_id":"b0ace0a7-d999-4f1f-b5f1-5a5c7fae7b58","resolution":{"observed_at":"2026-08-14T14:10:19.338328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05438","last_updated":"2020-12-15T11:26:04Z","snapshot_observed_at":"2026-08-14T19:45:39.287552Z","submitted_at":"2018-02-15T09:07:57Z","title":"Mean Field Multi-Agent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05438","snapshot_observed_at":"2026-08-14T14:10:18.836124Z","title":"Mean ﬁeld multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.836124Z"},"links":{"cited_paper":"/paper/1802.05438","citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:5cde7d4c590a618e10cb969ed4bde607ad21d24b9d13a3fb73caafb84d1cbcaa","observation_id":"da88a2e6-83d8-4104-9f3a-de8336a58df4","resolution":{"observed_at":"2026-08-14T14:10:18.836124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.840220Z","title":"Deep reinforcement learning with double q-learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.840220Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:194d9bb6c4ac1f5dbfab748785e75402b8b1c802a35a2ae7c66f191f09dc0675","observation_id":"f998c9f5-81bf-48bb-bde4-7b37372a0ed2","resolution":{"observed_at":"2026-08-14T14:10:18.840220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.313468Z","title":"The optimizers curse: Skepticism and postdecision surprise in decision analysis,","venue":null,"work_id":"e095f1b7-d383-431e-aa2e-a0a6a8e5e1ab","year":2006},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.844496Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:aab2033e31e4ee190bfb2757950c2ee64d7eff8b7ae0d991bc64661c411de6e2","observation_id":"afd3646e-a4cf-4466-92b2-9c496af9c4b2","resolution":{"observed_at":"2026-08-14T14:10:19.318237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.299737Z","title":"Stochastic games,","venue":null,"work_id":"f7bdaf32-9d7f-4af4-b5a2-fbad8051e009","year":1953},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.848235Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:30e1d959b4b79dddb8b1d41b08e5aca5d4cb50f173fda605851800d75265e9ff","observation_id":"5ff7c61e-3442-4e4d-874f-4b63478a46ed","resolution":{"observed_at":"2026-08-14T14:10:19.304412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.851680Z","title":"Markov games as a framework for multi-agent rein- forcement learning,","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.851680Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:4384dab4cce7b7e478fa6e9184cc225e985dbd6605f21a21aab819cf5828982b","observation_id":"8d480387-ef36-4c35-8845-ed726e91073b","resolution":{"observed_at":"2026-08-14T14:10:18.851680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.278802Z","title":"Multi-agent reinforce- ment learning for trafﬁc signal control,","venue":null,"work_id":"337065b3-c426-47d2-b923-24de4d804f19","year":2014},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.856272Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:80401aeb3dba080f86a1dba5b137b1e885097301f8f254265b7e1319c785cb29","observation_id":"d293c8be-9d44-4ce6-af4f-ec41e1881842","resolution":{"observed_at":"2026-08-14T14:10:19.282806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.264866Z","title":"Analyzing and visualizing multiagent rewards in dynamic and stochastic domains,","venue":null,"work_id":"86cfd9ef-005e-4ff5-a170-1ff7f5c1480c","year":2008},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.860094Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:3a314de1c1797e88e085ac4db1e4353c4e85ae9cd9d21231247429686941757f","observation_id":"d22cc704-e909-4aed-9ff8-e6d409aff68b","resolution":{"observed_at":"2026-08-14T14:10:19.269195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.863855Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environ- ments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.863855Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:8ba6d16f87b10902593df408b0ef1a144f83ca544c2abdab1aa8a318987a5cda","observation_id":"2e592a8c-c3e0-4f92-a23a-95a968294ae2","resolution":{"observed_at":"2026-08-14T14:10:18.863855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.252416Z","title":"Efﬁcient ridesharing order dispatching with mean ﬁeld multi-agent reinforcement learning,","venue":null,"work_id":"098f2f9e-452b-4341-8b22-bae3f810158b","year":2019},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.867582Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:7bd9896c1d3af85651ea94c566cd828899b0966d2570818f3a1dad4ff67b9288","observation_id":"335ca4f3-b591-4bea-a568-577fbdef626b","resolution":{"observed_at":"2026-08-14T14:10:19.256880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.238045Z","title":"Convergence of stochastic iterative dynamic programming algorithms,","venue":null,"work_id":"2b5a705c-5252-40c0-8085-c7e3cab50348","year":1994},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.871426Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:dcfa496fad40512ae9596171c4d2aec9bd7a89e70c81293c544482b1578c56e4","observation_id":"daa96648-8cf0-452a-b99b-a4f67ed73a2f","resolution":{"observed_at":"2026-08-14T14:10:19.243667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.225271Z","title":"A uniﬁed analysis of value-function- based reinforcement-learning algorithms,","venue":null,"work_id":"b9d42b85-1d90-40fc-820c-f085514fcfd7","year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.875531Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:a47252b6d198a74a091ccde9e9c1226fc7e06fb49ac266a39642a56702e9dfb3","observation_id":"de4f5e7d-33c1-4fec-8fa9-01f542c3a20a","resolution":{"observed_at":"2026-08-14T14:10:19.229580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.879543Z","title":"Adaptive trafﬁc signal control with actor-critic methods in a real-world trafﬁc network with different trafﬁc disruption events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.879543Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:1bc3bb0a55d0deedf253c0ad7c5a6ef77ee024b9216bcaaad76f8158d9ff655e","observation_id":"964c8418-0dc4-459e-bf6c-efda623bb842","resolution":{"observed_at":"2026-08-14T14:10:18.879543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.883638Z","title":"Multiagent rein- forcement learning for integrated network of adaptive trafﬁc signal controllers (marlin-atsc): methodology and large-scale application on downtown toronto,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.883638Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:abbcd82d60d4f907da01bfa0a1aa80f83f24eba04ec2b90d4b159f602357e6e3","observation_id":"d208bf45-36cf-455f-b257-b6c076dd30e5","resolution":{"observed_at":"2026-08-14T14:10:18.883638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.196602Z","title":"Adaptive group-based signal control by reinforcement learning,","venue":null,"work_id":"ffe435a8-a4a6-4945-8f2a-dc532b632d52","year":2015},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.887519Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:a5be1ddc592af76b2c79ad39cf8f53b75ae742d4cb906788e17dd10464d2cc4e","observation_id":"f0c0fdeb-b8d2-43b7-b00c-c5a20bf228e7","resolution":{"observed_at":"2026-08-14T14:10:19.200745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.891267Z","title":"Cooperative deep reinforcement learning for large-scale trafﬁc grid signal control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.891267Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:af8538a2e7a6d373048a0bea395c057c207ad95c26f16c8451fcdc1200723639","observation_id":"627abbdb-8de3-4d5e-b3ec-d5ce4826bd65","resolution":{"observed_at":"2026-08-14T14:10:18.891267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.175807Z","title":"Large-scale trafﬁc grid signal control with regional reinforcement learning,","venue":null,"work_id":"57cea996-cc32-4e7f-803a-3098caeacfc5","year":2016},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.894879Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:787f5e35e34cabd8e78254971b62ec14f1227a92dc7f4bf9a12138388188d23c","observation_id":"16e57bbd-97b8-40c1-a9db-edcc42bb39a8","resolution":{"observed_at":"2026-08-14T14:10:19.180106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.163730Z","title":"Monaco sumo trafﬁc (most) scenario: A 3d mobility scenario for cooperative its,","venue":null,"work_id":"2b7676b6-ddec-4475-8a31-6a7eb56dbdf3","year":2018},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.898492Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:0685ca1fe452921e7d969b10a373fc2e7bffdea33a56b963eedb1db4ac0326ab","observation_id":"e9d04554-b067-4850-9738-ed08298f4467","resolution":{"observed_at":"2026-08-14T14:10:19.167910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.151761Z","title":"Agent-based trafﬁc ﬂow optimization at multiple signalized intersec- tions,","venue":null,"work_id":"3564bc22-a737-42c8-a56e-0fca01951cd7","year":2014},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.901761Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:b338c3999da60a6f74b4c754e74ffe3a0da349b08bcc6f3de841c76cb0408f7b","observation_id":"f373a301-af4c-4aac-bac8-43b72162dd9c","resolution":{"observed_at":"2026-08-14T14:10:19.156126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-14T14:10:18.905728Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.905728Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:d11f4d340da1cef8197702fd22b5821ebf78016e11bce075eebec3980795f859","observation_id":"18e7ebba-152a-460b-9f76-23547abc2355","resolution":{"observed_at":"2026-08-14T14:10:18.905728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.139127Z","title":"Sim2real viewpoint invariant visual servoing by recurrent control,","venue":null,"work_id":"c4a7d9ae-8b0a-48c5-a02a-5d30ba8d94a1","year":2018},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.909723Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:bdb99e96d851cb7039914220ef1177947cc3751ca0dcdb1fcce952d48070fe54","observation_id":"bc7489e9-9b59-449f-8622-65553bed4db4","resolution":{"observed_at":"2026-08-14T14:10:19.143343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.127022Z","title":"Feudal networks for hierarchical rein- forcement learning,","venue":null,"work_id":"88c9f944-4988-4193-9bd2-f59e35a443eb","year":2017},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.913435Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:3334bafd22ad8a2205480f595285d00acfd7232cc7184db68ab897a7ccaddeea","observation_id":"7d4ccbfe-874b-4dd7-98d3-c954d9ce3ae6","resolution":{"observed_at":"2026-08-14T14:10:19.131139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:18.917795Z","title":"Max pressure control of a network of signalized intersec- tions,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.917795Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:2beaf38115090cd4f468cda9bd6cbae63c6b7a8e8eb7a0b0000f8e78f18d4dbc","observation_id":"84a59941-8c86-4cb4-a2b7-dd6bc8de423c","resolution":{"observed_at":"2026-08-14T14:10:18.917795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:10:19.102274Z","title":"Distributed trafﬁc signal control using the cell transmission model via the alternating direction method of multipliers,","venue":null,"work_id":"859e5bcd-c7f0-41f3-ae51-e5c4e7a01634","year":2014},"citing_paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T14:10:18.922778Z"},"links":{"citing_paper":"/paper/1908.03761"},"observation_digest":"sha256:35f3032e8564327dcfe283f1b9d586e68b1c35cd358174e03f02eb72bc1522d9","observation_id":"00ed7121-abb7-4300-b0ff-a4343132512d","resolution":{"observed_at":"2026-08-14T14:10:19.109503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.03761","last_updated":"2020-09-30T12:01:34Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T14:19:37.102706Z","submitted_at":"2019-08-10T14:19:21Z","title":"Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:1908.03761."}