{"as_of":"2026-08-21T10:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3142783fa3b22ef4d9a025e887bebce8eddc95bb567914010f3c911a0b09257","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T23:23:38.957539Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.06229/citation-record","integrity":"/paper/2511.06229/integrity","json":"/paper/2511.06229/citation-record.json","paper":"/paper/2511.06229"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.683612Z","title":"Diakaki, V","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.683612Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:db4d97e21066db86725266df108c8cdd256ee833ce5c4f0c573f4a4f1f4abe30","observation_id":"0e82afcd-6d6d-48cb-95f1-99bf8e8e4d0b","resolution":{"observed_at":"2026-08-03T23:23:32.683612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.753107Z","title":"Li, and J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.753107Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:358c9bd389fdfcc50392b69dec29ba17631c025fb71a4ef03f160a4591b028a7","observation_id":"677ce0e9-a148-4977-be2f-048be66e4ec7","resolution":{"observed_at":"2026-08-03T23:23:32.753107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.833345Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.833345Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4e2ac377a8976ae46f32d37df55143e02a08af72b7c9488cd94522d35d9f1ea8","observation_id":"e5fee026-0986-460d-8618-bb1ce2f4fd26","resolution":{"observed_at":"2026-08-03T23:23:32.833345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.957739Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.957739Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:6fe34826f7ed546969eb89bac311e1bcf4691feff01b355db098282b3659c1c0","observation_id":"0d7bf459-9bf5-4494-abf7-e84f6810ab12","resolution":{"observed_at":"2026-08-03T23:23:32.957739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.074591Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.074591Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:3f9088e5afa6464b50ae8bbc2252c98a521abfcfb6cb9e8541229b05a6af9a49","observation_id":"222b3e58-b069-4a3f-83f2-f063585c9a79","resolution":{"observed_at":"2026-08-03T23:23:33.074591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.198379Z","title":"Markou, and C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.198379Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:91eb0954be5709cb5b26e8ef61596371e81a6f07e7af2de62d3207edbf656b98","observation_id":"5fb3a231-b8ae-4d04-902c-e9b5b45eb3e8","resolution":{"observed_at":"2026-08-03T23:23:33.198379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.355980Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.355980Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:078c063921d5a25d4431a5ba7403133660f9ee3c6bb8e572160fd97ad38e9bc3","observation_id":"dd10f324-50f3-4517-b3c7-a10ee41de6da","resolution":{"observed_at":"2026-08-03T23:23:33.355980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.463976Z","title":"Dynamic Origin–Destination Matrix Calibration for Large-Scale Network Simulators.Transportation Research Part C: Emerging Technologies, 2019a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.463976Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:6ee6980d9d9934b3d8cc1ab2e8c15438fba91082dfceffc031bae19b6b037251","observation_id":"0b67dae1-1c11-4342-a5f5-544c37c5ac69","resolution":{"observed_at":"2026-08-03T23:23:33.463976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.559574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.559574Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4da7d8388a354bc635a1f58207383d1e9afac0ef89fce60c8d0f66040076bedd","observation_id":"950d9374-2b48-4712-808f-ea91ef050569","resolution":{"observed_at":"2026-08-03T23:23:33.559574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.781959Z","title":"Sasaki, Y","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.781959Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:962b5e5a1b2c3848baaa30cb3252bb71c2983a15c8237e5587de44717b40f146","observation_id":"4b0b6997-87b5-4862-ada7-b4cae3b74b91","resolution":{"observed_at":"2026-08-03T23:23:33.781959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.901818Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.901818Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:5a3ac2aa2fb778c49b9d54b58dc96724949c82c9c031768f77aa1e2b248605db","observation_id":"d0508538-dc7e-43d9-8887-f716a82ce8ca","resolution":{"observed_at":"2026-08-03T23:23:33.901818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.022007Z","title":"Montero, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.022007Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:ad3f3c641e6585751446fa204d76201e1100daec6f27bf3d13684cf6699a6794","observation_id":"e3475b7a-4eb2-4056-a88f-63b30d2b56f0","resolution":{"observed_at":"2026-08-03T23:23:34.022007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.102592Z","title":"Antoniou, M","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.102592Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:dec7ac204788bc60f55f76cb83dfeebfc22cb49542d79416cf3f43c8b1827da5","observation_id":"ac029355-c2e1-41e5-a391-e269211abf9d","resolution":{"observed_at":"2026-08-03T23:23:34.102592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.295251Z","title":"Osorio.Efficient Offline Calibration of Ori- gin–Destination (Demand) for Large-Scale Stochastic Traffic Models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.295251Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:b64f86abaf14455587b432f9662162c21215454c90a32c3f853d7fe15fe89607","observation_id":"00b0058d-2073-49a2-8db4-fef59dc802eb","resolution":{"observed_at":"2026-08-03T23:23:34.295251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.495701Z","title":"Kesting.Traffic Flow Dynamics","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.495701Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:5e3c9e6366bd7e73a258072adb2861ff4d0e545228623ecb1e290f4d71863966","observation_id":"5f2bb943-9c49-441c-8755-6c471ed344a0","resolution":{"observed_at":"2026-08-03T23:23:34.495701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.701459Z","title":"Steps toward Artificial Intelligence.Proceedings of the IRE, 1961","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.701459Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:727f5baa2298cc34eafe4fe58a0886132226c558c6baa7000203c481925373c3","observation_id":"32b48692-4065-46df-9ab0-7afd4100d08a","resolution":{"observed_at":"2026-08-03T23:23:34.701459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01072","last_updated":"2024-07-04T09:32:18Z","snapshot_observed_at":"2026-08-20T01:15:04.998523Z","submitted_at":"2023-12-02T08:49:51Z","title":"A Survey of Temporal Credit Assignment in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01072","snapshot_observed_at":"2026-08-03T23:23:34.899054Z","title":"Ferret, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.899054Z"},"links":{"cited_paper":"/paper/2312.01072","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:9db56d68af593ea77e8f9ff1090770947997120393a1d9f65aa6a23db72ce841","observation_id":"5718411b-dbfe-4b54-a177-6b9c5b198636","resolution":{"observed_at":"2026-08-03T23:23:34.899054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.057615Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.057615Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:eee7df7fd4d80d9790b7d5b3d0a3890b3af3feb994ae26c5ae4412f21afddd9f","observation_id":"7b627236-2461-4c79-a5d7-b27b5089613a","resolution":{"observed_at":"2026-08-03T23:23:35.057615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.05866","last_updated":"2017-09-28T21:51:43Z","snapshot_observed_at":"2026-08-14T20:40:30.429588Z","submitted_at":"2017-08-19T15:55:31Z","title":"A Brief Survey of Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.05866","snapshot_observed_at":"2026-08-03T23:23:35.220835Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.220835Z"},"links":{"cited_paper":"/paper/1708.05866","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:72a42baa3e53efa47288f00c471f594491f02c1a012b01cce3aa68f78ae2f110","observation_id":"8789beff-5f02-4c6f-ae53-c11b946c3a5f","resolution":{"observed_at":"2026-08-03T23:23:35.220835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T23:23:35.405091Z","title":"Wolski, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.405091Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:ca6c412466525dbc6093fd4da994ed031bd46a169ce442c01fa6f2fb950a9cec","observation_id":"1049e798-0652-47aa-92d2-21e7a3d1d942","resolution":{"observed_at":"2026-08-03T23:23:35.405091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-03T23:23:35.541666Z","title":"Moritz, S","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.541666Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:352d8049b0136ae4276c25672366f712bdd93aa08232897ce75eff3acf42d60b","observation_id":"12ef41fb-f7b9-4593-8bc1-2bc593182898","resolution":{"observed_at":"2026-08-03T23:23:35.541666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.666933Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.666933Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:714d842a49db5a3f508e20a5d6efb3a857ec6fab61df3fead8c386791d3fabae","observation_id":"1fa94b80-8582-426b-88d9-1a821197fcea","resolution":{"observed_at":"2026-08-03T23:23:35.666933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.794591Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.794591Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:7cc39a5add3f3fd73704a03d6d70272af592913364f2c51009f30f5ffa645db5","observation_id":"ca59cad7-284c-4b44-877d-08103acce6a6","resolution":{"observed_at":"2026-08-03T23:23:35.794591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.928226Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.928226Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:956cbd5eda3e02644605274c13e96820a71b9fd0898ef1ed395a07754dfdb4c4","observation_id":"7b413353-06bf-418e-80b8-9aca7a7ecfa9","resolution":{"observed_at":"2026-08-03T23:23:35.928226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.117077Z","title":"Inaudi, and G","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.117077Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:44fba252ba190166d071f28a7ae696f5a5b3dcef97c1b26b8f26df39ac6de6d2","observation_id":"6a958d6b-f35c-427a-ac66-5305f62290f5","resolution":{"observed_at":"2026-08-03T23:23:36.117077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.282047Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.282047Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:178638ba057d28e16f68e73f17b4fb47bd54508a772d2a459862dd4e14655341","observation_id":"8e1e8422-0889-4a9b-9299-aa168721621a","resolution":{"observed_at":"2026-08-03T23:23:36.282047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.451862Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.451862Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4fb2a0d18f345fbc9e4e7671d191e2bd874bc8167fd037d2ed7004a9b3fe9d15","observation_id":"68a46a14-794c-442f-9fb0-91fec737971c","resolution":{"observed_at":"2026-08-03T23:23:36.451862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.589956Z","title":"F., and J","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.589956Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:7904483dd66c1810d0581b62ad91020bffe6aabcca71d7e6c19655e981e8c096","observation_id":"86d265f0-ed73-49f5-aff0-9f84de8db72e","resolution":{"observed_at":"2026-08-03T23:23:36.589956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.711536Z","title":"Gu, and M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.711536Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:61e900daf5f2876a5027dfefc57459de9ef68afdd5c8485226e1fed790cffcfa","observation_id":"0317c9b9-e440-4174-8c4e-f1ae8fb5ee58","resolution":{"observed_at":"2026-08-03T23:23:36.711536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.865095Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.865095Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:57b98de501ed8c3c5bb9343dd40a904b30e69963fdd5d756444978f279ac032f","observation_id":"1e1017ee-65d9-4539-bca2-99304ad67cac","resolution":{"observed_at":"2026-08-03T23:23:36.865095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.037920Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.037920Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:3147728ecdf45608773eeecff817f2c2ed8e6c30cf659098f8318c698009afca","observation_id":"46b76a8b-96d2-46d2-b48b-c39b83c678ef","resolution":{"observed_at":"2026-08-03T23:23:37.037920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.143895Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.143895Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:2d6ffda9e1dffec0e117de1849dfd8ed69b10f5cbd83197438038d2f2b39cf7a","observation_id":"587cb204-7748-472e-8200-198113e4dc4d","resolution":{"observed_at":"2026-08-03T23:23:37.143895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.279728Z","title":"Van Lint, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.279728Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:dea63d1df2d0e0b2faf6421e3c1534f34833f89596b5d74898b066fbbe67410e","observation_id":"43e9d9b3-e035-40a3-b35a-604b93d6c33a","resolution":{"observed_at":"2026-08-03T23:23:37.279728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.427176Z","title":"Khoshkhah, and A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.427176Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:f760e487f74c2439be5c8456da2e4c39e7f1c0ad09a03d147f39604129300b4e","observation_id":"a559974e-e483-4f8a-838c-6a247a58d46e","resolution":{"observed_at":"2026-08-03T23:23:37.427176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.549100Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.549100Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:10ed599500ee9178a107fc5e7b11230e0c144d50cebb9c5a15c3c4a6c2e832d1","observation_id":"c2fb4ad4-7816-4cf4-889b-f5edcbf8bbcc","resolution":{"observed_at":"2026-08-03T23:23:37.549100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.675216Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.675216Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:310cdb700f2d1449ad0cc2c62fbd84f219e1cb19940ed4a5e483447d6ffbc33c","observation_id":"880b8f0e-dcf1-4ecb-b347-458262dd4e5e","resolution":{"observed_at":"2026-08-03T23:23:37.675216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.795580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.795580Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:a22cdc5cfaff1c1f80d7b6ae795c7947e3ef620fa3475fde362b446f9642b8c1","observation_id":"50f11dea-88df-46c7-ac0b-33cbfb6a2074","resolution":{"observed_at":"2026-08-03T23:23:37.795580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.967122Z","title":"Value-function Approximations for Partially Ob- servable Markov Decision Processes.Journal of artificial intelligence research, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.967122Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:0e06af7d877c01035018a5f850fab551f0e79da62457d234d65ff2a33470f770","observation_id":"dd34e80f-48f7-4560-86f1-60587a2fe5a0","resolution":{"observed_at":"2026-08-03T23:23:37.967122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.086574Z","title":"Liang, and N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.086574Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:6d4920c471bd3229d665babf73c699821737f2d4d4743a901c10dfce403b978c","observation_id":"4797e490-440e-4379-b6a8-0fe66b5ef3cc","resolution":{"observed_at":"2026-08-03T23:23:38.086574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.271542Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.271542Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:c81dffd0a5a5228cb8d9d9633a07aef0f8a1c18a8f484e5ebbeeb59ea1e01e6b","observation_id":"80366d07-d79d-4e8d-939a-76be2ab7a8d2","resolution":{"observed_at":"2026-08-03T23:23:38.271542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-03T23:23:38.403820Z","title":"Kavukcuoglu, D","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.403820Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4135f802bfbe051a2c03d2b5cab19562bf888fc9c08208c75beb20bb75021de7","observation_id":"40811562-c89f-4b5b-b95b-9d9d01ee8089","resolution":{"observed_at":"2026-08-03T23:23:38.403820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.580516Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.580516Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:3934233b2e533974bee4ed7cd9f22a9cba6f38b64d4cd05d870bef5bca21f5ab","observation_id":"5f782bc9-7730-4c92-9a0a-c28f9349ef86","resolution":{"observed_at":"2026-08-03T23:23:38.580516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.772041Z","title":"Springer, New York, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.772041Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:5f525b255548a816db62f11a470b3a8b9b7c91243f5f7c763162f4449fbc1664","observation_id":"6a747b68-069f-4769-a3ff-4a131919dcbd","resolution":{"observed_at":"2026-08-03T23:23:38.772041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02811","last_updated":"2018-07-08T13:06:26Z","snapshot_observed_at":"2026-08-18T00:58:48.914606Z","submitted_at":"2018-07-08T13:06:26Z","title":"A Tutorial on Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02811","snapshot_observed_at":"2026-08-03T23:23:38.957539Z","title":"I.A Tutorial on Bayesian Optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.957539Z"},"links":{"cited_paper":"/paper/1807.02811","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:53e3c700beda3ff8aa6b62a94e6651e2807747d71be5c026afab3cadd4e1657e","observation_id":"38c75a37-918a-434b-a8a4-071d03487b52","resolution":{"observed_at":"2026-08-03T23:23:38.957539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-20T01:15:18.511915Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2511.06229."}