{"as_of":"2026-08-16T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0bb917351931982ce916f763a2473ad364055d64cf03f50931f62dc375fd7deb","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:19:40.066335Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18286/citation-record","integrity":"/paper/2607.18286/integrity","json":"/paper/2607.18286/citation-record.json","paper":"/paper/2607.18286"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:36.711195Z","title":"Transit signal priority (tsp): A planning and implementation handbook,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:36.711195Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:943010525655820ca5ef51251ae9e039ae3533190848acbd153db97ea38ceda5","observation_id":"c1c04dda-9529-48ff-8469-1a39cab8aa2f","resolution":{"observed_at":"2026-08-02T09:19:36.711195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:36.804192Z","title":"Accessed 2026-05-13","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:36.804192Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:db5f9ef241e3fc4412305622e117042b69ad5f2101d3a6c849398c53cd734a88","observation_id":"21f50261-912b-405d-aee0-99ebcc47769b","resolution":{"observed_at":"2026-08-02T09:19:36.804192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:36.899196Z","title":"Deep reinforcement learning for transit signal priority in a connected environment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:36.899196Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:2531a60563bba9552403121d5599b5f342f24f7c70252f169284d84a1db51c83","observation_id":"ca1abaef-85f3-4b7e-bbd1-8d3db3f74b5c","resolution":{"observed_at":"2026-08-02T09:19:36.899196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.030573Z","title":"Deep reinforcement learning two-way transit signal priority algorithm for opti- mizing headway adherence and speed,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.030573Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:04500fc124cf74c44aba8a2fc9d1d0fa25a7dc26b116a15a3606eeff54b525ad","observation_id":"fcb1e06d-cb54-4606-9fb0-6b88fb957f91","resolution":{"observed_at":"2026-08-02T09:19:37.030573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.154485Z","title":"Multi-agent reinforcement learning for co- operative transit signal priority to promote headway adherence,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.154485Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:91c13c1c5774b8444a65379bbf0cd966a078bab0d41a99a9a58c20ecd8207229","observation_id":"88558379-bd75-4e99-b007-4811f80abdc6","resolution":{"observed_at":"2026-08-02T09:19:37.154485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.288095Z","title":"Constrained traffic signal control under competing public transport priority requests via safe reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.288095Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:f7f94089d43ef9d1e90573447970fc1f93e19ea14f80a68f49796b20d7d94cc7","observation_id":"04bb9f75-cfeb-4796-bfc6-986457ebb628","resolution":{"observed_at":"2026-08-02T09:19:37.288095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.438480Z","title":"Universal value function approximators,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.438480Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:ec66fbfc0a3f62c90e53f6ed7bfa4aee4da33eaaecfe213d56cf3292b377b0d8","observation_id":"34620826-9c7a-4f71-87bb-808273cbdeee","resolution":{"observed_at":"2026-08-02T09:19:37.438480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.587344Z","title":"Dynamic weights in multi-objective deep reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.587344Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:a3fbec4d189ef452c958571bc89cc775bbbda5e0b27a495f95617efe778faa40","observation_id":"0a13ca1c-3e89-4453-b16a-f9096d439d29","resolution":{"observed_at":"2026-08-02T09:19:37.587344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.703790Z","title":"Pareto conditioned net- works,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.703790Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:9ce44e885332d76f73d50d03e9912a9c8aa627dc0bba1157cf3d9bce37b147a0","observation_id":"7257f738-ad30-4128-a603-2c623f5709ef","resolution":{"observed_at":"2026-08-02T09:19:37.703790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:37.847834Z","title":"Reinforcement learning benchmarks for traffic signal control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:37.847834Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:c47128371539943c49807a859291c17893be2602dd049fbb1363b5bb107611ed","observation_id":"125c4571-3338-48b9-9d10-220cb3e032cd","resolution":{"observed_at":"2026-08-02T09:19:37.847834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:38.033957Z","title":"Reinforcement learning for traffic signal control: Comparison with commercial systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.033957Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:09a7b70a396830cb6e00fca240c3e93686590d5fc7bf81b0bb10f60d8dbbfbe6","observation_id":"60674f63-6fc6-4d46-a397-4bc4cfa58269","resolution":{"observed_at":"2026-08-02T09:19:38.033957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:38.171272Z","title":"Libsignal: an open library for traffic signal control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.171272Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:00cbc25a879307f26703c3cecc7b09a1243f5d6b735e0dd105ad970e5da33ea6","observation_id":"86283967-92c6-4a0c-9242-9b466b369a3d","resolution":{"observed_at":"2026-08-02T09:19:38.171272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15221","last_updated":"2024-10-19T21:34:24Z","snapshot_observed_at":"2026-08-16T13:07:44.887811Z","submitted_at":"2024-10-19T21:34:24Z","title":"IntersectionZoo: Eco-driving for Benchmarking Multi-Agent Contextual Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15221","snapshot_observed_at":"2026-08-02T09:19:38.492589Z","title":"Intersectionzoo: Eco-driving for benchmarking multi- agent contextual reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.492589Z"},"links":{"cited_paper":"/paper/2410.15221","citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:0c194a66b2a38f64c564e80627814479003aa65f9b42e98eb4e2a6dff5ebc7c7","observation_id":"0ffb995c-0c11-4883-be7a-77a4bd5bc6a0","resolution":{"observed_at":"2026-08-02T09:19:38.492589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:38.634851Z","title":"SUMO-RL,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.634851Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:7b267ce045718f706208a65693e5ff1d74282adee586e950e988d56491012202","observation_id":"9752e6c5-a227-4b91-916f-202b972ae7fc","resolution":{"observed_at":"2026-08-02T09:19:38.634851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:38.736360Z","title":"Microscopic traffic simulation using sumo,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.736360Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:d00620171bc8ff43beca8c3e6775af14d5cb88e21e5c01bf7167f606286aa72b","observation_id":"d0e8a53f-0e00-4927-aded-f02efb5b6719","resolution":{"observed_at":"2026-08-02T09:19:38.736360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:38.844017Z","title":"Domain randomization for transferring deep neural networks from sim- ulation to the real world,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.844017Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:1df0ddd6cd4a54aaa3df1d8424b56df1c271eb95f179e4a679051a0deeaa8690","observation_id":"2ae3d59a-b390-4c99-91d4-cd5a0888605d","resolution":{"observed_at":"2026-08-02T09:19:38.844017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:39.026123Z","title":"Bridging the reality gap of reinforcement learning based traffic signal control using domain randomization and meta learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.026123Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:ebee70d414998214606f3a2c5ca6e359345e416f039a8811c8b4c99676c628b6","observation_id":"834e6c0d-c590-4452-9361-57d7d81ec224","resolution":{"observed_at":"2026-08-02T09:19:39.026123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:39.177115Z","title":"Generalight: Improving environment generalization of traffic signal control via meta reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.177115Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:c18b068edb7a2b54869f75beadf4995b502140b916e5fe3a892df3517599809c","observation_id":"4de81f9f-bb50-4d47-9e80-07fba9ced0ab","resolution":{"observed_at":"2026-08-02T09:19:39.177115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:39.301312Z","title":"Optimization and simulation of fixed-time traffic signal control in real-world applications,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.301312Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:bc723b211f40d47279f5caf00bdedd4e2a2f22d5793cc7a5d20973de2a890f0a","observation_id":"14f0226e-97e9-41db-bb26-3b057847fee8","resolution":{"observed_at":"2026-08-02T09:19:39.301312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:39.472751Z","title":"Stable-baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.472751Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:e24013e8592344d9137701baabd6407d1c3d3eb23620d1ad9888edd94c4c1954","observation_id":"46cc5bc8-1826-4a45-b1e7-f8056d9d2e81","resolution":{"observed_at":"2026-08-02T09:19:39.472751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:39.926982Z","title":"A generalized algorithm for multi-objective reinforcement learning and policy adaptation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.926982Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:b824c60afe24935638f24bbad9305534a83ca89d8367fc8f192b8aeb68e609bb","observation_id":"c0afc9d7-e667-4107-ab54-97b7aa0cf99a","resolution":{"observed_at":"2026-08-02T09:19:39.926982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:19:40.066335Z","title":"A toolkit for reliable benchmarking and research in multi-objective reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:40.066335Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:ef0ae4bcaf4e14fc928a89c374740af06eae5428164f59882edd5b49baa5734c","observation_id":"21ef76d4-cafa-4494-bb20-5f611be9a4b2","resolution":{"observed_at":"2026-08-02T09:19:40.066335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T09:19:39.778749Z","title":"Available: http://arxiv.org/abs/1707.06347","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:39.778749Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:fd645c63149cc025637172ccd217554d3efbb1536a6bf617615fa2cf91e8a56c","observation_id":"2f5594ed-d2db-47db-a2f3-80a3f716a815","resolution":{"observed_at":"2026-08-02T09:19:39.778749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10994-023-06412-y","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://doi.org/10.1007/s10994-023-06412-y","venue":"Machine Learning","work_id":"b1991de1-7f66-4bb7-9458-9ea118a1ed08","year":null},"citing_paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T09:19:38.318999Z"},"links":{"citing_paper":"/paper/2607.18286"},"observation_digest":"sha256:17b051ae73b984db232a0ecb989fc6b596055c10e18b790e8b74937b45cc8db6","observation_id":"a505756c-5a15-4c1d-bef7-78f1dad013bf","resolution":{"observed_at":"2026-08-02T09:23:26.436026Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.18286","last_updated":"2026-06-30T09:57:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T11:34:06.191417Z","submitted_at":"2026-06-30T09:57:39Z","title":"Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2607.18286."}