{"as_of":"2026-08-09T17:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75003adbe8a6d24d2d87bef99372444789c1f89bde74fb94fc0dffc8cee10467","coverage":[{"denominator":175,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T14:02:55.681719Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16210/citation-record","integrity":"/paper/2607.16210/integrity","json":"/paper/2607.16210/citation-record.json","paper":"/paper/2607.16210"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.128461Z","title":"Verifying Global Two-Safety Properties in Neural Networks with Confidence , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.128461Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:15fd0ce06583ccf0f2c764575d3a974ca3ffb073ae2b5bdbee63ae365b7a6a67","observation_id":"775c723e-81df-435e-9866-72cca0146453","resolution":{"observed_at":"2026-08-02T14:02:54.128461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.199809Z","title":"Formal Methods for ML-Enabled Autonomous Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.199809Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4099bc50fc7a92d2db034ff3cdc30e36259c9ea4fe04f5576f465daea645423a","observation_id":"85c72701-09a1-497c-9a34-3c711073e0cd","resolution":{"observed_at":"2026-08-02T14:02:54.199809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.282110Z","title":"International Journal on Software Tools for Technology Transfer , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.282110Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a5c34e767eec97f9b31891584770c25495d73ff638431a7fd787a91cc2a0ff3e","observation_id":"38092ef7-facd-412c-a791-b75d191a54fc","resolution":{"observed_at":"2026-08-02T14:02:54.282110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.293450Z","title":"CAV , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.293450Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:47b44410b02a21eee7f29c10acb26d67d745fbd75de58e43eaac211401101c3b","observation_id":"0eef7a90-2eeb-41ea-bfa3-cd892fd27f5f","resolution":{"observed_at":"2026-08-02T14:02:54.293450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00263","last_updated":"2022-04-30T13:12:33Z","snapshot_observed_at":"2026-08-09T15:58:25.141516Z","submitted_at":"2022-04-30T13:12:33Z","title":"Complete Verification via Multi-Neuron Relaxation Guided Branch-and-Bound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00263","snapshot_observed_at":"2026-08-02T14:02:54.347830Z","title":"arXiv preprint arXiv:2205.00263 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.347830Z"},"links":{"cited_paper":"/paper/2205.00263","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:85fa9ca0d554523e3ea4ebeea0719af4636a9611db231429c979b74aab9dad6f","observation_id":"1e6f262d-a70b-4e84-a067-704f1e9c9a91","resolution":{"observed_at":"2026-08-02T14:02:54.347830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.361856Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.361856Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4d2aaa2017714275cfa586a0d5cdf31d1c1f7636655563b01b793451256a6c76","observation_id":"cf3191d2-145e-43de-ba28-919abe31674d","resolution":{"observed_at":"2026-08-02T14:02:54.361856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.364678Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.364678Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:84c4ef6821aea3085add7d1b3ff34aebd2f49351825fc6b713f57b4d931f35af","observation_id":"64367a46-990d-4857-a652-015a21c6245b","resolution":{"observed_at":"2026-08-02T14:02:54.364678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.367725Z","title":"Proceedings of the ACM on Programming Languages , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.367725Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5ce63955f4afd61504c48a8a083736ce9416ca4d6f69775615f2c538dfbb02cb","observation_id":"7bb573b5-6643-417e-b9ad-77a43ecbd849","resolution":{"observed_at":"2026-08-02T14:02:54.367725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.370534Z","title":"The Probabilistic Termination Tool Amber , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.370534Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:60314535f3c5c930885590fdc0967af432f5cd9c73d175393185725a74ccf1e9","observation_id":"4c8dee03-651c-49ab-83f5-b4c7c47d6e29","resolution":{"observed_at":"2026-08-02T14:02:54.370534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.376144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.376144Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:575c9e3bf3d394f65c33a556ea9ae4fa84dd6d6426aca2f9f7ad7b85df1f01b7","observation_id":"958ffb89-fe6a-43a9-8fad-d467ce980f40","resolution":{"observed_at":"2026-08-02T14:02:54.376144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.381104Z","title":"Lopez-Miguel and Sebastian Adam and Ezio Bartocci and Thomas Eiter and Martin Tappler , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.381104Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:8c4b1876505f577e723d869ca51fbc95affbf44f59c72182b6ba68560de48a5f","observation_id":"f4ce62e7-ab40-44ad-aead-6a280367398e","resolution":{"observed_at":"2026-08-02T14:02:54.381104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2025/1264","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence,","venue":null,"work_id":"aa6e1249-c678-49d1-9107-406a43ee720d","year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.386374Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9e7a36f7cdfb1a587fb940b4c05a5415d8ddf5b0df24556caca1610bc58d1d69","observation_id":"b47aa3c9-f381-4bbf-83d4-92dca484ff46","resolution":{"observed_at":"2026-08-02T14:03:33.338011Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.391796Z","title":"Yun and Peizhi Niu and Xusheng Luo and Changliu Liu , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.391796Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:72c015ff322cb126cf6d9db5163917f546d783fc3781693bcf0453b03fdd7ddf","observation_id":"7f57d7da-d093-4a36-b05b-081710e97866","resolution":{"observed_at":"2026-08-02T14:02:54.391796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.395784Z","title":"Donti and Changliu Liu and Enrico Marchesini , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.395784Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:281e211fe0200cc60a28d70d7c0d82ff81a2d01093bd1be64cf67a16fc915a32","observation_id":"9ede5dc4-2df1-4be3-b639-0107d5c401d6","resolution":{"observed_at":"2026-08-02T14:02:54.395784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-02T14:02:54.401533Z","title":"Christiano and John Schulman and Dan Man","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.401533Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:570d783de5235806d1541b7fddca912cfd075cb787639e2ef4aabff0604c5d32","observation_id":"757218a8-9bd6-4894-be10-ae47ad59f567","resolution":{"observed_at":"2026-08-02T14:02:54.401533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.407560Z","title":"Conference on Artificial Intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.407560Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b59c0f28a7ea7139060169fe5e220d07628d510e739a849b85dcda2999502a58","observation_id":"9dab8827-1a78-475e-89e7-6d97a7009439","resolution":{"observed_at":"2026-08-02T14:02:54.407560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.412473Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.412473Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a9bc98d7e1cc17cacf28509ec3e9e112542e5dc4bd68b77225eb16b21d7aa4c6","observation_id":"8b3a9b81-2009-4079-afdd-bdd487d30815","resolution":{"observed_at":"2026-08-02T14:02:54.412473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.418769Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.418769Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f8bb6609c72a8bd3efa5e9ffc55060d0bfd22f713884555e9543e3b3dc950486","observation_id":"0293e842-18c7-4ef1-9bc8-9509c7927d28","resolution":{"observed_at":"2026-08-02T14:02:54.418769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.423945Z","title":"Proceedings of the 2023 International Conference on Autonomous Agents and Multiagent Systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.423945Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:cff73c43c04871abfead7ba80e9e384c75ba4866ba1b4e23bb483aaba04f82b1","observation_id":"abf9afab-3eda-4290-b432-6c1bf519ada3","resolution":{"observed_at":"2026-08-02T14:02:54.423945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.429639Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.429639Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:768bafe4d5b496a4493579eb4277ff55584664e632b676fb0991361f0f7b5af6","observation_id":"ae1e88b9-290e-4cdc-b5c0-463a1e67bd57","resolution":{"observed_at":"2026-08-02T14:02:54.429639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.434588Z","title":"2025 , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.434588Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:47aa4acade82cbb736eeb4c20bc63e17caa5da14e5cd71b5c4b9b0d288b757b0","observation_id":"7bd54849-0944-40de-af52-7d1d4e809b51","resolution":{"observed_at":"2026-08-02T14:02:54.434588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.439294Z","title":"IJCAI , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.439294Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:ac416682f918e4ce59155fbd533bac595bbacb68495c7b05f418a333247a51f6","observation_id":"8bea831f-7f75-4af5-8c7f-683077cf1fc9","resolution":{"observed_at":"2026-08-02T14:02:54.439294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.444739Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.444739Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d0ed9289d9602257cc874db8797b4c5bef26492cec3fb1fa463c3495d22adb30","observation_id":"a3eecd15-44ef-4e1b-92a4-31a0a39a10c4","resolution":{"observed_at":"2026-08-02T14:02:54.444739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.450046Z","title":"Tools and Algorithms for the Construction and Analysis of Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.450046Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:202273ece9b7e41f748458c4ad31a00e182fbcb7c9275f561705e475986e4558","observation_id":"f1cf0f00-b126-4987-96fd-5617fa5e2a0d","resolution":{"observed_at":"2026-08-02T14:02:54.450046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.455306Z","title":"International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.455306Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0ca6cb1908242e474a5ae557ff8132f754ea20d1fab21c9426d4d4d53262ddad","observation_id":"f39dad8d-0c24-4f33-88c1-ed9716e2c576","resolution":{"observed_at":"2026-08-02T14:02:54.455306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.459469Z","title":"2022 , url =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.459469Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0dca5a840bc0731d72170ae4ef7b80274721c5b9ca2692bf3247fec4ad9b6450","observation_id":"920f6f33-e92e-4d12-9f1d-4e44554fc2d7","resolution":{"observed_at":"2026-08-02T14:02:54.459469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.465126Z","title":"Towards Hierarchical Task Decomposition using Deep Reinforcement Learning for Pick and Place Subtasks , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.465126Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b18de1e98e8dfd08c01f4e7633914667b1b97bf8709210e4a349a3f8a629bd04","observation_id":"e258d0de-3275-459f-9d64-e861479af162","resolution":{"observed_at":"2026-08-02T14:02:54.465126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.470222Z","title":"International Conference on Computer Aided Verification , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.470222Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:96b2f60ff3a61ae34074603d8e49d13a50928646c485501119626230607c3a46","observation_id":"2acdd3e2-153b-41a6-8227-d6a02052b44d","resolution":{"observed_at":"2026-08-02T14:02:54.470222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.474294Z","title":"2021 , isbn =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.474294Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4dcbc65d9428e54aa0860b54c00a515427ef35b827b63f195f28147664340cb2","observation_id":"83a91d41-b1b1-4948-bfee-ec2db7a21f3a","resolution":{"observed_at":"2026-08-02T14:02:54.474294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.480867Z","title":"CAV , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.480867Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:81a548231f9229e8bdebb3efa8d7d39689d64e5618825f561fd60f5a1b8cfda7","observation_id":"f4ac6ec9-5ed6-4252-88f8-b345a5bf2a9d","resolution":{"observed_at":"2026-08-02T14:02:54.480867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.485366Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.485366Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:293ebabb7b964d1bd5b569e0e9f4dec5ed85667e69a2de4254ae04ac003ad330","observation_id":"096f35b5-1885-49dd-8e38-87438550458a","resolution":{"observed_at":"2026-08-02T14:02:54.485366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23903","last_updated":"2025-09-05T15:41:39Z","snapshot_observed_at":"2026-08-05T13:27:13.023088Z","submitted_at":"2024-10-31T13:05:46Z","title":"Neural Network Verification with PyRAT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23903","snapshot_observed_at":"2026-08-02T14:02:54.489903Z","title":"arXiv preprint arXiv:2410.23903 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.489903Z"},"links":{"cited_paper":"/paper/2410.23903","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f5de990065a978cbcfd607d64ddaaf6b8737f56bd25602c317076599f1122df8","observation_id":"41b728e9-918d-4a99-926d-63c45eba8c66","resolution":{"observed_at":"2026-08-02T14:02:54.489903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.495437Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.495437Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:60be4f401e7928a2bc9e2e3ee00ea1bbc4033ef40203df8c7db5338db150f03c","observation_id":"563b9d86-8252-479d-9e67-d93dd5c64cbc","resolution":{"observed_at":"2026-08-02T14:02:54.495437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.499588Z","title":"HSCC , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.499588Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d50c91b7cd149cd169c37624e3675cbd6df81ec47151f48d9065517e6fc8b12f","observation_id":"81196328-c092-49ac-8171-98b7a99d1f46","resolution":{"observed_at":"2026-08-02T14:02:54.499588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.503860Z","title":"FMAS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.503860Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b0e87322bb706734044d636f1140ba9a91e7ce9941810e58b86e25802e6560c3","observation_id":"297d5b24-c32b-4458-9d35-c926bd4ebdca","resolution":{"observed_at":"2026-08-02T14:02:54.503860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.508400Z","title":"CCS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.508400Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:ebc893e79c5e0f2b536a32d0b0f8f42bc3e1f3b2c475e0e7d4aa3db9ac406e99","observation_id":"3436bda5-114e-437d-9a12-206eada7a556","resolution":{"observed_at":"2026-08-02T14:02:54.508400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.515357Z","title":"Proceedings of the 26th ACM International Conference on Hybrid Systems: Computation and Control , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.515357Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d92ee4110d3d31c6f31ca9fb460c78c7ede088800d178dc8b3b829ccb751d626","observation_id":"e7f8e6dc-42be-4a03-b9bc-2a166314f0a2","resolution":{"observed_at":"2026-08-02T14:02:54.515357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.521862Z","title":"CAV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.521862Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9a85e12a541c629fb6eb36804435c9dd2ff7078617155b55e450d528d471313a","observation_id":"abb7a3f9-abc2-435a-adc6-400aa85f9f22","resolution":{"observed_at":"2026-08-02T14:02:54.521862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.526634Z","title":"IJCAI , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.526634Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f6274d59676673d8176ce406a7740e98b4df7d371b600ab79e64e6c140abf383","observation_id":"d0a931f4-e53b-4e4b-bd22-4ffa4c0eaad4","resolution":{"observed_at":"2026-08-02T14:02:54.526634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.532408Z","title":"NeurIPS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.532408Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:42faa6c62c6a869adb9274fadde29c2dcdc51c101668c27d9dee78ce7f026b70","observation_id":"f6ec1425-faf6-41b0-9069-e6d53b3a2a52","resolution":{"observed_at":"2026-08-02T14:02:54.532408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.536543Z","title":"NFM , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.536543Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:bb79ed77b60f04692cc8908d8de382c4ecba33e6f58597b165fe8a60622da1e7","observation_id":"5230a4ec-394c-4ba2-9386-9a9cc401d060","resolution":{"observed_at":"2026-08-02T14:02:54.536543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.542073Z","title":"arXiv preprint arXiv:2401.XXXX , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.542073Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4418f87871104548f19b19b88867e60bc764e4fe98b75b5d4ce76fee24a62bc4","observation_id":"4ab8e62a-0713-49ec-9133-efd3e05a3666","resolution":{"observed_at":"2026-08-02T14:02:54.542073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.546362Z","title":"ATVA , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.546362Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5f5f182ce691939b62e6c1db31d25d22a71249d5ad8ad660a9612c541e451c66","observation_id":"3c105dbb-9691-4795-8a4e-84a44bca20a4","resolution":{"observed_at":"2026-08-02T14:02:54.546362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.552002Z","title":"ICLR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.552002Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:614d0da006d1643398f529e03bb4d2034bedfca406c04c557a3967a66572904f","observation_id":"dc0b26a0-8df5-4078-8828-727f88da68f3","resolution":{"observed_at":"2026-08-02T14:02:54.552002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.557035Z","title":"NeurIPS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.557035Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:77c793a1070dd2f31bb3a51185aeba7f61422bbfb0b96c4cd5809ee1ea1e78f1","observation_id":"49a3af2e-5889-4c3e-b1a3-b19fb2a7d164","resolution":{"observed_at":"2026-08-02T14:02:54.557035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.562984Z","title":"Proceedings of Machine Learning Research vol , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.562984Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d4f9d0b00109af7bec35fae46042778b0ceafc61574196fea34266feec7ea5b0","observation_id":"0c5f1a02-251a-44de-9d2a-e722920fb95a","resolution":{"observed_at":"2026-08-02T14:02:54.562984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.571918Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.571918Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:94a437e4e7de7eef2900024c89b52d66693ebc4c51ff37cd9ce8b569d66ec147","observation_id":"014e5340-a219-48ff-8279-c5e6dc3a3f8e","resolution":{"observed_at":"2026-08-02T14:02:54.571918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.579508Z","title":"IEEE Access , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.579508Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:68033faf9b65fa1cecda502967ba158726acb51559e6c4c519e5ae69286f4ca1","observation_id":"2d221fb6-8f5a-43f9-9fd8-396b5aaf526d","resolution":{"observed_at":"2026-08-02T14:02:54.579508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.584806Z","title":"Journal of the American statistical association , volume=","venue":null,"work_id":null,"year":1963},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.584806Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2fc5cbb2d6733f8e0958c77a78901d37eb3a821976dd9d19d8e016793923bacd","observation_id":"6f9fa095-f511-483d-a305-8f7d8aab5a2e","resolution":{"observed_at":"2026-08-02T14:02:54.584806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.591861Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.591861Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f3a41706256102b1a63ee2b75880c31c70d70f4a848a303f207dbc875b4254ce","observation_id":"c59fe1c0-967b-460d-ae15-234b6492a7b7","resolution":{"observed_at":"2026-08-02T14:02:54.591861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.609331Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.609331Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c1d6408efb73f702d7c0765d3de89452008db018aa7eff91a2de33afe9ff6146","observation_id":"971b887f-a444-4b73-a526-dd422d790993","resolution":{"observed_at":"2026-08-02T14:02:54.609331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.614212Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.614212Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2abdc7a99c5b9720b558696c06aa67fdc088c412b6bdcf34534f585309e1bb03","observation_id":"d92b994c-efc5-4433-a3cf-2b2161027d12","resolution":{"observed_at":"2026-08-02T14:02:54.614212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.624387Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.624387Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:1065ee1b4dab15ab5616b65d5dc17a6e929a3fbff398dad1172e6f64168fc2aa","observation_id":"89bc9ba0-61c9-4113-a8ea-17cd5961a361","resolution":{"observed_at":"2026-08-02T14:02:54.624387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.640847Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.640847Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:adefde8b184fadf1a5c1c78c035939ec6c156bb40019f2a13425d092fe20d7c5","observation_id":"74138e14-8826-4fd5-864b-4d617a281900","resolution":{"observed_at":"2026-08-02T14:02:54.640847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.648543Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.648543Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0c6fa2d69d48f8b860a932a0d0b2bdd98eafce83a3b337b2a76dc030e9be221c","observation_id":"323101d5-117d-414f-b8bf-f189fa9a5ca3","resolution":{"observed_at":"2026-08-02T14:02:54.648543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.654109Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.654109Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0d68f060be74d7e933e57849f46212518707e442bd340bf2a69d823877eb7407","observation_id":"aca4cc9d-9d1b-4b5b-875d-b2326cc0ec93","resolution":{"observed_at":"2026-08-02T14:02:54.654109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.659378Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.659378Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9705c853f98069298ad8876a4cea6c4ff2b8330bec6ce0046c123423535eea6d","observation_id":"78880f66-0f38-44d1-8962-22b2270a2e56","resolution":{"observed_at":"2026-08-02T14:02:54.659378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.666736Z","title":"Journal of artificial intelligence research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.666736Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d2400f12925a667bb1de3dc2d29fbf0dd7c0d2a5f898cedbea694df6df8c306f","observation_id":"8a1ee006-076b-4079-9841-b93457f8cf59","resolution":{"observed_at":"2026-08-02T14:02:54.666736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.675611Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.675611Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0959df2c79bc88b0b5e90e00ba84ccb2dade855b3a373026bc7211bb13813c0e","observation_id":"b3a3c11d-0eb9-4c67-8122-194c26dd1eb2","resolution":{"observed_at":"2026-08-02T14:02:54.675611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.682299Z","title":"Journal of the ACM , volume=","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.682299Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a808368e741b4eccd89472bda30f9f6d0451168a75dd0c1385737e8ad7fc7f00","observation_id":"6e37a39f-3867-4aae-a621-ac5b5f2f26da","resolution":{"observed_at":"2026-08-02T14:02:54.682299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.687097Z","title":"Nature , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.687097Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:314d04a9f1c91855433b2d1c578998872c4fa8c5d0fdf37bfda5143044ec6174","observation_id":"93679887-0aee-47c0-b20b-d06399a8f453","resolution":{"observed_at":"2026-08-02T14:02:54.687097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.692049Z","title":"Theoretical Computer Science , volume=","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.692049Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:977731fe47aafd304b900f29981ec99b62c9d19210189afa058efc0f32dc5811","observation_id":"57f12127-635a-4d99-908d-6997d28ecc1b","resolution":{"observed_at":"2026-08-02T14:02:54.692049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.705462Z","title":"International Journal on Software Tools for Technology Transfer , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.705462Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e5912522f52b5e02fcec2cf2a51900aebcaa3f6831e4676e500bc17a962c54f4","observation_id":"90c10f2f-666a-4e14-97a4-059b66d4532d","resolution":{"observed_at":"2026-08-02T14:02:54.705462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.740220Z","title":"International Symposium on Automated Technology for Verification and Analysis , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.740220Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:db495e7eda0a87913709d6f26ce882542cec5c483509b19551c1547214887207","observation_id":"531a90c2-e617-435f-b36b-188c7612fd46","resolution":{"observed_at":"2026-08-02T14:02:54.740220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.768220Z","title":"2024 , author =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.768220Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:36e9267b3a54e133fca5b67e9dbe4b2bd87534d0170ca3ac0541ef61b2326de1","observation_id":"cfa273dd-02a2-4abf-9d18-645d8bb325d9","resolution":{"observed_at":"2026-08-02T14:02:54.768220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.804276Z","title":"CAV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.804276Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f6748f9aa61a4f268404ab70c7e4e11faade816eafc0eb1897268a3aada31dff","observation_id":"5824362f-801b-42d3-a6ec-f5d9bcc4b32c","resolution":{"observed_at":"2026-08-02T14:02:54.804276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.842203Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.842203Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f1926a5870ff9fe2ce1fa5ad3a78c36b3d1e3533c3fd1fba51b9d646ea09c352","observation_id":"8565109e-8942-4a3d-9ef5-217ce055e4ec","resolution":{"observed_at":"2026-08-02T14:02:54.842203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.869582Z","title":"Robust Explainable AI , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.869582Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f16fb2187fdbe28dd151c144e320d6cd996d8e9eb42efc2da9240ed070064dba","observation_id":"af3bfcfa-170c-44aa-aa02-89063c9c8b9b","resolution":{"observed_at":"2026-08-02T14:02:54.869582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.905797Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.905797Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:53564bb19347d2716b8e793b19db7df561985b6419017a2aeb0081d4731c7d70","observation_id":"bbb6c472-4f12-4455-8855-2b94e543c78c","resolution":{"observed_at":"2026-08-02T14:02:54.905797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.958941Z","title":"NeurIPS , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.958941Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6f6adadc327ee1ed4813f561f1c705f7f8f5df909056b81ecd62c70825c2de1b","observation_id":"943878ce-a8de-42df-a3dc-82a7e0d24683","resolution":{"observed_at":"2026-08-02T14:02:54.958941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.995727Z","title":"2021 , url=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.995727Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:14dd8968373a4a0454803dfb52c7273ef7ce0b5458a778f01a6c09c16e127bbc","observation_id":"03911a8a-f695-48b3-a965-0669feddc1e0","resolution":{"observed_at":"2026-08-02T14:02:54.995727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.033686Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.033686Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2bec049ab77636c764aac748760b9bb5f0ab11aed620c814796f43fae410361f","observation_id":"52020d09-4066-460c-b632-f28f9448bc7a","resolution":{"observed_at":"2026-08-02T14:02:55.033686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.069185Z","title":"ECAI 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.069185Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4af14764bfd83ae7b8ecd42547b6f1d1a670ed41998552ac24cbec05b9818cdd","observation_id":"010b501b-ef72-4907-a1cf-7d6ba92d360d","resolution":{"observed_at":"2026-08-02T14:02:55.069185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.089719Z","title":"nature , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.089719Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d8908231dd59b5209f43be85bdc128935f2677d41c14400965a54a87ccea3044","observation_id":"4ee141e6-8558-42f0-9fde-9d144bea2df3","resolution":{"observed_at":"2026-08-02T14:02:55.089719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.124338Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.124338Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e3d97eaf5696a9225b6eaf7e4c4d6fddb87bf46819d579f564aebf304725e584","observation_id":"4e375cdc-b22f-47ec-9fe5-6fc54d5ec9fe","resolution":{"observed_at":"2026-08-02T14:02:55.124338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.160969Z","title":"Donti , booktitle=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.160969Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:1816a931eb49a878623479658076dff4f6c1563ba8f44de7815ae841a5ca146c","observation_id":"6a6b4412-fcd0-46db-976e-ca43aebec610","resolution":{"observed_at":"2026-08-02T14:02:55.160969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.196682Z","title":"International Journal on Software Tools for Technology Transfer , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.196682Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:713ab756e25537d22b9d8b03697c1fd9f11a50d4921dae1bdbd0b60cca9b0715","observation_id":"1b60c397-ad43-455b-8056-435162418a65","resolution":{"observed_at":"2026-08-02T14:02:55.196682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.224359Z","title":"NeurIPS , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.224359Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c5447070ce6d5eabca07724ca9722f148f2ebd2f04a655d2900e4b3a5449f86c","observation_id":"0b9c2366-563e-404b-83a6-c14fd5c971e7","resolution":{"observed_at":"2026-08-02T14:02:55.224359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.251676Z","title":"1999 , publisher=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.251676Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:82305c6b9a9542e6bffcf2c6a5f5ab99bdb40c96041df5a80cb3905623563d75","observation_id":"8e7d879f-362a-4a1f-acdc-c128fde46231","resolution":{"observed_at":"2026-08-02T14:02:55.251676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.272170Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.272170Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:cb11e4d30ee2886d74a2d92546d7bbf6221e373299ecbcc99d309b1aa2b08ab2","observation_id":"414c199a-f3a5-4ea2-85cb-0f01701e8cb1","resolution":{"observed_at":"2026-08-02T14:02:55.272170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.307261Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.307261Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e2d17cbba45878dbe13be6e721274cd30fb4daff92a19d8069702ddef818528b","observation_id":"d2cccf2f-fbab-46ce-aa84-7be495856e89","resolution":{"observed_at":"2026-08-02T14:02:55.307261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.337055Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.337055Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5949b037e5c278148638753f37e0d10adfaff04bf893f70086bee8c6ed50ae76","observation_id":"ebc62ea5-cfed-4a3b-9123-4bea9e39ce5d","resolution":{"observed_at":"2026-08-02T14:02:55.337055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.351664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.351664Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4326f4176a62b3dc51cfb062173d9c133887d649577452f958564748ae02aa92","observation_id":"267ac7d6-1e73-43f6-8c57-5d3c19c9dc06","resolution":{"observed_at":"2026-08-02T14:02:55.351664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.369178Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.369178Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f7a85158acd0de1011fd130b791c95a3c11494d2473e3d1dbcedcb0c74376aaf","observation_id":"23f3a4d8-052a-4fea-8919-bad91ef4d93d","resolution":{"observed_at":"2026-08-02T14:02:55.369178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.373586Z","title":"AIRO 2023 Artificial Intelligence and Robotics 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.373586Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:fad920b8fa2bc719dda0f6ad435324b31111ce2d5a6ba53a6dbf06a215c2c163","observation_id":"767ecfe2-7179-4cee-bd26-58660cf3dcfd","resolution":{"observed_at":"2026-08-02T14:02:55.373586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.382529Z","title":"arXiv preprint arXiv:2507.05405","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.382529Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5250449533b580e96378f0b847883aff27d2b9b290af8ffa47bccc613547d94b","observation_id":"80c8ccec-6cea-41fc-8e13-8cabfb51ef99","resolution":{"observed_at":"2026-08-02T14:02:55.382529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.390517Z","title":"Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.390517Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:fc937686bcb1caf3187e1f4a63f533389ba56e4afa97be657a1f82c3607ead74","observation_id":"4116d49e-bb85-449c-9896-9eb6235d536d","resolution":{"observed_at":"2026-08-02T14:02:55.390517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.399981Z","title":"Artificial intelligence , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.399981Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a3056d6628c5f78e170758b27ae410d001593edc84c90e95e991ed3de509c6e9","observation_id":"2931b84e-f4e2-4adb-822e-962a4da2ee26","resolution":{"observed_at":"2026-08-02T14:02:55.399981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.407455Z","title":"ACM computing surveys (CSUR) , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.407455Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:abe686ad9ba8bddf8cf555a7cc7c25616b3ed6cd8214cfb7fffe74c2a24fd32c","observation_id":"2f26bfd6-2030-40b8-b290-c1c0a0f0d783","resolution":{"observed_at":"2026-08-02T14:02:55.407455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.417626Z","title":"ICML , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.417626Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:8fcf44264bac934c24ce1c4e6e174fe012ccb0b6c04c1229477156f4fd9cb5cd","observation_id":"1bbd02ca-b8fb-4007-a46d-8b73c1b50f8b","resolution":{"observed_at":"2026-08-02T14:02:55.417626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.440725Z","title":"IEEE SP , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.440725Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:32e4e8d1f52f7ac84947b2783e81eb63b0392f3ea81b996293ee7d709125922c","observation_id":"4eeabf37-24e6-44ee-9e92-34cb65dd2e49","resolution":{"observed_at":"2026-08-02T14:02:55.440725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.462479Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.462479Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e96cfae3a7cec559e27bf0d977daa0e24627639a3158db5a530cade1188c640d","observation_id":"079ecc48-afec-443d-8582-8f07f85e30a1","resolution":{"observed_at":"2026-08-02T14:02:55.462479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16760","last_updated":"2023-12-28T00:46:35Z","snapshot_observed_at":"2026-08-09T04:25:37.880492Z","submitted_at":"2023-12-28T00:46:35Z","title":"The Fourth International Verification of Neural Networks Competition (VNN-COMP 2023): Summary and Results","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16760","snapshot_observed_at":"2026-08-02T14:02:55.491202Z","title":"arXiv preprint arXiv:2312.16760 , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.491202Z"},"links":{"cited_paper":"/paper/2312.16760","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6f05b850a776281ff4f62338a31df19a76feacd3c095e624a571cf7ac72ec0d1","observation_id":"59233193-e98d-450a-9add-ccb3a88c43bc","resolution":{"observed_at":"2026-08-02T14:02:55.491202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10376","last_updated":"2023-02-16T08:06:35Z","snapshot_observed_at":"2026-07-06T14:33:03.656499Z","submitted_at":"2022-12-20T15:58:01Z","title":"The Third International Verification of Neural Networks Competition (VNN-COMP 2022): Summary and Results","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10376","snapshot_observed_at":"2026-08-02T14:02:55.508412Z","title":"arXiv preprint arXiv:2212.10376 , year=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.508412Z"},"links":{"cited_paper":"/paper/2212.10376","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:313863a38752b8a0894faaa70c4ab18d7709ff61c09a56b6e16c6e182ecd2908","observation_id":"0f76bff9-0b22-4059-b292-21ca6ec4c09e","resolution":{"observed_at":"2026-08-02T14:02:55.508412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.527167Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.527167Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:8c7fc7fb599dfd3f6550f619a18f22e451e5639d31e4f488e2095e7304f8bdca","observation_id":"683db619-3cea-4af8-a56e-9a84ed772d34","resolution":{"observed_at":"2026-08-02T14:02:55.527167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17556","last_updated":"2025-07-10T09:08:34Z","snapshot_observed_at":"2026-07-06T18:20:52.408832Z","submitted_at":"2024-05-27T18:00:03Z","title":"Solving Probabilistic Verification Problems of Neural Networks using Branch and Bound","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17556","snapshot_observed_at":"2026-08-02T14:02:55.555451Z","title":"arXiv preprint arXiv:2405.17556 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.555451Z"},"links":{"cited_paper":"/paper/2405.17556","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c3264e64ca44780578026a4f74890b6daf3ae1b1da13c7c21a436d917456a8b9","observation_id":"2f1fd7d4-ed2d-45cd-a4a0-1fc8cb6de161","resolution":{"observed_at":"2026-08-02T14:02:55.555451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.582987Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.582987Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:3256b0a09c9acd8c38eb2f5a3429e8a864a66a0e12f788620d81bf673612e16b","observation_id":"4d0bcbbd-a203-4a5c-86b7-9373ed481c95","resolution":{"observed_at":"2026-08-02T14:02:55.582987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.617854Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.617854Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:214cfd27095ce2abca25893c64d20846e970d5e3aa2f6e5bd04bcc3a0f33e598","observation_id":"b0c11868-7673-420c-917b-7405c7c8dc44","resolution":{"observed_at":"2026-08-02T14:02:55.617854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.646147Z","title":"2019 IEEE/ACM 41st International Conference on Software Engineering: New Ideas and Emerging Results (ICSE-NIER) , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.646147Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:cdc1dd831431f96ac24d5abd4c832ae36546e3e5fbe937b0ed3123ab07c1400d","observation_id":"a938b48e-e2b1-4364-a641-3157a942d0ee","resolution":{"observed_at":"2026-08-02T14:02:55.646147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.681719Z","title":"NeurIPS , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.681719Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:31d36b0858ec26a3fb3a851111d16dce4ea4d0a6ee6b5626516df465bb36fbdf","observation_id":"76167bdf-6244-42e0-9bc5-2eec6faf5cb8","resolution":{"observed_at":"2026-08-02T14:02:55.681719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T15:58:56.896130Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":175},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 175 outbound references and 0 inbound Pith citation observations for arXiv:2607.16210."}