{"as_of":"2026-08-13T22:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3cf0903318950ef9e5f9a4a357f866212d98566a5b0f0ef4e1e9acb5c0f66dec","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:13.861239Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:44:01.319756Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:11:15.649761Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-08-07T00:44:01.319756Z","title":"Cullen, Paul Montague, Sarah Monazam Erfani, and Benjamin IP Rubinstein","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13024","last_updated":"2025-08-11T02:15:49Z","snapshot_observed_at":"2026-08-11T09:59:47.031104Z","submitted_at":"2025-06-16T01:18:33Z","title":"Position: Certified Robustness Does Not (Yet) Imply Model Security","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T00:44:01.319756Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2506.13024"},"observation_digest":"sha256:0cf836722b0d4cec1a1d2bd79711446bf7bd3303d9293c1f0e98c8f7e2108bb9","observation_id":"26814004-f1fd-40ac-8dfe-eaa6b2887a79","resolution":{"observed_at":"2026-08-07T00:44:01.319756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-08-06T18:29:36.704014Z","title":"Cullen, Paul Montague, Sarah M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08270","last_updated":"2025-07-11T02:34:16Z","snapshot_observed_at":"2026-08-07T01:31:51.955348Z","submitted_at":"2025-07-11T02:34:16Z","title":"Agent Safety Alignment via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:29:36.704014Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2507.08270"},"observation_digest":"sha256:2e82f2e6f17ede1af2c290af613998e82cf1719e11e042e27b208bbb9cb8e4d6","observation_id":"3d8ff5a5-ea96-4e0b-91cb-22d95099f4d2","resolution":{"observed_at":"2026-08-06T18:29:36.704014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.19532","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-06-25T02:17:29.965443Z","title":"Fine-pruning: Defending against backdooring attacks on deep neural networks","venue":null,"work_id":"72a79b6e-3c7e-468e-9c45-4cbcbaffc019","year":2025},"citing_paper":{"arxiv_id":"2605.05977","last_updated":"2026-05-07T10:21:14Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T10:21:14Z","title":"BehaviorGuard: Online Backdoor Defense for Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T10:45:47.028500Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2605.05977"},"observation_digest":"sha256:af52a936320eb558b9e95b03e1987d1fbc83b1170f01b4795f4d5ff1f69ba205","observation_id":"71bedfe3-d47f-4a69-a628-94828df796af","resolution":{"observed_at":"2026-06-25T02:17:29.965443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.19532","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-06-25T02:17:29.965443Z","title":"Fine-pruning: Defending against backdooring attacks on deep neural networks","venue":null,"work_id":"72a79b6e-3c7e-468e-9c45-4cbcbaffc019","year":2025},"citing_paper":{"arxiv_id":"2605.09638","last_updated":"2026-05-10T16:34:16Z","snapshot_observed_at":"2026-08-02T13:49:44.882700Z","submitted_at":"2026-05-10T16:34:16Z","title":"Plan2Cleanse: Test-Time Backdoor Defense via Monte-Carlo Planning in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:02.988190Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2605.09638"},"observation_digest":"sha256:6f5c8a9b67ed7afd175ad5309979c5137552c7b957d524c86e2e30b5f62e2891","observation_id":"34f9838f-1e5f-413e-ba7a-4122c125163c","resolution":{"observed_at":"2026-06-25T02:17:29.965443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19532/citation-record","integrity":"/paper/2505.19532/integrity","json":"/paper/2505.19532/citation-record.json","paper":"/paper/2505.19532"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.903079Z","title":"Poisoning Deep Reinforcement Learning Agents with In- Distribution Triggers","venue":null,"work_id":"5bd19087-8752-4b74-a1c5-567cb0eca9b3","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.745552Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:e0ca6439369f246be4d6f4c17f75a8950bef5b408302a9c064d28b567e2ee371","observation_id":"24f0970d-618e-4102-8706-4439c8b32b7c","resolution":{"observed_at":"2026-08-07T14:16:25.052191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.573755Z","title":"Can Machine Learning be Secure? InProceedings of the 2006 ACM Symposium on Information, Computer and Communications Security, pages 16–25, 2006","venue":null,"work_id":"ba1f24e4-8152-4158-abc4-12bdb5950035","year":2006},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.815703Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:90e540f13cb51ccd6c078dfd7bc6e45fa92fc6567033cd343f5b20787118dc7b","observation_id":"ee685072-8c34-402e-b082-b7a4187c5205","resolution":{"observed_at":"2026-08-07T14:16:24.767945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.271969Z","title":"The Theory of Dynamic Programming","venue":null,"work_id":"6b906cdc-c064-4507-b556-2ea9b3b1b795","year":1954},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.913367Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:3557027502e3baaf32ac9c0d0a6d4389c7c588498a5951e1830ec3157b32ee80","observation_id":"0c1b0ddf-32dc-4637-bcba-72c79c6bb8a8","resolution":{"observed_at":"2026-08-07T14:16:24.402866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.999751Z","title":"Provable Defense against Backdoor Policies in Reinforcement Learning.Advances in Neural Information Processing Systems, 35:14704–14714, 2022","venue":null,"work_id":"ef0d3845-1070-4974-8f71-f03b33662c22","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.991357Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:ff15dc47919ef0aaf29f9206842dc01fff8bdf57eeb6e3675710e0be712d07fb","observation_id":"4d8d3aa4-062a-4087-a14e-4432c50246b2","resolution":{"observed_at":"2026-08-07T14:16:24.118281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.749888Z","title":"Evasion Attacks Against Machine Learning at Test Time","venue":null,"work_id":"c5f70085-26ff-4669-b2e5-5981e4cf967a","year":2013},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.056165Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:2003e9269a3e557707ecfe78c201f8d1db8ae423bd6d2aa12dbc5cd81eba9da3","observation_id":"60c86d88-0001-4dbb-9dfe-207899ff98b0","resolution":{"observed_at":"2026-08-07T14:16:23.863576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.6389","last_updated":"2013-03-25T10:16:36Z","snapshot_observed_at":"2026-08-13T17:28:58.657057Z","submitted_at":"2012-06-27T19:59:59Z","title":"Poisoning Attacks against Support Vector Machines","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.6389","snapshot_observed_at":"2026-08-07T14:16:09.120007Z","title":"Poisoning Attacks against Support Vector Machines.arXiv:1206.6389 [cs, stat], March 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.120007Z"},"links":{"cited_paper":"/paper/1206.6389","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:a73f2fef20d19853614f3ee335b097fa2f4396387d30ede6fc18895d313cdabb","observation_id":"1f7c4ae6-b121-41a8-a1f8-4e3e5a839b5a","resolution":{"observed_at":"2026-08-07T14:16:09.120007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.438464Z","title":"A conceptual framework for externally-influenced agents: An assisted reinforcement learning review.Journal of Ambient Intelligence and Humanized Computing, 14(4):3621–3644, 2023","venue":null,"work_id":"4e123d0b-f597-485b-b146-6f31cd878653","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.219209Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:0621c23456a6742dedfb78c0484d955dd3d671403a95bf63091f27256c287c53","observation_id":"b98bfa1e-704b-4477-b2c3-a5bea58a8677","resolution":{"observed_at":"2026-08-07T14:16:23.564667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.136280Z","title":"Strong Data Augmentation Sanitizes Poisoning and Backdoor Attacks Without an Accuracy Tradeoff","venue":null,"work_id":"c4f18a76-e1b2-480b-b64a-0d0ab9f72e7a","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.314319Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:37ac94fa85aff01ccbb818ea3ba5db30ffd776a4f52a0eecebd7cbced87909d0","observation_id":"cea9ad1c-3035-43c9-a257-4727e7a5eaf2","resolution":{"observed_at":"2026-08-07T14:16:23.296878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12066","last_updated":"2019-04-26T22:41:03Z","snapshot_observed_at":"2026-07-06T07:48:48.815834Z","submitted_at":"2019-04-26T22:41:03Z","title":"ABIDES: Towards High-Fidelity Market Simulation for AI Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12066","snapshot_observed_at":"2026-08-07T14:16:09.371334Z","title":"Abides: Towards high-fidelity market simulation for ai research.arXiv preprint arXiv:1904.12066, 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.371334Z"},"links":{"cited_paper":"/paper/1904.12066","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:0511e280bd32b25f54f08e7af2c46058e8a66fba0b80fb9b6023ad8e6b92342c","observation_id":"d5950921-2832-4264-a2d5-f3a85efe7f24","resolution":{"observed_at":"2026-08-07T14:16:09.371334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11455","last_updated":"2022-11-21T13:44:13Z","snapshot_observed_at":"2026-08-13T13:38:16.899353Z","submitted_at":"2022-11-21T13:44:13Z","title":"Backdoor Attacks on Multiagent Collaborative Systems","version":1},"cited_work":{"arxiv_id":"2211.11455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.11455","snapshot_observed_at":"2026-08-07T14:16:15.407287Z","title":"Backdoor Attacks on Multiagent Collaborative Systems","venue":"cs.MA","work_id":"9e3f1300-abac-44c4-b41f-08d9bfc97834","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.462751Z"},"links":{"cited_paper":"/paper/2211.11455","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6343371058ac9d9bd4d7e4d93f2a3b4fc29ba799a44052151d47267533be7346","observation_id":"7316298d-0a5b-4fea-89ad-d3a01200ca4f","resolution":{"observed_at":"2026-08-07T14:16:15.524825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.830344Z","title":"MARNet: Backdoor Attacks against Cooperative Multi-Agent Reinforcement Learning.IEEE Transactions on Dependable and Secure Computing, 2022","venue":null,"work_id":"c76ebb5c-d26e-47e6-8b9b-a5396871ab44","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.542591Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:102e5ec0dcc0c74b566a2caf3b1f5d138e8d5f893533c992e66c92a7f11a9088","observation_id":"228bd688-ce3d-4e83-bebd-9c51564df737","resolution":{"observed_at":"2026-08-07T14:16:22.979794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.582832Z","title":"Certified Adversarial Robustness via Random- ized Smoothing","venue":null,"work_id":"edc3b8d0-85ff-4d8a-94b3-8d1448dbc9fa","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.602938Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:76ba0e86dea248c0bb9773cd59882c6c2a723d22bc8639a2cc03fbd34d3b441c","observation_id":"84e91ac8-425c-4771-b0da-0d076d7ed0aa","resolution":{"observed_at":"2026-08-07T14:16:22.687430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.295881Z","title":"Double bubble, toil and trouble: Enhancing certified robustness through transitivity.Advances in Neural Information Processing Systems, 35:19099–19112, 2022","venue":null,"work_id":"8da030c9-f4f3-4a80-bd21-ed8f2f2b528a","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.655891Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:99b49081ac22f806663b7fa4be967aa59691be3890698b00f462574d8239fa3a","observation_id":"10ca9940-2439-4c6d-80e2-9620d89070f8","resolution":{"observed_at":"2026-08-07T14:16:22.416479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.152076Z","title":"Cullen, Shijie Liu, Paul Montague, Sarah M","venue":null,"work_id":"bf6ee878-f98a-45b9-b7b0-8eb59c2a8523","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.746018Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:02e949abc4e3252eded27c591da91748b1d9a1736a15e83b3a784f799bcddad9","observation_id":"30f1801b-c281-4a89-8e84-da716c6ad6f4","resolution":{"observed_at":"2026-08-07T14:16:22.235882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.905904Z","title":"It’s Simplex! Disaggregating Measures to Improve Certified Robustness","venue":null,"work_id":"1116cecb-08a9-4c2e-92a0-ab97f15dbed7","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.797497Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:245382e250e12fdb390efbd90d764b223e36ed21351dc9cc7d0b4a9f18cc74fc","observation_id":"c57c3dea-9816-4319-acd6-78e9897e0bb7","resolution":{"observed_at":"2026-08-07T14:16:22.028532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.677386Z","title":"An Automated FX Trading System using Adaptive Reinforcement Learning.Expert Systems with Applications, 30(3):543–552, 2006","venue":null,"work_id":"839aaccd-5fa9-410b-aef7-cb4cc7394a58","year":2006},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.873759Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:30701cefb7258686742fd35a4eadf2e807fdff9f074c9587f2232a634ed44f81","observation_id":"2fbd68f7-da95-443a-94e7-81af0edc5fe0","resolution":{"observed_at":"2026-08-07T14:16:21.801447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.428424Z","title":"CARLA: An Open Urban Driving Simulator","venue":null,"work_id":"cbabbbc1-d5b9-46d3-86d2-03089736202e","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.939953Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:8a9238998992e8f18d7b7fac69525dba7f045ec81021c8045fad659db0f456d5","observation_id":"90a40535-83b9-480c-9d43-9e9baa9bbf9a","resolution":{"observed_at":"2026-08-07T14:16:21.534425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.246146Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":"407dd407-673d-407f-8bdd-e9a968e23bb6","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.019452Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:46c657674036ef153f63c622c0924f24adcffc613861795fbea1adeed59f9bf5","observation_id":"3fcd4da5-b74e-4869-8304-82d192365c6f","resolution":{"observed_at":"2026-08-07T14:16:21.315128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03141","last_updated":"2024-03-05T17:26:41Z","snapshot_observed_at":"2026-08-13T04:02:51.851068Z","submitted_at":"2024-03-05T17:26:41Z","title":"Language Guided Exploration for RL Agents in Text Environments","version":1},"cited_work":{"arxiv_id":"2403.03141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.03141","snapshot_observed_at":"2026-08-07T14:16:15.162411Z","title":"Language Guided Exploration for RL Agents in Text Environments","venue":"cs.CL","work_id":"81311ab1-cf3d-4588-be33-8e2ebb2366d4","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.180714Z"},"links":{"cited_paper":"/paper/2403.03141","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:e67260c0e1b6f59a8a8b7bc052b595f36e96ffb724bf927dc5ecd82c80da89bf","observation_id":"0e7fa66a-4ce9-48a8-8290-8f3d704957fa","resolution":{"observed_at":"2026-08-07T14:16:15.282384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06974","last_updated":"2024-11-09T18:58:35Z","snapshot_observed_at":"2026-08-13T16:02:20.731500Z","submitted_at":"2022-04-14T13:55:21Z","title":"Planting Undetectable Backdoors in Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06974","snapshot_observed_at":"2026-08-07T14:16:10.237019Z","title":"Kim, Vinod Vaikuntanathan, and Or Zamir","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.237019Z"},"links":{"cited_paper":"/paper/2204.06974","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:e596a19ada8e4722309e0bbacd2847a6239523b2c7fe4fb6d75bf88192ebfb4b","observation_id":"8c463425-7772-4b7f-a911-6cdc02f0fcfa","resolution":{"observed_at":"2026-08-07T14:16:10.237019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.830955Z","title":"BAFFLE: Hiding Backdoors in Offline Reinforcement Learning datasets","venue":null,"work_id":"fbc5eb24-1625-4cfd-9605-d8cd934a8b8a","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.324278Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:fd15f13564fadb5c1c6d0b2511565a3d5eb7337c3c45e5c10e931ea2a5068910","observation_id":"71cfbef9-06ea-4ae8-abae-6f8b66386102","resolution":{"observed_at":"2026-08-07T14:16:20.927351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-08-12T15:43:59.037380Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T14:16:10.384895Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain.arXiv:1708.06733 [cs], March 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.384895Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7aa71881ffe16c36808ff8d7a014f569f8f393a68b343e008c111d8aec862b27","observation_id":"ebb433b1-9ce8-4b8b-9d65-76e9f3449a2f","resolution":{"observed_at":"2026-08-07T14:16:10.384895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03609","last_updated":"2023-09-14T08:15:55Z","snapshot_observed_at":"2026-08-13T16:45:10.065152Z","submitted_at":"2022-02-08T02:49:09Z","title":"PolicyCleanse: Backdoor Detection and Mitigation in Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2202.03609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03609","snapshot_observed_at":"2026-08-07T14:16:14.810190Z","title":"PolicyCleanse: Backdoor Detection and Mitigation in Reinforcement Learning","venue":"cs.LG","work_id":"bfbf29a9-ae96-498a-a73e-28c59b1ed0ee","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.446404Z"},"links":{"cited_paper":"/paper/2202.03609","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7ee486fda26dc6f3fa19a5e2767c022a42e44ebfa51295ca5826e0f295503a54","observation_id":"b8c93030-60ed-4cdc-9598-1a16f925bc06","resolution":{"observed_at":"2026-08-07T14:16:14.965276Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.643440Z","title":"Assessing the Vulnerabilities of the Open-Source Artificial Intelligence (AI) Landscape: A Large-Scale Analysis of the Hugging Face Platform","venue":null,"work_id":"ea82c970-706f-4fc2-8f3b-d901a248bd36","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.454275Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:dcec7f46f6c9c3c1b0bbfbfb68219919308a654be036068bb5a81b780d948a7d","observation_id":"bfb968c8-6543-42d1-be6d-6446a4d9efd6","resolution":{"observed_at":"2026-08-07T14:16:20.707748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.395182Z","title":"TrojDRL: Evaluation of Backdoor Attacks on Deep Reinforcement Learning","venue":null,"work_id":"ef8c2b9c-399e-460f-9abf-338caa5dbf10","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.582816Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:32835750e14c251cec481217bc6b088095a1ce46db3c5d4b7d413e1f4ec04e1d","observation_id":"07f1cc15-035a-44ff-b755-668f87d8a211","resolution":{"observed_at":"2026-08-07T14:16:20.511519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11420","last_updated":"2022-05-28T01:20:56Z","snapshot_observed_at":"2026-08-13T18:59:33.121698Z","submitted_at":"2021-06-21T21:42:08Z","title":"Policy Smoothing for Provably Robust Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11420","snapshot_observed_at":"2026-08-07T14:16:10.671575Z","title":"Policy Smoothing for Provably Robust Reinforcement Learning.arXiv preprint arXiv:2106.11420, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.671575Z"},"links":{"cited_paper":"/paper/2106.11420","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:1aaf46a2a41c45d8a21398aaf33bffbec33f95389aeeda61a67a2d0252a92dd6","observation_id":"1b805143-6fd5-4b8d-a1c3-54e9f60583d3","resolution":{"observed_at":"2026-08-07T14:16:10.671575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06957","last_updated":"2024-02-10T13:57:51Z","snapshot_observed_at":"2026-08-13T04:55:23.496912Z","submitted_at":"2024-02-10T13:57:51Z","title":"Architectural Neural Backdoors from First Principles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06957","snapshot_observed_at":"2026-08-07T14:16:10.746820Z","title":"Architec- tural Neural Backdoors from First Principles.arXiv preprint arXiv:2402.06957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.746820Z"},"links":{"cited_paper":"/paper/2402.06957","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:82992cc3ada71d7cf402dce9783935c4be406db516de03b4ccb6c5b8b800de4f","observation_id":"97c9257d-11e0-4009-b752-278fae881646","resolution":{"observed_at":"2026-08-07T14:16:10.746820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.194501Z","title":"Markov Games as a Framework for Multi-Agent Reinforcement Learning","venue":null,"work_id":"2c86f9b7-bcfb-4d47-ace6-8dc2266d0f49","year":1994},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.832696Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:9077823a0421be3e13d976b5a71aa9f1908ae0c0125e597ef66e0e06c504d2c3","observation_id":"cf09a675-8643-4606-bef5-eb1fe31efd53","resolution":{"observed_at":"2026-08-07T14:16:20.254614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.976982Z","title":"Provably Efficient Black-Box Action Poisoning Attacks against Reinforcement Learning.Advances in Neural Information Processing Systems, 34:12400–12410, 2021","venue":null,"work_id":"293d3225-b9a4-4e57-9281-3a5be2734234","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.941533Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:3e4d47d822d009ad6eb7b1d526aec42667c22e77d674c99ae1911d892350c64d","observation_id":"0aa6899e-3fcd-4b29-a60d-34cdb5a316ca","resolution":{"observed_at":"2026-08-07T14:16:20.059640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.734986Z","title":"Fine-Pruning: Defending against Dackdooring Attacks on Deep Neural Networks","venue":null,"work_id":"dcc06620-dc57-49b4-939a-ebbda6158f68","year":2018},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.053113Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c70e19bb1392580491f8847f61a625f3716957164cb62402ffee7715b7f39ad1","observation_id":"1cd0789d-5bd6-49e1-8c89-d91d9c566f1c","resolution":{"observed_at":"2026-08-07T14:16:19.850917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.593965Z","title":"Enhancing the Antidote: Improved Pointwise Certifications against Poisoning Attacks","venue":null,"work_id":"886b41b6-1c58-4083-83cb-c8fa9551ab9a","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.147442Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:d99a53d10b9a52dabdcb6427b2cd86d985370e8a47dc1aded5fb26456f619942","observation_id":"c32f9f8e-6dfe-433d-b824-e736751c2eb5","resolution":{"observed_at":"2026-08-07T14:16:19.667735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.427040Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","venue":null,"work_id":"646bd3a0-b65b-4033-97e9-355d5895eaca","year":2025},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.221298Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:433b38330de99980249550dcc78b45ee31f4245de6f86ccecf038759496971df","observation_id":"f0a1f8c2-923b-44fa-80ea-cd194c8970be","resolution":{"observed_at":"2026-08-07T14:16:19.529582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.202660Z","title":"Neural Trojans","venue":null,"work_id":"3071c363-e96f-48da-8288-36973556a3b2","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.298570Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6a28a0d5cabb91b67e479c61cf2c021ceaed00181dce6d9019d1f20fde75af16","observation_id":"27edbecb-bf88-439f-a9f5-8a8150c26499","resolution":{"observed_at":"2026-08-07T14:16:19.305670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.014423Z","title":"Policy Poisoning in Batch Reinforcement Learning and Control.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"f09a9205-d99b-4f09-ac64-932d17407f7f","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.401800Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:531177fb7363c1d3d5c403a7f3dd1a0054ddab96014beea71b56177bb8696438","observation_id":"566ccd0f-48cf-4514-83bd-6f35319822f3","resolution":{"observed_at":"2026-08-07T14:16:19.078769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02845","last_updated":"2022-06-10T17:05:55Z","snapshot_observed_at":"2026-08-13T17:20:54.297193Z","submitted_at":"2021-12-06T08:11:05Z","title":"Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks","version":3},"cited_work":{"arxiv_id":"2112.02845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.02845","snapshot_observed_at":"2026-08-07T14:16:14.451395Z","title":"Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks","venue":"cs.LG","work_id":"5c5a9dff-be85-44be-8fae-0608ca90865e","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.458479Z"},"links":{"cited_paper":"/paper/2112.02845","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7515c0a229ea90cd81f6c811d1ab0f345c6b9da574481c587f071f06e2aea216","observation_id":"b6c1dd5b-9f31-483b-9d63-c915d53d8349","resolution":{"observed_at":"2026-08-07T14:16:14.616466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.798633Z","title":"Playing Atari with Deep Reinforcement Learning, December","venue":null,"work_id":"160a754a-ff02-477f-88f4-9522ca2c1067","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.554843Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:4eaa4af21441c193bd0368b34e1c675ba47b02af6ef1ac74c300a592431ffc5c","observation_id":"ac2a61ab-3ea7-4b80-bbf6-a8d1491e6787","resolution":{"observed_at":"2026-08-07T14:16:18.899224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.674488Z","title":"Implicit Poisoning Attacks in Two-Agent Reinforcement Learning: Adversarial Policies for Training-Time Attacks","venue":null,"work_id":"5da0ebed-f79a-4e0e-8110-28a28404a6e7","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.785271Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:698be1f8b4bc2ad03bb127866566c5ed5090494ce8754ab8bab983d49501dadc","observation_id":"e85d0210-ac6e-4afa-80c7-406526022785","resolution":{"observed_at":"2026-08-07T14:16:18.724484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.488574Z","title":"Cal-QL: Calibrated offline RL pre-training for efficient Online Fine-Tuning.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"532a0768-f4db-4408-877c-e3ce51803fbc","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.951247Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:3b4d73468068e4ecce8904434b4568a20fc7840a1bfb89ee274e0f1494ac3550","observation_id":"312ce2f5-0951-4555-b69f-4fe3c0baf33c","resolution":{"observed_at":"2026-08-07T14:16:18.548415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.253279Z","title":"JPMorgan Develops Robot to Execute Trades, July 2017","venue":null,"work_id":"0db9263e-2431-4fc8-a39c-2efed7532633","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.018846Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:691a0d026582e1be5991d40265c9f3c0bf9db1fad06e8f26ce3eeeff030c59e8","observation_id":"63a6a1f2-4391-48e2-a735-baa6b864a371","resolution":{"observed_at":"2026-08-07T14:16:18.354926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.081399Z","title":"Policy Teaching via Environment Poisoning: Training-time Adversarial Attacks against Reinforcement Learning","venue":null,"work_id":"1ff7bace-cd81-496c-8f5d-94f6c6af5e3d","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.096873Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c5dcc2b0d3119a8816ad789322138ee7d7a7075fd0029d5a6c2de3b5645971e5","observation_id":"5fd7afc1-43d6-47fa-b9b4-8887be6340c4","resolution":{"observed_at":"2026-08-07T14:16:18.180560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.866500Z","title":"Understanding the Limits of Poisoning Attacks in Episodic Reinforcement Learning","venue":null,"work_id":"5b496b53-2cd9-455e-9432-056d9a74f84c","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.219825Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:0e194a285f47f977445e335e570798b02b82c8a6f54aada501e71ce594480772","observation_id":"8f8095b2-b532-429f-a7a3-492acb00e3f5","resolution":{"observed_at":"2026-08-07T14:16:17.973244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:16:12.347692Z","title":"Proximal Policy Optimization Algorithms, August 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.347692Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:008747e18d4e6edd0285285a25a24ada64fd2c6ed10fe8a68be042e885f1f663","observation_id":"cebaed85-ccee-44ee-994d-8c12717c64a3","resolution":{"observed_at":"2026-08-07T14:16:12.347692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-12T23:44:54.360729Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-07T14:16:12.417191Z","title":"Safe, Multi-Agent, Reinforce- ment Learning for Autonomous Driving.arXiv preprint arXiv:1610.03295, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.417191Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:fe8dfca37815d681dc37eef11b03bf095c96db757a4bce63cdb99574d61aaced","observation_id":"ec7b3903-b31b-4ac9-ab90-b4119d1d39ec","resolution":{"observed_at":"2026-08-07T14:16:12.417191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.00774","last_updated":"2022-02-15T22:18:13Z","snapshot_observed_at":"2026-07-06T09:52:06.977995Z","submitted_at":"2020-09-02T01:43:30Z","title":"Vulnerability-Aware Poisoning Mechanism for Online RL with Unknown Dynamics","version":5},"cited_work":{"arxiv_id":"2009.00774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.00774","snapshot_observed_at":"2026-08-07T14:16:14.181252Z","title":"Vulnerability-Aware Poisoning Mechanism for Online RL with Unknown Dynamics","venue":"cs.LG","work_id":"8cf23832-661e-4af1-803c-c5a6402a9b2c","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.543771Z"},"links":{"cited_paper":"/paper/2009.00774","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:b10e9a6e058ee4ff4692d724fca63d9260e66027ba8a43743bacfa9b5450567d","observation_id":"8264c65a-711a-47d2-9eac-6f488a616ac8","resolution":{"observed_at":"2026-08-07T14:16:14.239670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.650430Z","title":"PettingZoo: Gym for Multi-Agent Reinforcement Learning.Advances in Neural Information Processing Systems, 34:15032–15043, 2021","venue":null,"work_id":"5cb24976-a939-4c29-ab06-ba964f9a28a4","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.676060Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:90c1bc922caea8b6c36385d8c8ca62b279cfa5dfcbb4bd25a173e5bfdbed71ed","observation_id":"5634e41f-5f95-4688-b95c-55bc2b167cff","resolution":{"observed_at":"2026-08-07T14:16:17.716099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.837650Z","title":"Terry, Ariel Kwiatkowski, John U","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.837650Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:22af552df21f946888940a5023e99d6c62c7de05af95734eb8545f9f689f7762","observation_id":"e88ff9e9-ce87-47a3-b961-3e01d43c85ba","resolution":{"observed_at":"2026-08-07T14:16:12.837650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.446913Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","venue":null,"work_id":"7475549f-25e5-4e53-aee8-fa0c6eb14b3f","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.019993Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:d8e136e541ed0417ba69c9d0170cbf08acabc1844f461d6db3395ce8402fa85a","observation_id":"88a1cf82-57b3-4079-9032-e64371323bc7","resolution":{"observed_at":"2026-08-07T14:16:17.520817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.220627Z","title":null,"venue":null,"work_id":"57383f9e-4272-48b1-8be6-f57344969f83","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.140080Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7af76d897024ab4c1fd09c2b63136cbad007f3c03da15784d0a3a02a534b849f","observation_id":"9b059332-876c-4306-b361-e1bfa42b28de","resolution":{"observed_at":"2026-08-07T14:16:17.328253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.081392Z","title":null,"venue":null,"work_id":"6e2113e5-a564-4d0f-8376-9abe1a081e97","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.258616Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c5744315e3bcec2fa3775727990ba0217dd6f86cdb64ad2b9273ef4600a1ac94","observation_id":"62011085-d68e-4778-b113-93c53cb405d2","resolution":{"observed_at":"2026-08-07T14:16:17.170905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.846437Z","title":"Transferable Environment Poisoning: Training-time Attack on Reinforcement Learning","venue":null,"work_id":"dd5ab3d9-16c2-45be-943a-f7a56c778887","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.418890Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:dd1151b6b75c92bea5e4598f52798e2130686a36918f46fae1a05edd3692b2c4","observation_id":"13b09dc5-92ce-43d8-a4d0-5c1e9a631854","resolution":{"observed_at":"2026-08-07T14:16:16.949314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09972","last_updated":"2019-02-26T14:43:14Z","snapshot_observed_at":"2026-08-13T01:30:16.075157Z","submitted_at":"2019-02-26T14:43:14Z","title":"Design of intentional backdoors in sequential models","version":1},"cited_work":{"arxiv_id":"1902.09972","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09972","snapshot_observed_at":"2026-08-07T14:16:14.010652Z","title":"Design of intentional backdoors in sequential models","venue":"cs.CR","work_id":"24b20404-1cfc-4232-b9f2-a93075d2db24","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.532135Z"},"links":{"cited_paper":"/paper/1902.09972","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:bafc88c6afd6de1db2d4a4cc08b136b4c6c2af59386d6dbd1792d542c20b44de","observation_id":"8a8452bd-4632-4c30-81ed-369fcda75eea","resolution":{"observed_at":"2026-08-07T14:16:14.073814Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.620773Z","title":"A Temporal-Pattern Backdoor Attack to Deep Reinforcement Learning","venue":null,"work_id":"6c1945c1-547b-468b-9ea1-6a8ade91028f","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.626270Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:cfbae9493de6142fa649724e4f2b6864613798cf2a0a554f5dce713ed9474bd1","observation_id":"cfb2976a-90cc-4cd2-a21a-7e79fd02024d","resolution":{"observed_at":"2026-08-07T14:16:16.721920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.280855Z","title":"∞X k=0 γkRopp(si+k+1, aopp i+k+1, aatt i+k+1) aopp i+k+1 ∼π opp, aatt i+k+1 ∼π # , (7) πopp = argminπ∈Π E","venue":null,"work_id":"14bb54d3-f4ba-473b-b456-f77260fdac20","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.695320Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:2bf58745875f35568d1a4f7f2b8c481fea064c6ce2de7b044dd43cb4146fbcab","observation_id":"3187cb81-6d16-4ab9-a3c2-96b1066f48b0","resolution":{"observed_at":"2026-08-07T14:16:16.447981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.983891Z","title":"The trigger action and backdoor action remain consistent with those outlined in Section 4","venue":null,"work_id":"3ba8852a-46e3-44f0-90b0-104212e160fc","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.771099Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:b4c42497a9bbb4d59af9ca19b77a9473f26bda0dac7d2db8124e9e63863cf1ea","observation_id":"1d7e9e0c-9f3f-4dbb-9b36-00235c7d7530","resolution":{"observed_at":"2026-08-07T14:16:16.111055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.750807Z","title":"move-up,","venue":null,"work_id":"4f7f32e8-fae4-41af-a20d-66932a5a687f","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.861239Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:61879202b8e5101981dcf4070e38ca93ee8bbfba4a8a9c73b498cbe0ea7ed422","observation_id":"23cb00e4-16b6-4331-8592-0c6c4634803b","resolution":{"observed_at":"2026-08-07T14:16:15.835427Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T14:16:11.645830Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.645830Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7b2e085d9605d60fe15dc7a3f2cd1a98016d8671554554a526f4cdd0c7faa5fc","observation_id":"e701deac-8449-41e7-bbfe-6a7ef1d6d8ec","resolution":{"observed_at":"2026-08-07T14:16:11.645830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.037818Z","title":null,"venue":null,"work_id":"710259e6-8940-4eaf-92eb-49f9d2692ea9","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":8677,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.094719Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:10c198796e9dc41bf01dcf6d6c5cd346c0aea6a8da47231e0b2137672090ac48","observation_id":"8a09f742-749b-4f0d-86e0-0bb66a3f1c2f","resolution":{"observed_at":"2026-08-07T14:16:21.105155Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T10:25:15.942975Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":6,"verified_fuzzy":37},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 4 inbound Pith citation observations for arXiv:2505.19532."}