{"as_of":"2026-08-14T13:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7dc0b62a991af6d8f395d7d2a2dd53408b03a005f937df913103ab8dc3dfcc87","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:33:53.640555Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11172/citation-record","integrity":"/paper/2506.11172/integrity","json":"/paper/2506.11172/citation-record.json","paper":"/paper/2506.11172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.375082Z","title":"López, and Vladlen Koltun","venue":null,"work_id":"68b9c8a3-3bd7-453d-a0d6-492741fec783","year":2017},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.570258Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:9a63cfe84d61621a574152aa66af6b563ab5a9f649c3b8d4c0e780ff7aa3667b","observation_id":"f58df497-37b2-4c7f-a948-88252a80b5c5","resolution":{"observed_at":"2026-08-07T04:33:59.521851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-07T04:33:51.271578Z","title":"Awac: Accelerating online reinforcement learning with offline datasets.arXiv preprint arXiv:2006.09359, 2020a","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.271578Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:01740f06191fbeed8ddc3da8aa962168d1af380283457f91c7a43dce2e2c1cb0","observation_id":"d675eb21-6ec0-41d0-b05e-ccfdf91e7a0c","resolution":{"observed_at":"2026-08-07T04:33:51.271578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.146563Z","title":"Tactics of adversarial attack on deep reinforcement learning agents","venue":null,"work_id":"259ee3a3-fe44-4c20-9a1e-e38b306a2eb3","year":2017},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.410454Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:30b3c4139c6b43dc8fd0079aa8633138a36611508b441a4be91ac70acad63b07","observation_id":"73993638-8a13-47e6-a2a7-c5d5c92ed92e","resolution":{"observed_at":"2026-08-07T04:33:58.292204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.854904Z","title":"Policy teaching via environment poisoning: Training-time adversarial attacks against re- inforcement learning","venue":null,"work_id":"599edd1c-e078-4a12-9082-002fc2f02c8b","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.582813Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:d90e77257ac14583ffa5990fc6410bbf8134d17757dfe495ee71e6b0313185be","observation_id":"f2365652-123b-46f8-a50c-565305277aa9","resolution":{"observed_at":"2026-08-07T04:33:57.983111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.519598Z","title":"Understanding the limits of poisoning attacks in episodic reinforcement learning","venue":null,"work_id":"af3480b9-3990-4015-a846-9f9a5d5f9d04","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.734589Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:74916e6423ab92949611bbe2118799d6459b4bbf96c4e8f36a419315c25bbe32","observation_id":"910c8e31-de8b-4ad1-aaf1-c3020a4049a8","resolution":{"observed_at":"2026-08-07T04:33:57.700610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04299","last_updated":"2023-01-11T04:25:00Z","snapshot_observed_at":"2026-08-13T13:06:48.389895Z","submitted_at":"2023-01-11T04:25:00Z","title":"SoK: Adversarial Machine Learning Attacks and Defences in Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2301.04299","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.04299","snapshot_observed_at":"2026-08-07T04:33:53.870181Z","title":"SoK: Adversarial Machine Learning Attacks and Defences in Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"964c97ab-d70d-45a4-91cc-3f95ab17cd5a","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.978936Z"},"links":{"cited_paper":"/paper/2301.04299","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:c1c0da6b062ec1e08ba74391475077012d6261f0f620bdbe5aed914498b99c2a","observation_id":"a5aa4151-e9f6-4447-818f-0558a868e3c4","resolution":{"observed_at":"2026-08-07T04:33:53.979737Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.903193Z","title":"Stealthy and effi- cient adversarial attacks against deep reinforcement learn- ing","venue":null,"work_id":"d6647f20-e052-4cd3-9630-0197c2c78ebc","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.103411Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:30595154394a9afde431f6a8ddd92b08560757b83d7d2b9a37f0010538e6dcde","observation_id":"c77d68a0-8a7e-4556-974d-c53e1db78987","resolution":{"observed_at":"2026-08-07T04:33:57.060431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.609173Z","title":"Vulnerability- aware poisoning mechanism for online RL with unknown dynamics","venue":null,"work_id":"d21a9f00-612a-4ae5-8d05-279d161491ec","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.272268Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:bbd84932ebb2c5489ce7f92b0702182f619f04fc84fe500a1e6b48ab79052afd","observation_id":"8068bb60-2e8f-4706-951a-bc15927fc7c9","resolution":{"observed_at":"2026-08-07T04:33:56.757052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.353651Z","title":"Who is the strongest enemy? towards optimal and efficient evasion attacks in deep RL","venue":null,"work_id":"ffdc0c36-674c-4457-a977-23a3eee0bb81","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.406491Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:443c6a1c6ef7544a7b8e17055c966bf9a21081939613172ad98123f69cae1d5a","observation_id":"7c5958e1-33eb-4343-8b5e-e1319324bf10","resolution":{"observed_at":"2026-08-07T04:33:56.482952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-08-12T13:17:36.653110Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-07T04:33:52.816694Z","title":"Tucker, and Ofir Nachum","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.816694Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:6e77b07f34e692fb3d5b12daa530b3a6602446813cba53ceb34d510d4edd9104","observation_id":"91dfd0b0-7ade-4dec-ad12-648b2c8709a9","resolution":{"observed_at":"2026-08-07T04:33:52.816694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.408610Z","title":"Zou, Sergey Levine, Chelsea Finn, and Tengyu Ma","venue":null,"work_id":"afe4ff58-cd96-4e28-9b0d-e41e8d922278","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.951899Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:90cd0add61bbd71853a3169df3c5f5c8420e20e62c759bec5ecea6db3c92223d","observation_id":"95c9a2f4-25c3-4f94-a704-8c471f1447b2","resolution":{"observed_at":"2026-08-07T04:33:55.558915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.08452","last_updated":"2021-01-21T05:38:52Z","snapshot_observed_at":"2026-08-13T20:27:38.924770Z","submitted_at":"2021-01-21T05:38:52Z","title":"Robust Reinforcement Learning on State Observations with Learned Optimal Adversary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.08452","snapshot_observed_at":"2026-08-07T04:33:53.084260Z","title":"Liu, Duane S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.084260Z"},"links":{"cited_paper":"/paper/2101.08452","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:e2b152bc5960b05f419c9fa9978dca61d14fc17b50c4e526b6f5d5d525c50ea4","observation_id":"92d01ebd-d99f-4d4e-b4d6-7d08a6ec9c91","resolution":{"observed_at":"2026-08-07T04:33:53.084260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.089010Z","title":"Adaptive reward-poisoning attacks against reinforcement learning","venue":null,"work_id":"1c3527c0-7f1b-437c-80e7-e7d4b80b7e54","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.218690Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:db28f284404a92f5b491c6ed9436f3eb301d8e1e004f9be229d4983b2ca1b8bf","observation_id":"7c600682-afe6-4dc4-bf3d-0422803035e9","resolution":{"observed_at":"2026-08-07T04:33:55.221667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.427794Z","title":"We use the official open-source code of these algorithms and follow the settings by D4RL [Fu et al., 2020]","venue":null,"work_id":"f47271ca-fcf7-4707-97ed-9131960d6b08","year":2018},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.468531Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:44cf79ae6818e456544841db36830b5b812aa84b8354aeecc3cb0215973bf811","observation_id":"ad6cdf0c-538e-4b90-83a6-fe1b13fc8ad3","resolution":{"observed_at":"2026-08-07T04:33:54.581343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.158907Z","title":null,"venue":null,"work_id":"185ea1e8-e4e8-4c86-b986-162a7b8b1ccb","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.640555Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:76f17813c01c5370fdaa3f289215f34e10f0c483212e7a9823f4d6c832ff54bd","observation_id":"4bb23235-9f51-4126-82ff-fcf70a40938f","resolution":{"observed_at":"2026-08-07T04:33:54.274142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.462537Z","title":"Morel: Model-based offline rein- forcement learning","venue":null,"work_id":"455a4cd4-7b29-4a5d-aaa1-51d92f4d8a72","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.165260Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:6d9059e3b54c1e32fc43f08e8fead5c5ea999ddf69fb032b30feabb4a1792187","observation_id":"7d3bb7f3-2eaa-4acd-a487-210fe25d24db","resolution":{"observed_at":"2026-08-07T04:33:58.613023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.703345Z","title":"Hunt, and Mingyuan Zhou","venue":null,"work_id":"f4dfc0fe-4897-4e38-80fe-3fab7b8ebd58","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.686117Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:721f23f67fdfa6b516ea98cee3abdbaee29d7ce982a573ac31bd64efd488adf3","observation_id":"8310298f-6573-40c7-8a0a-0f42180a46cc","resolution":{"observed_at":"2026-08-07T04:33:55.880927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-14T04:09:47.636898Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-07T04:33:50.727595Z","title":"Tucker, and Sergey Levine","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.727595Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:ac515915a91247d064dfcb965f1b6b698d14933b86021c5637b27a87edbdac2d","observation_id":"53bada1c-cf38-49be-933b-c503b7026613","resolution":{"observed_at":"2026-08-07T04:33:50.727595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.070327Z","title":"Mujoco: A physics engine for model-based control.2012 IEEE/RSJ International Conference on Intelligent Robots and Sys- tems, pages 5026–5033,","venue":null,"work_id":"f851cb4e-e855-43d1-be53-4ace83c654b8","year":2012},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.532346Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:bfd9eaa47a879224e3cc2f74a42f45230131bd064bd9afe6c28c6417fca86440","observation_id":"c0c529f5-abf3-4f92-a26a-33bd37cbde61","resolution":{"observed_at":"2026-08-07T04:33:56.215240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.962379Z","title":"Decision S4: efficient sequence-based RL via state spaces layers","venue":null,"work_id":"cec42f76-a1e1-4c05-8cd0-fa46082d0a48","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.300447Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:03bc5dd0eb249316273646b1f0703498fb63fcbd05b7f0cfbe649a36358fa208","observation_id":"202fe4ea-8544-48ba-951e-73dc33df8417","resolution":{"observed_at":"2026-08-07T04:34:00.100542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.107158Z","title":"A minimalist ap- proach to offline reinforcement learning","venue":null,"work_id":"33efc81b-fa4b-44a6-b447-48c7e8a4daa5","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.881185Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:5c1524997ded6cd6eea7c4263ab234d4ccdfd49c57f8f17c7359f9e023eb9b88","observation_id":"47c7acd4-3f06-4a80-8e12-570475adba9d","resolution":{"observed_at":"2026-08-07T04:33:59.282913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.799101Z","title":"Off- policy deep reinforcement learning without exploration","venue":null,"work_id":"0dd52444-74b0-4408-871e-165b3f3823e5","year":2019},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.985675Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:df67ba44b375bdd40fe805bd6a9ac6d023adb71a66a0340c0a7d341ea6f711d1","observation_id":"34f1a10d-7849-468c-bf85-d789b519e125","resolution":{"observed_at":"2026-08-07T04:33:58.917369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.215102Z","title":"Reinforcement learning with sim- ple sequence priors","venue":null,"work_id":"93f128cb-c115-40a7-acc0-2dfe2eff34fe","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.849502Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:972e8fc92069f6bdf03bd3469a70d5b18f56f6ed671eda8d2135c71a0a8a14b6","observation_id":"e03b7de2-deea-4a87-9a0e-7be9f458d069","resolution":{"observed_at":"2026-08-07T04:33:57.350096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.678258Z","title":"Julian, Chelsea Finn, and Sergey Levine","venue":null,"work_id":"0469b89d-34e6-45c4-957e-ae9a9d625e16","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.413606Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:a5f52d313d1daaf09f22c43393558f700e2f362d6005637944fac0ea019dd721","observation_id":"349fd631-693d-42ab-b360-af2bde90d62c","resolution":{"observed_at":"2026-08-07T04:33:59.808138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.769485Z","title":null,"venue":null,"work_id":"84ccc7a7-df59-40bd-a333-241ddc8456e9","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":3090,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.338283Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:917b2c7d711dc9e6cfdce33e2a2f0700ffccbeb30f9ae0d34d8d73726308694c","observation_id":"1697ad35-3954-4e2e-a61b-e678f76d06a0","resolution":{"observed_at":"2026-08-07T04:33:54.948969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T04:56:10.599292Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2506.11172."}