{"as_of":"2026-08-09T22:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f79782ddfca87100463c8a2b153fda61c66f7f1da2e20c915e368b2b509c5042","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:29:09.695715Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21111/citation-record","integrity":"/paper/2607.21111/integrity","json":"/paper/2607.21111/citation-record.json","paper":"/paper/2607.21111"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:04.378083Z","title":"A survey on offline reinforcement learning: Taxonomy, review, and open problems.IEEE Transactions on Neural Networks and Learning Systems, 35(8):10237–10257, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:04.378083Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:22e1ce4b9c7a4a297b379cd5b53951795dc08eb9331dda19369c9ab787965da8","observation_id":"1a44a8cc-32a9-4900-816d-0ec5053ef141","resolution":{"observed_at":"2026-08-01T08:29:04.378083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:04.486443Z","title":"On the op- portunities and challenges of offline reinforcement learning for recommender systems.ACM Transactions on Information Systems, 42(6):1–26, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:04.486443Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:582931f3937f65cfb6f90ac85dc08b729856d901fa382aca401228b2a56fb883","observation_id":"f7105ab4-6d35-40bd-935d-9800a59ea773","resolution":{"observed_at":"2026-08-01T08:29:04.486443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:04.555835Z","title":"Learning from good trajectories in offline multi-agent reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:04.555835Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:58c02326979f05e6bd174dc1d10ca4ecbeda1055b2b9e3c8b4c93ae6122518fa","observation_id":"65cfb667-aafe-4d2e-84bb-12e8afadbc04","resolution":{"observed_at":"2026-08-01T08:29:04.555835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:04.723992Z","title":"Offline reinforcement learning: Role of state aggregation and trajectory data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:04.723992Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:df98d09d4d69b782f095babc109660e241d1f1844feb0d5353c32ce6cf533c95","observation_id":"acb56731-82b7-4c14-8ca3-f36d1ce1025f","resolution":{"observed_at":"2026-08-01T08:29:04.723992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:04.885282Z","title":"A survey of privacy attacks in machine learning.ACM Computing Surveys, 56(4):1–34, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:04.885282Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:57ae8afc6fee5502b8141b2b4ed76edc1c98a786c26f9bed154e3140029d5388","observation_id":"3d16d7f2-b168-4b22-a4a4-af7ddaffe58e","resolution":{"observed_at":"2026-08-01T08:29:04.885282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:05.062525Z","title":"The right to be forgotten in federated learning: An efficient realization with rapid retraining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.062525Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:73bb5be2ab26c100705615eb08c170e40e3ceb2bad5f26f0c2e3ab8f549c6142","observation_id":"db7cb7d1-6205-41ee-be03-2f93b09515e7","resolution":{"observed_at":"2026-08-01T08:29:05.062525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:05.229273Z","title":"A comprehensive survey of forgetting in deep learning beyond continual learning.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(3):1464–1483, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.229273Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:e469d446f7c8b5e526a09e44397491763162635236c4465f4f64ff3895f6d1ea","observation_id":"dead6cee-a246-4eed-a9b6-802ae4f5a3ee","resolution":{"observed_at":"2026-08-01T08:29:05.229273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:05.399738Z","title":"Choquette-Choo, Hengrui Jia, Adelin Travers, Baiwu Zhang, David Lie, and Nicolas Papernot","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.399738Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:f9f9667a6a2872e7d4ae1056f2cc197f2e9e4ae6dff529c6351ac4ce35ee94e3","observation_id":"36860cc9-9797-4c4a-af66-5627df090cf4","resolution":{"observed_at":"2026-08-01T08:29:05.399738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:05.573359Z","title":"Hannun, and Laurens van der Maaten","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.573359Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:10beaf74c2638e301361e85593e80590715d5fba2ccfc129ce64acf1593b8998","observation_id":"2fa855f5-8743-4a2e-aa8c-f94801113224","resolution":{"observed_at":"2026-08-01T08:29:05.573359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:05.716602Z","title":"A survey of machine unlearning.ACM Transactions on Intelligent Systems and Technology, 16(5):1–46, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.716602Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:2fc89b3db33a2dc913a7bfd7e5199168bc224654ad6c8821338a9a6d38ba6eb9","observation_id":"2346a3ad-109e-41d1-a678-cbf862a36e99","resolution":{"observed_at":"2026-08-01T08:29:05.716602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T08:29:05.884586Z","title":"D4RL: datasets for deep data-driven reinforcement learning.arXiv, abs/2004.07219, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:05.884586Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:f6e46cfcd29b806d15a46df86be3cb970f930bce46aca3c0a72bb010ecea7253","observation_id":"11c84449-1b10-4baa-bc1d-c5df6ee95e3e","resolution":{"observed_at":"2026-08-01T08:29:05.884586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.029417Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.029417Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:5130f34000f97718a6b8e450d5f72bf00bd3a02b3c2e3d8f430a392fff7f5785","observation_id":"a1f86f4e-2aed-4f27-8207-208a9012c25d","resolution":{"observed_at":"2026-08-01T08:29:06.029417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.187628Z","title":"Constrained decision transformer for offline safe reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.187628Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:7e77f1376a467819988c145b04ea054a1a5f17db2085a500084a349afd24e79f","observation_id":"77093852-a74c-4a2c-b60c-79d7b1e708db","resolution":{"observed_at":"2026-08-01T08:29:06.187628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.349381Z","title":"Critic-guided decision transformer for offline reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.349381Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:f4c50e03da0958589f44786ed35e5cb18ab53295111a5a2b33e3a07ed9fe5b7d","observation_id":"1686a6cf-6bfe-4d3f-bfad-3a173a8ee1b7","resolution":{"observed_at":"2026-08-01T08:29:06.349381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.539668Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.539668Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:30a270f927a2a04e89f17e7d6895465d4d47353ad4a9615764fc1b3527bb2515","observation_id":"8a722dad-51dd-4bb0-8f45-4ac93e1c0e0b","resolution":{"observed_at":"2026-08-01T08:29:06.539668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.749038Z","title":"Trajdeleter: Enabling trajectory forgetting in offline reinforcement learning agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.749038Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:27c634c5a1d514d77572db6f0cbbb7fa0ffd7203f689146f0531ca9c869b5997","observation_id":"a86a5696-4422-4866-a819-1d3f57ff595a","resolution":{"observed_at":"2026-08-01T08:29:06.749038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:06.978938Z","title":"Rethinking machine unlearning for large language models.Nature Machine Intelligence, 7(2):181–194, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:06.978938Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:413c70dabcbe7a487e22337df6738450549c861b20240633855069e0c81c7c55","observation_id":"b4013e32-fa2c-40cd-8b34-edbd56e86fdb","resolution":{"observed_at":"2026-08-01T08:29:06.978938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:07.194179Z","title":"Eternal sunshine of the spotless net: Selective forgetting in deep networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:07.194179Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:a6bff9f2d60ecbd57836c6777c98a3395d37078cb2d04183b1c2ff44c93e444a","observation_id":"cc5c17f5-4615-4de8-9342-b7bc56272ba2","resolution":{"observed_at":"2026-08-01T08:29:07.194179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:07.375430Z","title":"Erroreraser: Unlearning data bias for improved continual learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:07.375430Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:6132a7487e58b2560c7f9e9042417c3aaf79e562471852c196c441b8bda226d0","observation_id":"30eb4762-0d4b-47bb-8a95-bbce0b086739","resolution":{"observed_at":"2026-08-01T08:29:07.375430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:07.503004Z","title":"Unrolling SGD: understanding factors influencing machine unlearning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:07.503004Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:5b834b366bd7b09ec74d629602f4aa1f758d0c52a49e01584f396300ee9f09b2","observation_id":"0b51bbd2-9442-4291-9f92-eda9fae61b4a","resolution":{"observed_at":"2026-08-01T08:29:07.503004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.01569","last_updated":"2025-08-03T03:37:31Z","snapshot_observed_at":"2026-08-06T05:35:05.200438Z","submitted_at":"2025-08-03T03:37:31Z","title":"LetheViT: Selective Machine Unlearning for Vision Transformers via Attention-Guided Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.01569","snapshot_observed_at":"2026-08-01T08:29:07.642694Z","title":"Lethevit: Selective machine unlearning for vision transformers via attention-guided contrastive learning.arXiv, abs/2508.01569, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:07.642694Z"},"links":{"cited_paper":"/paper/2508.01569","citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:030c12c3985f86a32d4432d2872bac6ad4d5e26180b6c1a743c0fb48aa23e400","observation_id":"d4fb5aad-917d-48c8-be0d-3a5fccff83bc","resolution":{"observed_at":"2026-08-01T08:29:07.642694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17233","last_updated":"2025-08-24T07:15:59Z","snapshot_observed_at":"2026-08-09T08:06:39.519550Z","submitted_at":"2025-08-24T07:15:59Z","title":"Module-Aware Parameter-Efficient Machine Unlearning on Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17233","snapshot_observed_at":"2026-08-01T08:29:07.836856Z","title":"Module-aware parameter-efficient machine unlearning on transformers.arXiv, abs/2508.17233, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:07.836856Z"},"links":{"cited_paper":"/paper/2508.17233","citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:a7dda4ced577e2c0343d0228213e3e77b82aa136f90a5f7727a43836e8d2e1d4","observation_id":"6137b76d-e9c0-4c01-89bf-dcc532ac5edc","resolution":{"observed_at":"2026-08-01T08:29:07.836856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04231","last_updated":"2026-04-05T19:27:24Z","snapshot_observed_at":"2026-08-06T13:26:39.227957Z","submitted_at":"2026-04-05T19:27:24Z","title":"Subspace Control: Turning Constrained Model Steering into Controllable Spectral Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04231","snapshot_observed_at":"2026-08-01T08:29:08.003053Z","title":"Subspace control: Turning constrained model steering into controllable spectral optimization.arXiv, abs/2604.04231, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.003053Z"},"links":{"cited_paper":"/paper/2604.04231","citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:9317860b01bb3341f31f74fe7f123df0aec1c0e8dbe1e5c62852fa89a19ee982","observation_id":"a50db434-4a4b-43bf-8850-8fa93e17bc09","resolution":{"observed_at":"2026-08-01T08:29:08.003053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:08.226119Z","title":"Membership inference attacks against machine learning models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.226119Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:841ac4ff6b2117c590d0289360e7516779d1f0ddcb0fc5f7cd9678a190ebe2c2","observation_id":"6ad9c09b-b92c-4749-8ab4-3141dbb407c4","resolution":{"observed_at":"2026-08-01T08:29:08.226119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:08.376038Z","title":"Privacy risk in machine learning: Analyzing the connection to overfitting","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.376038Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:c53721e36e689448d484ece11ebf5dfb19afbef077f2544558a72bece33154ab","observation_id":"115d6750-0e39-49a0-bc86-4eddc536997c","resolution":{"observed_at":"2026-08-01T08:29:08.376038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:08.510707Z","title":"ML-Leaks: Model and data independent membership inference attacks and defenses on machine learning models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.510707Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:6ba333c6f682440a143fb96257d1485938addbfdae839cd1850747559d05f102","observation_id":"6e0b66dc-f181-45b7-8817-76f6a1283daf","resolution":{"observed_at":"2026-08-01T08:29:08.510707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:08.686847Z","title":"Systematic evaluation of privacy risks of machine learning models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.686847Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:78e0ef1c57baad8fba086b3af989573c55b56ba99fcb5a81c79c6f6ecdd0e46a","observation_id":"a9c6e25b-eb94-442b-8d7a-e9c0b5d73331","resolution":{"observed_at":"2026-08-01T08:29:08.686847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:08.847916Z","title":"Membership inference attacks from first principles","venue":null,"work_id":null,"year":1914},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:08.847916Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:9f5c18a01f3d7c0b02177b18b9f1b3cbb5c1b2cf9dabb26a220d5139ed1249f1","observation_id":"8765880a-321b-47ad-b6ba-dc49e2d0b1be","resolution":{"observed_at":"2026-08-01T08:29:08.847916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T08:29:09.003632Z","title":"Offline reinforcement learn- ing: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643, abs/2005.01643, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.003632Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:2892f8a05ed306b727bad9a96109db8b86aba4f8474be0e6b4194b83affa5b58","observation_id":"d12712e1-4aa8-4a25-809e-03f6c7c66ef9","resolution":{"observed_at":"2026-08-01T08:29:09.003632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:09.158727Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.158727Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:31a4302d1abe7923f3096871cb1e0732fae14068d3e068e4cd0d32c66f0714eb","observation_id":"1aa0c523-ccd2-4916-a964-0f0d20e85a00","resolution":{"observed_at":"2026-08-01T08:29:09.158727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:09.390857Z","title":"Long short-term memory.Neural Computation, 9(8):1735–1780, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.390857Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:6797f62e2e97a16e8cf535025f894bf9aca4445b63ba66001a738c08723bacc6","observation_id":"6c46ab6e-8be3-437c-bf2e-9f2ab0687b7d","resolution":{"observed_at":"2026-08-01T08:29:09.390857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:09.473902Z","title":"Reinforcement unlearning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.473902Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:cae60deebca2faed30de0e19fb66b9e29b10541833e14e64494defb939ed8f08","observation_id":"b6c61593-098c-43df-a0c7-680b85b9d260","resolution":{"observed_at":"2026-08-01T08:29:09.473902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:09.607901Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.607901Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:91eab8ad9bbaa0a3643ee9e92f32594c88b7f64328fa96ca042c91b4cb80ef3d","observation_id":"6bb09ed1-93a7-48b9-ae3e-b4c614eafb53","resolution":{"observed_at":"2026-08-01T08:29:09.607901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:29:09.695715Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T08:29:09.695715Z"},"links":{"citing_paper":"/paper/2607.21111"},"observation_digest":"sha256:9a4e67f45f4a0f964303653c5afb9440bd3d529e821d12ca3111090c18184471","observation_id":"58be887b-86e8-4165-851f-3d9384da41fc","resolution":{"observed_at":"2026-08-01T08:29:09.695715Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21111","last_updated":"2026-07-23T09:40:40Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T21:20:30.632484Z","submitted_at":"2026-07-23T09:40:40Z","title":"TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2607.21111."}