{"as_of":"2026-08-18T01:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dfa179a53c253339c67493195fe640ca34ebed9bd4488698ca419024b1081084","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T21:55:13.704957Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27968/citation-record","integrity":"/paper/2607.27968/integrity","json":"/paper/2607.27968/citation-record.json","paper":"/paper/2607.27968"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.533968Z","title":"In: 2021 IEEE symposium on security and privacy (SP)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.533968Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:5628a6187f02868ef79c418839e5f9afcd89ce4b0d95a30802ab68356d10ffd9","observation_id":"a67c3f68-64f9-4c46-a139-0f9764d3da27","resolution":{"observed_at":"2026-07-31T21:55:10.533968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.640183Z","title":"In: 2015 IEEE symposium on security and privacy","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.640183Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:97b6e44fb1776d0c807addd3002db4d3743b6d9c3a83e5f63c3298f73c9fdd1d","observation_id":"cd1b2483-ce9c-401b-ac08-f6a204618672","resolution":{"observed_at":"2026-07-31T21:55:10.640183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.715745Z","title":"In: The Eleventh International Conference on Learning Representations (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.715745Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:b1e184db7ab5354e8c7fac64543275a012aa94dc010ca936c299ff3578322eab","observation_id":"997db017-ab7b-4a9f-b17b-97909c6de28f","resolution":{"observed_at":"2026-07-31T21:55:10.715745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.781911Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems Datasets and Benchmarks Track (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.781911Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:eb1300edca2c1849c7a31680e9777d98ee736f7ac238fa99750c1dd9c8d6e805","observation_id":"ae2896c2-c946-4011-a215-a1beaa5988e4","resolution":{"observed_at":"2026-07-31T21:55:10.781911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-16T14:55:24.066689Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-07-31T21:55:10.827361Z","title":"arXiv preprint arXiv:2310.02238 (2023) Reward Design for Reinforcement Unlearning 13","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.827361Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:454069b2a2ce54fdd52eca5e256d9f50f01025c007948eae48d76ec255d27bfe","observation_id":"402f4099-6f57-4e93-b08d-76d064c20f88","resolution":{"observed_at":"2026-07-31T21:55:10.827361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.885706Z","title":"Official Journal of the European Union (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.885706Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:29ee5c10b2c7afd4753ae0de1cd41d800cba3a81be2f08ab2b55295a6c321717","observation_id":"62c624af-2ebd-4fa5-8cbf-51a4819a1bc3","resolution":{"observed_at":"2026-07-31T21:55:10.885706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.940732Z","title":"Official Journal of the European Union (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.940732Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:b3949ff958c308ae34573948e46a411c5ce330cff87b91b0ec05ef534cabfea6","observation_id":"f5129560-9279-4509-ae0d-455567d8306a","resolution":{"observed_at":"2026-07-31T21:55:10.940732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.123199Z","title":"CoRR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.123199Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:3182e1f1e78cff1d18f71b009a916908be8cad1ce6d3f7cf373fda1b728f9069","observation_id":"3088ac90-d800-4425-b03e-150779755d76","resolution":{"observed_at":"2026-07-31T21:55:11.123199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.189416Z","title":"Advances in neural information processing systems32(2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.189416Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:966435910fb01742d7784db713170eba95ed3d9869e13581d8fef3812820f8cb","observation_id":"81171f77-7d71-441e-9351-a9f41082a31c","resolution":{"observed_at":"2026-07-31T21:55:11.189416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.249325Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.249325Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:f6433d44594e75f81736645bfd077aa31fe4a649cf8cc0597bf5e936571df10d","observation_id":"875a0c20-7022-4753-b0a2-0456061d935f","resolution":{"observed_at":"2026-07-31T21:55:11.249325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.317529Z","title":"Information & Commu- nications Technology Law28(1), 65–98 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.317529Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:d66a8444f3aa20ffe1b34dba96995898ff512204f5b8c71b87eb65ec4f090ff7","observation_id":"deed7fef-77b5-45be-9f5e-1945aeafe950","resolution":{"observed_at":"2026-07-31T21:55:11.317529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.406039Z","title":"In: The 61st Annual Meeting Of The Association For Computational Linguistics (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.406039Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:90cd9af6756152d6e02d6b930a03a0fd290d0b086395bec79f5b75683113af0f","observation_id":"3293c30e-1c61-4aba-a99c-0520e2c20fda","resolution":{"observed_at":"2026-07-31T21:55:11.406039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.504653Z","title":"In: The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.504653Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:04bfce9a7ab59521e68409c89b2990fcb0e2d6fe4d0cc616e021c536f3eb1737","observation_id":"e1d516c7-7f14-476b-bd7f-1809cf471d77","resolution":{"observed_at":"2026-07-31T21:55:11.504653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.568648Z","title":"In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.568648Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:8d36ec2ddda461a3e5a15d3ffc49647e6f1317364c92e08892a457315ba7a19d","observation_id":"95be9cd1-c3aa-4ce2-9041-2cacb89448ae","resolution":{"observed_at":"2026-07-31T21:55:11.568648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.629120Z","title":"Advances in Neural Information Processing Systems36, 20750–20762 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.629120Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:1cea2d6cff43fde169ab2b143dd09c42fe389b24bc9444c290cd727c622c2323","observation_id":"6e2f4b6f-d301-4ff1-98bf-844cd99de6cb","resolution":{"observed_at":"2026-07-31T21:55:11.629120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.688841Z","title":"In: Second Conference on Language Modeling (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.688841Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:1e7feb1e487b27b4681844fa1632dcd64ce3219e953bad4f5d3261afe07e056a","observation_id":"f616599b-b130-43b6-a17c-e5e39edbcb12","resolution":{"observed_at":"2026-07-31T21:55:11.688841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.759108Z","title":"In: Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.759108Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:3c925e3097d388e434ac6cb3689cf9d10495c6007ea6ea496ad25a5ec1556844","observation_id":"dc37383b-a264-4336-96f2-19a5afa24d3d","resolution":{"observed_at":"2026-07-31T21:55:11.759108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.875970Z","title":"Nature Machine Intelligence pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.875970Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:b68e4f3c1e209a585d53c02910466783d180f0a9121b28842b299df9c8542f07","observation_id":"a9cef38d-4e6b-4402-85e4-69feadde94b3","resolution":{"observed_at":"2026-07-31T21:55:11.875970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.967981Z","title":"CoRR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.967981Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:b9f356ce25cd27a91351eff1ae6599bb4bcf654459a2c575505da8647855df3a","observation_id":"dc9b98ed-8a08-4023-af0b-16eab27dd01a","resolution":{"observed_at":"2026-07-31T21:55:11.967981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.034510Z","title":"Advances in neural information processing systems35, 27591–27609 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.034510Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:350ccae479221008d8a15e3fd70653bd4afb6c724ed52f95499eb5304bc82dc8","observation_id":"e2c5098f-6da3-4f42-8415-ef89b5d5361e","resolution":{"observed_at":"2026-07-31T21:55:12.034510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.132860Z","title":"In: First Conference on Language Modeling (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.132860Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:fafa32cda9470b3c50417a25c607cf59b3f809d50f1c187194e8cb3c6cd0efa9","observation_id":"61f8bb73-5c7b-437d-a18b-41f933149def","resolution":{"observed_at":"2026-07-31T21:55:12.132860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.261904Z","title":"In: Proceedings of the 31st International Conference on Computational Linguistics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.261904Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:e63449cb728af851a0cc2258cba6f6902234a17fd84e286c24f3e39e72aa4fac","observation_id":"4726c605-703c-4289-bc11-a1597f0702c4","resolution":{"observed_at":"2026-07-31T21:55:12.261904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.371294Z","title":"In: Algorithmic Learning Theory","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.371294Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:d57a06227010ebf12cc0d4ca74baef68317c59fdb33ec9ca569b502b403f54cd","observation_id":"59fffe0d-34a1-4fa3-8262-d133757d404a","resolution":{"observed_at":"2026-07-31T21:55:12.371294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.471787Z","title":"ACM Transactions on Intelligent Systems and Technology16(5), 1–46 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.471787Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:cd490935c2a72f774932aa7467134fb4c124e957846ab1ea145344c0a3d69f86","observation_id":"727d2ac0-379f-4d42-b640-9b051ca25f2d","resolution":{"observed_at":"2026-07-31T21:55:12.471787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.535921Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.535921Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:7509af898521f8fc7696eb425109e11e362a6eac0a86f3cda6560f209b67394f","observation_id":"ce65cd6a-e6bf-411d-89bd-54704a29a03a","resolution":{"observed_at":"2026-07-31T21:55:12.535921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.630719Z","title":"Advances in Neural Information Processing Systems36, 53728–53741 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.630719Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:e5edec408620d62025e70d7bdc2d0c9024e045805fb855a43683a520756dd960","observation_id":"0e99e794-0199-47d5-8710-2b47136eedaa","resolution":{"observed_at":"2026-07-31T21:55:12.630719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.724577Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.724577Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:2859e66d8573296ae3d37ac80941ff1aba62e9a9fcab82b756d3e202724403c3","observation_id":"80d62ed6-1967-4eea-885f-3a9a5dc4b32a","resolution":{"observed_at":"2026-07-31T21:55:12.724577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.780508Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.780508Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:5ef60a2d41b270164ce6fd6ebc680d6d50391bdf0e3024df5e319c1dd0e7f8c3","observation_id":"351e3d45-fedf-45ad-9721-cc1074ae742e","resolution":{"observed_at":"2026-07-31T21:55:12.780508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.870993Z","title":"Advances in Neural Information Processing Systems34, 18075–18086 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.870993Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:a4a1032cc6d83f4243db8d471783e3b7dfbaf02b486bcbb5c2510155d86ec640","observation_id":"9b0c0066-19f5-4bb9-a20d-8a179ab37fde","resolution":{"observed_at":"2026-07-31T21:55:12.870993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-31T21:55:12.939314Z","title":"arXiv preprint arXiv:2402.03300 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.939314Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:6e0de4c4412224f0608bf5b413f14eed4e10b12f436805ed81fa5d6823417f3e","observation_id":"752bbdb5-3f65-44f7-b404-929abf3774c3","resolution":{"observed_at":"2026-07-31T21:55:12.939314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.007776Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.007776Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:dceef4f78bbaac0b3f711c0cac992f648a85dec51b706dede33feaab8d739106","observation_id":"32cc7f85-756e-4518-b208-019957c59423","resolution":{"observed_at":"2026-07-31T21:55:13.007776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.121127Z","title":"In: Conference on Learning Theory","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.121127Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:cac610530376d6a4d1a1c2d095cbce5c980616dbca4b10aa2a4f0ae9f1d8e451","observation_id":"fce02641-6f6b-4d57-a62a-e74d36cab6c1","resolution":{"observed_at":"2026-07-31T21:55:13.121127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.209250Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.209250Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:8a0f888294c18dd11a46d243a298530ea29039da2b42b5264bd52bf24e2c81a0","observation_id":"80b5ca3b-edc1-462e-860b-2f96c49ded4d","resolution":{"observed_at":"2026-07-31T21:55:13.209250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.273482Z","title":"In: The Thirty-First International Joint Conference on Artificial Intelligence (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.273482Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:849e6d16677957257688800f85c435c666fc6e87eb5003d7757f9a225bace94f","observation_id":"27041aa1-962e-455b-82dd-df22a1581321","resolution":{"observed_at":"2026-07-31T21:55:13.273482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.338035Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Pa- pers)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.338035Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:acbe54874a0be249a0264ea717fb0278c8f813750c5a0574092f89e88659fde8","observation_id":"96cd0941-6832-4506-a88d-4c940e9f849e","resolution":{"observed_at":"2026-07-31T21:55:13.338035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.404187Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.404187Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:397da467cc317e7c50ae1ce0fc02bce047b98f8eedd478140d68faee20de9532","observation_id":"7c85dd62-382b-415e-9511-401dad5177d2","resolution":{"observed_at":"2026-07-31T21:55:13.404187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.521475Z","title":"arXiv preprint arXiv:2601.20568 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.521475Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:86a81645ef146cb9de3d7b6ec23046c7179ca11e68a414ff4b674a3526cd2561","observation_id":"fa92a933-6086-4614-9b81-46774240372a","resolution":{"observed_at":"2026-07-31T21:55:13.521475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.642017Z","title":"In: The Thirty- ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.642017Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:69020d621654f449231d4d7d97543f3d7c4a25a6a00f5c8dec1e18e94b8cb585","observation_id":"e8241d0f-0d8f-4211-a96b-e93bac6c8a90","resolution":{"observed_at":"2026-07-31T21:55:13.642017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.704957Z","title":"does the completion contain any forbidden item?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.704957Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:4db1b5a2cfe7f99fe79f3a4a1b1909683b0c8c7225a1177f486aa69e9ead4dd3","observation_id":"286c5a3b-3f62-44e7-a06d-e1286eed1847","resolution":{"observed_at":"2026-07-31T21:55:13.704957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T16:31:08.692522Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2607.27968."}