{"as_of":"2026-08-12T14:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d99b6fd1ae6b9d08c3445574345434a85d12f7af369a913f905fdf9e133bf41c","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:26:56.446574Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:34:43.970506Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:34:47.754484Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"cited_work":{"arxiv_id":"2502.00602","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00602","snapshot_observed_at":"2026-08-07T12:34:47.754484Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","venue":"cs.CL","work_id":"2fcfffa4-cb2e-40ce-a659-8f5321f3f467","year":2025},"citing_paper":{"arxiv_id":"2505.24302","last_updated":"2026-07-21T01:12:17Z","snapshot_observed_at":"2026-08-07T16:41:29.098287Z","submitted_at":"2025-05-30T07:28:20Z","title":"ScienceMeter: Tracking Scientific Knowledge Updates in Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:43.970506Z"},"links":{"cited_paper":"/paper/2502.00602","citing_paper":"/paper/2505.24302"},"observation_digest":"sha256:731a4cd275ad63fc5fb45e0af9ac346720b8fa1abf3d2d6d938f526822b72a51","observation_id":"496d7cfd-03fe-4e65-9dff-11f962fc3063","resolution":{"observed_at":"2026-08-07T12:34:47.862614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00602/citation-record","integrity":"/paper/2502.00602/integrity","json":"/paper/2502.00602/citation-record.json","paper":"/paper/2502.00602"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:55.925116Z","title":"A neural probabilistic language model","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.925116Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:0b6033be11fda1bfa1012e5c836677b3f4b2247ce423060df6864961aac8afa4","observation_id":"ddea3436-633f-4e0e-b2a6-df699d930684","resolution":{"observed_at":"2026-08-09T18:26:55.925116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:55.932845Z","title":"Pattern recognition and machine learning, volume 4","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.932845Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:d27521473d46b2a0a6f89ee915c4f33219a04f5aa9aa891312445cceb5e3b4aa","observation_id":"078661a8-bfce-4497-950d-a85935eda788","resolution":{"observed_at":"2026-08-09T18:26:55.932845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-09T18:26:55.941132Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.941132Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:a9856bee78907286c36d3024f52541b9b2a60b964daf946bf44822e346774107","observation_id":"ba286dd8-5a3d-467a-bc63-c0a8ce602f07","resolution":{"observed_at":"2026-08-09T18:26:55.941132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:55.951441Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.951441Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:193036fab14541d6a6898a4ba46dea49cba36c6035d4182424849ee79cfea8e8","observation_id":"81756c13-7e9c-40ed-bd22-e1085a7f593e","resolution":{"observed_at":"2026-08-09T18:26:55.951441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-09T18:26:55.957742Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.957742Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:e22c859d253e943be5eb79013afdfc378c82db6a1299e3e88344658bd4db6435","observation_id":"29e9174a-e7ae-4a99-99e8-a35fa1d0e0b4","resolution":{"observed_at":"2026-08-09T18:26:55.957742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-07-06T03:45:28.546418Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-09T18:26:55.964047Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.964047Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:825aff16c7bac5ff47f91ea198fb60faef3d2235ead0f00ad77428f58c5fffda","observation_id":"f3eeec36-cf1f-4a5b-ae2f-b358c1d751f0","resolution":{"observed_at":"2026-08-09T18:26:55.964047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:58.204664Z","title":"Evaluating the ripple effects of knowledge editing in language models","venue":null,"work_id":"5fd80002-d8b2-4f49-9ffd-7f47de865c2a","year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.974422Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:1c470af858a06bc9bc5a25656c36dbd4a33347d4ee388e253bc512d80c0d73be","observation_id":"7ae62e6f-339a-4f62-94d4-4e52a7bcd39a","resolution":{"observed_at":"2026-08-09T18:26:58.211400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:55.982618Z","title":"Elements of information theory","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.982618Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:57471eba8991c2c8606835e521236a8e9d22b9705c53e630332ed833a3eeacd3","observation_id":"1464037b-690c-4166-b4d9-0b2bbea1218a","resolution":{"observed_at":"2026-08-09T18:26:55.982618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08696","last_updated":"2022-03-10T02:28:59Z","snapshot_observed_at":"2026-08-10T23:57:00.263588Z","submitted_at":"2021-04-18T03:38:26Z","title":"Knowledge Neurons in Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08696","snapshot_observed_at":"2026-08-09T18:26:55.989243Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.989243Z"},"links":{"cited_paper":"/paper/2104.08696","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:47c97d780efa333e04b622a89e61a518b3fbbeff6a3121035388bc329229c7ff","observation_id":"a3bce83e-7c9f-4d1a-9f4e-0968102593df","resolution":{"observed_at":"2026-08-09T18:26:55.989243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08164","last_updated":"2021-09-08T20:44:44Z","snapshot_observed_at":"2026-08-11T13:50:34.280135Z","submitted_at":"2021-04-16T15:24:42Z","title":"Editing Factual Knowledge in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08164","snapshot_observed_at":"2026-08-09T18:26:55.998480Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:55.998480Z"},"links":{"cited_paper":"/paper/2104.08164","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:2e1da7f1e229a904264ebe85a555e446f92b41384deba97e0a4c01b80c4026fd","observation_id":"84ceff7d-93fd-4436-9d34-709d63edfe5e","resolution":{"observed_at":"2026-08-09T18:26:55.998480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03329","last_updated":"2022-10-18T02:58:24Z","snapshot_observed_at":"2026-08-12T13:01:26.281557Z","submitted_at":"2022-10-07T05:14:58Z","title":"Calibrating Factual Knowledge in Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03329","snapshot_observed_at":"2026-08-09T18:26:56.009198Z","title":"Calibrating factual knowledge in pretrained language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.009198Z"},"links":{"cited_paper":"/paper/2210.03329","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:6d97fc1e23fa3c81cb0c1f8fa6768f1a967df4b7576d35023365bb86c3378ac6","observation_id":"da02cd86-2722-4146-88f3-690889a32de8","resolution":{"observed_at":"2026-08-09T18:26:56.009198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-09T18:26:56.015569Z","title":"A survey for in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.015569Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:f8c913e3d0e0658469bd3260f30c300022b9e1ceda46d3ca833ba2c4c5a09b1e","observation_id":"73079c1e-86f0-41f8-b8c7-81342ca4022f","resolution":{"observed_at":"2026-08-09T18:26:56.015569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T18:26:56.021780Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.021780Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:95efcb929cce6a15f12ce846a2823b67b5f77fb04b3287d74324843af2462afc","observation_id":"7f8a3aab-b197-4cdd-931f-178b98ece498","resolution":{"observed_at":"2026-08-09T18:26:56.021780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09509","last_updated":"2022-07-14T13:04:29Z","snapshot_observed_at":"2026-07-06T12:49:18.486644Z","submitted_at":"2022-03-17T17:57:56Z","title":"ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09509","snapshot_observed_at":"2026-08-09T18:26:56.028321Z","title":"Toxigen: A large-scale machine-generated dataset for adversarial and implicit hate speech detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.028321Z"},"links":{"cited_paper":"/paper/2203.09509","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:a1eba87e95115163508820101e379573c5d96dbffe688751d9c84b533bc440ac","observation_id":"cb2914bf-a048-4f64-87ac-d609bee73200","resolution":{"observed_at":"2026-08-09T18:26:56.028321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:58.167259Z","title":"Aging with grace: Lifelong model editing with discrete key-value adaptors","venue":null,"work_id":"3de1b48b-e353-4799-b98a-55b63077c7e4","year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.037739Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:c36248ffa145d8ed63ebf19162b5c7ebe38727181f1b61c54309fd24d9ea8197","observation_id":"6655497d-0ecd-452c-b6fd-66c1fef5200d","resolution":{"observed_at":"2026-08-09T18:26:58.173894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15191","last_updated":"2022-10-27T05:52:35Z","snapshot_observed_at":"2026-08-09T08:03:28.022738Z","submitted_at":"2022-10-27T05:52:35Z","title":"Truncation Sampling as Language Model Desmoothing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15191","snapshot_observed_at":"2026-08-09T18:26:56.047686Z","title":"Truncation sampling as language model desmoothing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.047686Z"},"links":{"cited_paper":"/paper/2210.15191","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:16b6fec2bfe96a6e9b38ab5e6e3fbdc5e48a1aeef9226ccef79271c3ffe06f0b","observation_id":"fb92d708-92b7-4287-9518-96b09df24047","resolution":{"observed_at":"2026-08-09T18:26:56.047686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.054201Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.054201Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:23e67ba723901cfc8b8020b329d64ecdab9055b5d6d02a0bfbdfe6f3ada92758","observation_id":"2204d177-fce7-443a-b638-7d6af2a8474d","resolution":{"observed_at":"2026-08-09T18:26:56.054201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.061090Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.061090Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:429e461ed4e927e618ded4b55956fde7a4e8be92160b1a3d78e2e9656cb5fcde","observation_id":"5f4547cb-941a-4dbc-a830-c37a5db7b4a2","resolution":{"observed_at":"2026-08-09T18:26:56.061090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09785","last_updated":"2023-01-24T02:12:42Z","snapshot_observed_at":"2026-08-11T01:11:45.889416Z","submitted_at":"2023-01-24T02:12:42Z","title":"Transformer-Patcher: One Mistake worth One Neuron","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09785","snapshot_observed_at":"2026-08-09T18:26:56.068084Z","title":"Transformer-patcher: One mistake worth one neuron","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.068084Z"},"links":{"cited_paper":"/paper/2301.09785","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:997435b33e2d5dc8683cb80c0d54bb1ec32aafa0fecc06833f011875ea0fdb59","observation_id":"2b3f2b99-773d-4efa-bd06-94c05804d655","resolution":{"observed_at":"2026-08-09T18:26:56.068084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.074346Z","title":"Survey of hallucination in natural language generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.074346Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:cbbd29d1580cd80bb72c6629b7d3e3bdfc97ddbfcf51c3f135db64c54a90e828","observation_id":"4b2ee85d-a69d-42a5-b0ae-e3c27455eb83","resolution":{"observed_at":"2026-08-09T18:26:56.074346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11905","last_updated":"2024-06-05T15:46:03Z","snapshot_observed_at":"2026-08-12T01:50:40.658805Z","submitted_at":"2024-02-19T07:45:17Z","title":"Learning to Edit: Aligning LLMs with Knowledge Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11905","snapshot_observed_at":"2026-08-09T18:26:56.080612Z","title":"Learning to edit: Aligning llms with knowledge editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.080612Z"},"links":{"cited_paper":"/paper/2402.11905","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:759c4b0af91cd98c1b2f23e0641b04c30ea27a50c86b80826e3fa4ecf48b45a9","observation_id":"4b9ffcaa-33ef-41a6-88db-92a5551479ab","resolution":{"observed_at":"2026-08-09T18:26:56.080612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.088618Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.088618Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:b6c8dab31cd53bc8063e334f25b676d0cf15be040ac882e06fc0009b05a4086e","observation_id":"ff2b0342-b4ae-4b42-8ede-1a26b2746cdc","resolution":{"observed_at":"2026-08-09T18:26:56.088618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.098715Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.098715Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:c829686c73b9fba3b6b8fec7d9817e609b9afe43abeafaa15566089fd024c11e","observation_id":"288acc03-3efc-43fe-a696-161161195d9d","resolution":{"observed_at":"2026-08-09T18:26:56.098715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.09038","last_updated":"2016-10-27T23:54:31Z","snapshot_observed_at":"2026-07-06T05:16:27.373400Z","submitted_at":"2016-10-27T23:54:31Z","title":"Professor Forcing: A New Algorithm for Training Recurrent Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.09038","snapshot_observed_at":"2026-08-09T18:26:56.104597Z","title":"Professor forcing: A new algorithm for training recurrent networks, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.104597Z"},"links":{"cited_paper":"/paper/1610.09038","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:c528f72d6e791373918fa4d7e4f97bf810924a6cf3fd0aebeab9fe89f148da4b","observation_id":"e3096a34-2940-4966-8719-5665c0c30af3","resolution":{"observed_at":"2026-08-09T18:26:56.104597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13459","last_updated":"2022-10-22T11:52:38Z","snapshot_observed_at":"2026-08-11T03:42:38.448716Z","submitted_at":"2022-10-22T11:52:38Z","title":"Adaptive Label Smoothing with Self-Knowledge in Natural Language Generation","version":1},"cited_work":{"arxiv_id":"2210.13459","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.13459","snapshot_observed_at":"2026-08-09T18:26:57.282597Z","title":"Adaptive Label Smoothing with Self-Knowledge in Natural Language Generation","venue":"cs.LG","work_id":"ded2cec6-8e85-449b-a825-6c8ae74bcccc","year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.111113Z"},"links":{"cited_paper":"/paper/2210.13459","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:02037bd8fb2ea7c5238d9f140e83957ff0e0d1a5a6d6b82ad4e938221560b286","observation_id":"3c0423eb-b3ae-4650-9025-d2c75da7f966","resolution":{"observed_at":"2026-08-09T18:26:57.292112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-09T18:26:56.117440Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.117440Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:5a787b3b341a840c26c999f80f24ed2c99477b566e44866f56b5761a8236d016","observation_id":"18a498a9-1b16-4f90-8455-48dbcefaecdb","resolution":{"observed_at":"2026-08-09T18:26:56.117440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.124484Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.124484Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:6cac4bbd6990a52f00311c3d4c6ed01334c5a7761493b4f0ce4ef7976081ea0b","observation_id":"291f52ab-e6df-46de-a3a3-c9871687ee6d","resolution":{"observed_at":"2026-08-09T18:26:56.124484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-07-06T14:04:55.099373Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-09T18:26:56.132279Z","title":"Mass-editing memory in a transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.132279Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:2f233af39525f408d3cb201c12c4e2890ffdef68caa67406df156ab7577cf11c","observation_id":"64bae0d1-053e-4957-9f69-bcdd2271f538","resolution":{"observed_at":"2026-08-09T18:26:56.132279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11309","last_updated":"2022-06-13T23:26:16Z","snapshot_observed_at":"2026-08-11T17:57:13.018546Z","submitted_at":"2021-10-21T17:41:56Z","title":"Fast Model Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11309","snapshot_observed_at":"2026-08-09T18:26:56.139474Z","title":"Fast model editing at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.139474Z"},"links":{"cited_paper":"/paper/2110.11309","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:2247721446acce89f8d449bbb3fccbfcdb4d52bb2247a1e9e8d6c13194b50c2c","observation_id":"aefd6953-e1e7-4aee-9947-c8ccff503e5c","resolution":{"observed_at":"2026-08-09T18:26:56.139474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:58.055519Z","title":"Memory-based model editing at scale","venue":null,"work_id":"cf625c47-a39a-4e7c-9084-40df856fcab3","year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.146356Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:dd036c53051134db00e4e477a3bada8df6ca992d9e53bb72742494f2e075566e","observation_id":"ad76e627-7940-4aba-9845-9ca38931f369","resolution":{"observed_at":"2026-08-09T18:26:58.063878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:57.890279Z","title":"When does label smoothing help? Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"0b89e3b1-a861-4c9a-b447-2317a5deed09","year":2019},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.155439Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:c4f4a096dd0e264da2bb0d5a45a93034bbd6eb57b324745d09c5d40585c80ab8","observation_id":"3aec5a26-c1d7-4138-89b5-8bc7eb60ac79","resolution":{"observed_at":"2026-08-09T18:26:58.039521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.162743Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.162743Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:29c332cd2f08d2fcad647dae1efc10e1447f44647d4d94fa67cfe3843eb72021","observation_id":"f9d0b7c9-78d6-4610-9c6e-2a69649b669f","resolution":{"observed_at":"2026-08-09T18:26:56.162743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.170394Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.170394Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:223ffb893df9a637a3d3c166778b4967d729e7d452961c7f74e3a119feed4454","observation_id":"f2878f8a-c7a3-423e-866a-899e9e9d7c51","resolution":{"observed_at":"2026-08-09T18:26:56.170394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.187968Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.187968Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:4999b2adca3773ed396687b7e6e157de582e03dab7d18dc7caa8661ee7c3af69","observation_id":"7f8155a4-cc06-493f-bcf4-6ec5dfc957a1","resolution":{"observed_at":"2026-08-09T18:26:56.187968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.197022Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.197022Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:bf01970a965c527018972e70d7a9fb34601e19eac84d23c272c55f86b84f6ee4","observation_id":"a93c5575-3a6e-4c6b-81c6-b1832fe3b571","resolution":{"observed_at":"2026-08-09T18:26:56.197022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09920","last_updated":"2024-09-24T09:48:36Z","snapshot_observed_at":"2026-08-11T16:53:58.710480Z","submitted_at":"2024-06-14T11:02:21Z","title":"Knowledge Editing in Language Models via Adapted Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09920","snapshot_observed_at":"2026-08-09T18:26:56.205565Z","title":"Knowledge editing in language models via adapted direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.205565Z"},"links":{"cited_paper":"/paper/2406.09920","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:056bcc8e8b1404eed0ae78c1575de87afe7f67e7c9063f2aa00c879649dc5189","observation_id":"ffda8ba5-100f-4c9d-ae08-1b83f1ac6123","resolution":{"observed_at":"2026-08-09T18:26:56.205565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10705","last_updated":"2019-09-24T04:26:27Z","snapshot_observed_at":"2026-07-06T08:24:02.658708Z","submitted_at":"2019-09-24T04:26:27Z","title":"Do Massively Pretrained Language Models Make Better Storytellers?","version":1},"cited_work":{"arxiv_id":"1909.10705","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.10705","snapshot_observed_at":"2026-08-09T18:26:57.125423Z","title":"Do Massively Pretrained Language Models Make Better Storytellers?","venue":"cs.CL","work_id":"07dcb7ce-7e22-4fee-a5e1-b6433eea3ebc","year":2019},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.213066Z"},"links":{"cited_paper":"/paper/1909.10705","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:a507cfdb937294e5c9e6b40b295f4c06df9c40ea08c648e43df897bef7cb1bcd","observation_id":"c86e1b7e-70b0-44c1-84e5-5b4aa4ce6073","resolution":{"observed_at":"2026-08-09T18:26:57.133668Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.3215","last_updated":"2014-12-14T20:59:51Z","snapshot_observed_at":"2026-08-02T03:58:50.109606Z","submitted_at":"2014-09-10T19:55:35Z","title":"Sequence to Sequence Learning with Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.3215","snapshot_observed_at":"2026-08-09T18:26:56.219166Z","title":"Sequence to sequence learning with neural networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.219166Z"},"links":{"cited_paper":"/paper/1409.3215","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:dd685672c1179ed6668db5cdd7da5b6af95fe98e52082b7d36ff76f9f08159f1","observation_id":"a31c7010-11aa-4f31-af75-1e33f3c6f5dc","resolution":{"observed_at":"2026-08-09T18:26:56.219166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:57.818584Z","title":"Rethinking the inception architecture for computer vision","venue":null,"work_id":"815a86fd-437e-4957-aa0f-fc55a02339b3","year":2016},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.226329Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:b57c58c95949ef21d808aff151e296d02fc99c7ef2a8027f3f8c516e0dcd2122","observation_id":"44abd8b6-acdd-4147-8261-12f0214518f9","resolution":{"observed_at":"2026-08-09T18:26:57.825154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07641","last_updated":"2024-11-12T08:46:43Z","snapshot_observed_at":"2026-07-06T19:48:58.392175Z","submitted_at":"2024-11-12T08:46:43Z","title":"Top-$n\\sigma$: Not All Logits Are You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07641","snapshot_observed_at":"2026-08-09T18:26:56.233285Z","title":"Top- n : Not all logits are you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.233285Z"},"links":{"cited_paper":"/paper/2411.07641","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:5d20961f57d0ee06f6bdfba789dd63ec4962d91eb098c6bf3a22683eef91d7a0","observation_id":"72ffb4d0-3558-4913-bfb7-165291b11dda","resolution":{"observed_at":"2026-08-09T18:26:56.233285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T18:26:56.241970Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.241970Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:4925508c6db02c3141cff689d0a8d12c00655b524a5f56c09c9ad82a8b7dbd4d","observation_id":"7ef1a219-a826-41f6-b39f-721b7b634f61","resolution":{"observed_at":"2026-08-09T18:26:56.241970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.251845Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.251845Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:d0c3e8579119de5198dfa1d01d589cf0eda89732390c25a95cd58fd417414062","observation_id":"f088568f-0dda-40dc-b9a6-a38ca9946bba","resolution":{"observed_at":"2026-08-09T18:26:56.251845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:57.775667Z","title":"Beyond reverse KL : Generalizing direct preference optimization with diverse divergence constraints","venue":null,"work_id":"88c1df2b-409f-426e-aaa9-659fb69ba178","year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.260103Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:171370bd39fdf3ac6f28fa7c50b2d9c2f492c6d55e237c926da59b897af93533","observation_id":"3dd24a00-f392-4c90-a37f-a66f048efb4d","resolution":{"observed_at":"2026-08-09T18:26:57.781716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02144","last_updated":"2023-09-05T11:32:48Z","snapshot_observed_at":"2026-07-06T16:14:26.899440Z","submitted_at":"2023-09-05T11:32:48Z","title":"Making Large Language Models Better Reasoners with Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02144","snapshot_observed_at":"2026-08-09T18:26:56.266635Z","title":"Making large language models better reasoners with alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.266635Z"},"links":{"cited_paper":"/paper/2309.02144","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:769647c50db2f51441045c3935e5f79c3fa3fd3dc875c48b105225204889e8f3","observation_id":"d3673c36-b155-43a3-a7ac-b846dc343f53","resolution":{"observed_at":"2026-08-09T18:26:56.266635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14768","last_updated":"2024-12-19T02:18:54Z","snapshot_observed_at":"2026-08-11T16:30:20.088753Z","submitted_at":"2024-05-23T16:35:52Z","title":"WISE: Rethinking the Knowledge Memory for Lifelong Model Editing of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14768","snapshot_observed_at":"2026-08-09T18:26:56.274579Z","title":"Wise: Rethinking the knowledge memory for lifelong model editing of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.274579Z"},"links":{"cited_paper":"/paper/2405.14768","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:d6a80a84caef7cca04b24ea347b54768fc8819d65db40865f41f0861ddcd6feb","observation_id":"dbdbd37d-a875-4f37-8fdf-149b2572d569","resolution":{"observed_at":"2026-08-09T18:26:56.274579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07269","last_updated":"2024-06-24T02:17:57Z","snapshot_observed_at":"2026-08-09T19:25:27.721643Z","submitted_at":"2023-08-14T16:52:42Z","title":"EasyEdit: An Easy-to-use Knowledge Editing Framework for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07269","snapshot_observed_at":"2026-08-09T18:26:56.284030Z","title":"Easyedit: An easy-to-use knowledge editing framework for large language models, 2024 c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.284030Z"},"links":{"cited_paper":"/paper/2308.07269","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:dea3680156b40ba91e55a517d1a30991b0fdf182a23bf7cddc58db760d28d3d8","observation_id":"b9d15102-87f5-49f6-8f4c-1e81953a15ec","resolution":{"observed_at":"2026-08-09T18:26:56.284030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16218","last_updated":"2024-09-19T20:25:40Z","snapshot_observed_at":"2026-08-09T19:25:29.348716Z","submitted_at":"2023-10-24T22:18:13Z","title":"Knowledge Editing for Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16218","snapshot_observed_at":"2026-08-09T18:26:56.291805Z","title":"Knowledge editing for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.291805Z"},"links":{"cited_paper":"/paper/2310.16218","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:80c1d4a5feb4d7bf955abfa87b7e5d76f459d9736105c6bc6ddd8b5747b883bd","observation_id":"b63fbf01-e451-4302-a1ec-6ce0cd311446","resolution":{"observed_at":"2026-08-09T18:26:56.291805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10471","last_updated":"2024-11-09T03:15:16Z","snapshot_observed_at":"2026-08-09T05:46:50.795612Z","submitted_at":"2024-01-19T03:48:27Z","title":"DeepEdit: Knowledge Editing as Decoding with Constraints","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10471","snapshot_observed_at":"2026-08-09T18:26:56.299568Z","title":"Deepedit: Knowledge editing as decoding with constraints","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.299568Z"},"links":{"cited_paper":"/paper/2401.10471","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:6be8e0424f38d74a7325c17a9abca6e5ea477f5faeac4e28be78973f818fc8f7","observation_id":"035aec74-33e3-4e82-a1e8-d60a72466475","resolution":{"observed_at":"2026-08-09T18:26:56.299568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.307652Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.307652Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:0d54bfec96090ffcb02b26aab7dea985ee138202427fd27e6f21c9b6a292f9e4","observation_id":"fc2dde73-c9f1-4776-ae94-ac73ede65bdb","resolution":{"observed_at":"2026-08-09T18:26:56.307652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13048","last_updated":"2024-02-20T14:36:23Z","snapshot_observed_at":"2026-07-06T17:32:52.500465Z","submitted_at":"2024-02-20T14:36:23Z","title":"Stable Knowledge Editing in Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.13048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13048","snapshot_observed_at":"2026-08-09T18:26:56.857312Z","title":"Stable Knowledge Editing in Large Language Models","venue":"cs.CL","work_id":"00d975e1-114f-4cdc-a3d8-f624a8074e8d","year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.317453Z"},"links":{"cited_paper":"/paper/2402.13048","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:1adda71904e84c34a7313ae52629471a1661b96477a633bbbac75748c58d5aff","observation_id":"1a4c97d8-9de6-4984-8dca-5f243266f245","resolution":{"observed_at":"2026-08-09T18:26:56.868753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09954","last_updated":"2025-07-24T11:16:48Z","snapshot_observed_at":"2026-08-01T01:37:02.582985Z","submitted_at":"2023-08-19T09:17:19Z","title":"DocTER: Evaluating Document-based Knowledge Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09954","snapshot_observed_at":"2026-08-09T18:26:56.324733Z","title":"Eva-kellm: A new benchmark for evaluating knowledge editing of llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.324733Z"},"links":{"cited_paper":"/paper/2308.09954","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:0347305f98da22acc433ad7bca2be49dd166907513670f27cc182301eff48e93","observation_id":"97747534-0bae-46b2-a44d-5a944e427d08","resolution":{"observed_at":"2026-08-09T18:26:56.324733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:57.733119Z","title":"On early stopping in gradient descent learning","venue":null,"work_id":"b8418177-1299-403e-9b6c-c1efac8e009c","year":2007},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.332073Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:6823d1ac8112d81cea38e5767f6b631f37dda879b198664ff60b731e86ab1485","observation_id":"3a4b1975-099b-403f-b3f6-dd201f5da4e3","resolution":{"observed_at":"2026-08-09T18:26:57.740740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13172","last_updated":"2023-11-30T08:55:24Z","snapshot_observed_at":"2026-07-06T15:30:45.921201Z","submitted_at":"2023-05-22T16:00:00Z","title":"Editing Large Language Models: Problems, Methods, and Opportunities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13172","snapshot_observed_at":"2026-08-09T18:26:56.340971Z","title":"Editing large language models: Problems, methods, and opportunities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.340971Z"},"links":{"cited_paper":"/paper/2305.13172","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:d5a0830630a5c9756a0212a24e996fe844ec8ba3883736a500d6ad0c0332ebca","observation_id":"8e49f47a-7002-4faf-a188-9d5c1d5acbde","resolution":{"observed_at":"2026-08-09T18:26:56.340971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:57.712675Z","title":"Melo: Enhancing model editing with neuron-indexed dynamic lora","venue":null,"work_id":"51aff4f8-1dc7-4d1b-b019-9367992e85c6","year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.347781Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:ecb4639df92d0ec968d5d6ccfd6627f8f5cc24c5cfc2a25ac50db208e31960e6","observation_id":"22b9ae43-f800-4f61-9592-6b9c930a038f","resolution":{"observed_at":"2026-08-09T18:26:57.719476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07819","last_updated":"2025-06-17T11:41:46Z","snapshot_observed_at":"2026-08-12T09:18:05.976654Z","submitted_at":"2024-10-10T11:09:00Z","title":"Uncovering Overfitting in Large Language Model Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07819","snapshot_observed_at":"2026-08-09T18:26:56.356054Z","title":"Uncovering overfitting in large language model editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.356054Z"},"links":{"cited_paper":"/paper/2410.07819","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:954857588e3220211083ca43522019edfdb3f450e829252ef5e50e457dbecc39","observation_id":"88f435bb-d08e-4a64-9aa3-4da4f8ea247b","resolution":{"observed_at":"2026-08-09T18:26:56.356054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16123","last_updated":"2024-04-28T12:03:38Z","snapshot_observed_at":"2026-08-04T18:14:55.109223Z","submitted_at":"2024-02-25T15:46:33Z","title":"InstructEdit: Instruction-based Knowledge Editing for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16123","snapshot_observed_at":"2026-08-09T18:26:56.362331Z","title":"Instructedit: Instruction-based knowledge editing for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.362331Z"},"links":{"cited_paper":"/paper/2402.16123","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:b0fdb0355dc5b7d1759bd834a834eb7ef1c67f59a1fe49a083d8ca78299e6a84","observation_id":"f0bb1929-c95e-4343-9de2-610b5fcc3995","resolution":{"observed_at":"2026-08-09T18:26:56.362331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01286","last_updated":"2024-11-17T06:50:44Z","snapshot_observed_at":"2026-08-09T19:25:28.585645Z","submitted_at":"2024-01-02T16:54:58Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01286","snapshot_observed_at":"2026-08-09T18:26:56.372616Z","title":"A comprehensive study of knowledge editing for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.372616Z"},"links":{"cited_paper":"/paper/2401.01286","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:2dd63e2624f5605599a06dc2465a3c4a6bd155f89c7d85595ab2f3c7fcc9c6fb","observation_id":"1fd3d8df-cf8b-4622-860b-5ea3e2833cb3","resolution":{"observed_at":"2026-08-09T18:26:56.372616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-09T18:26:56.384264Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.384264Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:dab94f222a57285355ded0bdddf4e1c8a5ffeae57ba4bf44e36368109ca3142d","observation_id":"964594c3-526f-4090-af0e-fb11b1b9a7f9","resolution":{"observed_at":"2026-08-09T18:26:56.384264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.406747Z","title":"Self-distillation as instance-specific label smoothing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.406747Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:61cacc49c7632f65c72f1c02a3653f6185ef357b7e3d9ee746bb5bf3e50647c4","observation_id":"c4bba2d9-b4be-4a33-b465-fed4a0a72dae","resolution":{"observed_at":"2026-08-09T18:26:56.406747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12740","last_updated":"2023-05-22T06:07:58Z","snapshot_observed_at":"2026-08-06T23:54:34.424656Z","submitted_at":"2023-05-22T06:07:58Z","title":"Can We Edit Factual Knowledge by In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12740","snapshot_observed_at":"2026-08-09T18:26:56.413597Z","title":"Can we edit factual knowledge by in-context learning? arXiv preprint arXiv:2305.12740, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.413597Z"},"links":{"cited_paper":"/paper/2305.12740","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:dbccadd114331f1a6629cc99671d05f4c1adaaa0acb7dd9fe0ff2205dbb22ec3","observation_id":"1055e602-e0a2-4bf2-8cfc-7c7be6c127af","resolution":{"observed_at":"2026-08-09T18:26:56.413597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14795","last_updated":"2024-09-09T04:38:16Z","snapshot_observed_at":"2026-08-09T19:28:56.615305Z","submitted_at":"2023-05-24T06:48:41Z","title":"MQuAKE: Assessing Knowledge Editing in Language Models via Multi-Hop Questions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14795","snapshot_observed_at":"2026-08-09T18:26:56.424341Z","title":"Mquake: Assessing knowledge editing in language models via multi-hop questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.424341Z"},"links":{"cited_paper":"/paper/2305.14795","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:e00eeaee51b3eed27d6318cdb96f45722303f7278ec69a015ee598a096955d0a","observation_id":"162c339c-90f4-4f6c-ac81-d3c296bdec1c","resolution":{"observed_at":"2026-08-09T18:26:56.424341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09419","last_updated":"2023-05-01T07:48:05Z","snapshot_observed_at":"2026-08-07T09:28:58.130002Z","submitted_at":"2023-02-18T20:51:09Z","title":"A Comprehensive Survey on Pretrained Foundation Models: A History from BERT to ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09419","snapshot_observed_at":"2026-08-09T18:26:56.431156Z","title":"A comprehensive survey on pretrained foundation models: A history from bert to chatgpt","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.431156Z"},"links":{"cited_paper":"/paper/2302.09419","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:a0b22824b4752f0d617f40197ac004640ed12ab8b45e10014e1e31519dabea32","observation_id":"5ed2808a-0148-4403-8ec7-d1902e08bdad","resolution":{"observed_at":"2026-08-09T18:26:56.431156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.00363","last_updated":"2020-12-01T09:39:13Z","snapshot_observed_at":"2026-08-10T15:59:10.397359Z","submitted_at":"2020-12-01T09:39:13Z","title":"Modifying Memories in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.00363","snapshot_observed_at":"2026-08-09T18:26:56.438382Z","title":"Modifying memories in transformer models","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.438382Z"},"links":{"cited_paper":"/paper/2012.00363","citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:b385c389e9267026550a787b1a4b959e524105d9504fdf69c39493a27d55af65","observation_id":"dd1a85f2-4549-4dce-a928-a0a64c61519f","resolution":{"observed_at":"2026-08-09T18:26:56.438382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:26:56.446574Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T18:26:56.446574Z"},"links":{"citing_paper":"/paper/2502.00602"},"observation_digest":"sha256:130cd49606c2572c3063cd03db08ee33aa3e46cc146bc2a6b698f50b1f660bea","observation_id":"2a16fbfe-5d10-4b3e-a65e-4f9785d50112","resolution":{"observed_at":"2026-08-09T18:26:56.446574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00602","last_updated":"2025-05-28T04:42:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T19:26:58.196687Z","submitted_at":"2025-02-02T00:10:51Z","title":"Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":3,"verified_fuzzy":8},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 1 inbound Pith citation observation for arXiv:2502.00602."}