{"as_of":"2026-08-11T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75b4d7eed9f24e9ed28ac619c34fc997768fedc57f9e22aca77ef391c756fb4f","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:13:49.492144Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:24:12.109846Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:39:42.275515Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-08-07T00:40:37.672276Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13045","last_updated":"2025-08-24T10:01:04Z","snapshot_observed_at":"2026-08-08T06:33:39.031465Z","submitted_at":"2025-06-16T02:27:25Z","title":"Continual Learning for Generative AI: From LLMs to MLLMs and Beyond","version":4},"reference_index":261,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:37.672276Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2506.13045"},"observation_digest":"sha256:1d6b6447865e364263ebe6e56eeaca4e963807567c40be0259fef72d2ce52dc7","observation_id":"0803615a-1aae-4fe1-b08d-45305d3eca7d","resolution":{"observed_at":"2026-08-07T00:40:37.672276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":"2501.13453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-04T08:39:42.275515Z","title":"arXiv preprint arXiv:2501.13453 (2025)","venue":null,"work_id":"874160b9-44d1-4305-bbe4-9518d9777d0f","year":2025},"citing_paper":{"arxiv_id":"2508.18187","last_updated":"2026-04-13T21:17:05Z","snapshot_observed_at":"2026-07-06T22:18:21.877811Z","submitted_at":"2025-08-25T16:44:43Z","title":"BRAIN: Bias-Mitigation Continual Learning Approach to Vision-Brain Understanding","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-18T21:13:41.362773Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2508.18187"},"observation_digest":"sha256:43cd5f1e7184095a4b3da7cbc976a8ec0240a0fa364249da6707af89687ce4c0","observation_id":"621d67fa-9563-46c4-9c5a-8acfd75bf496","resolution":{"observed_at":"2026-05-18T21:16:51.280862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-08-05T14:03:42.556978Z","title":"Spurious forgetting in continual learning of language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21767","last_updated":"2025-08-29T16:40:57Z","snapshot_observed_at":"2026-08-06T03:24:39.373354Z","submitted_at":"2025-08-29T16:40:57Z","title":"UItron: Foundational GUI Agent with Advanced Perception and Planning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T14:03:42.556978Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2508.21767"},"observation_digest":"sha256:b6a571ffa6f85f254be686e061e257beb8ac0ec94fc825040f9628bde80a81b4","observation_id":"02ac1d36-1fd9-4d7d-b985-926a985ef2f2","resolution":{"observed_at":"2026-08-05T14:03:42.556978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":"2501.13453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-04T08:39:42.275515Z","title":"arXiv preprint arXiv:2501.13453 (2025)","venue":null,"work_id":"874160b9-44d1-4305-bbe4-9518d9777d0f","year":2025},"citing_paper":{"arxiv_id":"2604.17215","last_updated":"2026-04-19T02:52:33Z","snapshot_observed_at":"2026-08-07T13:05:16.901779Z","submitted_at":"2026-04-19T02:52:33Z","title":"Continual Safety Alignment via Gradient-Based Sample Selection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:53.472918Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2604.17215"},"observation_digest":"sha256:fe293c43940a44bf3b5e089d0791cbc8702d5af01cda52188312e6b7cb19aeef","observation_id":"b54430d0-4d87-4f9d-b876-5b196e25b384","resolution":{"observed_at":"2026-05-10T07:16:54.730744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":"2501.13453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-04T08:39:42.275515Z","title":"arXiv preprint arXiv:2501.13453 (2025)","venue":null,"work_id":"874160b9-44d1-4305-bbe4-9518d9777d0f","year":2025},"citing_paper":{"arxiv_id":"2605.05285","last_updated":"2026-07-13T13:01:55Z","snapshot_observed_at":"2026-08-07T19:39:52.311778Z","submitted_at":"2026-05-06T17:38:13Z","title":"Attribution-Guided Continual Learning for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T16:31:15.098964Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2605.05285"},"observation_digest":"sha256:0326cc8f7a84782c98c7282ecb53c41107e2559334838c72e4a06e878bb1421f","observation_id":"24111cad-c311-412c-8609-c92607db8f99","resolution":{"observed_at":"2026-05-11T18:11:05.472178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-14T19:12:02.449224Z","title":"Spurious forgetting in continual learning of language models.arXiv preprint arXiv:2501.13453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.05285","last_updated":"2026-07-13T13:01:55Z","snapshot_observed_at":"2026-08-07T19:39:52.311778Z","submitted_at":"2026-05-06T17:38:13Z","title":"Attribution-Guided Continual Learning for Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T19:12:02.449224Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2605.05285"},"observation_digest":"sha256:d4d0079d8a6590c9a12816795c748cf9dc71125023c2bda674593f38a5fd2550","observation_id":"c8d3da86-7f3e-43b1-8344-1713cf88cae6","resolution":{"observed_at":"2026-07-14T19:12:02.449224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":"2501.13453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-04T08:39:42.275515Z","title":"arXiv preprint arXiv:2501.13453 (2025)","venue":null,"work_id":"874160b9-44d1-4305-bbe4-9518d9777d0f","year":2025},"citing_paper":{"arxiv_id":"2606.05513","last_updated":"2026-06-03T23:40:30Z","snapshot_observed_at":"2026-07-06T23:45:28.379468Z","submitted_at":"2026-06-03T23:40:30Z","title":"EpiEvolve: Self-Evolving Agents for Streaming Pandemic Forecasting under Regime Shifts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T05:40:18.458584Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2606.05513"},"observation_digest":"sha256:34fa087af32bc747b83de74fa0a9af6f5fd5f4ed0fbe715f0399e74628929fcb","observation_id":"51f7e64b-8434-45f9-a077-e08c5a159881","resolution":{"observed_at":"2026-07-02T09:06:49.153906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":"2501.13453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-07-04T08:39:42.275515Z","title":"arXiv preprint arXiv:2501.13453 (2025)","venue":null,"work_id":"874160b9-44d1-4305-bbe4-9518d9777d0f","year":2025},"citing_paper":{"arxiv_id":"2606.22317","last_updated":"2026-06-21T03:15:25Z","snapshot_observed_at":"2026-08-07T02:35:30.805654Z","submitted_at":"2026-06-21T03:15:25Z","title":"Curriculum Reinforcement Learning Can Incentivize Reasoning Capacity in LLMs Beyond the Base Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T11:10:56.755558Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2606.22317"},"observation_digest":"sha256:b960588a4b811ec89f279dffa5762be31f3a7351fbe4f71e042197f11c343afe","observation_id":"9f250876-a5da-45b9-91d1-02e9001bbc6d","resolution":{"observed_at":"2026-07-04T08:39:42.278601Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-08-01T22:58:01.028788Z","title":"19 Preprint","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15587","last_updated":"2026-07-17T03:18:17Z","snapshot_observed_at":"2026-08-09T17:50:56.609811Z","submitted_at":"2026-07-17T03:18:17Z","title":"Rethinking Transfer in Continual Learning: A Replay-Based Realisation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T22:58:01.028788Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2607.15587"},"observation_digest":"sha256:1ac0b2ad4cda3414469bc4c7f88df5b6ec480d484b76fd2ea53531f7c427ee5a","observation_id":"a3ca1545-4829-455c-b628-25c14e42c338","resolution":{"observed_at":"2026-08-01T22:58:01.028788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-08-03T16:13:24.960751Z","title":"Spurious forgetting in continual learning of language models.arXiv preprint arXiv:2501.13453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28979","last_updated":"2026-07-31T03:07:31Z","snapshot_observed_at":"2026-08-09T14:22:35.517143Z","submitted_at":"2026-07-31T03:07:31Z","title":"Mixture-of-Translators: Translating KV Caches Across Heterogeneous Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:13:24.960751Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2607.28979"},"observation_digest":"sha256:2b09ebe807a0aa6f53b67514aaf3da7650e6dba4375cf03490754ca7ec5cadc8","observation_id":"49b2ef81-e460-4c67-8259-d8bf0f037826","resolution":{"observed_at":"2026-08-03T16:13:24.960751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13453","snapshot_observed_at":"2026-08-07T12:24:12.109846Z","title":"Spurious forgetting in continual learning of language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06216","last_updated":"2026-08-06T16:07:26Z","snapshot_observed_at":"2026-08-09T23:13:07.679087Z","submitted_at":"2026-08-06T16:07:26Z","title":"Continual Learning in Transition","version":1},"reference_index":172,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.109846Z"},"links":{"cited_paper":"/paper/2501.13453","citing_paper":"/paper/2608.06216"},"observation_digest":"sha256:3af568650aa5d22e7353184f465e445ca1914eed66820e5fb18d338635d43cbc","observation_id":"d813f63c-9826-4f18-a47e-2cddb17b919b","resolution":{"observed_at":"2026-08-07T12:24:12.109846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13453/citation-record","integrity":"/paper/2501.13453/integrity","json":"/paper/2501.13453/citation-record.json","paper":"/paper/2501.13453"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.199906Z","title":"Transformers learn through gradual rank increase","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.199906Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:9b35f1e31b89ac393c4bac8eb21d6fe55d72c2f105f182b30fff0b96c74cf0f6","observation_id":"8531e4ca-aa94-4253-a03e-e6483653e6e3","resolution":{"observed_at":"2026-08-10T16:13:49.199906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.204988Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.204988Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:e96742a0d255253ddfbce9150d42a4146e78aafbd46d96c939a0b622b1d138cd","observation_id":"070163e8-2804-4e76-b0e5-aae654ebafb4","resolution":{"observed_at":"2026-08-10T16:13:49.204988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-10T16:01:01.114216Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-10T16:13:49.209022Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.209022Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:3324077af4f805ced3d7c3cdccd8f3f05a6ca91745de60c8568d24b869b81b81","observation_id":"245c08e6-fbb3-4d73-9e21-b234e462dfbb","resolution":{"observed_at":"2026-08-10T16:13:49.209022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.427704Z","title":"Introduction to matrix analysis","venue":null,"work_id":"1237773f-0292-4489-8ebe-f931ca1ffb8f","year":1997},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.213730Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:7707c083ce9bcd7a2ffe00f369bac141743bdcb8f34dbebde49d1cfd6f5e61c8","observation_id":"a09484c1-608a-4489-867f-5de771f3b450","resolution":{"observed_at":"2026-08-10T16:13:50.432147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-10T16:13:49.217728Z","title":"Lora learns less and forgets less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.217728Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:35627ec1901ec8ddad3090c6271af6d21a54bdc4691dabdc0cf24fd0776acb74","observation_id":"09af653f-d803-448a-becc-ad67b65294ee","resolution":{"observed_at":"2026-08-10T16:13:49.217728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.222185Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.222185Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:d2c786e4ef8ddc7cf3eed4b99b35811da1af21a323084f38a508e5667b7f3971","observation_id":"e7bb6762-06fc-41e6-b07e-351e442df6bf","resolution":{"observed_at":"2026-08-10T16:13:49.222185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.406441Z","title":"Emergent and predictable memorization in large language models","venue":null,"work_id":"4cf438cb-4741-4931-b443-f4565cfa1de4","year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.226378Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:30159607e81daf7a7f9add50559f5b0f35e6326b50d29a206b2097379d0226f8","observation_id":"0a2694ae-099f-4e65-9fd6-386d801c3a0b","resolution":{"observed_at":"2026-08-10T16:13:50.410434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.230163Z","title":"Gpt-neox-20b: An open-source autoregressive language model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.230163Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:13f304e4fb21510c3d6188842cf52adca13fd87282931d8603c8f4382275d71e","observation_id":"a09339cf-ae7f-4a9c-bc85-8eb6d720eb00","resolution":{"observed_at":"2026-08-10T16:13:49.230163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.384095Z","title":"Transformers learn through gradual rank increase","venue":null,"work_id":"9e4af38a-efad-45c3-b936-cf6560c0d20a","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.234318Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:1daaf64b804d8e2e252c70cfec2ff32923b9f1e5cd69b587f287ef2b3e298a76","observation_id":"9cd4ddad-53b8-4ba1-837e-0c93171d8e5f","resolution":{"observed_at":"2026-08-10T16:13:50.389147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.238386Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.238386Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:df34eb20be4749f252a476f1d790e44ca5c67520c0f2a428f9c6ebd8b42c1009","observation_id":"1783dfb3-9eca-410f-9289-831ea545ed18","resolution":{"observed_at":"2026-08-10T16:13:49.238386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.242613Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.242613Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:1049f4887416ef33f71ffe378281a18198a9dd91aaec272bb669a455a70b2fed","observation_id":"8ffd564e-b801-43d6-81fe-6fb31f33c132","resolution":{"observed_at":"2026-08-10T16:13:49.242613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.349877Z","title":"Is forgetting less a good inductive bias for forward transfer? In The Eleventh International Conference on Learning Representations, 2023","venue":null,"work_id":"c6dbb03d-2779-42af-9dc5-42ebd579f5de","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.246826Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:fb00586675f37be7f5ec4c06ed669a4efe8cdddca65844a293705dc28a6e394b","observation_id":"f8fc59c0-2f78-458c-92a4-8ea79a34464a","resolution":{"observed_at":"2026-08-10T16:13:50.355315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.251025Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.251025Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:5ff97f5245b26ea28f87ebde010300cde67c8f771b7cbd20e277e75d611cc454","observation_id":"58092db6-8f75-436b-b020-99277a9ca42d","resolution":{"observed_at":"2026-08-10T16:13:49.251025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.254830Z","title":"Mofo: Momentum-filtered optimizer for mitigating forgetting in llm fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.254830Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:aeb6a516f91a9551dc72144041f1c48fc0d8e20850864a019cad59d092de5b6b","observation_id":"dac4994f-230f-40f2-9d9d-817aff8dfad1","resolution":{"observed_at":"2026-08-10T16:13:49.254830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-10T16:13:49.258541Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.258541Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:100993284a9459b5719670c531fcd64c22d4c479160d9e1335f4ce8884935c9c","observation_id":"f4cbfe3c-0dc0-4800-a70b-59e63adeead5","resolution":{"observed_at":"2026-08-10T16:13:49.258541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T16:13:49.262568Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.262568Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:69be231bca568bc9593ac5c31c236186b6532f0c153586e88c02a726c13e85d7","observation_id":"f59f8cee-27f5-4b06-85a5-80c69eca692c","resolution":{"observed_at":"2026-08-10T16:13:49.262568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.267158Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.267158Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:5753f675030e15a36dc4a208eea9168e8a0ba2d0852c61d9e74363e49fe2fe68","observation_id":"5ab2ab0b-3211-4cdf-b8dd-c26c1722314a","resolution":{"observed_at":"2026-08-10T16:13:49.267158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.320434Z","title":"Probing representation forgetting in supervised and unsupervised continual learning","venue":null,"work_id":"b343bad2-67e0-4fe4-8fed-c409608940c3","year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.272745Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:450091bfb62950ae8d7071ba03875f6ec91b0084a494b7a43f322c7311b550aa","observation_id":"96053e55-9cbd-495c-86e6-85ea1da85767","resolution":{"observed_at":"2026-08-10T16:13:50.326339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.276811Z","title":"The rotation of eigenvectors by a perturbation","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.276811Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:a0d561f6752a7635648786ad4142efd8043a561b2453e1468ededaa719c6fe9a","observation_id":"553a1612-2aac-46c5-8180-40dc3eb30e55","resolution":{"observed_at":"2026-08-10T16:13:49.276811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08164","last_updated":"2021-09-08T20:44:44Z","snapshot_observed_at":"2026-08-07T07:18:37.623241Z","submitted_at":"2021-04-16T15:24:42Z","title":"Editing Factual Knowledge in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08164","snapshot_observed_at":"2026-08-10T16:13:49.280301Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.280301Z"},"links":{"cited_paper":"/paper/2104.08164","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:82d2d74aa43579d67d5647360affffd7eca83405acc3ee7417b2df3d2c6080d5","observation_id":"198f5425-2b24-4578-8628-fff1b1059b44","resolution":{"observed_at":"2026-08-10T16:13:49.280301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.294273Z","title":"Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin","venue":null,"work_id":"82b3bb8e-531e-44e0-96ff-6162ce6ee7e8","year":1932},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.284366Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:de1f87f23de97598a2fadd0606b7d29d1fdcd06401a83a613e403907a5880eda","observation_id":"0aa4bc49-27c4-482d-8d9e-35489163322e","resolution":{"observed_at":"2026-08-10T16:13:50.299974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.288087Z","title":"Catastrophic forgetting in connectionist networks","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.288087Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:3cfa43a54de625cb1a45853ca09808b4255e998d20eb1ae6d71218e8e48df40f","observation_id":"611a56f5-50dc-46d0-a33a-b2431184b3e7","resolution":{"observed_at":"2026-08-10T16:13:49.288087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.291577Z","title":"Aging with grace: Lifelong model editing with discrete key-value adaptors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.291577Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:51d2f6b8fa5709fd1d4911d03722f8a0355a0f7d1c4f5f9ce7944d05c04f6fc0","observation_id":"d3443724-c806-4cf6-9759-693b3e33eae6","resolution":{"observed_at":"2026-08-10T16:13:49.291577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.295026Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.295026Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:48af9c555a4978749203529884032ebca6a559ef11d17e6fc0ec67d1bd183404","observation_id":"23efc310-0137-4dad-b936-546c07b33633","resolution":{"observed_at":"2026-08-10T16:13:49.295026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.243627Z","title":"Editing models with task arithmetic","venue":null,"work_id":"727beb90-1765-4ab9-8aa1-1099c486125e","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.298575Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:f355f4054d07a323767d436d9869c231e4c97415f2432430be745418edbba1cf","observation_id":"5a17543f-5757-4eb0-a266-434d1bae6a73","resolution":{"observed_at":"2026-08-10T16:13:50.249400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-10T16:13:49.302508Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.302508Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:e9270230f59ce3d229131f379b7e351fc5eef94640c710294cbeec21135e6cc2","observation_id":"752c4c42-4997-4244-b558-093f64d4f9af","resolution":{"observed_at":"2026-08-10T16:13:49.302508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-10T16:13:49.306638Z","title":"triviaqa: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.306638Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:46e954176f33d65272300ee3bcc7747b3e8e28852ab089f2eea0faa8db0c325a","observation_id":"e20839b8-b8cb-4514-9fb7-d01a80b4ce87","resolution":{"observed_at":"2026-08-10T16:13:49.306638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.310529Z","title":"Overcoming catastrophic forgetting in neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.310529Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:c74ed008a89a563190a055f4f91e8f9f275fe3916abf23f44d33223cc900b19d","observation_id":"faf41daa-caa6-45a3-b668-9641cd51adad","resolution":{"observed_at":"2026-08-10T16:13:49.310529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.216583Z","title":"A theoretical understanding of shallow vision transformers: Learning, generalization, and sample complexity","venue":null,"work_id":"91ffd527-f7c6-46fd-924b-076c68670d2d","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.314272Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:cf59c87209f925364bf140f775410e2926d2f1049c4c7e7ca6e8bf71ae0c2b38","observation_id":"55f1ffd9-748b-4c2e-ae76-231ead23b767","resolution":{"observed_at":"2026-08-10T16:13:50.221689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.202361Z","title":"Pmet: Precise model editing in a transformer","venue":null,"work_id":"f6c4d220-6abb-48bc-8fb3-5c5433506091","year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.317973Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:3731d7b3cdbe880f378aa6d6e7555d7b37b8f378292ec14d391699344810543c","observation_id":"1e185766-3c08-4b06-92f1-bb68b19a8b4a","resolution":{"observed_at":"2026-08-10T16:13:50.206958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16559","last_updated":"2023-05-26T00:57:43Z","snapshot_observed_at":"2026-07-06T15:33:42.279377Z","submitted_at":"2023-05-26T00:57:43Z","title":"Teamwork Is Not Always Good: An Empirical Study of Classifier Drift in Class-incremental Information Extraction","version":1},"cited_work":{"arxiv_id":"2305.16559","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16559","snapshot_observed_at":"2026-08-10T16:13:49.750705Z","title":"Teamwork Is Not Always Good: An Empirical Study of Classifier Drift in Class-incremental Information Extraction","venue":"cs.CL","work_id":"87a58345-26b8-49d0-870e-e129e72fd999","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.321665Z"},"links":{"cited_paper":"/paper/2305.16559","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:3e1dd71a013e18cfe53a5477d5ad8507b11e9b0db4235356148fcd7421887ca9","observation_id":"8df469ef-25b7-4c8a-a0bb-d7df3f7605bd","resolution":{"observed_at":"2026-08-10T16:13:49.755510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T16:13:49.325504Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.325504Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:1449bbf05d69ea9d0669d7c301570731cc22c8c21fc401658cb4b07449f3a77d","observation_id":"986f9864-2e6f-419c-87ed-cf0e5e4f28b2","resolution":{"observed_at":"2026-08-10T16:13:49.325504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.329205Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.329205Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:4108d1407b36b97ff82d7d16060665eea238ccffd5488f714eccfabe2e6538cb","observation_id":"38c118b4-088a-4d41-a427-4ad08fa76991","resolution":{"observed_at":"2026-08-10T16:13:49.329205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-07-06T14:04:55.099373Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-10T16:13:49.333208Z","title":"Mass-editing memory in a transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.333208Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:ec04bb9bf0d6b4aed9026131ace50f0a32e2979badd466d9dcec05b93927ed61","observation_id":"1917ce0b-c76c-473c-85fb-2ae94145f9a2","resolution":{"observed_at":"2026-08-10T16:13:49.333208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11309","last_updated":"2022-06-13T23:26:16Z","snapshot_observed_at":"2026-08-03T23:42:31.942314Z","submitted_at":"2021-10-21T17:41:56Z","title":"Fast Model Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11309","snapshot_observed_at":"2026-08-10T16:13:49.336896Z","title":"Fast model editing at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.336896Z"},"links":{"cited_paper":"/paper/2110.11309","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:0514a6d5443ccdbdf0fbc5d7bf84be9fe6a624990d704a91d4ae3d44189a6d96","observation_id":"bc5ac63b-d3bf-4a31-a575-bdf06d40f7a0","resolution":{"observed_at":"2026-08-10T16:13:49.336896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.177478Z","title":"Memory-based model editing at scale","venue":null,"work_id":"8e75bc3a-7ff5-42c7-a722-576473cbf9f7","year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.340511Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:8a19e90b2505e301f8491fbeeee33ec69a46211b7f3ed10d20cab06cb20c1aab","observation_id":"acb33ac7-f1d6-4d4a-b18a-c6bda3600dd5","resolution":{"observed_at":"2026-08-10T16:13:50.182974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.164062Z","title":"Transformers without tears: Improving the normalization of self-attention","venue":null,"work_id":"127576f4-6387-43a0-83b2-82f6af2f59b7","year":2019},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.344836Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:927d71dd3983b4824f88d828c33d6d94455be4dda1e7c1b270d30739ac82481e","observation_id":"d9f87b0d-3b8e-4b6d-bd0a-c1f209bb8924","resolution":{"observed_at":"2026-08-10T16:13:50.168497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.148691Z","title":"Hello gpt-4o","venue":null,"work_id":"7c8da1d7-dfca-43b2-8cf0-80bba3bc669f","year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.348302Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:48cba6215472bed68b02028c6b06dd59eb1cc7c7179e9cad1b0ffd2029382429","observation_id":"9ca1ee20-7e30-4592-8783-9ae82d6f5fac","resolution":{"observed_at":"2026-08-10T16:13:50.153901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07470","last_updated":"2024-04-11T04:22:15Z","snapshot_observed_at":"2026-08-10T23:06:21.351269Z","submitted_at":"2024-04-11T04:22:15Z","title":"Scalable Language Model with Generalized Continual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07470","snapshot_observed_at":"2026-08-10T16:13:49.351990Z","title":"Scalable language model with generalized continual learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.351990Z"},"links":{"cited_paper":"/paper/2404.07470","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:8ae0898a4ee877a60e990f5771ffe22f24705d8356afe9e85d9aaea17984557f","observation_id":"36dbee31-026c-4721-93de-0abc695c24d9","resolution":{"observed_at":"2026-08-10T16:13:49.351990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.355872Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! In The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.355872Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:ae6d26d5ea4b841e850b138e31d1c8ae2d894fe3d044d9211d63f562d1bbaa82","observation_id":"02a701e0-355a-4389-a046-376c30f3911d","resolution":{"observed_at":"2026-08-10T16:13:49.355872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.360105Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.360105Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:b2412657ce1b1672613f7e6e35320af4eaee301792889a8ba39df7a436f58c81","observation_id":"81298a5d-f42e-4d98-b058-df6baad2230c","resolution":{"observed_at":"2026-08-10T16:13:49.360105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.364070Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.364070Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:d146877bd1ef786707061145a876e945747814fa4be15e46ceccdb679a9aadd0","observation_id":"84744448-0a0e-4d8c-8534-7c210bc5416b","resolution":{"observed_at":"2026-08-10T16:13:49.364070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12314","last_updated":"2023-01-29T00:17:38Z","snapshot_observed_at":"2026-08-06T00:54:52.034031Z","submitted_at":"2023-01-29T00:17:38Z","title":"Progressive Prompts: Continual Learning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12314","snapshot_observed_at":"2026-08-10T16:13:49.368351Z","title":"Progressive prompts: Continual learning for language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.368351Z"},"links":{"cited_paper":"/paper/2301.12314","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:c94bae4e5cac1b1386463dc85d5e03edc0576fbbe63951a1d2752f456a158079","observation_id":"f3ceb6f7-95ec-4076-9255-0990cd13550e","resolution":{"observed_at":"2026-08-10T16:13:49.368351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18865","last_updated":"2024-02-29T05:27:45Z","snapshot_observed_at":"2026-08-04T00:58:13.854277Z","submitted_at":"2024-02-29T05:27:45Z","title":"Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18865","snapshot_observed_at":"2026-08-10T16:13:49.372204Z","title":"Analyzing and reducing catastrophic forgetting in parameter efficient tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.372204Z"},"links":{"cited_paper":"/paper/2402.18865","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:9a8d86963dc9c42ddc38414c2ca6d8634dca4e06f0d4054245008d91255897e3","observation_id":"1b467f89-c219-4704-b2d3-417350548577","resolution":{"observed_at":"2026-08-10T16:13:49.372204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.107420Z","title":"Gradient projection memory for continual learning","venue":null,"work_id":"31d04151-9b15-4b05-8131-50a7e34dee04","year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.377314Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:6e621f2064b7859ac223b967ba3a8394e16863e2dc6ea342cb650d7269d35061","observation_id":"522a1fa1-2164-41b4-b616-721df24333e8","resolution":{"observed_at":"2026-08-10T16:13:50.111622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01557","last_updated":"2019-04-02T17:26:41Z","snapshot_observed_at":"2026-08-08T18:47:15.884862Z","submitted_at":"2019-04-02T17:26:41Z","title":"Analysing Mathematical Reasoning Abilities of Neural Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01557","snapshot_observed_at":"2026-08-10T16:13:49.381526Z","title":"Analysing mathematical reasoning abilities of neural models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.381526Z"},"links":{"cited_paper":"/paper/1904.01557","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:a41494b5e28a5ad570080a168022960d474c43aff012534f55d6940b0e0e5d57","observation_id":"c29d2b97-dc66-4069-bd49-7150d5b3e7e3","resolution":{"observed_at":"2026-08-10T16:13:49.381526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.091531Z","title":"Coda-prompt: Continual decomposed attention-based prompting for rehearsal-free continual learning","venue":null,"work_id":"fbd44384-df62-4e08-9249-b09bb5e6d29a","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.385604Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:568cd851dcb0fbc381b09b25a273ec82ba59dfb3a9fac0fa6e038c031cc3493c","observation_id":"6c96f383-2544-421c-b622-c3144143acbe","resolution":{"observed_at":"2026-08-10T16:13:50.098469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.077728Z","title":"Lamol: Language modeling for lifelong language learning","venue":null,"work_id":"f6037d9d-093f-4661-89cd-6d90b202120f","year":2020},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.389420Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:c6686c98eaf3c0b72ad2b9a5a42a4d9041616b7c50d0c1683e582118bd86c4e3","observation_id":"4f2745dd-be10-4c4b-bc44-00459c31575d","resolution":{"observed_at":"2026-08-10T16:13:50.082510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-10T16:13:49.393292Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.393292Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:333d03bda0e7af3fe302a08bacd06ab45285c522d59b9b1d3584f693adf580d5","observation_id":"89aae155-c70d-49c6-a29d-b73f2fcc3f50","resolution":{"observed_at":"2026-08-10T16:13:49.393292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.065149Z","title":"Can bert refrain from forgetting on sequential tasks? a probing study","venue":null,"work_id":"76b1c27c-e01a-4aac-b095-f75099f4f000","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.397709Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:339cb5e03a82af5f152494457cddfc7a5e83ce42b918763132917962bc0ebdc8","observation_id":"34ced315-cedd-475a-a257-afec87d5fe32","resolution":{"observed_at":"2026-08-10T16:13:50.069490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.401444Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.401444Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:f1e755a4ac6463cecbe0ca93e7e78b1fb6319f834f156e39708e82c87634820f","observation_id":"91525e3c-7457-4b64-84ee-bac7c3000a90","resolution":{"observed_at":"2026-08-10T16:13:49.401444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.404974Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.404974Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:965662aaed12aead9873f6e9e4388ed22a98490ecf9c41adec23037a2e22d8d3","observation_id":"f5cdb08b-ff69-485c-9052-fd98b621e6cc","resolution":{"observed_at":"2026-08-10T16:13:49.404974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T16:13:49.408484Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.408484Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:4204f60bc93eff65dceb434e4bc8fdcf3f52c237c3f7f72f120e5a454d9fc503","observation_id":"8e171550-f7c9-493f-b512-c8591629df86","resolution":{"observed_at":"2026-08-10T16:13:49.408484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.030722Z","title":"Mesh-transformer-jax: Model-parallel implementation of transformer language model with jax, 2021","venue":null,"work_id":"6c01d44d-2d50-4781-952a-a175b8517c36","year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.412193Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:7cef7cd87e34c41058b33317ee819ea84dfae2b4fccd57b51431cd6667bdf5b9","observation_id":"b5cef756-7401-4abf-ace4-706b61607be0","resolution":{"observed_at":"2026-08-10T16:13:50.035906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07269","last_updated":"2024-06-24T02:17:57Z","snapshot_observed_at":"2026-08-09T19:25:27.721643Z","submitted_at":"2023-08-14T16:52:42Z","title":"EasyEdit: An Easy-to-use Knowledge Editing Framework for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07269","snapshot_observed_at":"2026-08-10T16:13:49.415709Z","title":"Easyedit: An easy-to-use knowledge editing framework for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.415709Z"},"links":{"cited_paper":"/paper/2308.07269","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:dba06c1fdbb8b8d805675ce33e5b930ca81e7f203e1f0b8acf31d3cb0dd4272a","observation_id":"e5b2228d-e737-4534-9f50-cb56e905ca89","resolution":{"observed_at":"2026-08-10T16:13:49.415709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06762","last_updated":"2023-10-10T16:38:49Z","snapshot_observed_at":"2026-08-06T11:45:24.039210Z","submitted_at":"2023-10-10T16:38:49Z","title":"TRACE: A Comprehensive Benchmark for Continual Learning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06762","snapshot_observed_at":"2026-08-10T16:13:49.419588Z","title":"Trace: A comprehensive benchmark for continual learning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.419588Z"},"links":{"cited_paper":"/paper/2310.06762","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:25d2656625e34b6a0fc4a05608f8cb0d30fc781cc03d0c70fb5dca48ffd5f40d","observation_id":"b368dd9b-2331-4866-a4f0-247f41abfce2","resolution":{"observed_at":"2026-08-10T16:13:49.419588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:50.017286Z","title":"Learning to prompt for continual learning","venue":null,"work_id":"2b38e06a-a2d2-474b-8d69-10915f102831","year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.423678Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:abbd6f5673d647f3349e7c34a76943a9953b0275b2efa7b311a60a30b97453bd","observation_id":"31a88124-4add-4462-9bfd-8b971e429d85","resolution":{"observed_at":"2026-08-10T16:13:50.021921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.427970Z","title":"Magicoder: Empowering code generation with oss-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.427970Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:734bb807d94b7f148f0b320f2d7b453a7287ac6530fd594f805022dbfac01a92","observation_id":"18431be1-9ecd-42c9-b04d-65304a402583","resolution":{"observed_at":"2026-08-10T16:13:49.427970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02415","last_updated":"2024-05-30T04:45:34Z","snapshot_observed_at":"2026-08-08T22:37:20.916283Z","submitted_at":"2024-01-04T18:59:12Z","title":"LLaMA Pro: Progressive LLaMA with Block Expansion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02415","snapshot_observed_at":"2026-08-10T16:13:49.431912Z","title":"Llama pro: Progressive llama with block expansion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.431912Z"},"links":{"cited_paper":"/paper/2401.02415","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:cfe86eef85a265070ee8f1d53b5d433e71d4d48db71a479b00b90bd9e216f1f5","observation_id":"10c9a90f-1c1e-44cf-b952-6febaee3e5f6","resolution":{"observed_at":"2026-08-10T16:13:49.431912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.994835Z","title":"Pretrained language model in continual learning: A comparative study","venue":null,"work_id":"abda3b08-f35b-4f4f-bbfc-e5f3c1c0c35a","year":2021},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.435755Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:349cde0bb555f89e3ea0953b0f3f90bda557cbe7a84c6440b096e55015e8d709","observation_id":"5b44996a-4e49-4c33-b8aa-8d3894977c7c","resolution":{"observed_at":"2026-08-10T16:13:49.998911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.981151Z","title":"Shadow alignment: The ease of subverting safely-aligned language models","venue":null,"work_id":"311e1666-c16c-44ca-97d2-1b80ae7ee116","year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.439828Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:9fb9585b3d8b2321ba2a3dc38af073864cc6f612257bef96fca705f926127665","observation_id":"c9a1df3a-806d-4b7d-9e5e-6823d2813a5e","resolution":{"observed_at":"2026-08-10T16:13:49.986077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-10T16:13:49.444384Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.444384Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:7f544cbc8132ede7e11e22dca933af15a35bc7b48f72c2f69974b88cf935d9e3","observation_id":"efe5b9a7-085d-421b-b83c-48f49e7a46b7","resolution":{"observed_at":"2026-08-10T16:13:49.444384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.449329Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.449329Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:5cf9de5c1eba4d556b00cf783c92bce60951d2954f5434373d3eae9436569e29","observation_id":"dd501cd3-64d0-41d8-8a2c-aa8c7956668b","resolution":{"observed_at":"2026-08-10T16:13:49.449329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10652","last_updated":"2022-04-05T00:54:35Z","snapshot_observed_at":"2026-07-06T12:50:01.067926Z","submitted_at":"2022-03-20T21:22:48Z","title":"Continual Sequence Generation with Adaptive Compositional Modules","version":2},"cited_work":{"arxiv_id":"2203.10652","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.10652","snapshot_observed_at":"2026-08-10T16:13:49.578710Z","title":"Continual Sequence Generation with Adaptive Compositional Modules","venue":"cs.CL","work_id":"33e24261-22fa-49e6-9181-5d095c823571","year":2022},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.453828Z"},"links":{"cited_paper":"/paper/2203.10652","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:6b64460995eb7320a460690a5298e74990a77ceadab2fa5ae3d880b6a40962da","observation_id":"2f52a1f8-f2ed-4946-9f72-52199768ed5b","resolution":{"observed_at":"2026-08-10T16:13:49.582899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.957880Z","title":"Can we edit factual knowledge by in-context learning? In Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pp.\\ 4862--4876, 2023 a","venue":null,"work_id":"7e79e089-8bbe-48f3-a038-9b0f982a8d5c","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.458213Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:5fb4f648ae5e3c3dec5b6deb9510ed97dbca23a8a7b91c66785d431a35fcd29d","observation_id":"e45bb04d-808f-436b-bbc7-c7bafe80e1e3","resolution":{"observed_at":"2026-08-10T16:13:49.962362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07887","last_updated":"2024-08-08T03:49:59Z","snapshot_observed_at":"2026-07-06T17:00:53.532910Z","submitted_at":"2023-12-13T04:14:22Z","title":"Learn or Recall? Revisiting Incremental Learning with Pre-trained Language Models","version":5},"cited_work":{"arxiv_id":"2312.07887","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.07887","snapshot_observed_at":"2026-08-10T16:13:49.560535Z","title":"Learn or Recall? Revisiting Incremental Learning with Pre-trained Language Models","venue":"cs.CL","work_id":"6db35083-040e-4f31-b4b9-9c190fd94b66","year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.462510Z"},"links":{"cited_paper":"/paper/2312.07887","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:cf3120e327afc1d84e7f48b1eb0c859e7cc897176778efc19ab8b45c80a12d97","observation_id":"f00ad06e-8f1a-4291-93ec-a2cc7edc8087","resolution":{"observed_at":"2026-08-10T16:13:49.566475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08526","last_updated":"2024-06-18T06:56:44Z","snapshot_observed_at":"2026-07-06T17:29:34.813390Z","submitted_at":"2024-02-13T15:29:50Z","title":"Can LLMs Learn New Concepts Incrementally without Forgetting?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08526","snapshot_observed_at":"2026-08-10T16:13:49.466841Z","title":"Concept-1k: A novel benchmark for instance incremental learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.466841Z"},"links":{"cited_paper":"/paper/2402.08526","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:d49d046e712298c415960eaca90942350b33416fc8be9baac2bbbbc390b30591","observation_id":"9fd6e736-027f-4b1f-a639-9b18cc70d938","resolution":{"observed_at":"2026-08-10T16:13:49.466841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-10T16:13:49.471244Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.471244Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:92708cf0c674990240f1f063f9e4ead6531d32e8aba3c1f21049e04cd14f555f","observation_id":"422d6b62-1bc2-4a2d-bdf2-5c6ad3bc21d1","resolution":{"observed_at":"2026-08-10T16:13:49.471244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-10T16:13:49.476013Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.476013Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:e28c1fa93e39eb8d2dfe3c0dccb0bef71406ede3ffb7cc74d4b6734ffd3f6db7","observation_id":"8bfab8c4-159d-4d0f-8f73-445089797524","resolution":{"observed_at":"2026-08-10T16:13:49.476013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.479842Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.479842Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:1fe5d59d613df2447f4d7f483c37821b487b94a5faf02bebcf84715a1c08c8b0","observation_id":"182392e8-c035-46eb-85d0-90d09a26d446","resolution":{"observed_at":"2026-08-10T16:13:49.479842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.484231Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.484231Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:140faad12bc438408f7fb2ee0863163f6cd587eb54bcdce784924390787763aa","observation_id":"a574c6e3-bbbb-414e-9086-492cc06b98ad","resolution":{"observed_at":"2026-08-10T16:13:49.484231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.488507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.488507Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:433624f9d4cbead8616eea2f7eebe0ef4fced7f70c0d8e08df35fa38c37ebc2c","observation_id":"a2edce88-8e41-41ca-ab02-54c7c7a56401","resolution":{"observed_at":"2026-08-10T16:13:49.488507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:49.492144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:49.492144Z"},"links":{"citing_paper":"/paper/2501.13453"},"observation_digest":"sha256:70826551cb52550c70182b459c335815225194d5546d6d9ef3eb1d6652e3dc9b","observation_id":"8857660a-6caa-425c-bcef-c938d5915b26","resolution":{"observed_at":"2026-08-10T16:13:49.492144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.13453","last_updated":"2025-01-23T08:09:54Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T23:06:44.625590Z","submitted_at":"2025-01-23T08:09:54Z","title":"Spurious Forgetting in Continual Learning of Language Models"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":3,"verified_fuzzy":21},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 11 inbound Pith citation observations for arXiv:2501.13453."}