{"as_of":"2026-08-17T21:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18c1d2e4fe37c5d36441d4ea30bdbe251784741ef5da55620e2e79c2fdd997a2","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:16:41.677882Z","state":"measured"},{"denominator":99,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":99,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:36:29.456241Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T07:22:27.784185Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"cited_work":{"arxiv_id":"2504.21239","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.21239","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memorization and knowledge injec- tion in gated llms.arXiv preprint arXiv:2504.21239","venue":null,"work_id":"49fa7505-6652-4e78-aed4-473921e7a0d4","year":null},"citing_paper":{"arxiv_id":"2510.09885","last_updated":"2026-06-09T20:01:06Z","snapshot_observed_at":"2026-08-13T02:58:34.288337Z","submitted_at":"2025-10-10T21:43:50Z","title":"Diffusion-Inspired Masked Fine-Tuning for Knowledge Injection in Autoregressive LLMs","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T07:21:54.004830Z"},"links":{"cited_paper":"/paper/2504.21239","citing_paper":"/paper/2510.09885"},"observation_digest":"sha256:29488675427c6a8f4688041b92469878eefb0e7d80f2db35107d580e07b5976c","observation_id":"6d511518-0e5b-4fbd-8f16-155fa51a9a6c","resolution":{"observed_at":"2026-05-18T07:22:27.788068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21239","snapshot_observed_at":"2026-08-04T10:36:29.456241Z","title":"Memorization and knowledge injec- tion in gated llms.arXiv preprint arXiv:2504.21239,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.09885","last_updated":"2026-06-09T20:01:06Z","snapshot_observed_at":"2026-08-13T02:58:34.288337Z","submitted_at":"2025-10-10T21:43:50Z","title":"Diffusion-Inspired Masked Fine-Tuning for Knowledge Injection in Autoregressive LLMs","version":6},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T10:36:29.456241Z"},"links":{"cited_paper":"/paper/2504.21239","citing_paper":"/paper/2510.09885"},"observation_digest":"sha256:1b16dff3ed601bfa4dc628eb8e1fe3125f5f72c5e56aa196bf3b6572fa04f4e6","observation_id":"eb7f651f-6b2e-4da8-a09f-3be99c126897","resolution":{"observed_at":"2026-08-04T10:36:29.456241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.21239/citation-record","integrity":"/paper/2504.21239/integrity","json":"/paper/2504.21239/citation-record.json","paper":"/paper/2504.21239"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.135955Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.135955Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:41dae5b8424aa7b1b0b828980004e21c340b66950f015b6c5f90775bf61e3771","observation_id":"58e9bd6b-b45d-4220-b47f-05ca13a0a52d","resolution":{"observed_at":"2026-08-16T05:16:41.135955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-16T05:16:41.146628Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.146628Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:aa69715d7e2d1d2bbbbd78acbe5a7db69087f7a5355d42dd9e3c83b7f8265108","observation_id":"c3b17a6c-d3b0-4423-9774-8268ee1f21ed","resolution":{"observed_at":"2026-08-16T05:16:41.146628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12288","last_updated":"2024-05-26T17:45:21Z","snapshot_observed_at":"2026-08-17T20:26:12.888582Z","submitted_at":"2023-09-21T17:52:19Z","title":"The Reversal Curse: LLMs trained on \"A is B\" fail to learn \"B is A\"","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12288","snapshot_observed_at":"2026-08-16T05:16:41.155545Z","title":"a is b\" fail to learn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.155545Z"},"links":{"cited_paper":"/paper/2309.12288","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:5a484451643fe8ce2d45ff0c534793d1ec41c05db08e495f9e086cd2ab613b5c","observation_id":"1999a715-beec-4492-a466-f10e206b1ae5","resolution":{"observed_at":"2026-08-16T05:16:41.155545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-16T13:52:21.979655Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-16T05:16:41.160939Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.160939Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:22d44115672debb3017805681fc7b86c9e6b52f9a626c8794e77aca39223f2ea","observation_id":"dc18b297-06b0-4559-a0aa-f8b1fbd975dc","resolution":{"observed_at":"2026-08-16T05:16:41.160939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.167349Z","title":"and Schulz, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.167349Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:c708be340447e754e79bf21f4f4f6df34629549acbc00fde77b2c82d05ec4660","observation_id":"b80d2d6d-5fe3-4538-b51e-d7943f4094f9","resolution":{"observed_at":"2026-08-16T05:16:41.167349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.172767Z","title":"Concepts as semantic pointers: A framework and computational model","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.172767Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b2ac488eee0de9a561171770443361b7c456ad98d188e18ae545cbdf4170308a","observation_id":"42ff43b8-c6a2-4768-8d67-283f8ed956b5","resolution":{"observed_at":"2026-08-16T05:16:41.172767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.178489Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.178489Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:736d71891788190cf853a6b398b14e5a470718a6d3d22887764f84ba2900b3e0","observation_id":"fccdfc86-7992-48f7-baa3-9a16ff90803a","resolution":{"observed_at":"2026-08-16T05:16:41.178489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.183757Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.183757Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:3bfc8f004890b49f45a56e0bef4eab25da0c81169d5db93ac01c81550afaeb3c","observation_id":"f6f70219-3f80-4692-b8dd-d1bbc47dedc2","resolution":{"observed_at":"2026-08-16T05:16:41.183757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15605","last_updated":"2025-02-23T19:48:12Z","snapshot_observed_at":"2026-08-17T13:41:24.767561Z","submitted_at":"2024-12-20T06:58:32Z","title":"Don't Do RAG: When Cache-Augmented Generation is All You Need for Knowledge Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15605","snapshot_observed_at":"2026-08-16T05:16:41.188480Z","title":"J., Chen, C.-T., Cheng, J.-H., and Huang, H.-H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.188480Z"},"links":{"cited_paper":"/paper/2412.15605","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b7d5852c1547ac42d5a84e3ada2d130442de702e921bba46bcb36971725836e1","observation_id":"05481a27-a234-4614-96fe-3d838caa5425","resolution":{"observed_at":"2026-08-16T05:16:41.188480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09009","last_updated":"2023-10-31T16:13:44Z","snapshot_observed_at":"2026-08-16T15:15:27.509831Z","submitted_at":"2023-07-18T06:56:08Z","title":"How is ChatGPT's behavior changing over time?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09009","snapshot_observed_at":"2026-08-16T05:16:41.194267Z","title":"How is chatgpt's behavior changing over time? arXiv preprint arXiv:2307.09009, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.194267Z"},"links":{"cited_paper":"/paper/2307.09009","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:418b6b28dffd96072e9c10cc54d9757d1afaae6da14af2d13cac41745fbce34b","observation_id":"6040ff64-6f07-4844-9b30-075578b131c8","resolution":{"observed_at":"2026-08-16T05:16:41.194267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12651","last_updated":"2020-04-27T08:59:57Z","snapshot_observed_at":"2026-08-09T03:44:43.469238Z","submitted_at":"2020-04-27T08:59:57Z","title":"Recall and Learn: Fine-tuning Deep Pretrained Language Models with Less Forgetting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12651","snapshot_observed_at":"2026-08-16T05:16:41.199008Z","title":"Recall and learn: Fine-tuning deep pretrained language models with less forgetting","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.199008Z"},"links":{"cited_paper":"/paper/2004.12651","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:c4bb9198ee152ba7b243f84ed4d56b80d859036f9aa692842d2ea5ee9927482a","observation_id":"12a9c613-1d5b-4465-85b9-82da557d6a82","resolution":{"observed_at":"2026-08-16T05:16:41.199008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3555","last_updated":"2014-12-11T06:46:53Z","snapshot_observed_at":"2026-08-13T10:35:27.214652Z","submitted_at":"2014-12-11T06:46:53Z","title":"Empirical Evaluation of Gated Recurrent Neural Networks on Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3555","snapshot_observed_at":"2026-08-16T05:16:41.203496Z","title":"Empirical evaluation of gated recurrent neural networks on sequence modeling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.203496Z"},"links":{"cited_paper":"/paper/1412.3555","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:f42454343f3cd0289c9d241d6f8f49d0931a121cbd6c8fdd20e62e88d6bef115","observation_id":"fbbac37b-8235-4445-85ca-1f883d8a7e65","resolution":{"observed_at":"2026-08-16T05:16:41.203496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.208949Z","title":"X., and Schulz, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.208949Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b91f20f8c99c1e5ff61d05fba13e7c8c01ac8c71ea2971630ecc0d6f3ad5fbd4","observation_id":"64197c8e-c13d-4851-b95e-e8a3161e57e6","resolution":{"observed_at":"2026-08-16T05:16:41.208949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11901","last_updated":"2024-08-21T22:54:47Z","snapshot_observed_at":"2026-08-16T14:08:44.987970Z","submitted_at":"2024-03-18T16:01:42Z","title":"Larimar: Large Language Models with Episodic Memory Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11901","snapshot_observed_at":"2026-08-16T05:16:41.213099Z","title":"Larimar: Large language models with episodic memory control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.213099Z"},"links":{"cited_paper":"/paper/2403.11901","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ae0b17b43efb33e659fdab54995ee0537fbbacae8c425049741a670143ea4891","observation_id":"5aa1c60f-010c-459b-b40a-02d7b16e6f02","resolution":{"observed_at":"2026-08-16T05:16:41.213099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07063","last_updated":"2025-01-13T05:16:14Z","snapshot_observed_at":"2026-08-14T11:51:35.982630Z","submitted_at":"2025-01-13T05:16:14Z","title":"Research on the Online Update Method for Retrieval-Augmented Generation (RAG) Model with Incremental Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07063","snapshot_observed_at":"2026-08-16T05:16:41.217748Z","title":"Research on the online update method for retrieval-augmented generation (rag) model with incremental learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.217748Z"},"links":{"cited_paper":"/paper/2501.07063","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:97699a66612102b292c612d14dd6ede678124ca1cdacba0de9bf9c13c6af60c4","observation_id":"89f0af77-02dd-425d-8620-6530c5b61d0c","resolution":{"observed_at":"2026-08-16T05:16:41.217748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-08-14T22:45:56.335948Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-08-16T05:16:41.222226Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.(2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.222226Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ac9ad540a4d477258dd6dcb616e50a6f1231f74f18887d953181503a5b243713","observation_id":"a7acf40b-4ef1-45b9-be63-4c48486cb01c","resolution":{"observed_at":"2026-08-16T05:16:41.222226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.228469Z","title":"A., Oomerjee, A., Christopoulou, F., Lampouras, G., Bou-Ammar, H., and Wang, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.228469Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:e95a83ac876d2cc0c8a952a7ab9549d6ec3ff0cd8da6ca31aa82aa5aef5cc4da","observation_id":"5b781abc-c611-4fac-8fb9-1be9f03fde38","resolution":{"observed_at":"2026-08-16T05:16:41.228469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.240078Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.240078Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b524a20d9949c0ff593d825d2682173e4e2515cc36ca4f6cc89903f6771c17a3","observation_id":"cb46011c-1b58-4298-8237-db108a67516c","resolution":{"observed_at":"2026-08-16T05:16:41.240078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11078","last_updated":"2024-06-03T05:39:10Z","snapshot_observed_at":"2026-08-16T14:17:51.098009Z","submitted_at":"2024-02-16T21:10:33Z","title":"Model Editing by Standard Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2402.11078","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11078","snapshot_observed_at":"2026-08-16T05:16:42.848921Z","title":"Model Editing by Standard Fine-Tuning","venue":"cs.LG","work_id":"4cceda4e-00f0-4040-bc83-6f618c60b952","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.247569Z"},"links":{"cited_paper":"/paper/2402.11078","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:149ffa7051cba5be05a400a1cc670470bb954e0da59fbf6b5edf6a993187ce1c","observation_id":"62f2641a-c84a-4dae-9837-c3008118c41a","resolution":{"observed_at":"2026-08-16T05:16:42.858454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.253037Z","title":"and Derrida, B","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.253037Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ec5b0df7cf0aa76a796be5a01a5c3f2a26d4dda09f7425321a64dd27271e13c8","observation_id":"d3d3d059-cbcb-4b22-bb96-3cd6eaf1038c","resolution":{"observed_at":"2026-08-16T05:16:41.253037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05904","last_updated":"2024-10-01T12:08:23Z","snapshot_observed_at":"2026-08-16T13:53:58.560866Z","submitted_at":"2024-05-09T17:00:22Z","title":"Does Fine-Tuning LLMs on New Knowledge Encourage Hallucinations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05904","snapshot_observed_at":"2026-08-16T05:16:41.258403Z","title":"Does fine-tuning llms on new knowledge encourage hallucinations? arXiv preprint arXiv:2405.05904, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.258403Z"},"links":{"cited_paper":"/paper/2405.05904","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ccca953616cf835181fbdf054e9a9012e0a2fe4d29f04069787b9cd69aa62ea9","observation_id":"8802bcef-cf0f-42a1-974c-c52c0b8de837","resolution":{"observed_at":"2026-08-16T05:16:41.258403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02950","last_updated":"2025-03-04T03:10:09Z","snapshot_observed_at":"2026-08-14T00:03:16.400115Z","submitted_at":"2025-01-06T11:46:40Z","title":"Key-value memory in the brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02950","snapshot_observed_at":"2026-08-16T05:16:41.263898Z","title":"J., Fiete, I., and Irie, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.263898Z"},"links":{"cited_paper":"/paper/2501.02950","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6ef06139895e585f352b239c7f466fe82d1213e44c8ba9ac80b23ac883b0d82f","observation_id":"86b200ea-7c4d-40ba-8ee6-95e0e6177c41","resolution":{"observed_at":"2026-08-16T05:16:41.263898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07453","last_updated":"2024-06-10T17:50:14Z","snapshot_observed_at":"2026-08-16T14:27:34.264135Z","submitted_at":"2024-01-15T03:57:15Z","title":"Model Editing at Scale leads to Gradual and Catastrophic Forgetting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07453","snapshot_observed_at":"2026-08-16T05:16:41.270239Z","title":"Model editing at scale leads to gradual and catastrophic forgetting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.270239Z"},"links":{"cited_paper":"/paper/2401.07453","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:9f4f4d64c4a6f20a27f986edc3d8b0a7eea6b9595133e74a01cbd9d0bd640b82","observation_id":"a130b423-3b65-42a3-8d60-a9458db4f22c","resolution":{"observed_at":"2026-08-16T05:16:41.270239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.275539Z","title":"K., and Soares, G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.275539Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b68b881a9dcab9ff84c3fa04649849568422cdfd756a8e0d0b1401ceab81e908","observation_id":"3479d498-3263-4377-96c9-0340db123e41","resolution":{"observed_at":"2026-08-16T05:16:41.275539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.283331Z","title":"J., Shu, Y., Gu, Y., Yasunaga, M., and Su, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.283331Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:57ffe7e6fa630baa30e0f98b6d66a8c58f0394032c3c2a72513e85495f394845","observation_id":"81ce2275-5522-41bf-bb3d-91c879468be7","resolution":{"observed_at":"2026-08-16T05:16:41.283331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13988","last_updated":"2024-08-08T07:32:14Z","snapshot_observed_at":"2026-08-16T15:45:37.621531Z","submitted_at":"2023-03-24T13:24:41Z","title":"Machine Psychology","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13988","snapshot_observed_at":"2026-08-16T05:16:41.288590Z","title":"Machine psychology: Investigating emergent capabilities and behavior in large language models using psychological methods","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.288590Z"},"links":{"cited_paper":"/paper/2303.13988","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:464520b9b22c0fa8ddd915adfed7f1c9835e90c9676f9673bdaa16d882f28a31","observation_id":"dcebdd6e-eb67-4f9a-a488-7ec52d6a5b3e","resolution":{"observed_at":"2026-08-16T05:16:41.288590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00309","last_updated":"2025-01-08T05:16:25Z","snapshot_observed_at":"2026-08-15T15:30:31.504538Z","submitted_at":"2024-12-31T06:59:35Z","title":"Retrieval-Augmented Generation with Graphs (GraphRAG)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00309","snapshot_observed_at":"2026-08-16T05:16:41.292771Z","title":"A., Mukherjee, S., Tang, X., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.292771Z"},"links":{"cited_paper":"/paper/2501.00309","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:9fa0f77f347b1822292790a49e4ce8435f3174d1aee34cb5294140cce77e40c7","observation_id":"425e91c2-42d3-4df9-8d48-2c642db41efe","resolution":{"observed_at":"2026-08-16T05:16:41.292771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.297346Z","title":"Aging with grace: Lifelong model editing with discrete key-value adaptors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.297346Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b5d3c5647e116dbcd5c566d00a4043ee18cd26e09bf9d83d49c06d23745d2ac7","observation_id":"4510ab94-346b-4c88-901f-5d881d5098be","resolution":{"observed_at":"2026-08-16T05:16:41.297346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.301812Z","title":"and Schmidhuber, J","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.301812Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:856b9a81cdbc65876dc7f056a85574e772b1afaf397dcc4d41523ce7203d6894","observation_id":"c7403cbf-7958-41c2-8cdf-017f3a4931d8","resolution":{"observed_at":"2026-08-16T05:16:41.301812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.305662Z","title":null,"venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.305662Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:e0d5620a9e804edb1bb14ba3f8e275e9bb6878cb76d04d71eee2a95ade0a33aa","observation_id":"c7b27234-e523-45a8-a95c-9a3dafec524c","resolution":{"observed_at":"2026-08-16T05:16:41.305662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01436","last_updated":"2024-10-25T06:20:16Z","snapshot_observed_at":"2026-08-16T13:46:40.929275Z","submitted_at":"2024-06-03T15:28:21Z","title":"Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01436","snapshot_observed_at":"2026-08-16T05:16:41.310197Z","title":"K.-M., Lin, T.-H., Liao, C.-W., Fang, H.-C., Huang, C.-W., and Chen, Y.-N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.310197Z"},"links":{"cited_paper":"/paper/2406.01436","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ec3e0bb1e529ec313c30b300e598b461cb8ac5a5e8090c74bd5192141e778deb","observation_id":"471e4e37-9505-4f75-86ed-c9c11dd69dec","resolution":{"observed_at":"2026-08-16T05:16:41.310197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T05:16:41.316820Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.316820Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6ec2e4f2d8ba4be1297991bd3432cc34a0941844f3c1dc017ffc617831e4968b","observation_id":"98318a8b-7aa4-4eae-9f41-21b3707f2e25","resolution":{"observed_at":"2026-08-16T05:16:41.316820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01244","last_updated":"2024-05-25T12:17:29Z","snapshot_observed_at":"2026-08-16T14:13:28.768283Z","submitted_at":"2024-03-02T16:11:23Z","title":"Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01244","snapshot_observed_at":"2026-08-16T05:16:41.321157Z","title":"Mitigating catastrophic forgetting in large language models with self-synthesized rehearsal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.321157Z"},"links":{"cited_paper":"/paper/2403.01244","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:df3190dfd6efd18ab678e470bfb08ae1df5d3a975bf92ade7f8e5a864f7f06d6","observation_id":"13beabba-a05e-4481-a894-9d8ec5fcb2b9","resolution":{"observed_at":"2026-08-16T05:16:41.321157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03839","last_updated":"2024-04-08T13:47:49Z","snapshot_observed_at":"2026-08-16T14:45:21.836671Z","submitted_at":"2023-11-07T09:39:12Z","title":"Aspects of human memory and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03839","snapshot_observed_at":"2026-08-16T05:16:41.327126Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.327126Z"},"links":{"cited_paper":"/paper/2311.03839","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:06fb4e3d863ef6599cfcc02dd3c7d3e2c43cee02a2c3945a7e588084f042c70e","observation_id":"7042bfd2-601b-446b-a358-603f933e5ee4","resolution":{"observed_at":"2026-08-16T05:16:41.327126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-16T05:16:41.332057Z","title":"Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.332057Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6abb6b61e7901100b02edd6e0f084f4ee2eba4e13dcd24c4dd4cada11f97cc41","observation_id":"fa8788fb-dabe-4d04-b382-4f114d587c19","resolution":{"observed_at":"2026-08-16T05:16:41.332057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21571","last_updated":"2024-07-31T12:56:14Z","snapshot_observed_at":"2026-08-16T13:29:33.418477Z","submitted_at":"2024-07-31T12:56:14Z","title":"PMoE: Progressive Mixture of Experts with Asymmetric Transformer for Continual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21571","snapshot_observed_at":"2026-08-16T05:16:41.338420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.338420Z"},"links":{"cited_paper":"/paper/2407.21571","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:dc6758c8128a3f8fc9f97b8e3142579cc9eda17d3b93041a64280232909692d1","observation_id":"aa47dae1-6c88-4483-84b9-3978c2c81553","resolution":{"observed_at":"2026-08-16T05:16:41.338420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03732","last_updated":"2023-11-28T03:23:20Z","snapshot_observed_at":"2026-08-14T13:45:26.254758Z","submitted_at":"2023-11-28T03:23:20Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03732","snapshot_observed_at":"2026-08-16T05:16:41.344815Z","title":"A rank stabilization scaling factor for fine-tuning with lora","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.344815Z"},"links":{"cited_paper":"/paper/2312.03732","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b94381edde3fffe775542749db062dfd28c9fd3613aa4e02957d704811d7688e","observation_id":"c55beafe-74b4-438e-9e6d-aa4ea964a7b0","resolution":{"observed_at":"2026-08-16T05:16:41.344815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05612","last_updated":"2024-05-28T23:56:14Z","snapshot_observed_at":"2026-08-16T21:17:58.141312Z","submitted_at":"2024-03-08T18:28:13Z","title":"Unfamiliar Finetuning Examples Control How Language Models Hallucinate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05612","snapshot_observed_at":"2026-08-16T05:16:41.351123Z","title":"Unfamiliar finetuning examples control how language models hallucinate","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.351123Z"},"links":{"cited_paper":"/paper/2403.05612","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6d30f10928c7dd03294b5023ef68dc18f416ab1b256651c056b4237e6607ca31","observation_id":"8e9f11a1-a6f2-499f-ae79-b1a594fbbc70","resolution":{"observed_at":"2026-08-16T05:16:41.351123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.360446Z","title":"and Sompolinsky, H","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.360446Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:c5287e369a3dc71896fd7a0b84ea11678570ca1cceb377a9477db5a3aeb421ae","observation_id":"f4f4bbf0-77b6-43d4-89c9-48cc8cf9b9bd","resolution":{"observed_at":"2026-08-16T05:16:41.360446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.365348Z","title":"A., Milan, K., Quan, J., Ramalho, T., Grabska-Barwinska, A., et al","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.365348Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:f873b74934211c16d90828e0cb36b318e53648fabb3cd2d6036f53302836cb59","observation_id":"8a3fbe72-6330-4083-88b1-333f7c1f2155","resolution":{"observed_at":"2026-08-16T05:16:41.365348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.369842Z","title":"and Sompolinsky, H","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.369842Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:431e2fd72694ac1fb1f14a60a68c45b43ea8c3753ea6dcc0d4ee26e97871f9ac","observation_id":"85440204-1de3-47d2-8636-e7db004bf284","resolution":{"observed_at":"2026-08-16T05:16:41.369842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10105","last_updated":"2024-04-14T01:15:31Z","snapshot_observed_at":"2026-08-16T14:59:40.231658Z","submitted_at":"2023-09-18T19:28:48Z","title":"Understanding Catastrophic Forgetting in Language Models via Implicit Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10105","snapshot_observed_at":"2026-08-16T05:16:41.375225Z","title":"M., and Raghunathan, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.375225Z"},"links":{"cited_paper":"/paper/2309.10105","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:54c48b1d7ba4d91fece1cadd027ab9952d0bc77c7ef3968157dfa0ca7643ae23","observation_id":"88b7bd97-b9eb-4513-84bb-9dcfe7da157c","resolution":{"observed_at":"2026-08-16T05:16:41.375225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14964","last_updated":"2025-08-07T09:12:17Z","snapshot_observed_at":"2026-08-14T18:22:07.618078Z","submitted_at":"2024-12-19T15:44:01Z","title":"Efficient Knowledge Injection in LLMs via Self-Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14964","snapshot_observed_at":"2026-08-16T05:16:41.380894Z","title":"Knowledge injection via prompt distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.380894Z"},"links":{"cited_paper":"/paper/2412.14964","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6c61c7621bb11d8245bb02181a80a34e507347d31d116d53c5c0620bb5380be6","observation_id":"70fe03a0-8b62-4f99-bb3b-64f38dc05a93","resolution":{"observed_at":"2026-08-16T05:16:41.380894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11299","last_updated":"2020-01-23T02:18:43Z","snapshot_observed_at":"2026-08-11T03:39:37.901826Z","submitted_at":"2019-09-25T06:04:37Z","title":"Mixout: Effective Regularization to Finetune Large-scale Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11299","snapshot_observed_at":"2026-08-16T05:16:41.385374Z","title":"Mixout: Effective regularization to finetune large-scale pretrained language models","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.385374Z"},"links":{"cited_paper":"/paper/1909.11299","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:0a8a4890fd154a5f4b721a4f3d6e4fba07ccb0ee5a790f42de9bf6435fd0ae9f","observation_id":"d1e79ae0-3dda-4a4e-b700-230b6fe273bb","resolution":{"observed_at":"2026-08-16T05:16:41.385374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.04115","last_updated":"2017-06-13T15:17:42Z","snapshot_observed_at":"2026-08-14T20:54:20.322452Z","submitted_at":"2017-06-13T15:17:42Z","title":"Zero-Shot Relation Extraction via Reading Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.04115","snapshot_observed_at":"2026-08-16T05:16:41.391655Z","title":"Zero-shot relation extraction via reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.391655Z"},"links":{"cited_paper":"/paper/1706.04115","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:0bf228ac99f9e1bdafb8fa8c888b371926eba4b8c7e18afcec2484e22daff297","observation_id":"ce2490f4-0c18-4065-83df-f19fc0533b91","resolution":{"observed_at":"2026-08-16T05:16:41.391655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.397268Z","title":"u ttler, H., Lewis, M., Yih, W.-t., Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.397268Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:482c61c5208aef6f4e05ed522ea60ba961ba026c7333f32b69070f5fd3ea3382","observation_id":"5bfb41ca-a4be-476b-836e-41aa385f544a","resolution":{"observed_at":"2026-08-16T05:16:41.397268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11830","last_updated":"2024-06-17T17:59:35Z","snapshot_observed_at":"2026-08-16T17:50:48.234084Z","submitted_at":"2024-06-17T17:59:35Z","title":"Language Modeling with Editable External Knowledge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11830","snapshot_observed_at":"2026-08-16T05:16:41.403108Z","title":"Z., Liu, E., Ross, A., Zeitoun, A., Neubig, G., and Andreas, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.403108Z"},"links":{"cited_paper":"/paper/2406.11830","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6d7a064e578ed7e60a37232289f2ab28a015ba9a64174c72ef1bb1d496d59f3f","observation_id":"67c1da96-d8ab-4b91-b137-145897c5f858","resolution":{"observed_at":"2026-08-16T05:16:41.403108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.411161Z","title":"and Sompolinsky, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.411161Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:bdfc3e4fe72f1b119d012267d0f2c39714099cbb6833399a78d49746b59b0c5b","observation_id":"3c746e7a-2e3d-4754-a29e-e2deb163fd94","resolution":{"observed_at":"2026-08-16T05:16:41.411161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.644664Z","title":"On the storage capacity of hopfield models with correlated patterns","venue":null,"work_id":"b8c1ccd5-7208-4b68-905d-392e6dc8ce83","year":1998},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.416926Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:f65a72e9f58a56abefffd370bd7123ae81e1ed814a3c038b892cc784c4036dd2","observation_id":"108611ed-f4f7-47ed-a43d-2b9db0a410dc","resolution":{"observed_at":"2026-08-16T05:16:43.649142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12851","last_updated":"2024-02-20T09:30:48Z","snapshot_observed_at":"2026-08-16T14:17:01.216486Z","submitted_at":"2024-02-20T09:30:48Z","title":"MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12851","snapshot_observed_at":"2026-08-16T05:16:41.421522Z","title":"Moelora: Contrastive learning guided mixture of experts on parameter-efficient fine-tuning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.421522Z"},"links":{"cited_paper":"/paper/2402.12851","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:a6cc46081fcf60e82d451ffc9ff33b1890b9ea77dcc92e7d6c3457fcd6e91ce0","observation_id":"fa7ad2d4-8d89-4119-b012-383ec44fecaf","resolution":{"observed_at":"2026-08-16T05:16:41.421522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-16T00:12:56.001802Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-16T05:16:41.426467Z","title":"An empirical study of catastrophic forgetting in large language models during continual fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.426467Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:86a12fb1f6f5bcbb001e8d5977caa9b84076c78912a4016b9a8a7efeec370bbc","observation_id":"24b4f310-be58-453c-b9a9-886dae9e5efa","resolution":{"observed_at":"2026-08-16T05:16:41.426467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.630190Z","title":"L., McNaughton, B","venue":null,"work_id":"d7b6a620-09bf-4039-975b-0c2e2845a32a","year":2020},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.432591Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:481ad66555748019096e8884100d27a866d5f5029bcaa260ae82bafee7b1c765","observation_id":"f401ab33-44d9-40de-b750-e468be1119d9","resolution":{"observed_at":"2026-08-16T05:16:43.634419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00213","last_updated":"2024-04-02T20:09:45Z","snapshot_observed_at":"2026-08-16T14:05:04.180080Z","submitted_at":"2024-03-30T01:56:07Z","title":"Injecting New Knowledge into Large Language Models via Supervised Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00213","snapshot_observed_at":"2026-08-16T05:16:41.438260Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.438260Z"},"links":{"cited_paper":"/paper/2404.00213","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:6504355d66c9a47dcf27d5c974a2fca9218a0e34d53897748a076eb113100991","observation_id":"b5b9316d-9b4b-4d23-a8ea-2c911ee7a47f","resolution":{"observed_at":"2026-08-16T05:16:41.438260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.616527Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"7f11c5b1-fe2b-4333-aac3-2c971911f0eb","year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.443057Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:c536b6f1fab1231bd07459f55cd55203e19844f4b93401e1a0deac644462e181","observation_id":"22e7e576-8561-44f5-83a1-603a3b53516a","resolution":{"observed_at":"2026-08-16T05:16:43.621010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-08-13T02:17:30.405636Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-16T05:16:41.449076Z","title":"S., Andonian, A., Belinkov, Y., and Bau, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.449076Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:abcd6dd28857ae8de3effd489770b8a9349d13d0228ee01374a687c189a91d73","observation_id":"91961ea4-f7c4-4505-b408-621820794708","resolution":{"observed_at":"2026-08-16T05:16:41.449076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11309","last_updated":"2022-06-13T23:26:16Z","snapshot_observed_at":"2026-08-16T17:47:32.583788Z","submitted_at":"2021-10-21T17:41:56Z","title":"Fast Model Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11309","snapshot_observed_at":"2026-08-16T05:16:41.454270Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.454270Z"},"links":{"cited_paper":"/paper/2110.11309","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:3e14757cea2c76309d828b73801478803db3ece64447ef223f66f1bf98b4da35","observation_id":"844ced59-c069-4a54-83a7-df8cc2737099","resolution":{"observed_at":"2026-08-16T05:16:41.454270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11672","last_updated":"2025-04-17T15:10:52Z","snapshot_observed_at":"2026-08-16T13:59:59.343348Z","submitted_at":"2024-04-17T18:13:16Z","title":"MemLLM: Finetuning LLMs to Use An Explicit Read-Write Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11672","snapshot_observed_at":"2026-08-16T05:16:41.458736Z","title":"o ksal, A., Imani, A., Fayyaz, M., and Sch \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.458736Z"},"links":{"cited_paper":"/paper/2404.11672","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:f88367ac1acdf60805763ea6765835d03243555b2e8497cc02b8a263f9328403","observation_id":"e9d2ae9e-de62-471f-8773-d0b1bc3b5bba","resolution":{"observed_at":"2026-08-16T05:16:41.458736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16938","last_updated":"2023-05-30T08:34:49Z","snapshot_observed_at":"2026-08-16T15:29:18.851413Z","submitted_at":"2023-05-26T13:55:17Z","title":"Few-shot Fine-tuning vs. In-context Learning: A Fair Comparison and Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16938","snapshot_observed_at":"2026-08-16T05:16:41.463405Z","title":"Few-shot fine-tuning vs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.463405Z"},"links":{"cited_paper":"/paper/2305.16938","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:a681a00b9a93fd0c0544311bc0358d09e04ed871e210bbcd824c3885dca57bab","observation_id":"b3cff3e3-6c88-45dd-8d3d-cc275229ba3d","resolution":{"observed_at":"2026-08-16T05:16:41.463405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08904","last_updated":"2022-08-05T09:33:10Z","snapshot_observed_at":"2026-08-16T17:20:27.429412Z","submitted_at":"2022-02-17T21:35:56Z","title":"SGPT: GPT Sentence Embeddings for Semantic Search","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08904","snapshot_observed_at":"2026-08-16T05:16:41.468412Z","title":"Sgpt: Gpt sentence embeddings for semantic search","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.468412Z"},"links":{"cited_paper":"/paper/2202.08904","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:34aeb963bca3193619ba49c1daadbb70a79bcd1ea61d1e48ef6a0a8a5f2ac424","observation_id":"46f70e97-56fe-482e-9418-060547062790","resolution":{"observed_at":"2026-08-16T05:16:41.468412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.602599Z","title":"Short-term memory and long-term memory are still different","venue":null,"work_id":"8e86da5e-f5d8-4127-ac76-f6e95581960d","year":2017},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.473257Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:0a3760b3565a37d9237be74b45fac3091b23cc056b808b4bf5ca2e798440917e","observation_id":"66ff1f28-4d1e-4786-a48c-228a98914753","resolution":{"observed_at":"2026-08-16T05:16:43.606838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05934","last_updated":"2024-01-30T11:58:10Z","snapshot_observed_at":"2026-08-17T13:43:49.391827Z","submitted_at":"2023-12-10T16:52:00Z","title":"Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05934","snapshot_observed_at":"2026-08-16T05:16:41.477882Z","title":"Fine-tuning or retrieval? comparing knowledge injection in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.477882Z"},"links":{"cited_paper":"/paper/2312.05934","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:5515b6775a779747e34beda3803ae3186bb2d2d5aedf49705c8badfbdf191ef8","observation_id":"cdf227d4-575e-4b61-b984-ad1b1e054cfd","resolution":{"observed_at":"2026-08-16T05:16:41.477882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.586943Z","title":"Propagating knowledge updates to lms through distillation","venue":null,"work_id":"2c65feb3-b215-4da6-9286-ebe93f032143","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.483307Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:fb25f656345971825afa5abe0561706ca4965e701fcf562f295aee2a8a9ea00f","observation_id":"9e6c77ad-5c75-466b-a0b8-66a7e67eeab1","resolution":{"observed_at":"2026-08-16T05:16:43.593152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11194","last_updated":"2025-03-30T20:10:35Z","snapshot_observed_at":"2026-08-16T18:40:30.915974Z","submitted_at":"2024-06-17T04:00:04Z","title":"In-Context Editing: Learning Knowledge from Self-Induced Distributions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11194","snapshot_observed_at":"2026-08-16T05:16:41.487442Z","title":"In-context editing: Learning knowledge from self-induced distributions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.487442Z"},"links":{"cited_paper":"/paper/2406.11194","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:870a0a1fd876a14df06a71b745dc88b357112dc66725e00ceda6e742e1e3bcad","observation_id":"039fd7de-f408-4be1-919a-bac8e5e0bc82","resolution":{"observed_at":"2026-08-16T05:16:41.487442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.570462Z","title":"Memorag: Boosting long context processing with global memory-enhanced retrieval augmentation","venue":null,"work_id":"0d6c87ba-5ed5-446b-91bc-5cd7d033003a","year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.492632Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:f29b9586da0d55d125cd46c1b60179a8674eef5195fb26ff2f42091ccac17d22","observation_id":"1da35401-c173-49f1-adc6-37d4b6b44198","resolution":{"observed_at":"2026-08-16T05:16:43.575340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01869","last_updated":"2022-11-28T02:39:06Z","snapshot_observed_at":"2026-08-16T16:26:54.498220Z","submitted_at":"2022-10-04T19:35:11Z","title":"Memory in humans and deep language models: Linking hypotheses for model augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01869","snapshot_observed_at":"2026-08-16T05:16:41.497394Z","title":"L., Poeppel, D., and Vo, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.497394Z"},"links":{"cited_paper":"/paper/2210.01869","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:e9a90bf41add7b0cd5c6b86d5fed61d1cf9230f6a4ae28fd52b372b465eae8df","observation_id":"f5fe1709-5b3c-4b3b-951a-7c556afaff57","resolution":{"observed_at":"2026-08-16T05:16:41.497394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.555574Z","title":null,"venue":null,"work_id":"50c8ba83-7e81-4132-baa7-22f49b2096aa","year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.503132Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b7bf894abf32f0a599e3abe6676c55de88e1825df79a9a0173e8945720a9782a","observation_id":"673955ab-07a1-40db-adb8-e5ee5ef9a6fb","resolution":{"observed_at":"2026-08-16T05:16:43.561550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.534401Z","title":"Efficiency of local learning rules in threshold-linear associative networks","venue":null,"work_id":"1c56ce4a-3738-43df-bc08-1127eca292ec","year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.507606Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:d404bb01874d4d24cf64d5ec3b4552e7f86b2bdad23dd87a89a598999d06ab30","observation_id":"970fdd0e-8863-445e-af1e-d23f528f05bd","resolution":{"observed_at":"2026-08-16T05:16:43.539872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.519473Z","title":"A rapid and efficient learning rule for biological neural circuits","venue":null,"work_id":"c1ecb8d0-6c90-4019-a056-4d75ddb3c8db","year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.513921Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:4dc5c33ae4f17ba4454ccecd1a78e9f59f1f83531a694447f7495c35b295ab88","observation_id":"a99b1790-c42a-432f-940d-a55b4916fc49","resolution":{"observed_at":"2026-08-16T05:16:43.524992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.505960Z","title":"Stochastic consolidation of lifelong memory","venue":null,"work_id":"29f8c81a-ba33-4a8d-9af5-0baa9a18f10f","year":2022},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.518879Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:86b1f33577a2dd811c2b0fa53c409fcc4a8cde01502631a8c0fa49eceed05ba7","observation_id":"d3d9414e-51bc-4953-aec0-4930e59887b7","resolution":{"observed_at":"2026-08-16T05:16:43.510520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10315","last_updated":"2025-01-26T04:27:17Z","snapshot_observed_at":"2026-08-16T13:34:20.244967Z","submitted_at":"2024-07-14T20:22:36Z","title":"Order parameters and phase transitions of continual learning in deep neural networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10315","snapshot_observed_at":"2026-08-16T05:16:41.524214Z","title":"Order parameters and phase transitions of continual learning in deep neural networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.524214Z"},"links":{"cited_paper":"/paper/2407.10315","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:5142a70c97edc535e162a158c56a66d60773675e37b099a78bd6ae79aa70b2e2","observation_id":"e75202cb-377b-41a9-a56a-05cbc4815525","resolution":{"observed_at":"2026-08-16T05:16:41.524214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-16T05:16:41.530120Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.530120Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:cf8c3b5f04bf3a91d5872800142b85c226c5babf0cf795622e2d8eb81a1ccd35","observation_id":"fa8d94ca-5ff1-49bd-937a-7e6f87e26508","resolution":{"observed_at":"2026-08-16T05:16:41.530120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-16T13:57:48.048440Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-16T05:16:41.536030Z","title":"Continual learning of large language models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.536030Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:23f1cafc20524b07043055db53e06063cf714469a30d1f6cfe701687007835e0","observation_id":"8b9a68c0-cd62-493c-ae72-1f52f4ec26a4","resolution":{"observed_at":"2026-08-16T05:16:41.536030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.490592Z","title":"and Sutton, R","venue":null,"work_id":"a67656a5-a73f-46f1-909f-389f22f93b64","year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.541029Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:9fdcdde66a1806c08d385e89fcb790644bacd9a522e0d867265ca8c08f13dab0","observation_id":"4691aee8-293c-4b48-a3bc-e47ce889e336","resolution":{"observed_at":"2026-08-16T05:16:43.495987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13669","last_updated":"2025-02-17T13:10:33Z","snapshot_observed_at":"2026-08-14T09:49:54.105543Z","submitted_at":"2025-01-23T13:54:53Z","title":"How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13669","snapshot_observed_at":"2026-08-16T05:16:41.545919Z","title":"How to complete domain tuning while keeping general ability in llm: Adaptive layer-wise and element-wise regularization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.545919Z"},"links":{"cited_paper":"/paper/2501.13669","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:76b8359e1ab0588c34a90744925c51a5b754ff2e5ec5370a5712fa45d78e43d2","observation_id":"c2a425a5-f885-41d3-9b9a-315bb942bb31","resolution":{"observed_at":"2026-08-16T05:16:41.545919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03329","last_updated":"2019-12-23T04:36:52Z","snapshot_observed_at":"2026-08-14T16:41:59.624463Z","submitted_at":"2019-09-07T20:17:34Z","title":"LAMOL: LAnguage MOdeling for Lifelong Language Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03329","snapshot_observed_at":"2026-08-16T05:16:41.552368Z","title":"Lamol: Language modeling for lifelong language learning","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.552368Z"},"links":{"cited_paper":"/paper/1909.03329","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:9db0f26ad54e6efe395567514017a94fc32139b50c1509655b090ace08e377fc","observation_id":"e9114882-f6cb-4fd6-ab01-b7bc3237bdfa","resolution":{"observed_at":"2026-08-16T05:16:41.552368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.469393Z","title":null,"venue":null,"work_id":"8bcddb38-3495-4e9d-bc9f-e0fdebba2e0e","year":1986},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.558079Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:5ddb516dcb8c2763fa874cd0770c772dfd746be7500fa435bc97bdd9def15f1b","observation_id":"bc4673c1-2de5-4b1e-9a68-d9a3428bc51f","resolution":{"observed_at":"2026-08-16T05:16:43.478046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.563704Z","title":"Understanding the limits of lifelong knowledge editing in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.563704Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:ea7ff24787317c333ffcd7e97a918ab611fb69399c52ff05e353dc10ba017cf6","observation_id":"5be164d7-f516-49d2-86be-a4af149fbe64","resolution":{"observed_at":"2026-08-16T05:16:41.563704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.452399Z","title":"Gated linear networks","venue":null,"work_id":"1aae8954-94a2-44b7-b26a-8cc253fa467c","year":2021},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.569619Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:35b501fd7e64c2eb25dae4fb27d004f27d943bf3938a8b7971eea82ba43ea442","observation_id":"0159b05e-014e-4942-b3fd-d502f8250f88","resolution":{"observed_at":"2026-08-16T05:16:43.457251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.432820Z","title":"Wise: Rethinking the knowledge memory for lifelong model editing of large language models","venue":null,"work_id":"2886fb4b-65ef-4882-b162-c78b757b526d","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.576385Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:5d803b33e48de5f6ab23ecb2f835e880d95e3f85d332450c1b9b94de7ce25bb1","observation_id":"148a259e-0b97-4e19-9192-1373906d1d9b","resolution":{"observed_at":"2026-08-16T05:16:43.439084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.414460Z","title":"Self-updatable large language models by integrating context into model parameters","venue":null,"work_id":"5a1d09fc-7583-4019-ad9c-ea8453c41142","year":null},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.581363Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:72c44d8c7db70cbb4f317ee77aef6fc85c855057e26f718274eb74b970019672","observation_id":"9ac394a0-d76d-47a4-8c2f-5cf35d9831f2","resolution":{"observed_at":"2026-08-16T05:16:43.419956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13265","last_updated":"2025-01-21T05:50:19Z","snapshot_observed_at":"2026-08-16T13:16:58.316070Z","submitted_at":"2024-09-20T06:54:00Z","title":"Towards LifeSpan Cognitive Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13265","snapshot_observed_at":"2026-08-16T05:16:41.587190Z","title":"Towards lifespan cognitive systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.587190Z"},"links":{"cited_paper":"/paper/2409.13265","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:63224f10f467bfb176edfe61a3bb4c81c186581a77e453cec742fe3f05da81da","observation_id":"22a126c4-391c-4b9d-af44-9786c964025d","resolution":{"observed_at":"2026-08-16T05:16:41.587190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04617","last_updated":"2024-05-28T12:05:12Z","snapshot_observed_at":"2026-08-16T14:20:44.078187Z","submitted_at":"2024-02-07T06:50:42Z","title":"InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04617","snapshot_observed_at":"2026-08-16T05:16:41.594133Z","title":"Infllm: Training-free long-context extrapolation for llms with an efficient context memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.594133Z"},"links":{"cited_paper":"/paper/2402.04617","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:05e1ca4b25e3753914a721b4998bcec73ebb3af39e23962ff48b17ab9ea26592","observation_id":"bf62ed7c-f8d3-460c-9a80-2135b842474c","resolution":{"observed_at":"2026-08-16T05:16:41.594133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13053","last_updated":"2024-10-09T15:33:10Z","snapshot_observed_at":"2026-08-17T08:04:53.392270Z","submitted_at":"2024-05-19T20:46:07Z","title":"MeteoRA: Multiple-tasks Embedded LoRA for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13053","snapshot_observed_at":"2026-08-16T05:16:41.601037Z","title":"Meteora: Multiple-tasks embedded lora for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.601037Z"},"links":{"cited_paper":"/paper/2405.13053","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:3b48637e09303d0da06776202d27632e6bf51286a6f818bc990f22eb39d9373b","observation_id":"5a9d90ae-d70c-4615-8858-b11c5b78d860","resolution":{"observed_at":"2026-08-16T05:16:41.601037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-08-12T12:16:58.791696Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-16T05:16:41.607054Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.607054Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:bc5a7f8c61f1f8ab8daa245ba121d0fce7fc3e93806897c22c43ec250e39ccc1","observation_id":"ea6ef240-5cd2-4b85-b415-3f778c93c4b0","resolution":{"observed_at":"2026-08-16T05:16:41.607054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07666","last_updated":"2025-12-31T04:06:49Z","snapshot_observed_at":"2026-08-07T23:28:24.025478Z","submitted_at":"2024-08-14T16:58:48Z","title":"Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07666","snapshot_observed_at":"2026-08-16T05:16:41.611658Z","title":"Model merging in llms, mllms, and beyond: Methods, theories, applications and opportunities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.611658Z"},"links":{"cited_paper":"/paper/2408.07666","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:a2f9449d5325cb121da768b390826104a2efe28a8a00be4a6e5c86b216b6013f","observation_id":"66c8eed4-8397-4d09-8347-8a713d3ac1fb","resolution":{"observed_at":"2026-08-16T05:16:41.611658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01178","last_updated":"2024-07-01T11:07:23Z","snapshot_observed_at":"2026-08-16T13:38:10.274811Z","submitted_at":"2024-07-01T11:07:23Z","title":"$\\text{Memory}^3$: Language Modeling with Explicit Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01178","snapshot_observed_at":"2026-08-16T05:16:41.617374Z","title":"Memory3: Language modeling with explicit memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.617374Z"},"links":{"cited_paper":"/paper/2407.01178","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:a7b4890a57ad58117368f1e2b2390a89666656fc348337285cd5ef867fcc0901","observation_id":"f0cc11f0-4943-410c-bccf-5a95873d5f3f","resolution":{"observed_at":"2026-08-16T05:16:41.617374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09162","last_updated":"2024-03-14T08:18:59Z","snapshot_observed_at":"2026-08-16T14:09:55.702437Z","submitted_at":"2024-03-14T08:18:59Z","title":"Unveiling the Generalization Power of Fine-Tuned Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09162","snapshot_observed_at":"2026-08-16T05:16:41.622385Z","title":"A., and Lam, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.622385Z"},"links":{"cited_paper":"/paper/2403.09162","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:a69c0655e43edb96f53483a1b7d3a1d749d8ec36faf22f00186789e96606ccb2","observation_id":"03452df8-b4a6-450e-9914-ad50da59ea40","resolution":{"observed_at":"2026-08-16T05:16:41.622385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09656","last_updated":"2024-06-05T09:43:00Z","snapshot_observed_at":"2026-08-16T14:18:27.444348Z","submitted_at":"2024-02-15T01:50:38Z","title":"The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09656","snapshot_observed_at":"2026-08-16T05:16:41.627357Z","title":"The butterfly effect of model editing: Few edits can trigger large language models collapse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.627357Z"},"links":{"cited_paper":"/paper/2402.09656","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:df9235067bf88af2c8232221b2ad38b340a7a4c496921a6f13a699a5c56f1827","observation_id":"b0ba93cd-4772-47e2-ba69-2c8e7c591b63","resolution":{"observed_at":"2026-08-16T05:16:41.627357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:41.633361Z","title":"Melo: Enhancing model editing with neuron-indexed dynamic lora","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.633361Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:eac0d9ff2d0c2dee84b749f3f326ff23fce740a5bfa066ca936fa1aa7306dc60","observation_id":"3bbca866-29c9-416f-b78f-f8b9b93a656a","resolution":{"observed_at":"2026-08-16T05:16:41.633361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.192512Z","title":"J., and Ma, Y","venue":null,"work_id":"503d3bfb-0b51-49bf-a347-c9bd0dfca1c0","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.639332Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:1a35921fc0c04bdd0a05769b1e8882139478396447a5de73d17010cee0d29e37","observation_id":"09f261a5-31f4-472f-93e0-278d9a35e70d","resolution":{"observed_at":"2026-08-16T05:16:43.197156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13847","last_updated":"2025-02-19T16:10:43Z","snapshot_observed_at":"2026-08-17T04:15:42.226014Z","submitted_at":"2025-02-19T16:10:43Z","title":"DH-RAG: A Dynamic Historical Context-Powered Retrieval-Augmented Generation Method for Multi-Turn Dialogue","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13847","snapshot_observed_at":"2026-08-16T05:16:41.643368Z","title":"Dh-rag: A dynamic historical context-powered retrieval-augmented generation method for multi-turn dialogue","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.643368Z"},"links":{"cited_paper":"/paper/2502.13847","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:abe6c65925d6c5d00bc2dd633167d6f27e60c5dff065164e2405ffd0f0867d76","observation_id":"296bf271-b6aa-442c-bfd4-2caaa300617d","resolution":{"observed_at":"2026-08-16T05:16:41.643368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01286","last_updated":"2024-11-17T06:50:44Z","snapshot_observed_at":"2026-08-17T20:32:47.955697Z","submitted_at":"2024-01-02T16:54:58Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01286","snapshot_observed_at":"2026-08-16T05:16:41.648387Z","title":"A comprehensive study of knowledge editing for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.648387Z"},"links":{"cited_paper":"/paper/2401.01286","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:166ee2d55c5cdf7a9fe411654b7a198d2430fdc8dc996c623bfcf7235b3ea91a","observation_id":"6232976d-9cfc-4dbb-958d-1dff491d9959","resolution":{"observed_at":"2026-08-16T05:16:41.648387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05987","last_updated":"2021-03-11T17:22:50Z","snapshot_observed_at":"2026-08-13T22:28:03.255826Z","submitted_at":"2020-06-10T17:57:03Z","title":"Revisiting Few-sample BERT Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05987","snapshot_observed_at":"2026-08-16T05:16:41.653732Z","title":"Q., and Artzi, Y","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.653732Z"},"links":{"cited_paper":"/paper/2006.05987","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:eba344462953840a7cc0c9796d3813acbbf6ba5feaf7c961441697af4366fc29","observation_id":"968c6ea6-3982-4f0b-a756-af347648fd48","resolution":{"observed_at":"2026-08-16T05:16:41.653732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.172404Z","title":"and Wu, J","venue":null,"work_id":"f74b2389-0af0-4239-9a21-566a2d4c9bb0","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.658497Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:b806e43271357489b03412789ce8d111dcd38baf7941d825c2dcd707988129a9","observation_id":"b877ecf8-d858-49af-b92d-c3f8b62b6a71","resolution":{"observed_at":"2026-08-16T05:16:43.178377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09997","last_updated":"2024-02-15T15:02:46Z","snapshot_observed_at":"2026-08-16T14:18:17.402564Z","submitted_at":"2024-02-15T15:02:46Z","title":"LoraRetriever: Input-Aware LoRA Retrieval and Composition for Mixed Tasks in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09997","snapshot_observed_at":"2026-08-16T05:16:41.664918Z","title":"Loraretriever: Input-aware lora retrieval and composition for mixed tasks in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.664918Z"},"links":{"cited_paper":"/paper/2402.09997","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:062bb06287a8af69b596ab77ebd16d205293cfb000ba1ecddea74de5d5c01c3b","observation_id":"181cefb4-0b5f-4216-b569-1db626860cb9","resolution":{"observed_at":"2026-08-16T05:16:41.664918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12048","last_updated":"2024-02-19T11:02:05Z","snapshot_observed_at":"2026-08-16T14:17:22.875988Z","submitted_at":"2024-02-19T11:02:05Z","title":"Model Tailor: Mitigating Catastrophic Forgetting in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12048","snapshot_observed_at":"2026-08-16T05:16:41.670472Z","title":"Model tailor: Mitigating catastrophic forgetting in multi-modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.670472Z"},"links":{"cited_paper":"/paper/2402.12048","citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:31eb1c15f89562f7af23418016a47ce4dbf7845f2c66907e364f678c5b141a80","observation_id":"78f76a7a-9fb0-464e-af00-c97be9945e0e","resolution":{"observed_at":"2026-08-16T05:16:41.670472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:16:43.153562Z","title":"Initializing and retrofitting key-value adaptors for traceable model editing","venue":null,"work_id":"cbdcbe8e-dcc6-40d4-8912-b0e6804aac6d","year":2024},"citing_paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-16T05:16:41.677882Z"},"links":{"citing_paper":"/paper/2504.21239"},"observation_digest":"sha256:77bfee2e363d3bc6e19953fb548b2ab2c55275cf21909ac162259dca5076e915","observation_id":"f9fceb39-b580-45e1-a5ec-0ac6c2c67474","resolution":{"observed_at":"2026-08-16T05:16:43.158958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.21239","last_updated":"2025-04-30T00:28:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T18:40:13.764415Z","submitted_at":"2025-04-30T00:28:32Z","title":"Memorization and Knowledge Injection in Gated LLMs"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":80,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 2 inbound Pith citation observations for arXiv:2504.21239."}