{"as_of":"2026-08-10T11:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35558238521157f5b188dbf7b7b4e514a05d1f29c749d87f56ffd0e6b1c1cf17","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:34:23.475942Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T07:36:43.499258Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21577","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":"Collaborative parameter learning: Mitigating forgetting via parameter-level gradient analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-08T18:22:25.527933Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2601.21577","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:811c47e3c6bdd12adc228e7e3878bbc4595298ec4b9ea333f222e6cea583e59e","observation_id":"5e013853-de42-4363-9b6c-53ed31d8ab7e","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.21577/citation-record","integrity":"/paper/2601.21577/integrity","json":"/paper/2601.21577/citation-record.json","paper":"/paper/2601.21577"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ac18c252b77e5a8ff9cfb5b77ec9485a23b357bb3f59bcadab23ad1a3cd81f3f","observation_id":"d5a36b79-2f19-4397-84ac-e043ed312fd4","resolution":{"observed_at":"2026-05-16T09:37:41.653744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:164425a7c6e28434a668e7202f8022ef4c4aa9e4111893c5a8279c24c8cddd3f","observation_id":"acd85973-c994-40d9-a5bf-db8787bcb4e0","resolution":{"observed_at":"2026-05-16T09:37:41.614032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04496","last_updated":"2024-07-23T00:46:37Z","snapshot_observed_at":"2026-08-09T22:22:07.960491Z","submitted_at":"2024-06-06T20:41:36Z","title":"Time Sensitive Knowledge Editing through Efficient Finetuning","version":2},"cited_work":{"arxiv_id":"2406.04496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04496","snapshot_observed_at":"2026-07-03T16:58:43.092756Z","title":"Time sensitive knowledge editing through efficient finetuning.arXiv preprint arXiv:2406.04496","venue":null,"work_id":"0f44370a-c8cc-46a5-9746-386137b2fc54","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2406.04496","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:70b11238680f9e29ad295d64c454c77af8fcc84e60636d87541a93636ce2101b","observation_id":"fe343f95-5805-412f-af3f-144610398a21","resolution":{"observed_at":"2026-05-16T09:37:41.594163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:504cd4af0f7d6f98ec04a9ee67c0c8c9f8e1573adf4ba7dc8b5702c713c08c50","observation_id":"fb949c5c-c2b0-4c4e-906d-b594839a96e7","resolution":{"observed_at":"2026-05-16T09:37:41.598002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":"2304.08247","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-07-03T08:17:45.726306Z","title":"Medalpaca–an open-source collection of medical conversational ai models and training data","venue":null,"work_id":"e04d7f5e-abf5-46d9-8a8a-1707106f84bd","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:f40cf7e50b92d7a3f622105034c2d136f8cd5f7de2faae6c5ce8cd19931b627a","observation_id":"7cf5ee17-471e-4721-9bc4-e2e7901eda67","resolution":{"observed_at":"2026-05-16T09:37:41.650160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:327dca5426007e571d2a0e4804a78caa7eb50095d7601979f929d6afe255c6be","observation_id":"9b72f284-9513-4373-9150-0b6bf68c0418","resolution":{"observed_at":"2026-05-16T09:37:41.610469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:03e0e0714967bc79612b07b7b0cd301c2834e3482d7ef44853d48b42d9f1b0de","observation_id":"ae411208-6855-4ce0-93bb-4518282acf59","resolution":{"observed_at":"2026-05-16T09:37:41.664096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Connecting the knowledge dots: Retrieval-augmented knowledge connection for commonsense reasoning","venue":null,"work_id":"58fcb5be-8e48-4489-81e3-478d93e38a36","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:e75e2f6d61112ee68b1988c6a2bf1747710242316ebb2193190cddd9212cfb97","observation_id":"e266c18c-1f68-4c3f-9dd3-94c9f45a6e41","resolution":{"observed_at":"2026-05-16T09:42:42.188537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:c1df7be030d70955b3f2d5137c0da503d350378e005f6ecb00c2b1c4af2212ad","observation_id":"13bcfbba-cbab-4891-8474-ccade904158d","resolution":{"observed_at":"2026-05-16T09:37:41.606172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10105","last_updated":"2024-04-14T01:15:31Z","snapshot_observed_at":"2026-07-06T16:20:13.025092Z","submitted_at":"2023-09-18T19:28:48Z","title":"Understanding Catastrophic Forgetting in Language Models via Implicit Inference","version":2},"cited_work":{"arxiv_id":"2309.10105","doi":"10.48550/arxiv.2309.10105","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arxiv.2309.10105","venue":"arXiv (Cornell University)","work_id":"62d31a2c-7d11-4b83-b935-1c9164a7ec93","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2309.10105","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:5406389271573b32ba7bfb3390f5f816dc26e443b1483622dd3494a09271d915","observation_id":"3cf745ed-7ca6-4416-965d-20756712751e","resolution":{"observed_at":"2026-05-16T09:37:41.658814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04836","last_updated":"2024-06-07T11:09:13Z","snapshot_observed_at":"2026-07-06T18:27:03.044022Z","submitted_at":"2024-06-07T11:09:13Z","title":"Revisiting Catastrophic Forgetting in Large Language Model Tuning","version":1},"cited_work":{"arxiv_id":"2406.04836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04836","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revisiting catastrophic forgetting in large language model tuning.arXiv preprint arXiv:2406.04836","venue":null,"work_id":"b770be2d-1ed6-4278-8844-c2900da65a0a","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2406.04836","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ebb4006153618e8733939f186184de18b524713363ed114bcd6e8e4c72a47a77","observation_id":"ee4a8779-c9c6-4974-ba2d-c76e963d555f","resolution":{"observed_at":"2026-05-16T09:37:41.602424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analyzing and reducing catastrophic forgetting in parameter efficient tuning","venue":null,"work_id":"423e5597-a8d0-4db8-a2a9-42580db2cd38","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:b1381a9e4b24af840b138c50bf8bea0d8f89d5cc6078f63bbd389ff5585fc080","observation_id":"93f0729b-837d-4dfa-b692-9472a7a4d39a","resolution":{"observed_at":"2026-05-16T09:42:42.193106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-07-06T14:04:55.099373Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":"2210.07229","doi":"10.48550/arxiv.2210.07229","metadata_source":"pith","pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mass-Editing Memory in a Transformer","venue":"cs.CL","work_id":"03332427-98ba-4287-876a-bb315cbddb1d","year":2022},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:bc9f300213573a4d5559a92b9f72ca4a1ace32b6af7084ed59e36edd19580c02","observation_id":"dd44a44a-7b67-4d3b-966d-dfa93452b594","resolution":{"observed_at":"2026-05-16T09:37:41.618410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Commonsenseqa: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"46d9f4cf-4177-4585-a844-fd3a75256887","year":2019},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:b15f08ef4a5e187105aeb1ada6c7ed5bba3a2eb9407f1cbc226276d10669dc04","observation_id":"e0f22afc-7ed1-4b31-93dd-fb3f39db77a4","resolution":{"observed_at":"2026-05-16T09:42:42.183709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paths-over-graph: Knowledge graph empowered large language model reasoning","venue":null,"work_id":"871c1347-1c7c-4843-a718-be1a873bd0aa","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:04c0696c553991e456d82206fffe079d4fcfc1973fa79e8d0c884dcc2c3768e7","observation_id":"7d97ffa9-3c19-44c9-8adf-9beee5accb4b","resolution":{"observed_at":"2026-05-16T09:42:42.190719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:45c61fd18387f9b6bb07f92e8027f6cf795d4e4da86d94cb3bf6dcf2141dbd59","observation_id":"6f5c34c1-b2fa-4c26-8c3c-208407dfdc9d","resolution":{"observed_at":"2026-05-16T09:37:41.641416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02503","last_updated":"2025-07-03T10:11:22Z","snapshot_observed_at":"2026-08-10T02:12:51.017025Z","submitted_at":"2025-07-03T10:11:22Z","title":"Continual Gradient Low-Rank Projection Fine-Tuning for LLMs","version":1},"cited_work":{"arxiv_id":"2507.02503","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual gradient low-rank projection fine-tuning for llms.arXiv preprint arXiv:2507.02503","venue":null,"work_id":"2ecc31c9-cc88-4f3b-8792-744eb92037be","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2507.02503","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:09d64a5e4065f92a78e4da722778e396b09292eb8f541bce23b67e877e58566a","observation_id":"52e83c59-c9e1-46eb-9620-09dec1db033f","resolution":{"observed_at":"2026-05-16T09:37:41.645835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"K-adapter: Infusing knowledge into pre-trained models with adapters","venue":null,"work_id":"b6f2f154-0a3f-43f4-90e8-4cc1b235848f","year":2021},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:a5a856ee3b5f5321571131dbe5a4939b4ca6208bc08ed1654ca445055d0262e5","observation_id":"7aa5e7e6-6342-496d-bccf-46b0efc6c8a9","resolution":{"observed_at":"2026-05-16T09:42:42.180887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking retrieval-augmented generation for medicine","venue":null,"work_id":"dfc11ed2-75a7-4c09-887a-839252f9f334","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:9d1ed15a6c85895649a2cc3bb7acce8433d58c0ad5c87647d4fcebc7482fdb05","observation_id":"f4b832d8-7df2-411b-b816-8d9177fc3cf0","resolution":{"observed_at":"2026-05-16T09:42:42.185935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:a1d19e016132b43e2d35d2531b7d29bfa03d39ef1a5d3c093fb8f1112db1bb22","observation_id":"e5760c54-0820-4ac6-b731-b1a889c04bd3","resolution":{"observed_at":"2026-05-16T09:37:41.628904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16386","last_updated":"2024-04-23T10:44:01Z","snapshot_observed_at":"2026-07-06T17:21:58.983048Z","submitted_at":"2024-01-29T18:27:52Z","title":"Continual Learning with Pre-Trained Models: A Survey","version":2},"cited_work":{"arxiv_id":"2401.16386","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.16386","snapshot_observed_at":"2026-07-04T02:49:25.503928Z","title":"Con- tinual learning with pre-trained models: A survey","venue":null,"work_id":"283359ab-3ad3-424b-a6b8-89e104f4360b","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2401.16386","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:73f39dd8c69c772f3468341af660c016b5b20172ea00580a5a0b590712880646","observation_id":"711f0166-de29-4d34-b105-2b9683d500bc","resolution":{"observed_at":"2026-05-16T09:37:41.625079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.01549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An information bottleneck perspective for effective noise filtering on retrieval-augmented generation.arXiv preprint arXiv:2406.01549","venue":null,"work_id":"13552968-97e9-4c55-969a-6455a2e79eef","year":2024},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:1abaafa13abaa6698d3b8a074a20b9b23d3719d79b79a6e8e318555d19e0f126","observation_id":"02b89018-8723-426d-98bd-98b0c6cada50","resolution":{"observed_at":"2026-05-16T09:37:41.637326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06864","last_updated":"2025-02-08T02:14:31Z","snapshot_observed_at":"2026-08-10T11:47:36.167976Z","submitted_at":"2025-02-08T02:14:31Z","title":"Knowledge Graph-Guided Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":"2502.06864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06864","snapshot_observed_at":"2026-07-02T23:47:27.245445Z","title":"Knowledge graph-guided retrieval augmented generation","venue":null,"work_id":"81fa99b0-6c6e-40e6-8391-c0008b405337","year":2025},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2502.06864","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:ecdaf887c2fd5478f3248157fc20b5af0f1b9719029ed7795f3040769524f28b","observation_id":"6ed3e21b-dfdd-4899-8cde-ad9feee21481","resolution":{"observed_at":"2026-05-16T09:37:41.633393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":16,"verified_fuzzy":6},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2601.21577."}