{"as_of":"2026-08-09T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25cf4d9b249e68cb60e618584016a70f11e0d3315812eb352bc2dcc70021d3c0","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:59:49.861333Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25614/citation-record","integrity":"/paper/2607.25614/integrity","json":"/paper/2607.25614/citation-record.json","paper":"/paper/2607.25614"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.766270Z","title":"Nested learning: The illusion of deep learning architectures.arXiv preprint arXiv:2512.24695,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.766270Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:5b4ed1b76bff88a2f511396d2cd05f2e4847faf33ca25efc7d2dde837fe03a43","observation_id":"fb559bd6-d0b6-4d0b-8e77-37b2c71a7494","resolution":{"observed_at":"2026-08-01T01:59:49.766270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.861333Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.861333Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:96a63dd92c0e1814f94a10af5ac124c9221fc38265d8cf679170f52a369a5e45","observation_id":"e7c4a55f-1261-4334-80a6-f5a39c1e5400","resolution":{"observed_at":"2026-08-01T01:59:49.861333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-01T01:59:49.781202Z","title":"On the opportunities and risks of foundation models.arXiv preprint arXiv:2108.07258,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.781202Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:884ab41d5867bf6f2738e85fa4e6bdf8c439dc550e43052827c5587afd1059a3","observation_id":"5fd6c1c4-b4ab-4062-a880-e5da167fda06","resolution":{"observed_at":"2026-08-01T01:59:49.781202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-06T19:10:40.703812Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-08-01T01:59:49.791419Z","title":"Conditional memory via scalable lookup: A new axis of sparsity for large language models.arXiv preprint arXiv:2601.07372,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.791419Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:62d6846081b6a74f6c2b6f5ac0f378d0038162d15132c998a225428ff93ed264","observation_id":"9fba827b-e92a-412a-a116-be7990f3b112","resolution":{"observed_at":"2026-08-01T01:59:49.791419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.797566Z","title":"Lawbench: Benchmarking legal knowledge of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.797566Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:cfe92f7d42d364738f59218f491c044683a127ef0020ca1432ae62e329a270b0","observation_id":"5f12b3f4-e261-4586-acc1-487b1f97f3e1","resolution":{"observed_at":"2026-08-01T01:59:49.797566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.800561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.800561Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:f38987fa18119c2c321c60049bb83b704e343241bd4698b7c87de9e59f56c748","observation_id":"172d9212-d55a-4924-88f9-56f814482fd8","resolution":{"observed_at":"2026-08-01T01:59:49.800561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.803728Z","title":"Biology-instructions: A dataset and benchmark for multi-omics sequence understanding capability of large language models.arXiv preprint arXiv:2412.19191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.803728Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:69d8319cf64094b0a40c4ccceaec6bc6ce2489311642d598e93345b9ab5c1b4b","observation_id":"e0ab5222-c315-4c54-a4f9-91210d12a5c7","resolution":{"observed_at":"2026-08-01T01:59:49.803728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05605","last_updated":"2024-01-11T00:44:25Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-11T00:44:25Z","title":"Scaling Laws for Forgetting When Fine-Tuning Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05605","snapshot_observed_at":"2026-08-01T01:59:49.806815Z","title":"Scaling laws for forgetting when fine-tuning large language models.arXiv preprint arXiv:2401.05605,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.806815Z"},"links":{"cited_paper":"/paper/2401.05605","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:9e9d9d8d2ad5aac25abf443b7fc38e5c05385d38192074fc3430579800babcb2","observation_id":"2a4cc0e8-e02f-45d7-8bee-36ab3aa6fa80","resolution":{"observed_at":"2026-08-01T01:59:49.806815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00172","last_updated":"2020-02-15T01:04:52Z","snapshot_observed_at":"2026-07-06T08:33:58.970043Z","submitted_at":"2019-11-01T01:09:53Z","title":"Generalization through Memorization: Nearest Neighbor Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00172","snapshot_observed_at":"2026-08-01T01:59:49.810007Z","title":"Generalization through memorization: Nearest neighbor language models.arXiv preprint arXiv:1911.00172,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.810007Z"},"links":{"cited_paper":"/paper/1911.00172","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:7e2de7b533c2f5b247a72540ded4b81bd65421ce28fb66c97143d1567e81c795","observation_id":"644d2c2a-aa12-4b6b-87a3-66500040f953","resolution":{"observed_at":"2026-08-01T01:59:49.810007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.813332Z","title":"Revisiting catastrophic forgetting in large language model tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.813332Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:2c98f61559f6536e90b13778211cf73269c1918c30370008dcd9402b6dac5380","observation_id":"078f9086-7e4f-4ea8-a15f-8672ce0f2f59","resolution":{"observed_at":"2026-08-01T01:59:49.813332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.816334Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.816334Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:2cd722c221a84212468d7096ec7f8a15285dfc8536c6904c37cf173b770ffc18","observation_id":"3dc97909-ec0a-4c1c-9af4-9cc36405d763","resolution":{"observed_at":"2026-08-01T01:59:49.816334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.819376Z","title":"More than catastrophic forgetting: Integrating general capabilities for domain-specific llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.819376Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:ca11f16ba1f2a0df9e4ddd68cce9a7f71ef7f903b0b4f566262507bc53c4b2e5","observation_id":"6b1ea18c-7af5-4050-8932-3c84e8fec64c","resolution":{"observed_at":"2026-08-01T01:59:49.819376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.822157Z","title":"Openswi: a massive-scale benchmark dataset for surface wave dispersion curve inversion.Earth System Science Data Discussions, 2025:1–37,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.822157Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:ec1b9518e3d0013cc5b04c76ac738cfc9d147b513f97741b5941400f18883295","observation_id":"38b08e56-fabf-47e1-b2dd-1d2cad791960","resolution":{"observed_at":"2026-08-01T01:59:49.822157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.831062Z","title":"K-adapter: Infusing knowledge into pre-trained models with adapters","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.831062Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:5423b558c7900e967db910e8ff7a3cc4fcceafee4e40fc700c514b185a48a791","observation_id":"d2034f67-ce03-4c4a-be68-73b852813996","resolution":{"observed_at":"2026-08-01T01:59:49.831062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-01T01:59:49.833794Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.833794Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:2da42eed145b597e4f5873cde81d383a7f65031fd5ff1a40d504ef5e65585a23","observation_id":"7fb349ae-8d2e-43c3-9eb7-63d15d154403","resolution":{"observed_at":"2026-08-01T01:59:49.833794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08913","last_updated":"2022-03-16T19:54:35Z","snapshot_observed_at":"2026-08-05T11:47:40.727016Z","submitted_at":"2022-03-16T19:54:35Z","title":"Memorizing Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08913","snapshot_observed_at":"2026-08-01T01:59:49.839575Z","title":"Memorizing transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.839575Z"},"links":{"cited_paper":"/paper/2203.08913","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:ab7b859859ef77556d7157321a6a02774788268d3749718328dfa5eeb7ca2997","observation_id":"df9d31c1-994e-48a6-85b2-5cb092d4baed","resolution":{"observed_at":"2026-08-01T01:59:49.839575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T01:59:49.842509Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.842509Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:4c0ee910cb2fefa6266f36fd90f2d55c01d1c652f0e6b7f91e7e60ba797e4f67","observation_id":"a8cc3a37-d8c6-4d53-8da7-9208ab44cc40","resolution":{"observed_at":"2026-08-01T01:59:49.842509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01178","last_updated":"2024-07-01T11:07:23Z","snapshot_observed_at":"2026-07-06T18:39:29.270369Z","submitted_at":"2024-07-01T11:07:23Z","title":"$\\text{Memory}^3$: Language Modeling with Explicit Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01178","snapshot_observed_at":"2026-08-01T01:59:49.845780Z","title":"Memory3: Language modeling with explicit memory.arXiv preprint arXiv:2407.01178,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.845780Z"},"links":{"cited_paper":"/paper/2407.01178","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:e835bb2b8a7c5a58446d8ba435b1549c45b931f4b6c266f10d68f33aacd6049d","observation_id":"8bf876c6-f133-4777-9c85-42e6014413b5","resolution":{"observed_at":"2026-08-01T01:59:49.845780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09391","last_updated":"2024-08-10T13:28:11Z","snapshot_observed_at":"2026-08-04T14:26:55.582131Z","submitted_at":"2024-02-14T18:42:25Z","title":"LlaSMol: Advancing Large Language Models for Chemistry with a Large-Scale, Comprehensive, High-Quality Instruction Tuning Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09391","snapshot_observed_at":"2026-08-01T01:59:49.848706Z","title":"Llasmol: Advancing large language models for chemistry with a large-scale, comprehensive, high-quality instruction tuning dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.848706Z"},"links":{"cited_paper":"/paper/2402.09391","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:cc63dc2b5e5e0def4caccf9489210748d40b0d640e261a325a29612cc20f4291","observation_id":"c35b4678-2a49-4c23-a705-72a5b783ad2e","resolution":{"observed_at":"2026-08-01T01:59:49.848706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T01:59:49.852324Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.852324Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:3439fbd115520bd00e926d64dd1d2c570a5f7260d6fb6535dbd3f651b3746522","observation_id":"302dfb7d-0802-49cc-897f-9237fdd5ed42","resolution":{"observed_at":"2026-08-01T01:59:49.852324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.855248Z","title":"2-10 trigger_word_extraction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.855248Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:2a80bd040cf9eba7a150f68bd9bde7aa3a34c5a82fa003f26c2ebbf8145f78bc","observation_id":"0e835b8c-ccd5-41f1-b29d-9fd9c7925c3f","resolution":{"observed_at":"2026-08-01T01:59:49.855248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.858569Z","title":null,"venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.858569Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:9048aa34ecab4b7aa8b16974b5d4a9b1fe270ecc152417e00020effeb124facb","observation_id":"12c767ba-d2ba-4282-8ce3-8b47011f72d7","resolution":{"observed_at":"2026-08-01T01:59:49.858569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.828263Z","title":"In- clude: Evaluating multilingual language understanding with regional knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.828263Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:0965ed167dd5208abb17781ea41364bce966b6bc10a71a226927e9105f5a34e7","observation_id":"91ec4bc2-563a-4a3c-88ff-fa7a573dc0ab","resolution":{"observed_at":"2026-08-01T01:59:49.828263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-07-06T08:36:43.643240Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-01T01:59:49.824935Z","title":"Compressive trans- formers for long-range sequence modelling.arXiv preprint arXiv:1911.05507,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.824935Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:55519ff79b06c35f654ed7e1c6c54f61e5d0aef8f074382eb17d33c02a2e561b","observation_id":"6cad2ed6-b857-4284-aee9-8f1b4fb670f1","resolution":{"observed_at":"2026-08-01T01:59:49.824935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.19276","last_updated":"2026-06-08T02:37:16Z","snapshot_observed_at":"2026-08-06T04:07:58.371903Z","submitted_at":"2026-05-19T02:50:11Z","title":"OpenCompass: A Universal Evaluation Platform for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19276","snapshot_observed_at":"2026-08-01T01:59:49.787962Z","title":"Memory decoder: A pretrained, plug-and-play memory for large language models.Advances in Neural Information Processing Systems, 38:115487–115510, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.787962Z"},"links":{"cited_paper":"/paper/2605.19276","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:d634f7178527fa578e02ca87e4d4fc1cb9cc089855639bcc70e3e100576191ee","observation_id":"d9c2fd53-3dc8-4f36-93bc-8a52f7067c9a","resolution":{"observed_at":"2026-08-01T01:59:49.787962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.836797Z","title":"Mlp mem- ory: A retriever-pretrained memory for large language models.arXiv preprint arXiv:2508.01832,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.836797Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:95fd52b815e8d0d3869094b077db23654bdf9eb7998706cd9491c7ed8a0b954b","observation_id":"e79e74aa-a955-4716-bc66-d1e25c7eb940","resolution":{"observed_at":"2026-08-01T01:59:49.836797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.784689Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.784689Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:26e63dabec2e4029214f133aeb618fc7a5e99eca8eb177be77333340c8f13ee1","observation_id":"746c02d1-d3e0-4969-8468-cc27a48cadca","resolution":{"observed_at":"2026-08-01T01:59:49.784689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09428","last_updated":"2025-06-28T02:26:03Z","snapshot_observed_at":"2026-08-09T03:32:07.542600Z","submitted_at":"2025-06-11T06:23:50Z","title":"Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09428","snapshot_observed_at":"2026-08-01T01:59:49.794527Z","title":"Improved supervised fine-tuning for large language models to mitigate catastrophic forgetting.arXiv preprint arXiv:2506.09428,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.794527Z"},"links":{"cited_paper":"/paper/2506.09428","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:40cd5984363b498abd4ee26d5f64a0b46e4d2eeaf5898c3920790400cb8d5349","observation_id":"66302a0f-e1f9-48af-8a1f-3809a69c10bb","resolution":{"observed_at":"2026-08-01T01:59:49.794527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T01:59:49.777615Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.777615Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:031b9d7fd4358c1db33b7b319a167bef71416f31d4b00c61ac059e916c663831","observation_id":"ef603cd2-3f3e-472d-9311-0db57add52cf","resolution":{"observed_at":"2026-08-01T01:59:49.777615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09764","last_updated":"2024-12-20T17:36:52Z","snapshot_observed_at":"2026-08-06T02:00:43.818545Z","submitted_at":"2024-12-12T23:56:57Z","title":"Memory Layers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09764","snapshot_observed_at":"2026-08-01T01:59:49.773747Z","title":"Memory layers at scale.arXiv preprint arXiv:2412.09764,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.773747Z"},"links":{"cited_paper":"/paper/2412.09764","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:a29b4caf1079b81d74273dc51024536d900d7619404f21abfbc680e55c3fa6d3","observation_id":"434605c4-975c-4aee-81f8-030c3887a850","resolution":{"observed_at":"2026-08-01T01:59:49.773747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:59:49.770279Z","title":"Llama-nemotron: Efficient reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.770279Z"},"links":{"citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:25ad1ec8ea04c3e1452f0a83054f4afa477d60e47bd124058368e6a28646938e","observation_id":"0d4e5623-24ae-43bf-86ce-3f5d50e05e2b","resolution":{"observed_at":"2026-08-01T01:59:49.770279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:33:49.293526Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.25614."}