{"as_of":"2026-08-09T06:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:228ce0afd27d617f76387fc979b8b5f698dfb8bf250bd39365073b4176ef3d58","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T04:08:39.594367Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09287/citation-record","integrity":"/paper/2607.09287/integrity","json":"/paper/2607.09287/citation-record.json","paper":"/paper/2607.09287"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.16405","last_updated":"2024-02-02T14:53:14Z","snapshot_observed_at":"2026-08-07T04:07:00.490666Z","submitted_at":"2024-01-29T18:43:49Z","title":"Scaling Sparse Fine-Tuning to Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16405","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Scaling sparse fine-tuning to large language models.arXiv preprint arXiv:2401.16405,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2401.16405","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:9f7d415c3409c19145e06ea63224ff0ff8baae4801c1335ed7c91917ba7775df","observation_id":"ad14e144-d21f-4ae8-aec8-dae0ee02fcdb","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Gallop: Gradient-based sparse learning on low-magnitude parameters.arXiv preprint arXiv:2510.19778,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:ce341a7ef283c4eae0040fec741c06bdea705b6b7bd8a5e855bd4bd0d13f898c","observation_id":"69a59fa8-6578-4f99-b66e-8686dee62963","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.19778","doi":"10.48550/arxiv.2510.19778","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Karl Cobbe, Vineet Kosaraju, Mohammad Bavarian, Mark Chen, Heewoo Jun, Lukasz Kaiser, Matthias Plappert, Jerry Tworek, Jacob Hilton, Reiichiro Nakano, et al","venue":"ArXiv.org","work_id":"93b9bfca-9f8e-45a2-a172-31f4eb1b82d0","year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:035b1762223c7db92d1decf0f59ea3f800de845cfbab4b56875ce2ec5b419f1a","observation_id":"46949af6-813f-4d59-8110-6f2e97c88119","resolution":{"observed_at":"2026-07-13T04:09:18.631438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-13T07:19:53.258795+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T07:19:53.258795+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02214","last_updated":"2024-11-02T06:00:03Z","snapshot_observed_at":"2026-08-04T13:15:41.775650Z","submitted_at":"2024-06-04T11:14:21Z","title":"SLTrain: a sparse plus low-rank approach for parameter and memory efficient pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02214","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Sltrain: a sparse plus low-rank approach for parameter and memory efficient pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2406.02214","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:c9cdde1126356b631951db7e1a46d38f347388035183e6025a14d3a48ab4bc0c","observation_id":"2d914d76-aefd-4b87-b037-c398446fd5b0","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Learning to solve arithmetic word problems with verb categorization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:9a1baf5f989c09936c3e0b22b67045da0573ab7a93d9b580d75db4f6f7ed1958","observation_id":"167fcd97-5dd6-474d-a9e6-6e23631947ef","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:aadc3b3fb774ea7d18147f243bacf0471e9e972299c25595efac99bee3706fab","observation_id":"1a7d9844-56aa-4933-97e6-dbf20e0fab69","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11439","last_updated":"2025-07-24T18:14:45Z","snapshot_observed_at":"2026-08-07T18:13:43.520890Z","submitted_at":"2025-02-17T04:54:42Z","title":"An Efficient Sparse Fine-Tuning with Low Quantization Error via Neural Network Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11439","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"An efficient sparse fine-tuning with low quantization error via neural network pruning.arXiv preprint arXiv:2502.11439,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2502.11439","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:0bfaf6f0dc3baf5e203fe271dfa794a4d94b60d9bea961e01a3964caef80759f","observation_id":"8a68ca6f-f98b-40c9-a624-23ba4ade3f9c","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Program induction by rationale genera- tion: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:86bfb420ef62d82198d72279e6d8841a81267988dec8362031264bb6b759775f","observation_id":"0d3738e6-5bf6-4afd-96bd-8c0036ed2584","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Dora: Weight-decomposed low-rank adaptation.arXiv preprint arXiv:2402.09353,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:424b02e858257bfb930a1124dd77339360ada0f9c73247866a2f60ad9b8b6a05","observation_id":"78d3410a-7aee-47f2-9a1c-686e36e9731f","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01392","last_updated":"2024-06-06T16:38:34Z","snapshot_observed_at":"2026-08-06T04:48:38.625443Z","submitted_at":"2024-06-03T14:56:09Z","title":"Sparsity-Accelerated Training for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01392","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"org/2025.acl-long.1541/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2406.01392","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:49e517a7da2df5016c3baf51d775ea592212675d162b34c40b4c3d0a40fda542","observation_id":"093be92d-4679-48e1-93a1-1f90377c6918","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04679","last_updated":"2024-06-03T06:59:31Z","snapshot_observed_at":"2026-08-03T01:46:05.289935Z","submitted_at":"2024-01-09T17:09:01Z","title":"RoSA: Accurate Parameter-Efficient Fine-Tuning via Robust Adaptation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04679","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Rosa: Accurate parameter-efficient fine-tuning via robust adaptation.arXiv preprint arXiv:2401.04679,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2401.04679","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:3a020205494b07096d0020bb29128cbd0089dff358efdbe781d4cdf5f7a74512","observation_id":"37b5cca5-772e-4a5f-8584-f87d1fe4ee1d","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07191","last_updated":"2021-04-15T06:11:12Z","snapshot_observed_at":"2026-08-07T13:11:17.300265Z","submitted_at":"2021-03-12T10:23:47Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.07191","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Are nlp models really able to solve simple math word problems?arXiv preprint arXiv:2103.07191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2103.07191","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:1e03e559a95850b5c3237c8831482017bd9acb51485bb1b6339f0ef13ad6ec70","observation_id":"0f88c719-42cd-43ac-9e97-214c7f146209","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.01413","last_updated":"2016-08-20T11:50:41Z","snapshot_observed_at":"2026-07-06T05:05:58.291779Z","submitted_at":"2016-08-04T01:47:23Z","title":"Solving General Arithmetic Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.01413","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Solving general arithmetic word problems.arXiv preprint arXiv:1608.01413,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/1608.01413","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:abe729c56f05c1c97b2e6acf6676f256f5a6a4c9cf543de0bacf682e9d8d587f","observation_id":"22d1c5b2-6e5e-46ad-ab30-960877bc9376","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11875","last_updated":"2024-06-08T03:29:17Z","snapshot_observed_at":"2026-07-06T17:05:06.923713Z","submitted_at":"2023-12-19T06:06:30Z","title":"Sparse is Enough in Fine-tuning Pre-trained Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11875","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Sparse is enough in fine-tuning pre-trained large language models.arXiv preprint arXiv:2312.11875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2312.11875","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:84fd222f43bcd5f41112e5716aea6b7578c5b8c2907ed4392dd2533988e82011","observation_id":"0d5e775e-ab87-4672-966f-96573f51e73d","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"A simple and effective pruning approach for large language models.arXiv preprint arXiv:2306.11695,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:29478864c68f7c69d47dcc69c04bb442b489140d8f3a5d554f214a0334dfa86c","observation_id":"b0f0f5b0-db12-4ef0-8497-96a412f042e7","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11621","last_updated":"2024-03-18T09:55:01Z","snapshot_observed_at":"2026-08-01T23:39:04.005780Z","submitted_at":"2024-03-18T09:55:01Z","title":"Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11621","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Let’s focus on neuron: Neuron-level supervised fine-tuning for large language model.arXiv preprint arXiv:2403.11621,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2403.11621","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:a926191bfd1d2ccacbf8443af8e386dfaa636532e055ecdd662f780fcafc977a","observation_id":"b1e6a095-d3e6-4f8a-9e17-8f0c36160bd9","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06289","last_updated":"2024-12-19T18:47:54Z","snapshot_observed_at":"2026-07-06T20:03:42.903210Z","submitted_at":"2024-12-09T08:24:11Z","title":"S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06289","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"S2ft: Efficient, scalable and generalizable llm fine-tuning by structured sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2412.06289","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:df5f543aaa10c76b6aded044b44fa5652142954af590cdcb4eb74d6ca95d8e26","observation_id":"c9f00262-f308-48fc-8c1f-ed6329db4db5","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Adaptive budget allocation for parameter-efficient fine-tuning.arXiv preprint arXiv:2303.10512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:881625a67fd2d143aeab42d1466de92e76d1ed349b2656576c23a2248e15a0b0","observation_id":"19775c8f-c5b9-4790-933b-8f75b9c364af","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15300","last_updated":"2024-08-27T14:41:14Z","snapshot_observed_at":"2026-08-07T05:38:13.866669Z","submitted_at":"2024-08-27T14:41:14Z","title":"GIFT-SW: Gaussian noise Injected Fine-Tuning of Salient Weights for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15300","snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Gift-sw: Gaussian noise injected fine-tuning of salient weights for llms.arXiv preprint arXiv:2408.15300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"cited_paper":"/paper/2408.15300","citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:00964bf7187d3b4edec88dbfe483229e261d619829555a8ac991d64cd782e615","observation_id":"db059159-49d4-450f-af3d-46e5f1e1d03b","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"All trainable masks use C4 calibration and approximately 5.6M trainable sparse parameters","venue":null,"work_id":null,"year":2050},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:a6a5e0cba1860ba64172c0cd8ffa9827f079f5ae99e2f52211f377782f091ab0","observation_id":"71761943-a945-4ba0-a4e6-808937660f68","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Full fine-tuning is an unbudgeted reference row separated by rules","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:64892d0c4211bcceba7ee917940e4ee42dfe666e2de7907f447a36a82c0b8262","observation_id":"8cb73a3b-0f5a-4e4e-b7b5-5bf03e12f41e","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Each row uses the learning rate selected by the held-out validation split of the fine-tuning set","venue":null,"work_id":null,"year":2072},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:715c7bda15060ab4a9ffcf2c8f0cb2e8eb0c1a17ff2c40ea56931a605e375a63","observation_id":"dba6f14f-42f3-4146-ba0b-d7b4de02e82b","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T04:08:39.594367Z","title":"Lower is better","venue":null,"work_id":null,"year":2079},"citing_paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T04:08:39.594367Z"},"links":{"citing_paper":"/paper/2607.09287"},"observation_digest":"sha256:e8c272b206e9362fc9aa546387bbdbedf6f037d96b5b5d0d11df4005301c7d2f","observation_id":"69f67018-2435-45f1-b8d0-149452e377ad","resolution":{"observed_at":"2026-07-13T04:08:39.594367Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09287","last_updated":"2026-07-10T10:55:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T10:40:57.712485Z","submitted_at":"2026-07-10T10:55:28Z","title":"Super-Tuning: From Activation-Aware Pruning to Sparse Fine-Tuning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.09287."}