{"as_of":"2026-08-17T22:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a1558ff63afd18aab4b1c22c2f1772ef7e3b350e39aba8e19fa64567024ae0c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:58:47.118068Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T11:36:55.495533Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2306.14048","last_updated":"2023-12-18T19:10:00Z","snapshot_observed_at":"2026-08-06T19:19:02.165567Z","submitted_at":"2023-06-24T20:11:14Z","title":"H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T18:00:50.053377Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2306.14048"},"observation_digest":"sha256:5c194846129d6583fafc739365d780eed0b30e457ff57adf5924ed6b6ff2cbfa","observation_id":"11843369-3084-452a-be33-b5b9ae8df156","resolution":{"observed_at":"2026-05-17T18:00:50.448044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":267,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:b93bcddf90e6d356909c287ba17f6829a20d1fe768ff3d20adb567f9a6c1512b","observation_id":"448c3dde-710e-4f4c-9dbf-5fef9b597f70","resolution":{"observed_at":"2026-05-19T20:28:39.198473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-12T12:07:30.262218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17525","last_updated":"2024-11-26T15:35:44Z","snapshot_observed_at":"2026-08-17T12:36:14.108141Z","submitted_at":"2024-11-26T15:35:44Z","title":"Pushing the Limits of Large Language Model Quantization via the Linearity Theorem","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T12:07:30.262218Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2411.17525"},"observation_digest":"sha256:f3981b4c364bee1c085855e12b439995d72b122b9f5e28531c421a12129144d5","observation_id":"f5c7acba-c9af-4b5d-a774-2f36e9dc24ba","resolution":{"observed_at":"2026-08-12T12:07:30.262218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-12T10:22:09.390014Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00143","last_updated":"2026-06-20T01:27:51Z","snapshot_observed_at":"2026-08-14T06:56:07.326038Z","submitted_at":"2024-11-28T19:00:28Z","title":"Is Oracle Pruning the True Oracle?","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-12T10:22:09.390014Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2412.00143"},"observation_digest":"sha256:9860253e188194ac4c0e8096cee7a2b19f6106690e83bec246046db9deb9e4d1","observation_id":"9b90b74d-5545-4467-977d-8d61c9cd376f","resolution":{"observed_at":"2026-08-12T10:22:09.390014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-11T12:53:33.568841Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13795","last_updated":"2025-08-04T10:49:54Z","snapshot_observed_at":"2026-08-17T01:29:15.186887Z","submitted_at":"2024-12-18T12:39:53Z","title":"Mix-LN: Unleashing the Power of Deeper Layers by Combining Pre-LN and Post-LN","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T12:53:33.568841Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2412.13795"},"observation_digest":"sha256:570f228f2f94cb4cee358c4c9d71575cbe32cee9f3463823f1b04fc569bd0571","observation_id":"74ef1976-1e15-49df-8559-fd95f273015c","resolution":{"observed_at":"2026-08-11T12:53:33.568841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-09T19:42:41.430360Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00258","last_updated":"2025-06-23T21:39:56Z","snapshot_observed_at":"2026-08-10T16:12:10.810877Z","submitted_at":"2025-02-01T01:35:23Z","title":"ProxSparse: Regularized Learning of Semi-Structured Sparsity Masks for Pretrained LLMs","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T19:42:41.430360Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2502.00258"},"observation_digest":"sha256:9fb4aab23f184289b17b884b0964415b07f930cc0dc9cfa3f8f51b027d9865f6","observation_id":"ed13a50e-67c2-4b94-b76c-a7dbe3d16b68","resolution":{"observed_at":"2026-08-09T19:42:41.430360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-09T17:37:39.618406Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00840","last_updated":"2025-06-10T17:24:15Z","snapshot_observed_at":"2026-08-13T15:05:06.722247Z","submitted_at":"2025-02-02T16:25:48Z","title":"Activation Approximations Can Incur Safety Vulnerabilities Even in Aligned LLMs: Comprehensive Analysis and Defense","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T17:37:39.618406Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2502.00840"},"observation_digest":"sha256:beeace2ca7ca15a26262d5d1d6407bdb0a12944441e5f6759f78ff94d0d631bb","observation_id":"960c1af9-ac41-4784-877c-0b3489ae88f3","resolution":{"observed_at":"2026-08-09T17:37:39.618406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-08T15:37:37.544678Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-17T00:55:48.139522Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.544678Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:c547f913312ea30eca299bc0a9ca629b3b216b858412640a7b144b0e47935afe","observation_id":"d13183e9-b65c-4b3f-bdb4-2e5a59b3ff48","resolution":{"observed_at":"2026-08-08T15:37:37.544678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-16T05:58:47.118068Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19449","last_updated":"2025-04-28T03:30:32Z","snapshot_observed_at":"2026-08-16T23:28:50.874978Z","submitted_at":"2025-04-28T03:30:32Z","title":"R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:58:47.118068Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2504.19449"},"observation_digest":"sha256:26a492f7b462882c205d90ff8d44a6c29dbd9723fd3f1df88ca4c52bf811df93","observation_id":"d2726795-01f5-4ed3-8fca-8eedcd883b9e","resolution":{"observed_at":"2026-08-16T05:58:47.118068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-16T04:17:58.317981Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01731","last_updated":"2025-05-21T01:38:25Z","snapshot_observed_at":"2026-08-16T06:52:33.556888Z","submitted_at":"2025-05-03T07:57:02Z","title":"Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:17:58.317981Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.01731"},"observation_digest":"sha256:d7f74518bc5816d225e2502d2badfc5b251dc306a8a705b32dd0bf4a536f31eb","observation_id":"14089137-cf2e-463d-ad5b-558a5d729da8","resolution":{"observed_at":"2026-08-16T04:17:58.317981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-15T20:44:32.127470Z","title":"arXiv preprint arXiv:2310.05175","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12216","last_updated":"2025-05-25T06:23:30Z","snapshot_observed_at":"2026-08-16T12:39:32.038611Z","submitted_at":"2025-05-18T03:26:07Z","title":"One-for-All Pruning: A Universal Model for Customized Compression of Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:44:32.127470Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.12216"},"observation_digest":"sha256:be2e9976dd7d682c962609f71563f547b70026a12fb86c7982569cfdabfae926","observation_id":"0ac7c410-f328-4c0c-b2d5-37322410a269","resolution":{"observed_at":"2026-08-15T20:44:32.127470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2505.17138","last_updated":"2026-05-18T17:05:12Z","snapshot_observed_at":"2026-08-17T13:25:30.263845Z","submitted_at":"2025-05-22T06:12:42Z","title":"RAP: Runtime Adaptive Pruning for LLM Inference","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T13:20:41.739571Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.17138"},"observation_digest":"sha256:2cc4a20aef3c76956a56623cca1b82d0f2eb3df55a06a055092553f63aaf4d02","observation_id":"46f4ccdc-ee8c-4393-9781-ae7f3bc2ea3d","resolution":{"observed_at":"2026-05-22T13:21:35.520787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-07T14:44:22.533903Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17909","last_updated":"2025-05-23T13:53:21Z","snapshot_observed_at":"2026-08-17T19:18:33.391509Z","submitted_at":"2025-05-23T13:53:21Z","title":"NeuroTrails: Training with Dynamic Sparse Heads as the Key to Effective Ensembling","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T14:44:22.533903Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.17909"},"observation_digest":"sha256:b0994971cfbd91419067bedbfea8a684f089b4985337095d40768392c548f411","observation_id":"83154707-d389-4e84-a03c-0e9a35a6b810","resolution":{"observed_at":"2026-08-07T14:44:22.533903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-07T14:30:22.213839Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18713","last_updated":"2025-05-24T14:27:20Z","snapshot_observed_at":"2026-08-14T17:29:30.813267Z","submitted_at":"2025-05-24T14:27:20Z","title":"Neural Parameter Search for Slimmer Fine-Tuned Models and Better Transfer","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T14:30:22.213839Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.18713"},"observation_digest":"sha256:9940f21d81df4fa963e0ab7c39dd6b34a6202368728b5edfb6f4387f76d440ad","observation_id":"32beb716-12c2-45f8-8030-a20d36cd74e8","resolution":{"observed_at":"2026-08-07T14:30:22.213839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-07T13:30:20.966547Z","title":"Out- lier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22689","last_updated":"2025-05-28T03:01:28Z","snapshot_observed_at":"2026-08-10T19:31:13.796459Z","submitted_at":"2025-05-28T03:01:28Z","title":"SlimLLM: Accurate Structured Pruning for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.966547Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2505.22689"},"observation_digest":"sha256:5429d06c4cf34891090256d6ea0fbbd9a2591d665e1070b64f10b4cb0adcd20e","observation_id":"da610b3d-80d9-4024-817f-9d69ad6fc237","resolution":{"observed_at":"2026-08-07T13:30:20.966547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-07T06:00:51.939296Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06280","last_updated":"2025-08-18T03:36:09Z","snapshot_observed_at":"2026-08-14T10:18:10.021430Z","submitted_at":"2025-06-06T17:59:28Z","title":"Eigenspectrum Analysis of Neural Networks without Aspect Ratio Bias","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T06:00:51.939296Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2506.06280"},"observation_digest":"sha256:979134ba2b1f25953cb6ecbba7539b766e52a71a67f9e46f3d0fcca095406934","observation_id":"52659e9c-dcc0-4cf0-ae10-318c363af065","resolution":{"observed_at":"2026-08-07T06:00:51.939296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2506.12876","last_updated":"2026-05-13T04:56:46Z","snapshot_observed_at":"2026-08-01T16:23:25.586402Z","submitted_at":"2025-06-15T15:02:59Z","title":"MaskPro: Linear-Space Probabilistic Learning for Strict (N:M)-Sparsity on LLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T09:01:16.991413Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2506.12876"},"observation_digest":"sha256:42bb80b5506fe99ba036eb0b12d250c10d2d6cfe641660b03ff1951d5fa6b9de","observation_id":"1bec7733-1361-4ff9-ad4c-546b2a85b73f","resolution":{"observed_at":"2026-05-19T09:02:14.387859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-15T16:52:43.574471Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00096","last_updated":"2025-09-03T14:58:03Z","snapshot_observed_at":"2026-08-15T16:46:49.896755Z","submitted_at":"2025-08-27T15:48:18Z","title":"Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:52:43.574471Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2509.00096"},"observation_digest":"sha256:341a900016567429b21a2c955eb67e87c471fa6460286450d2e384676b5fc0fb","observation_id":"4e180557-d46f-47e4-a24b-c577b55b8202","resolution":{"observed_at":"2026-08-15T16:52:43.574471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-15T16:32:08.636003Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04442","last_updated":"2025-09-04T17:59:06Z","snapshot_observed_at":"2026-08-16T04:25:40.473764Z","submitted_at":"2025-09-04T17:59:06Z","title":"Delta Activations: A Representation for Finetuned Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T16:32:08.636003Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2509.04442"},"observation_digest":"sha256:d78c15bf8b66279a65687f06e00ca1cf260915088f54f27b8f19f6dd77459e22","observation_id":"e0f43d3f-f8d2-42ae-ae1f-deaa3e0bce1e","resolution":{"observed_at":"2026-08-15T16:32:08.636003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:19:25.483640Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:fb142fec179321861c27e55461c9517708c1d6fec9e95b496e6d01c4ab8818c6","observation_id":"952dc2fc-7852-4694-9327-6cd42dbbdd40","resolution":{"observed_at":"2026-05-16T22:21:19.037429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T11:54:29.436149Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:a6e3a6061327ea1ea670bfce64aaf25f2b8d28d75b5f10d0a520f626bd549533","observation_id":"90f5a7c0-0544-485c-ad71-94a51b8662c0","resolution":{"observed_at":"2026-05-22T11:54:51.140973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2602.01997","last_updated":"2026-08-06T07:02:58Z","snapshot_observed_at":"2026-08-11T05:49:31.410586Z","submitted_at":"2026-02-02T11:57:22Z","title":"On the Limits of Layer Pruning for Generative Reasoning in Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T08:40:24.822863Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2602.01997"},"observation_digest":"sha256:7e2800fb730b3863d1621317c34be9878ddac0de0ac26b76fcc8a1729516b90b","observation_id":"404d1b5a-ddc4-4427-ac05-c62881a698b7","resolution":{"observed_at":"2026-05-16T08:40:46.210559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:074eda66ed96a98f9c422b41ee22c2875c88d0c3bf3703eb5dbe1a1e84e19ed8","observation_id":"906bb0b8-06fc-4300-b667-5d930d75d4fe","resolution":{"observed_at":"2026-05-15T14:35:55.593637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-14T20:29:33.439034Z","title":"Outlier weighed layerwise spar- sity (owl): A missing secret sauce for pruning llms to high sparsity.arXiv preprint arXiv:2310.05175,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.15389","last_updated":"2026-06-27T04:53:36Z","snapshot_observed_at":"2026-08-15T00:08:32.541686Z","submitted_at":"2026-03-16T15:04:16Z","title":"When Does Sparsity Mitigate the Curse of Depth in LLMs","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T20:29:33.439034Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2603.15389"},"observation_digest":"sha256:ec8f7e2581383c42d3a89e82a11d57eba142e1c0bd84af5e0cdd6d075a545cc4","observation_id":"234eb3a6-f68e-4e52-a3f0-07822113151f","resolution":{"observed_at":"2026-07-14T20:29:33.439034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2604.16502","last_updated":"2026-06-04T06:39:21Z","snapshot_observed_at":"2026-08-11T15:51:14.054052Z","submitted_at":"2026-04-14T14:36:53Z","title":"Topology-Aware Layer Pruning for Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:21:04.009413Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2604.16502"},"observation_digest":"sha256:239a7b212447ff94307e5e98c4c41e6dadc4051e6a54d9ae9759170babe1758b","observation_id":"678f365a-05e4-48d7-8849-969fbbcc697a","resolution":{"observed_at":"2026-05-11T09:00:59.437599Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2605.02404","last_updated":"2026-08-09T12:23:21Z","snapshot_observed_at":"2026-08-16T06:53:16.829999Z","submitted_at":"2026-05-04T09:46:47Z","title":"Statistically-Lossless Quantization of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T16:22:13.399819Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2605.02404"},"observation_digest":"sha256:a85745f2ea09c0ec2de4dcffdd2b50da04f9161680674965b507dd1a3932e01c","observation_id":"0de93011-4927-4e08-ab1a-6efe76e48195","resolution":{"observed_at":"2026-05-11T16:31:10.043243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2605.06216","last_updated":"2026-05-07T13:16:18Z","snapshot_observed_at":"2026-08-12T23:00:33.721101Z","submitted_at":"2026-05-07T13:16:18Z","title":"TIDE: Every Layer Knows the Token Beneath the Context","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-08T10:35:46.447739Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2605.06216"},"observation_digest":"sha256:feaf6458822e504e67402149485f5dad47c40e7c577226b491a5f6256678a899","observation_id":"abd95f39-4c6e-47cc-9eaa-2eb195b38b3e","resolution":{"observed_at":"2026-05-11T19:56:09.947767Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2605.06402","last_updated":"2026-05-07T15:11:45Z","snapshot_observed_at":"2026-08-13T05:47:30.385277Z","submitted_at":"2026-05-07T15:11:45Z","title":"SparseForge: Efficient Semi-Structured LLM Sparsification via Annealing of Hessian-Guided Soft-Mask","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T12:46:30.820552Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2605.06402"},"observation_digest":"sha256:81e2728d8b7fa7a5f15db6b62142d093f6ad1d1ae7254ac023cc2c016d59f1ef","observation_id":"71621750-b6f7-4726-98b4-06102c244475","resolution":{"observed_at":"2026-05-11T19:06:08.474183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2605.13997","last_updated":"2026-05-13T18:07:12Z","snapshot_observed_at":"2026-08-11T08:00:02.994501Z","submitted_at":"2026-05-13T18:07:12Z","title":"HodgeCover: Higher-Order Topological Coverage Drives Compression of Sparse Mixture-of-Experts","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-15T05:54:32.496951Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2605.13997"},"observation_digest":"sha256:0855d40b31fa5f7e9d51ec49fc8e608421234198987ae274c0294ac1dfe27d0d","observation_id":"78fbfdb7-9ba3-415b-8a08-c6aea7a17c34","resolution":{"observed_at":"2026-05-15T05:55:04.754307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2605.21104","last_updated":"2026-05-20T12:34:58Z","snapshot_observed_at":"2026-08-16T03:40:44.810221Z","submitted_at":"2026-05-20T12:34:58Z","title":"HORST: Composing Optimizer Geometries for Sparse Transformer Training","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-21T06:28:22.117741Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2605.21104"},"observation_digest":"sha256:59f6951f10195b04314bfd72478aa6f5fe521f4ee82039513714eca711cf7793","observation_id":"d4ec3a4c-ed00-4e7f-9a9d-b11052073fc2","resolution":{"observed_at":"2026-05-21T06:29:42.121353Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":"2310.05175","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-02T11:36:55.495533Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":"30830665-b77d-4751-98dd-78af4465c909","year":2023},"citing_paper":{"arxiv_id":"2606.05538","last_updated":"2026-06-04T00:43:20Z","snapshot_observed_at":"2026-08-12T18:39:40.723016Z","submitted_at":"2026-06-04T00:43:20Z","title":"Less is MoE: Trimming Experts in Domain-Specialist Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T03:11:23.755739Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2606.05538"},"observation_digest":"sha256:5fa967eb8ff0b8be47de704539bb922db575ce49a702765e7c5617f2f8e6e624","observation_id":"da8fed3b-558d-4a8a-9c82-6a98b86bd284","resolution":{"observed_at":"2026-07-02T11:36:55.497707Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-07-13T04:43:05.157923Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09204","last_updated":"2026-07-10T08:49:39Z","snapshot_observed_at":"2026-08-10T01:03:51.237994Z","submitted_at":"2026-07-10T08:49:39Z","title":"Complexity-Guided Component-wise Initialization for Language Model Pretraining","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T04:43:05.157923Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2607.09204"},"observation_digest":"sha256:766acb956f4fd6d7bf5b76896b782a639e71ac81b946e03a4d1f155b09fcb313","observation_id":"d029573f-fa06-4b00-921f-cdcb2dfd9020","resolution":{"observed_at":"2026-07-13T04:43:05.157923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-05T10:26:24.542193Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03887","last_updated":"2026-08-04T16:22:30Z","snapshot_observed_at":"2026-08-15T04:18:24.821304Z","submitted_at":"2026-08-04T16:22:30Z","title":"Omega-S: A Functional Resilience Index for LLM Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:26:24.542193Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2608.03887"},"observation_digest":"sha256:56956968407b48b09df98ad340394f926e9ab48dbefefa0e388638ecd29c94ea","observation_id":"439dc281-0d6d-4b2f-87ae-a8e357a1c8fc","resolution":{"observed_at":"2026-08-05T10:26:24.542193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-10T18:47:14.121790Z","title":"arXiv preprint arXiv:2310.05175 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06901","last_updated":"2026-08-07T07:36:19Z","snapshot_observed_at":"2026-08-17T08:27:34.694765Z","submitted_at":"2026-08-07T07:36:19Z","title":"Prune Once: Retraining-Free Task-Agnostic Pruning for Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:47:14.121790Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2608.06901"},"observation_digest":"sha256:5074dd5f05fbaadbba2a11249f81d80b770990a1823a503ab33274c0e0082678","observation_id":"5e1e48da-62d4-4e61-af21-c3241e6000ff","resolution":{"observed_at":"2026-08-10T18:47:14.121790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05175/citation-record","integrity":"/paper/2310.05175/integrity","json":"/paper/2310.05175/citation-record.json","paper":"/paper/2310.05175"},"outbound":[],"paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:54:04.707528Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2310.05175."}