{"as_of":"2026-08-21T17:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:070193d4f0481239abc9a6159b3f6a70f92a37ef0409937045bf7a948c465a4c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:58:46.775135Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T18:27:31.290744Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2310.02277","last_updated":"2026-04-30T14:28:10Z","snapshot_observed_at":"2026-08-15T00:50:40.778054Z","submitted_at":"2023-09-29T22:55:06Z","title":"Junk DNA Hypothesis: Pruning Small Pre-Trained Weights Irreversibly and Monotonically Impairs \"Difficult\" Downstream Tasks in LLMs","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-24T06:33:48.456209Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2310.02277"},"observation_digest":"sha256:0401ec65aa37099e61b1f8a69c56fbc24a244dab13edaf2fea4dfa45f7516ca0","observation_id":"97bee149-67c9-437e-a4ed-43bc82c1baff","resolution":{"observed_at":"2026-05-24T06:34:01.137921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-11T20:38:23.744646Z","title":"The lazy neuron phenomenon: On emergence of activation sparsity in transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05644","last_updated":"2024-12-16T12:12:19Z","snapshot_observed_at":"2026-08-17T04:45:59.341454Z","submitted_at":"2024-12-07T13:15:22Z","title":"Mixture of Hidden-Dimensions Transformer","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T20:38:23.744646Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2412.05644"},"observation_digest":"sha256:5fb733f49a79769de05fbc33811431389ee976c49b20410d3d6200d7cbf277b4","observation_id":"1f73b69a-b2e1-49d4-bc5a-c7312741f42e","resolution":{"observed_at":"2026-08-11T20:38:23.744646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-11T12:03:42.800530Z","title":"The lazy neuron phenomenon: On emergence of activation sparsity in transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14711","last_updated":"2025-02-27T16:33:09Z","snapshot_observed_at":"2026-08-14T22:43:45.227916Z","submitted_at":"2024-12-19T10:21:20Z","title":"ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:03:42.800530Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2412.14711"},"observation_digest":"sha256:e6e54276a8a808181fc602b13e63fc223378018a09a22363c088c5ecc0334e60","observation_id":"915e3ea1-e149-4e1a-b46c-622dfb12659e","resolution":{"observed_at":"2026-08-11T12:03:42.800530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-10T20:26:11.108797Z","title":"The lazy neuron phenomenon: On emergence of activation sparsity in transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09767","last_updated":"2025-01-15T05:17:12Z","snapshot_observed_at":"2026-08-16T01:50:09.153081Z","submitted_at":"2025-01-15T05:17:12Z","title":"LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:11.108797Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2501.09767"},"observation_digest":"sha256:ec3c67adf05614c7a9b920acc234894561d01d9cd584e79a93e407b9fe30efbb","observation_id":"4e4f57c0-1c42-4a96-8795-75d9ee719c5d","resolution":{"observed_at":"2026-08-10T20:26:11.108797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-16T05:58:46.775135Z","title":"The lazy neuron phenomenon: On emergence of activation sparsity in transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19449","last_updated":"2025-04-28T03:30:32Z","snapshot_observed_at":"2026-08-16T23:28:50.874978Z","submitted_at":"2025-04-28T03:30:32Z","title":"R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:58:46.775135Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2504.19449"},"observation_digest":"sha256:3871fd0708af644fbcc8d75b0ebc8322590eb76c3ea5fb16ff3c9b71631895b8","observation_id":"f88a3007-a501-41bf-878a-7ad8415b4cc7","resolution":{"observed_at":"2026-08-16T05:58:46.775135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-15T22:26:12.468222Z","title":"The lazy neuron phenomenon: On emergence of activation sparsity in transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07239","last_updated":"2025-05-12T05:29:30Z","snapshot_observed_at":"2026-08-18T15:16:05.977819Z","submitted_at":"2025-05-12T05:29:30Z","title":"Comet: Accelerating Private Inference for Large Language Model by Predicting Activation Sparsity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T22:26:12.468222Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2505.07239"},"observation_digest":"sha256:154de7ad9eb58333ea1e859d652954a69e8e13fb292d6062e81f8a6e7fda1aa8","observation_id":"1438d45b-527d-4d12-a0da-6bad59422f07","resolution":{"observed_at":"2026-08-15T22:26:12.468222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-07T11:18:55.401359Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03275","last_updated":"2025-06-03T18:03:32Z","snapshot_observed_at":"2026-08-13T16:49:10.720272Z","submitted_at":"2025-06-03T18:03:32Z","title":"Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:18:55.401359Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2506.03275"},"observation_digest":"sha256:b0e9c5d96adc9686d96235180565fa595535bb5807ccc016c0f1aa885f03c43e","observation_id":"b24b53d3-2be6-4049-9464-06003532ee3f","resolution":{"observed_at":"2026-08-07T11:18:55.401359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-07T10:48:16.101219Z","title":"Reddi, Ke Ye, Felix Chern, Felix Yu, Ruiqi Guo, and Sanjiv Kumar","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04434","last_updated":"2025-06-04T20:34:37Z","snapshot_observed_at":"2026-08-18T02:47:17.850776Z","submitted_at":"2025-06-04T20:34:37Z","title":"Grokking and Generalization Collapse: Insights from \\texttt{HTSR} theory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:48:16.101219Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2506.04434"},"observation_digest":"sha256:82441e9932a1f14400fe5f31c8d5181cb7d5255bce1c1c8e65cd8b9d1c6e5c81","observation_id":"1a1a5db6-4e9c-4e59-96f2-a8c92a668b79","resolution":{"observed_at":"2026-08-07T10:48:16.101219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-06T05:11:11.595425Z","title":"S.; Reddi, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02128","last_updated":"2025-08-04T07:22:36Z","snapshot_observed_at":"2026-08-20T15:47:45.059933Z","submitted_at":"2025-08-04T07:22:36Z","title":"Amber Pruner: Leveraging N:M Activation Sparsity for Efficient Prefill in Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:11:11.595425Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2508.02128"},"observation_digest":"sha256:dcefb8b3a069881e114e228b42e3f8615c094d397d72c90575dce270fbbab820","observation_id":"6388bbb7-dceb-4a14-9ec8-611602308aa8","resolution":{"observed_at":"2026-08-06T05:11:11.595425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-05T23:03:07.440296Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06016","last_updated":"2025-08-08T05:04:28Z","snapshot_observed_at":"2026-08-19T16:29:54.404997Z","submitted_at":"2025-08-08T05:04:28Z","title":"Crisp Attention: Regularizing Transformers via Structured Sparsity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:03:07.440296Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2508.06016"},"observation_digest":"sha256:98176942f2ead8f221629fc4beca246b438ab0bbd9676308e757d0affa78fb24","observation_id":"e31e9b2d-2c6b-4703-ab7b-274c0b4f0c06","resolution":{"observed_at":"2026-08-05T23:03:07.440296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T22:19:25.483640Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:05f25ede36d17d7f2cfeaf87c1ef0086f4e0833b10a36f9c50b1ac1e3ca783c6","observation_id":"eeb54b6e-a17f-4169-898f-6cae69b3dcae","resolution":{"observed_at":"2026-05-16T22:21:18.949994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T11:54:29.436149Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:066e1f6574a220b798188d1b56fc5d6255fe9555bbcf11a850d12f8c4a240446","observation_id":"0936c42e-cb5c-403d-b525-cc74cd0df84e","resolution":{"observed_at":"2026-05-22T11:54:51.146000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2605.17659","last_updated":"2026-05-20T20:56:41Z","snapshot_observed_at":"2026-08-14T02:50:30.487943Z","submitted_at":"2026-05-17T21:29:20Z","title":"Bug or Feature$^2$: Weight Drift, Activation Sparsity and Spikes","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T13:46:32.405079Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2605.17659"},"observation_digest":"sha256:6792e3de7a0a0a0c0a55fb7ec64a4220995105e6ed18f760ee10c86f826e8eab","observation_id":"047b9255-d160-4b86-8fbe-ba0c1ec7180a","resolution":{"observed_at":"2026-05-20T13:48:19.635502Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2605.17659","last_updated":"2026-05-20T20:56:41Z","snapshot_observed_at":"2026-08-14T02:50:30.487943Z","submitted_at":"2026-05-17T21:29:20Z","title":"Bug or Feature$^2$: Weight Drift, Activation Sparsity and Spikes","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T09:15:32.395442Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2605.17659"},"observation_digest":"sha256:c54afa4153310441561f3add39d290a3247a6d75e68286449ec09c852d7991cb","observation_id":"4b62806c-ff95-45ef-9438-db877f0205a1","resolution":{"observed_at":"2026-05-22T09:16:19.691350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":"2210.06313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-07-10T18:27:31.290744Z","title":"Large models are parsimonious learners: Activation sparsity in trained transformers","venue":"cs.LG","work_id":"1b080b9a-0841-4c64-95fd-5bb2f0c6012a","year":2022},"citing_paper":{"arxiv_id":"2607.07670","last_updated":"2026-07-08T17:24:43Z","snapshot_observed_at":"2026-08-19T04:45:27.255531Z","submitted_at":"2026-07-08T17:24:43Z","title":"Does Bielik Know What It Doesn't Know? Activation Dispersion Separates Entity Familiarity from Factual Reliability Across Model Scale","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-10T18:22:48.495407Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2607.07670"},"observation_digest":"sha256:7bfef88f81f5fdaa188e596f18b9f220afb5eb53961eb2b3b0f2d602d733a3f3","observation_id":"fc955751-b453-4718-8e47-8513aa42b2f2","resolution":{"observed_at":"2026-07-10T18:27:31.292588Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06313","snapshot_observed_at":"2026-08-02T04:52:40.385460Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-14T11:04:34.183607Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:40.385460Z"},"links":{"cited_paper":"/paper/2210.06313","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:8300828634c2670b6ae42afb8ab3a8947940e3c4e3354cb50c97fa068f54bb14","observation_id":"14a78b9a-81b6-4c22-9a92-829b0a12ab87","resolution":{"observed_at":"2026-08-02T04:52:40.385460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.06313/citation-record","integrity":"/paper/2210.06313/integrity","json":"/paper/2210.06313/citation-record.json","paper":"/paper/2210.06313"},"outbound":[],"paper":{"arxiv_id":"2210.06313","last_updated":"2023-06-09T21:53:43Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T05:19:24.411013Z","submitted_at":"2022-10-12T15:25:19Z","title":"The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2210.06313."}