{"as_of":"2026-08-19T05:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:954cc8b750050995e56b10b195924b6d9920b0dda8ef8fc3db4ab3686dbbf0bd","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:47:21.132773Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T00:57:22.872902Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:59:53.047847Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"cited_work":{"arxiv_id":"2508.17734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.17734","snapshot_observed_at":"2026-07-04T12:59:53.047847Z","title":"Layerwise importance analysis of feed-forward networks in transformer-based language models.arXiv preprint arXiv:2508.17734,","venue":null,"work_id":"1e9e0cb4-2466-4a7f-b01e-4131ceda77bb","year":2025},"citing_paper":{"arxiv_id":"2606.18246","last_updated":"2026-06-16T17:59:03Z","snapshot_observed_at":"2026-08-02T16:01:00.670614Z","submitted_at":"2026-06-16T17:59:03Z","title":"Variable-Width Transformers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T00:57:22.872902Z"},"links":{"cited_paper":"/paper/2508.17734","citing_paper":"/paper/2606.18246"},"observation_digest":"sha256:772c477a3767c918ea40348d2e3e773bdf5dc3444e56749966053e4d6caeccaa","observation_id":"75d245b3-9045-4ee3-85c4-756a16af6286","resolution":{"observed_at":"2026-07-03T20:58:58.615011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"cited_work":{"arxiv_id":"2508.17734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.17734","snapshot_observed_at":"2026-07-04T12:59:53.047847Z","title":"Layerwise importance analysis of feed-forward networks in transformer-based language models.arXiv preprint arXiv:2508.17734,","venue":null,"work_id":"1e9e0cb4-2466-4a7f-b01e-4131ceda77bb","year":2025},"citing_paper":{"arxiv_id":"2606.23670","last_updated":"2026-06-22T17:56:25Z","snapshot_observed_at":"2026-08-12T14:08:49.266214Z","submitted_at":"2026-06-22T17:56:25Z","title":"Tapered Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T09:11:20.341634Z"},"links":{"cited_paper":"/paper/2508.17734","citing_paper":"/paper/2606.23670"},"observation_digest":"sha256:47cbdbb3adf9090e763718b1fd16ce5be415bec170aec1c4e50cfed65217655d","observation_id":"ee9ca529-2ee5-49dd-8422-2fe3466f51a8","resolution":{"observed_at":"2026-07-04T10:09:44.020128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"cited_work":{"arxiv_id":"2508.17734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.17734","snapshot_observed_at":"2026-07-04T12:59:53.047847Z","title":"Layerwise importance analysis of feed-forward networks in transformer-based language models.arXiv preprint arXiv:2508.17734,","venue":null,"work_id":"1e9e0cb4-2466-4a7f-b01e-4131ceda77bb","year":2025},"citing_paper":{"arxiv_id":"2606.26620","last_updated":"2026-06-25T05:33:03Z","snapshot_observed_at":"2026-08-07T13:16:24.780198Z","submitted_at":"2026-06-25T05:33:03Z","title":"Discovering Millions of Interpretable Features with Sparse Autoencoders","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T05:34:00.754172Z"},"links":{"cited_paper":"/paper/2508.17734","citing_paper":"/paper/2606.26620"},"observation_digest":"sha256:0af9a00895f2db029827bc5d0a0e090ec9fe6a06f3c6a215207fe59b40c1f6e3","observation_id":"0f563cd1-4b6c-4763-8845-3367d29c930b","resolution":{"observed_at":"2026-07-04T12:59:53.049302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.17734/citation-record","integrity":"/paper/2508.17734/integrity","json":"/paper/2508.17734/citation-record.json","paper":"/paper/2508.17734"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T16:47:18.532533Z","title":"Qwen technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.532533Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:96b8df1fdbcd660d18d08a1fa35545d565092209cfefcbfabb71aa99156eacbc","observation_id":"08415b34-c8ec-4d53-8fcd-4c0a8ff2fd0e","resolution":{"observed_at":"2026-08-05T16:47:18.532533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-14T19:44:03.879127Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-05T16:47:18.639727Z","title":"Pythia: A suite for analyzing large language models across training and scaling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.639727Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:20b3648f5ce835b2b3891820f2fc4e6a50b22dbd687afa3824267344b9f105d9","observation_id":"f06ad9c0-03ab-48b7-8f58-b6fe934f4b68","resolution":{"observed_at":"2026-08-05T16:47:18.639727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:18.746514Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.746514Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:c0d448f4793d49cfa5add3dd40101563c2b96203e19a275c4defd5d7566bb0e7","observation_id":"f3fe1b96-9e49-4917-963e-e5658d3fad08","resolution":{"observed_at":"2026-08-05T16:47:18.746514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:18.828214Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.828214Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:8c165469d6796383e595fd4409a124a66772e3b297920b61643044c4e21b4d04","observation_id":"7c705f94-9853-46a2-8b65-f37140178d97","resolution":{"observed_at":"2026-08-05T16:47:18.828214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-05T16:47:18.893768Z","title":"Think you have solved question answering? try arc, the AI2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.893768Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:05481102e76e54bbe7724f0e91864716f35018cb9d70c08459b47894803418f2","observation_id":"d571667b-3af2-490d-8fb6-e837630800d7","resolution":{"observed_at":"2026-08-05T16:47:18.893768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:18.998554Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:18.998554Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:36e3f87c8cfe9d6ba3e92632f525953278f1e7f3f3162ec3333ecad558910147","observation_id":"0873c3d0-79dc-438e-b19d-dd25506c05c1","resolution":{"observed_at":"2026-08-05T16:47:18.998554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.075776Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.075776Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:e54fdad45476612a404e1fb93d609a3cf591e50d3c8891fb7cf99237f33dbfec","observation_id":"16a2b864-e812-49f6-8673-4dd97fe2f0a1","resolution":{"observed_at":"2026-08-05T16:47:19.075776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.132132Z","title":"Transformer feed-forward layers are key-value memories","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.132132Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:dce1e1eaa9c62580a6dd394b2263e38a3e220fed1a97dbd72d265e36c4400fc9","observation_id":"c35682f4-607b-4ee1-ac91-ebc8014652ff","resolution":{"observed_at":"2026-08-05T16:47:19.132132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T16:47:19.202280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.202280Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:175093ef812b1f0bc4046eb2ffa9409bb1c945684e31ff7988e310c0dc5bb0b1","observation_id":"1943563b-6490-44cf-853a-78278d546c1b","resolution":{"observed_at":"2026-08-05T16:47:19.202280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:22.284936Z","title":"Rae, and Laurent Sifre","venue":null,"work_id":"b128ebbd-50e4-4bba-a10a-af039fa5ed4a","year":2022},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.277780Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:f6748eeab9b906a22ec6fe8a4342d3ad1ae1d1f192c5c02843fd637eb180f238","observation_id":"ff1a42a7-6e55-4e63-8f60-4fd3d64b5a1a","resolution":{"observed_at":"2026-08-05T16:47:22.363906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.374322Z","title":"Mini CPM : Unveiling the potential of small language models with scalable training strategies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.374322Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:a18a9aff9cdb9836c8f812f5105da9227bfe56164578b00f705c137bc3e9fefc","observation_id":"06fc52a5-2750-4ee1-b643-03891995c460","resolution":{"observed_at":"2026-08-05T16:47:19.374322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:22.125125Z","title":"Analyzing feed-forward blocks in transformers through the lens of attention maps","venue":null,"work_id":"8e90e2c9-d7e1-4e0a-a50e-71c80dfbef94","year":2024},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.452666Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:e7c75dc8d3489a2575a5487fb7a63f512abb9fda291666b3d160b3921e3393f1","observation_id":"0977488b-6e2a-49b2-9b53-4e023aec2dc0","resolution":{"observed_at":"2026-08-05T16:47:22.181258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.04115","last_updated":"2017-06-13T15:17:42Z","snapshot_observed_at":"2026-08-14T20:54:20.322452Z","submitted_at":"2017-06-13T15:17:42Z","title":"Zero-Shot Relation Extraction via Reading Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.04115","snapshot_observed_at":"2026-08-05T16:47:19.543263Z","title":"Zero-shot relation extraction via reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.543263Z"},"links":{"cited_paper":"/paper/1706.04115","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:e374cb92c20f4afc3891ce21ad50c8c677319d1e638000dc01ad515aa74b1326","observation_id":"4a1ef59a-1d60-48bd-99f0-78470c794758","resolution":{"observed_at":"2026-08-05T16:47:19.543263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.611528Z","title":"Fineweb-edu: the finest collection of educational content, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.611528Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:18e5c321ed3299bb405ad682e52e3285de0e7350cc6b95458285be03150a10ad","observation_id":"40d18a0f-a0d7-4adb-b6c4-cd1bfafa7b65","resolution":{"observed_at":"2026-08-05T16:47:19.611528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.716827Z","title":"Locating and editing factual associations in GPT","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.716827Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:71cf409bf2c71a0cd13e19e5fc79ece299f11b6bbdf882b7e8e6573c3f747ebd","observation_id":"c5aa325c-95cb-4542-a1f4-f4ba8891f18a","resolution":{"observed_at":"2026-08-05T16:47:19.716827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:19.822444Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.822444Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:761653e3270334e55edf42e5f3cb46ddbe60803a80c6ebebfde23e1ab1491ff7","observation_id":"e3c5222e-edc2-490d-a694-27470fee8c60","resolution":{"observed_at":"2026-08-05T16:47:19.822444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:21.913623Z","title":null,"venue":null,"work_id":"5c4819e3-ebe4-4043-8769-1b586fadce6c","year":2022},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:19.931430Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:47d0a521eea292b521c9e297181587e1a003b71b44c4e246dc9d8415301d71f6","observation_id":"05207cd3-ff60-4b7d-a1b6-338e815a7ba6","resolution":{"observed_at":"2026-08-05T16:47:21.979620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T16:47:20.021791Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.021791Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:d6dbe2c7360994a4f66b25a22bb851db77ed516204bf2c1fba787e659cefd48c","observation_id":"6e4971e3-565b-4c16-835c-d849e7d7ba9c","resolution":{"observed_at":"2026-08-05T16:47:20.021791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.060132Z","title":"The lambada dataset, Aug 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.060132Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:c14602aabd5b6d26fa1d973ba7cf6dd160390c7c74a2d899654e05d9000f8efa","observation_id":"3926c5a6-10c4-445e-91bd-65fc5f3de5ea","resolution":{"observed_at":"2026-08-05T16:47:20.060132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.112911Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.112911Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:aba4a11225c97c76889876324a54facb99b7cd91b5d5927bfaca3a206ac930ff","observation_id":"20583272-b1b1-4f02-b235-7a75ce1fc72a","resolution":{"observed_at":"2026-08-05T16:47:20.112911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T16:47:20.203670Z","title":"GLU variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.203670Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:5a9a1665a06038bb8be3bddfd6a65f5753e8bea76832da79349c31bd22440191","observation_id":"05af4b76-b859-4bf1-badc-4b29850e3fab","resolution":{"observed_at":"2026-08-05T16:47:20.203670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02013","last_updated":"2025-06-15T18:27:17Z","snapshot_observed_at":"2026-08-14T18:24:15.384302Z","submitted_at":"2025-02-04T05:03:42Z","title":"Layer by Layer: Uncovering Hidden Representations in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02013","snapshot_observed_at":"2026-08-05T16:47:20.290385Z","title":"Layer by Layer: Uncovering Hidden Representations in Language Models , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.290385Z"},"links":{"cited_paper":"/paper/2502.02013","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:6c98df37e9927987e3e8993e00d8331c56eb3ab7ea581b75ba760d87264d4f53","observation_id":"8fc0d314-0d4d-48bc-9497-53fbcc73747a","resolution":{"observed_at":"2026-08-05T16:47:20.290385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T16:47:20.377926Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.377926Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:98b12a144cfb8d5d653ea80bea1a9fd21e69231bf4c1f1c8777ec9bfd1d80553","observation_id":"0427c39a-9e8e-48e5-9ab5-c81d5cafdc23","resolution":{"observed_at":"2026-08-05T16:47:20.377926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.464055Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.464055Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:0845cc2800c61227dc79bc466945f12907c6bc62bf58345789d668bd3579842e","observation_id":"bf935a5b-09dd-41f9-9ff1-31dabd492cda","resolution":{"observed_at":"2026-08-05T16:47:20.464055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:21.714458Z","title":"On layer normalization in the transformer architecture","venue":null,"work_id":"71ab4fbf-da85-4c53-af6f-45c5513c48b5","year":2020},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.500653Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:c9d25ca47f3957539163805260127caac6f40d1d78a4116958a0fab2ff7362b9","observation_id":"91187e76-5f2e-4c55-a58e-51996b39d663","resolution":{"observed_at":"2026-08-05T16:47:21.798041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.04745","last_updated":"2020-06-29T07:55:12Z","snapshot_observed_at":"2026-08-18T21:59:48.725274Z","submitted_at":"2020-02-12T00:33:03Z","title":"On Layer Normalization in the Transformer Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.04745","snapshot_observed_at":"2026-08-05T16:47:20.582931Z","title":"On layer normalization in the transformer architecture, 2020 b","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.582931Z"},"links":{"cited_paper":"/paper/2002.04745","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:1d35373e5a432b477202a2f84bf3b6f07416733f86568d6a00d8317e417246bf","observation_id":"81a50e45-4a39-4ba9-87fb-33e3dcd1e5fe","resolution":{"observed_at":"2026-08-05T16:47:20.582931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T16:47:20.671374Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.671374Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:09c86a3ac6509dd01fae3531da117c6f4235f8be9ccf44aab68e357280e2868d","observation_id":"e724b23d-d7f9-4eca-8764-cb461c7d0263","resolution":{"observed_at":"2026-08-05T16:47:20.671374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.756711Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.756711Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:fe265c520cd7e8de1e0320f50b6c9e45f84f789086c589a346cbc3fa1d7ada63","observation_id":"2c6f9f48-cc68-4a7b-9b14-9c9ffda33e2c","resolution":{"observed_at":"2026-08-05T16:47:20.756711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-05T16:47:20.845062Z","title":"Opt: Open pre-trained transformer language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.845062Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:f4fc0838f5ccf338f6450dcbca6fda81c8a82ec4b6257ffeb931b75ab6841b49","observation_id":"86d6fcbe-443f-43da-b1e6-34642db7612c","resolution":{"observed_at":"2026-08-05T16:47:20.845062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.928740Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.928740Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:4e19e8cf1ae6cfe1bc2aa716a66a074880b8530ea3326c43da9f905b176b58c1","observation_id":"40cc5619-41ce-4f33-9366-c17a852c7de3","resolution":{"observed_at":"2026-08-05T16:47:20.928740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:20.988610Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:20.988610Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:24f21881e0e9835f8e156d243f8729ab5ed21ddb2b4afb1fa8263428f9741123","observation_id":"3eb665a7-c9b6-4dd9-95e6-303ef934be68","resolution":{"observed_at":"2026-08-05T16:47:20.988610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:21.051703Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:21.051703Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:5ddc57c90363a576ff8eb4a09a5486d681ad99347e3217f573039a02efa2190e","observation_id":"bb942742-8394-458a-b939-737359663b95","resolution":{"observed_at":"2026-08-05T16:47:21.051703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:47:21.132773Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T16:47:21.132773Z"},"links":{"citing_paper":"/paper/2508.17734"},"observation_digest":"sha256:7d7b53c5d6dacc170ada850d0f73e35f919a2e010ccbabae3f9a7c4fd0f604df","observation_id":"76c01695-2020-4358-96ec-c7659765bb96","resolution":{"observed_at":"2026-08-05T16:47:21.132773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.17734","last_updated":"2025-08-25T07:21:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T03:00:13.674300Z","submitted_at":"2025-08-25T07:21:49Z","title":"Layerwise Importance Analysis of Feed-Forward Networks in Transformer-based Language Models"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 3 inbound Pith citation observations for arXiv:2508.17734."}