{"as_of":"2026-08-20T07:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c280961c7c6f8ff5f72a15c0208ca27753a42ce2355e84e4e2489efa95cc811a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:11:27.318659Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:39:05.411301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T11:53:03.579380Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"cited_work":{"arxiv_id":"2412.13435","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.13435","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sawtell, T","venue":null,"work_id":"e0768f99-e436-4698-8849-7219d400a149","year":2024},"citing_paper":{"arxiv_id":"2506.00166","last_updated":"2026-04-30T20:54:21Z","snapshot_observed_at":"2026-08-17T06:31:05.924897Z","submitted_at":"2025-05-30T19:11:52Z","title":"Disentangled Safety Adapters Enable Efficient Guardrails and Flexible Inference-Time Alignment","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T11:52:36.688263Z"},"links":{"cited_paper":"/paper/2412.13435","citing_paper":"/paper/2506.00166"},"observation_digest":"sha256:61d273045e562259821c8b0df336bacca14c86d1c2735b662d002bb6248e1efb","observation_id":"ee88e6a9-22ce-4327-a24b-2bb1a5ca65e8","resolution":{"observed_at":"2026-05-19T11:53:03.580813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13435","snapshot_observed_at":"2026-08-06T18:39:05.411301Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08064","last_updated":"2026-06-06T18:51:46Z","snapshot_observed_at":"2026-08-16T10:13:30.458348Z","submitted_at":"2025-07-10T16:47:25Z","title":"PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:05.411301Z"},"links":{"cited_paper":"/paper/2412.13435","citing_paper":"/paper/2507.08064"},"observation_digest":"sha256:4ec0095bc4ac0f0dd755e30a7573d45fd57b10f8890c358265d0811a91239995","observation_id":"476a462b-a819-46aa-a5cd-fd0632411bc6","resolution":{"observed_at":"2026-08-06T18:39:05.411301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"cited_work":{"arxiv_id":"2412.13435","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.13435","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sawtell, T","venue":null,"work_id":"e0768f99-e436-4698-8849-7219d400a149","year":2024},"citing_paper":{"arxiv_id":"2604.18519","last_updated":"2026-04-20T17:17:07Z","snapshot_observed_at":"2026-08-17T04:02:17.790778Z","submitted_at":"2026-04-20T17:17:07Z","title":"LLM Safety From Within: Detecting Harmful Content with Internal Representations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T04:33:54.058475Z"},"links":{"cited_paper":"/paper/2412.13435","citing_paper":"/paper/2604.18519"},"observation_digest":"sha256:b6e9e54421d2e104a50e4b79c318beb801a234e0bf0e02d1def7d927196d6477","observation_id":"9b434071-60ab-45dd-94a1-f0891d6c830a","resolution":{"observed_at":"2026-05-10T12:20:23.025851Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.13435/citation-record","integrity":"/paper/2412.13435/integrity","json":"/paper/2412.13435/citation-record.json","paper":"/paper/2412.13435"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T13:11:27.209218Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.209218Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:aa1e3f0a8a45338e49636d7f2e922319e4cb62be813b9a1c15ed07387fa46f56","observation_id":"621aba30-d957-4494-9157-56eb913fcd43","resolution":{"observed_at":"2026-08-11T13:11:27.209218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.784859Z","title":null,"venue":null,"work_id":"51362120-41f0-4a5d-a798-2e84aaf7fa2a","year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.212953Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:153f2eb7f60fc610443b08bf805ab17efa5db8a8206af9c21e581eb82027d2e4","observation_id":"f86e20bc-e063-4b78-8695-2213dd8c0f90","resolution":{"observed_at":"2026-08-11T13:11:27.787797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10045","last_updated":"2019-12-26T08:09:25Z","snapshot_observed_at":"2026-08-15T10:39:50.041286Z","submitted_at":"2019-10-22T15:27:30Z","title":"Explainable Artificial Intelligence (XAI): Concepts, Taxonomies, Opportunities and Challenges toward Responsible AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10045","snapshot_observed_at":"2026-08-11T13:11:27.216049Z","title":"Explainable Artificial Intelligence (XAI): Concepts, Taxonomies, Opportunities and Challenges toward Responsible AI","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.216049Z"},"links":{"cited_paper":"/paper/1910.10045","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:34309a251a3793fe383b5a73a15e5d7e4c0e19e3f1318cea13288a5898fff89c","observation_id":"1552ee4f-13ab-4e5e-9f72-46c06e0dd26e","resolution":{"observed_at":"2026-08-11T13:11:27.216049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.219618Z","title":"Extending Knowledge Graphs with Subjective Influence Networks for Personalized Fashion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.219618Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:b17ed827542bf8ca66d844f7ea6af91fa386764476fe494cb123918c3e25a609","observation_id":"7aa91d28-48c4-44cf-92ee-ab967d38945c","resolution":{"observed_at":"2026-08-11T13:11:27.219618Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03414","last_updated":"2024-10-04T13:24:59Z","snapshot_observed_at":"2026-08-20T04:00:09.102250Z","submitted_at":"2024-08-06T19:23:42Z","title":"Logistic Regression makes small LLMs strong and explainable \"tens-of-shot\" classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03414","snapshot_observed_at":"2026-08-11T13:11:27.222808Z","title":"tens- of-shot","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.222808Z"},"links":{"cited_paper":"/paper/2408.03414","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:b12692251588acb81ca4f74d02f22bf7f78838169a4353b17145a486a2de99bf","observation_id":"91ef6a88-4c8a-4956-a1ec-e0e8b88b4253","resolution":{"observed_at":"2026-08-11T13:11:27.222808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11681","last_updated":"2024-07-16T12:59:44Z","snapshot_observed_at":"2026-08-19T21:56:46.634488Z","submitted_at":"2024-07-16T12:59:44Z","title":"MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11681","snapshot_observed_at":"2026-08-11T13:11:27.226591Z","title":"MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.226591Z"},"links":{"cited_paper":"/paper/2407.11681","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:1a1190be95b8427239c38caf02acd59f6cdd6ca50a70e6c1415b9ac20532fe65","observation_id":"f94f497b-2ca5-434f-9822-3568c5aaf8cd","resolution":{"observed_at":"2026-08-11T13:11:27.226591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10873","last_updated":"2023-06-14T03:23:44Z","snapshot_observed_at":"2026-08-17T16:59:03.482533Z","submitted_at":"2022-12-21T09:37:05Z","title":"Prompt-Augmented Linear Probing: Scaling beyond the Limit of Few-shot In-Context Learners","version":3},"cited_work":{"arxiv_id":"2212.10873","doi":"10.48550/arxiv.2212.10873","metadata_source":"pith","pith_arxiv_id":"2212.10873","snapshot_observed_at":"2026-08-11T18:16:15.004306Z","title":"Prompt-Augmented Linear Probing: Scaling beyond the Limit of Few-shot In-Context Learners","venue":"cs.CL","work_id":"934d0aeb-67ea-4993-8578-7e854b211ca3","year":2022},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.230442Z"},"links":{"cited_paper":"/paper/2212.10873","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:54fc503b260f1d18d605542735b7580b0142dc3550f90d51e269aeac4402a7de","observation_id":"2d2eab33-97cd-4be8-b8b4-008039f009a1","resolution":{"observed_at":"2026-08-11T13:11:27.570921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.233906Z","title":"Evolutionary Fuzzy Systems for Explainable Artificial Intelligence: Why, When, What for, and Where to?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.233906Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:d5567acb9fe403426883a8314b7b807d514507ab8a8b252e1b5d3475e3af698f","observation_id":"71e0d5e9-c82a-49e1-bc1e-8f6ccdce3560","resolution":{"observed_at":"2026-08-11T13:11:27.233906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.07410","last_updated":"2021-06-14T13:23:20Z","snapshot_observed_at":"2026-08-20T02:58:27.463176Z","submitted_at":"2021-06-14T13:23:20Z","title":"Model Explainability in Deep Learning Based Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.07410","snapshot_observed_at":"2026-08-11T13:11:27.237620Z","title":"Model Explainability in Deep Learning Based Natural Language Processing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.237620Z"},"links":{"cited_paper":"/paper/2106.07410","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:4c53abc85de3183e60e466af5d7e3335ac06cd45d74c599c116c98ffdd2c4c4e","observation_id":"39a03626-5262-4769-af56-12f36a2af0c1","resolution":{"observed_at":"2026-08-11T13:11:27.237620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-17T18:25:58.914494Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-11T13:11:27.241267Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.241267Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:788b5eb8f4b477c6953f71eb6a388d521539fa5a9c91149626fbec95e1624ae9","observation_id":"ff891a96-45b4-400e-b5aa-786d1205030d","resolution":{"observed_at":"2026-08-11T13:11:27.241267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T13:11:27.244926Z","title":"The Llama 3 Herd of Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.244926Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:d6117ed556f945e3d75bd4136c6ad7e29f7fd6491c973c91efadb32de548cfb0","observation_id":"2447327e-4d10-4fec-b324-2b57de21388e","resolution":{"observed_at":"2026-08-11T13:11:27.244926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-16T14:06:10.494270Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-11T13:11:27.248085Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.248085Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:da3c719e5c201cd86434c087927644a6aadbf38dfefbe9790150db3749498d78","observation_id":"93dad778-be06-48e8-83b9-f2dcbad5118a","resolution":{"observed_at":"2026-08-11T13:11:27.248085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05276","last_updated":"2019-10-11T16:10:55Z","snapshot_observed_at":"2026-08-20T02:23:37.580874Z","submitted_at":"2019-10-11T16:10:55Z","title":"exBERT: A Visual Analysis Tool to Explore Learned Representations in Transformers Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05276","snapshot_observed_at":"2026-08-11T13:11:27.251360Z","title":"exBERT: A Visual Analysis Tool to Explore Learned Representations in Transformers Models","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.251360Z"},"links":{"cited_paper":"/paper/1910.05276","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:84682b7a21cf9e09af8928a12117a97343ab11a3f576ea99819f274f5b2149b4","observation_id":"9aa58de5-405f-4276-9f54-2fb2db47b341","resolution":{"observed_at":"2026-08-11T13:11:27.251360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00348","last_updated":"2025-04-23T01:35:19Z","snapshot_observed_at":"2026-08-17T16:58:11.267710Z","submitted_at":"2024-11-01T04:05:59Z","title":"Attention Tracker: Detecting Prompt Injection Attacks in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00348","snapshot_observed_at":"2026-08-11T13:11:27.254211Z","title":"Attention Tracker: Detecting Prompt Injection Attacks in LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.254211Z"},"links":{"cited_paper":"/paper/2411.00348","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:ab05eeac0360eabfaab88751c2987c952fc02a550043cce7e17fea33def10685","observation_id":"f109e5be-7272-4b62-9b81-2c995d2249c2","resolution":{"observed_at":"2026-08-11T13:11:27.254211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-11T13:11:27.257508Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.257508Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:e379ca43f29221aeee9eabb80fea75f8e61100581b65d8b71704cc07dc12e973","observation_id":"3871117c-3e45-42c8-a615-f2e09aef85dc","resolution":{"observed_at":"2026-08-11T13:11:27.257508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10077","last_updated":"2023-10-16T05:19:25Z","snapshot_observed_at":"2026-08-20T06:02:55.110319Z","submitted_at":"2023-10-16T05:19:25Z","title":"Prompt Packer: Deceiving LLMs through Compositional Instruction with Hidden Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10077","snapshot_observed_at":"2026-08-11T13:11:27.260452Z","title":"Prompt Packer: Deceiving LLMs through Compositional Instruction with Hidden Attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.260452Z"},"links":{"cited_paper":"/paper/2310.10077","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:885b1c6d109c8fcacc7f0dad17c597210bbda910daecb38049b5813967e9ff79","observation_id":"caf971d1-5ca7-4911-aba2-6ddc5ee77a8d","resolution":{"observed_at":"2026-08-11T13:11:27.260452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14578","last_updated":"2024-10-18T16:26:45Z","snapshot_observed_at":"2026-08-20T02:24:46.787029Z","submitted_at":"2024-10-18T16:26:45Z","title":"Large Language Models Are Overparameterized Text Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14578","snapshot_observed_at":"2026-08-11T13:11:27.263716Z","title":"K, Tim Fischer, and Chris Biemann","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.263716Z"},"links":{"cited_paper":"/paper/2410.14578","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:e8434a5f0c85a4cc7074602109c0f93f7eb065095bf1a5bff292a2233d274506","observation_id":"a02c2b83-9487-4298-ad0a-d1c176727c38","resolution":{"observed_at":"2026-08-11T13:11:27.263716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.776039Z","title":"original-date: 2024-03-27T19:04:05Z","venue":null,"work_id":"91099fa8-fdfd-4ff7-8ac9-5ac00906f2cd","year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.266522Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:879407300ab177d8dbcf5452d9da60800aba122eb92ee213f07ea9d44b7369cc","observation_id":"b187e0ba-b10c-4941-963f-0f508419d038","resolution":{"observed_at":"2026-08-11T13:11:27.778966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.269514Z","title":"Interactive Visualization and Manipulation of Attention- based Neural Machine Translation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.269514Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:169baa3be809bf962b738e01d4f53665c679aab290f004de2e9fe98894e9bdcb","observation_id":"1e0b91b9-bf60-4677-bc22-c9705f4a2f33","resolution":{"observed_at":"2026-08-11T13:11:27.269514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-16T14:20:31.299446Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-11T13:11:27.272180Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.272180Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:966dd6a2427bc0d0eaba525be196453007cf6bee112c4ae8e252b7d4403016c4","observation_id":"48c215e3-41d3-4839-9c02-73e7c764ba4f","resolution":{"observed_at":"2026-08-11T13:11:27.272180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-08-14T20:59:00.743160Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-11T13:11:27.275438Z","title":"A Unified Approach to Interpreting Model Predictions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.275438Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:0458fa3bc786e6a96957735bc730c2a81a528b4bea53761c3a26c7525fac5cc1","observation_id":"64bc7a4d-62c9-410b-8f85-76cbd82a4532","resolution":{"observed_at":"2026-08-11T13:11:27.275438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12874","last_updated":"2024-02-22T04:28:03Z","snapshot_observed_at":"2026-08-20T02:25:39.361116Z","submitted_at":"2024-01-23T16:09:53Z","title":"From Understanding to Utilization: A Survey on Explainability for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12874","snapshot_observed_at":"2026-08-11T13:11:27.278527Z","title":"From Understanding to Utilization: A Survey on Explainability for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.278527Z"},"links":{"cited_paper":"/paper/2401.12874","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:b11a34c374d20c4bfd4ce6653b3e4449643cff86404b57b712529d60e2da787d","observation_id":"5e968e38-6eac-4acc-b9f3-ff1e141d5644","resolution":{"observed_at":"2026-08-11T13:11:27.278527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11627","last_updated":"2023-09-28T03:59:27Z","snapshot_observed_at":"2026-08-16T15:31:43.348408Z","submitted_at":"2023-05-19T12:10:53Z","title":"LLM-Pruner: On the Structural Pruning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11627","snapshot_observed_at":"2026-08-11T13:11:27.281244Z","title":"LLM-Pruner: On the Structural Pruning of Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.281244Z"},"links":{"cited_paper":"/paper/2305.11627","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:65dd25c9fe0d1ff60627c488086e7a6d10f0a98f55a409a961f4b15583bf01b0","observation_id":"198ebd0b-0b4e-4ada-9eee-3e0a300e03c1","resolution":{"observed_at":"2026-08-11T13:11:27.281244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06541","last_updated":"2023-10-21T11:49:09Z","snapshot_observed_at":"2026-08-20T02:23:41.045073Z","submitted_at":"2023-02-13T17:34:13Z","title":"Towards Agile Text Classifiers for Everyone","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06541","snapshot_observed_at":"2026-08-11T13:11:27.284152Z","title":"Towards Agile Text Classifiers for Everyone","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.284152Z"},"links":{"cited_paper":"/paper/2302.06541","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:55dd4eee4af411cfbcff9881c577c889d44c49bcccb29dd85a37e2ffa6c00af3","observation_id":"579f59a8-7fb3-4278-bbb3-1bcd3a1a1d83","resolution":{"observed_at":"2026-08-11T13:11:27.284152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.04765","last_updated":"2018-03-13T13:02:13Z","snapshot_observed_at":"2026-08-14T19:36:43.134642Z","submitted_at":"2018-03-13T13:02:13Z","title":"Deep k-Nearest Neighbors: Towards Confident, Interpretable and Robust Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.04765","snapshot_observed_at":"2026-08-11T13:11:27.287758Z","title":"Deep k-Nearest Neighbors: Towards Confident, Interpretable and Robust Deep Learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.287758Z"},"links":{"cited_paper":"/paper/1803.04765","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:673c68df14882775ff1c51f6c3d4231c28249b905883149bd1561ae114065e75","observation_id":"58e2f91d-e5f0-4f2c-a3fa-66d756990b56","resolution":{"observed_at":"2026-08-11T13:11:27.287758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57967/hf/2739","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.419789Z","title":"deberta-v3-base-prompt-injection","venue":null,"work_id":"53599cb5-fe6b-4d19-a55b-6230f00f8ad2","year":null},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.291372Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:ca0f4292a23d0569310eeb5f873a265d03aac61948898579375bcbb88d138936","observation_id":"38424319-ab32-4b3e-b3bd-ab2785b4018a","resolution":{"observed_at":"2026-08-11T13:11:27.423523Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11755","last_updated":"2024-02-19T00:53:48Z","snapshot_observed_at":"2026-08-20T02:23:48.029371Z","submitted_at":"2024-02-19T00:53:48Z","title":"SPML: A DSL for Defending Language Models Against Prompt Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11755","snapshot_observed_at":"2026-08-11T13:11:27.294794Z","title":"Sharma, Vinayak Gupta, and Dan Grossman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.294794Z"},"links":{"cited_paper":"/paper/2402.11755","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:e5b17b1a7f7a02c7b19f46788b0932266e5f7f87dcbcbf0f338addfeaaf1700f","observation_id":"4275d321-ac99-4403-a6dd-25876e0bc58c","resolution":{"observed_at":"2026-08-11T13:11:27.294794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:11:27.765359Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","venue":null,"work_id":"724fb8c0-2f28-435f-b421-92c1a6c12c19","year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.298346Z"},"links":{"citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:d25f0e01eb628e0aa13717085cf992365118634b3f29348590f83b0f6761fbc5","observation_id":"f7a3c789-cb5e-4e70-992b-b023b92c037c","resolution":{"observed_at":"2026-08-11T13:11:27.769557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09299","last_updated":"2018-10-16T15:59:38Z","snapshot_observed_at":"2026-08-20T02:25:16.840515Z","submitted_at":"2018-04-25T00:32:45Z","title":"Seq2Seq-Vis: A Visual Debugging Tool for Sequence-to-Sequence Models","version":2},"cited_work":{"arxiv_id":"1804.09299","doi":"10.48550/arxiv.1804.09299","metadata_source":"pith","pith_arxiv_id":"1804.09299","snapshot_observed_at":"2026-08-11T18:16:15.004306Z","title":"Seq2Seq-Vis: A Visual Debugging Tool for Sequence-to-Sequence Models","venue":"cs.CL","work_id":"4fac90e7-7fe2-44ff-a485-f37f544e6ee7","year":2018},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.301038Z"},"links":{"cited_paper":"/paper/1804.09299","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:1759c481d52919fb2074970ff4657b142d75412116875365e0a4f53da00fe7f6","observation_id":"9e716e4c-9663-4d1d-befb-bbb8a6209586","resolution":{"observed_at":"2026-08-11T13:11:27.399409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00294","last_updated":"2023-10-30T16:11:05Z","snapshot_observed_at":"2026-08-19T23:06:37.376527Z","submitted_at":"2023-02-01T07:50:26Z","title":"The geometry of hidden representations of large transformer models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00294","snapshot_observed_at":"2026-08-11T13:11:27.303789Z","title":"The geometry of hidden representations of large transformer models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.303789Z"},"links":{"cited_paper":"/paper/2302.00294","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:9d5865ba9856084970eda9091719ce7a8a803cbf5ae31630e7432051a8be8931","observation_id":"c185dd6d-2530-4d50-8b49-e2785480e3c9","resolution":{"observed_at":"2026-08-11T13:11:27.303789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02679","last_updated":"2019-04-11T16:00:53Z","snapshot_observed_at":"2026-08-15T15:16:08.993378Z","submitted_at":"2019-04-04T17:32:49Z","title":"Visualizing Attention in Transformer-Based Language Representation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02679","snapshot_observed_at":"2026-08-11T13:11:27.306571Z","title":"Visualizing Attention in Transformer-Based Language Representation Models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.306571Z"},"links":{"cited_paper":"/paper/1904.02679","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:792918f35a926c6f6dddcc694e21dc8c2f19f5c096d1ca01b166a39dfa12eafc","observation_id":"d5f84271-5f12-4802-b474-6d4f226f76e6","resolution":{"observed_at":"2026-08-11T13:11:27.306571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-11T13:11:27.309586Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.309586Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:eea710982b6970119d65d79418e9a00c8334e0c5483240e63d9389e09d31f49a","observation_id":"7271482d-8d57-4639-a2f9-e1d8ee0651ed","resolution":{"observed_at":"2026-08-11T13:11:27.309586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17139","last_updated":"2024-10-14T04:36:09Z","snapshot_observed_at":"2026-08-20T02:24:40.429274Z","submitted_at":"2024-01-30T16:19:55Z","title":"Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17139","snapshot_observed_at":"2026-08-11T13:11:27.312668Z","title":"arXiv:2401.17139 [cs]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.312668Z"},"links":{"cited_paper":"/paper/2401.17139","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:8303554b7335d0bf2bdf4df62e11a9af017e4e776b9ea0269f259757289e7484","observation_id":"c51f7eab-d809-4287-9466-78088fc5283b","resolution":{"observed_at":"2026-08-11T13:11:27.312668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11998","last_updated":"2024-03-10T19:34:57Z","snapshot_observed_at":"2026-08-18T19:38:46.345325Z","submitted_at":"2023-09-21T12:13:55Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11998","snapshot_observed_at":"2026-08-11T13:11:27.315771Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.315771Z"},"links":{"cited_paper":"/paper/2309.11998","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:c13301ca51e7e80d1c3534b6a502e00308a21c40038ab7a68b325a90d401bde8","observation_id":"6c272931-d4e3-4ef7-9fe8-c0460bd97c6f","resolution":{"observed_at":"2026-08-11T13:11:27.315771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06929","last_updated":"2022-10-13T11:59:39Z","snapshot_observed_at":"2026-08-20T02:53:01.693348Z","submitted_at":"2022-10-13T11:59:39Z","title":"On the Explainability of Natural Language Processing Deep Models","version":1},"cited_work":{"arxiv_id":"2210.06929","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06929","snapshot_observed_at":"2026-08-11T13:11:27.617485Z","title":"On the Explainability of Natural Language Processing Deep Models","venue":"cs.CL","work_id":"108cf659-0181-4e77-86c2-15c96b0342f5","year":2022},"citing_paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T13:11:27.318659Z"},"links":{"cited_paper":"/paper/2210.06929","citing_paper":"/paper/2412.13435"},"observation_digest":"sha256:83129c39a5b149ed8fc9d846194eb61db6a7780b6be48b087015cb0a7c92c460","observation_id":"252d8eb9-9b3e-417f-9986-8f274d4a92fd","resolution":{"observed_at":"2026-08-11T13:11:27.622133Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.13435","last_updated":"2024-12-18T02:13:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T01:23:09.096141Z","submitted_at":"2024-12-18T02:13:13Z","title":"Lightweight Safety Classification Using Pruned Language Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 3 inbound Pith citation observations for arXiv:2412.13435."}