{"as_of":"2026-08-20T02:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5418914f7ed70eb0743bf31cd9833c4e90e998d85e486b0f75b280de6908f095","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:33:44.492537Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.15255/citation-record","integrity":"/paper/2501.15255/integrity","json":"/paper/2501.15255/citation-record.json","paper":"/paper/2501.15255"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-16T14:14:41.393057Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-10T14:33:44.336597Z","title":"A survey on recent advances in llm-based multi-turn dialogue systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.336597Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e3d9c824b54c64a7ab8f8dcc779183c7e93a965cb1b08cda7671847c6e51b854","observation_id":"013c793a-1f4f-44fd-b559-a65f588a533b","resolution":{"observed_at":"2026-08-10T14:33:44.336597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.341216Z","title":"Toolqa: A dataset for llm question answering with external tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.341216Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:91ac9554c9a55ad337528630d8ad9d538011f55ef0eccfff31c0688a676d120c","observation_id":"860e4a02-c02c-4311-8f6f-44a309285257","resolution":{"observed_at":"2026-08-10T14:33:44.341216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.345007Z","title":"A comprehensive survey on process-oriented automatic text summarization with exploration of llm-based methods,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.345007Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:8a1949ad0514f9133e0194a40de6c750c20dfc1f6b89f48d053256a63b9e3777","observation_id":"1fc67cd9-391c-468d-bbff-7aea2db876af","resolution":{"observed_at":"2026-08-10T14:33:44.345007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.981115Z","title":"Exploding ai power use: an opportunity to rethink grid planning and management,","venue":null,"work_id":"e68a8791-704b-46d4-afe5-e283f7de7106","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.348740Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:879581b9569e9d434c81f49b93cb7391e1cb6eb7dac938ed18aa80b00d736c00","observation_id":"03eb5be2-6622-44c8-a793-b71cffa218ee","resolution":{"observed_at":"2026-08-10T14:33:44.984078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10350","last_updated":"2021-04-23T14:26:29Z","snapshot_observed_at":"2026-08-16T05:11:57.545339Z","submitted_at":"2021-04-21T04:44:25Z","title":"Carbon Emissions and Large Neural Network Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10350","snapshot_observed_at":"2026-08-10T14:33:44.352118Z","title":"Carbon emissions and large neural network training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.352118Z"},"links":{"cited_paper":"/paper/2104.10350","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6ccbb2b8957e4587cbd1a3b2fc2f849b2fe6917ba11b493b167955578500ba41","observation_id":"87360897-f9a6-44b5-98b5-7ba475a0e4a4","resolution":{"observed_at":"2026-08-10T14:33:44.352118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.355940Z","title":"Drive as you speak: Enabling human-like interaction with large language models in au- tonomous vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.355940Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:7787eecb4d1bd0e0a06208fc29b6305c521f3ef1e0dcbede6b0948770498c517","observation_id":"0878c019-51b2-461a-a433-a919b5d8c977","resolution":{"observed_at":"2026-08-10T14:33:44.355940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11805","last_updated":"2024-03-18T14:03:23Z","snapshot_observed_at":"2026-08-17T01:11:48.504628Z","submitted_at":"2024-03-18T14:03:23Z","title":"LLM as a System Service on Mobile Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11805","snapshot_observed_at":"2026-08-10T14:33:44.359780Z","title":"Llm as a system service on mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.359780Z"},"links":{"cited_paper":"/paper/2403.11805","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:3506bc92ef2845e4298832e57a55cb8bc52c1eb61e4d18b4303253c04c9acb71","observation_id":"77454a21-ecf1-4483-8279-175eee468d69","resolution":{"observed_at":"2026-08-10T14:33:44.359780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.966054Z","title":"Language models are few-shot learners advances,","venue":null,"work_id":"335a47fe-75cd-4a06-a214-648029b1be1a","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.363470Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:03ec25b0298433421dccc3e5e883bf1f77ade5684d782cc35a0fc292d36edf55","observation_id":"457735b4-acc0-4490-934d-fb2fc19db4b8","resolution":{"observed_at":"2026-08-10T14:33:44.969294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.956473Z","title":"Energy and policy consid- erations for modern deep learning research,","venue":null,"work_id":"0ca13cfe-153f-461f-b15b-94b98c3b96d0","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.366745Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:bc9babf6d18a8a897fe04ce8a0143adabca99ec7ba5f1bcd08fe1a3d60d1afff","observation_id":"a448f3cd-607c-401b-b630-272fa0a7df22","resolution":{"observed_at":"2026-08-10T14:33:44.959998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.370200Z","title":"Learning both weights and connections for efficient neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.370200Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:cb458cb712aeaf2df8bb8ced61fa8c460f0ad4c0637d2e34b0ab73eeaab0fceb","observation_id":"bfda8e4c-9cf8-440c-a99f-ef35692fcf58","resolution":{"observed_at":"2026-08-10T14:33:44.370200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.374805Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.374805Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:f32c77de997496c6c4da59821a83fdb180a56d7eee27919c262977b75d2151e4","observation_id":"c3d97847-33d0-4074-bebf-99c305448449","resolution":{"observed_at":"2026-08-10T14:33:44.374805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.01611","last_updated":"2020-07-20T16:50:33Z","snapshot_observed_at":"2026-08-20T01:43:33.216920Z","submitted_at":"2019-03-05T00:52:12Z","title":"Stabilizing the Lottery Ticket Hypothesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.01611","snapshot_observed_at":"2026-08-10T14:33:44.378653Z","title":"Stabilizing the lottery ticket hypothesis,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.378653Z"},"links":{"cited_paper":"/paper/1903.01611","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:580856b3e8881b5ada787098a49ac9c2972da6526dfb3e107289ae23dc656536","observation_id":"41187ac8-a6c5-4cda-8770-24186917364d","resolution":{"observed_at":"2026-08-10T14:33:44.378653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.382403Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.382403Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a3e584c5b5469c36c5cd0fc7cd12914976b06a847b14cc8a8eba7d1c8dbd582a","observation_id":"c848a58c-8bad-4138-84a1-1b8e3aad5b48","resolution":{"observed_at":"2026-08-10T14:33:44.382403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.927987Z","title":"Plug-and-play: An efficient post-training pruning method for large language models,","venue":null,"work_id":"dc4c7039-7fea-47e9-87a9-2e678a74a878","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.385747Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:247a926007c75e38817fcc40d384c6939df672318a8fb893996659a0752d69c6","observation_id":"f8778de6-39f8-4a3b-8b69-eb9b73f8b73d","resolution":{"observed_at":"2026-08-10T14:33:44.931726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.389083Z","title":"Nvidia a100 tensor core gpu: Performance and innovation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.389083Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:0d52103a9807dc664296a0f4c9c4e2117fc5588b07e7d550be7d843c09391b17","observation_id":"861098ea-9bf3-4585-864d-f04b67e44447","resolution":{"observed_at":"2026-08-10T14:33:44.389083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.911731Z","title":"A fast post-training pruning framework for transformers,","venue":null,"work_id":"830a5307-4d0a-418a-b37a-4e47000a432b","year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.392355Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:d1f97b1b04e3a939fc31debce8416cff0b047c858cdbb27772a3c582a1944884","observation_id":"c15ccb1a-c0a3-4875-bd00-d852470f5f1a","resolution":{"observed_at":"2026-08-10T14:33:44.915181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.901357Z","title":"Loraprune: Structured pruning meets low-rank parameter-efficient fine- tuning,","venue":null,"work_id":"6abb96bf-381d-49f9-a9a3-0b04547571c4","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.395805Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:967831dd38d3742e4d58d1c06efd110f69c5cc3a1e02b6d10168e34b7a84c62a","observation_id":"6025b344-80c9-4c59-be53-413b5e2085df","resolution":{"observed_at":"2026-08-10T14:33:44.905108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-16T14:12:14.696997Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-10T14:33:44.399302Z","title":"Shortgpt: Layers in large language models are more redundant than you expect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.399302Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:ae5ec03ce953d326dab734a6ecf42bd32d046f12697936bde1cf810f89a111e2","observation_id":"914996d1-6d6c-4f73-a1a2-336f930a7cdf","resolution":{"observed_at":"2026-08-10T14:33:44.399302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.891330Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":"da4a26f9-c86e-44ab-983f-7a7d8a0d9823","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.403297Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:ef6fc78a9f4120f05a38949f932d2d6db3c99e0780800fb67c727a4a05f6dbda","observation_id":"18d08712-db2b-468a-b654-b6af2fede839","resolution":{"observed_at":"2026-08-10T14:33:44.894912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-13T04:32:33.562415Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-10T14:33:44.407072Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.407072Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:d48e9e21733eeab0fe6ec54f45fff329b20f4b39d3feef1a7a471ce9e064447b","observation_id":"32b8e711-9b39-4c5d-84cb-5a62ec94e6f7","resolution":{"observed_at":"2026-08-10T14:33:44.407072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-10T14:33:44.410576Z","title":"Parameter-efficient fine- tuning for large models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.410576Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:f5168c1dff2cd7cf39f42dcf6cfb55195713b4412d23185c080e2f63c185687c","observation_id":"2148dfb3-c847-4963-a91b-e4028f9fdb03","resolution":{"observed_at":"2026-08-10T14:33:44.410576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T14:33:44.414119Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.414119Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:c7a8b8307d869bc6d7516950825dd85428d8d75f2018b0c4b04efc71ee90221c","observation_id":"86fc1f16-90c8-40af-ae3e-61c118806114","resolution":{"observed_at":"2026-08-10T14:33:44.414119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.417177Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.417177Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:2c5a923b9b7c14f8562119a6ffa84f4ebc950a68c40a80e1e3232fe1b0524c59","observation_id":"bbf3125e-d4a0-4f6e-8220-2a763776e682","resolution":{"observed_at":"2026-08-10T14:33:44.417177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.419846Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.419846Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:9827b6e32edd407cfb46998d5af238abb7c585b5a6fab39793f6d0d686be8253","observation_id":"b82c9b1a-9d5c-46f2-9a02-ef2cf2de04d0","resolution":{"observed_at":"2026-08-10T14:33:44.419846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.869173Z","title":"Privacy-preserving large language models for structured medical information retrieval,","venue":null,"work_id":"b4e54109-b71b-4f06-8a70-0fec5f3cdcd0","year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.425729Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:c5ebabc4e308f16e94e5fddb68633138b13fcedcae617c463aacb6ee47de03d8","observation_id":"004b8d87-4e38-425d-badd-3ebb660de9b6","resolution":{"observed_at":"2026-08-10T14:33:44.872785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.858943Z","title":"Optimizing llm training for financial services: Best practices for model accuracy, risk management, and compliance in ai-powered financial applications,","venue":null,"work_id":"29dcfb0b-6efa-447f-a6f6-64c2a9221261","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.428556Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:01d73e0108e3e09ccb371b3f4682835a139e1bbf494a57a4c55f6a0b49cf3a3e","observation_id":"569f2be8-04f6-47c1-9a15-1184ec144354","resolution":{"observed_at":"2026-08-10T14:33:44.862571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T14:33:44.431221Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.431221Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:eda96c6f7f3faca250bd4a16bcedb699805046965f44e74f10fa9ee847c2d91f","observation_id":"413ef0f4-ae05-4b25-8b63-c54a62aa4674","resolution":{"observed_at":"2026-08-10T14:33:44.431221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-10T14:33:44.434000Z","title":"Slicegpt: Compress large language models by deleting rows and columns,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.434000Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:b24ef5ead8a1d93d0827bc07cc451f82fac44f80b72f00932a0d9ea9314d9dc0","observation_id":"56a01d3e-b6ad-44d5-b313-0840ed563c95","resolution":{"observed_at":"2026-08-10T14:33:44.434000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.848274Z","title":"Deja vu: Contextual sparsity for efficient llms at inference time,","venue":null,"work_id":"7507850f-85bf-4bc7-84f8-66143e4684e4","year":2023},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.436754Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:37ebe578c2e2f95c127f73d9af47ce8408018e40b8902395dd3951502201b3cc","observation_id":"b6853423-0452-43d1-8d62-1c0be72bec33","resolution":{"observed_at":"2026-08-10T14:33:44.852104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.439465Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.439465Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:4c82aad0cd753ddcda976050090b172be7a0985e8e091e069a43385fe45cf85a","observation_id":"fac87cdc-d51f-4666-9662-c5f8cee278ec","resolution":{"observed_at":"2026-08-10T14:33:44.439465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.831777Z","title":"An estimate for the condition number of a matrix,","venue":null,"work_id":"1c672c9f-52b9-4c1f-bc67-9771ddebec43","year":1979},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.442564Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:bcd23ed886055c6e30cb816437d1088ac053160d7d242df6b61c527127666221","observation_id":"8cf8064d-e626-43a5-adb0-c58efa3558ba","resolution":{"observed_at":"2026-08-10T14:33:44.835773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.821457Z","title":"Matrix inversion using cholesky decomposition,","venue":null,"work_id":"d75d4623-15b5-451f-b08b-681d638b79a4","year":2013},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.445594Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:d9ab4f0a1f5d66847d0930d47456b6c3907e21cacace9afa0deab31c6cd1393f","observation_id":"0c50f56f-9e78-4011-9f98-3db1ae1fbb79","resolution":{"observed_at":"2026-08-10T14:33:44.825043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.811191Z","title":"Points of significance: model selection and overfitting,","venue":null,"work_id":"c2979af8-33e6-4e86-aac7-561422590a7a","year":2016},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.448713Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a1dfc46028bf5ae263e3e5a1c284533bed39887d16b9ebbc1b18560649290a89","observation_id":"68e0d6a8-843e-49f8-9223-ddacac42845c","resolution":{"observed_at":"2026-08-10T14:33:44.814768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-10T14:33:44.452010Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.452010Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:ee96030698d0bd6f061c1107d70dd065f91f8f896b97fac3e9d9e311ce714a3c","observation_id":"436bbed2-b290-45c9-8d32-a2f722798a0b","resolution":{"observed_at":"2026-08-10T14:33:44.452010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-17T15:43:31.970425Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-10T14:33:44.455177Z","title":"Glm-130b: An open bilingual pre-trained model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.455177Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:272a3674ea0cccd2edcd490ec912cbc7ca20d624e47bd0ea57c88158b90e184b","observation_id":"97024a3e-4502-4863-88e1-91012bdd692b","resolution":{"observed_at":"2026-08-10T14:33:44.455177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T14:33:44.458701Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.458701Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:916dab538cf527e6ec93891ca811bfc5dfe5f3fdae3b2d3e060fbe9bb08d8d4b","observation_id":"3f4493f7-b8f6-4015-9178-4a4f842e31f3","resolution":{"observed_at":"2026-08-10T14:33:44.458701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.461865Z","title":"Building a large annotated corpus of english: The penn treebank,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.461865Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:f02ae27b4cc3abe00929a02a9defb9a91b6f4d9a06a5bcaa484005054d1201d5","observation_id":"39a0375b-ff2f-4ce5-a68c-f04d50aaa29e","resolution":{"observed_at":"2026-08-10T14:33:44.461865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.793900Z","title":"Compressing pre-trained language models by matrix decomposition,","venue":null,"work_id":"fbf674bb-ad53-47d7-8c70-932883d88b6e","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.465137Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:8d311a44de042ff66ea039d1b64611077a9e4db34721126118f0ac2b8ee2e530","observation_id":"211e2d4c-1762-437e-9d0f-0cec7d247e90","resolution":{"observed_at":"2026-08-10T14:33:44.797749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.783620Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions,","venue":null,"work_id":"240def24-2904-4063-8651-9d9d25f24f9a","year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.468363Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:e5751bda2a1c09cff4b8490e5761aa1b3ceaf1dc27d65afddb3ea66a65ca5d1d","observation_id":"20dbe893-cd7c-414e-98a3-8e24a909e03c","resolution":{"observed_at":"2026-08-10T14:33:44.786814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.773783Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":"581d1dae-0dcd-44ca-8904-56e7b80435cc","year":2019},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.471683Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:76fa219afad930f77669cc655520ff6a9d720511a84e36e48354fb4721a70bdb","observation_id":"7650a08c-734f-424c-8a36-a0d5f2b19c17","resolution":{"observed_at":"2026-08-10T14:33:44.777134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-18T19:00:40.885312Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-10T14:33:44.474924Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.474924Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:6f31e6d773dedf93759b9f2439fccd9fb67d6b35f62cfb262f9f9c072543365f","observation_id":"a5ae07b3-7fb5-4ebf-b463-0d0b87105b95","resolution":{"observed_at":"2026-08-10T14:33:44.474924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-10T14:33:44.478804Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.478804Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:1f00bf6ad966e3e42cedc0335c518ff7e66cfa3194099e2f6c917be14147796c","observation_id":"99c1038a-3f7b-406e-9e92-c72e68c59647","resolution":{"observed_at":"2026-08-10T14:33:44.478804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.763193Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":"627b96c5-61a9-4f24-99f4-b3f3c5190e0f","year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.482283Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:1116db1cd70dc35cd2b671c2b04e62671656294013ba8613f54da3490227bda9","observation_id":"0cdf96ac-8bf5-4b8e-8641-89b058676f1a","resolution":{"observed_at":"2026-08-10T14:33:44.766624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-17T19:08:01.495561Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-10T14:33:44.485758Z","title":"Crowdsourcing multiple choice science questions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.485758Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:00c700edc50599072ee4dd1af4dc23c4ff6b651cddf3fbec64d37d54331f7bdd","observation_id":"bf75d910-6fa0-4d25-a020-fc547f3e71be","resolution":{"observed_at":"2026-08-10T14:33:44.485758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.489292Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.489292Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:149a83cc03e28c88491cc6bd5c04f7d4eee5ac3aa7fd3bce7db62f690be463e3","observation_id":"b8a4af68-ef6c-49b0-8545-e136c391e98b","resolution":{"observed_at":"2026-08-10T14:33:44.489292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:33:44.744431Z","title":"Cupy: A numpy-compatible library for nvidia gpu calculations,","venue":null,"work_id":"f7bb047e-6647-410a-b088-57565a8b8c13","year":2017},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.492537Z"},"links":{"citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:a08ff7cbe2fa7362eb35afd43bca33655b218b302c7fa56ec702d533cb361522","observation_id":"d2509998-5f88-4a5f-b63c-20e94b791b83","resolution":{"observed_at":"2026-08-10T14:33:44.749821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T14:33:44.422738Z","title":"Available: https://arxiv.org/abs/1711.05101","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T14:33:44.422738Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.15255"},"observation_digest":"sha256:ba137307c8631385bb3f26d7df1ab6dce63b9af156344d624d0d05945836dcb6","observation_id":"e4d836dd-cb1c-4e10-a6a2-522a50cae2bd","resolution":{"observed_at":"2026-08-10T14:33:44.422738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15255","last_updated":"2025-01-25T16:03:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T23:34:04.003393Z","submitted_at":"2025-01-25T16:03:58Z","title":"Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2501.15255."}