{"as_of":"2026-08-09T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:68c93fc6c5449397ec6605fda2b8497cf4c5979adf8ca890db6bd2d3687da99c","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:39:09.589461Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:30.868615Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:56:20.572153Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-08-07T12:35:30.868615Z","title":"Darwinlm: Evolutionary structured pruning of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24584","last_updated":"2025-08-18T16:52:22Z","snapshot_observed_at":"2026-08-09T10:10:52.166144Z","submitted_at":"2025-05-30T13:32:00Z","title":"AutoChemSchematic AI: Agentic Physics-Aware Automation for Chemical Manufacturing Scale-Up","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.868615Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2505.24584"},"observation_digest":"sha256:20473bb412d650f5c018176f105ce8d8185af37b376dfdcf669701c07dfe5b30","observation_id":"7287e1bf-ca2c-471b-976e-a5f585d31d34","resolution":{"observed_at":"2026-08-07T12:35:30.868615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-08-07T04:48:39.329408Z","title":"Darwinlm: Evolutionary structured pruning of large language models.arXiv preprint arXiv:2502.07780, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09613","last_updated":"2025-06-11T11:14:57Z","snapshot_observed_at":"2026-08-07T22:27:03.845847Z","submitted_at":"2025-06-11T11:14:57Z","title":"SparseSSM: Efficient Selective Structured State Space Models Can Be Pruned in One-Shot","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:48:39.329408Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2506.09613"},"observation_digest":"sha256:af6cc44599719e083cd1a859552f10af989afff2bc6c18e3946520e30786bc06","observation_id":"2fac348a-30da-4891-b39c-dc1be7a6b1fc","resolution":{"observed_at":"2026-08-07T04:48:39.329408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-08-06T17:45:20.865857Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.10059","last_updated":"2025-07-14T08:44:59Z","snapshot_observed_at":"2026-08-09T09:16:27.763879Z","submitted_at":"2025-07-14T08:44:59Z","title":"GeLaCo: An Evolutionary Approach to Layer Compression","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:45:20.865857Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2507.10059"},"observation_digest":"sha256:20fda0cb2ffe132996f2c11a5c106a0cd2ff223db5c61603a44019cc22f92d1f","observation_id":"2d47a72e-4edb-46e3-88a7-31f2a37c23a3","resolution":{"observed_at":"2026-08-06T17:45:20.865857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-08-04T13:31:03.739460Z","title":"Darwinlm: Evolutionary structured pruning of large language models.arXiv preprint arXiv:2502.07780, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.00192","last_updated":"2026-07-28T23:06:32Z","snapshot_observed_at":"2026-08-09T14:41:56.717825Z","submitted_at":"2025-09-30T19:10:35Z","title":"Train Large, Deploy Compact: Structured Compression for Compact Low-Rank Adaptation","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T13:31:03.739460Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2510.00192"},"observation_digest":"sha256:78757079498588471f396a9b80ce6e0e80232fb37dcff06a340aa0c5b8022f28","observation_id":"4f06c780-054b-4572-b047-7384f857302a","resolution":{"observed_at":"2026-08-04T13:31:03.739460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:19ee9f359b8876381f03b52923ea59b066888cc28e89a7ff2ed0cbb4d136a234","observation_id":"6f8332c6-dd3d-461e-b033-92098bb6e568","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2604.24938","last_updated":"2026-05-09T03:09:53Z","snapshot_observed_at":"2026-07-31T18:37:45.542966Z","submitted_at":"2026-04-27T19:25:28Z","title":"Rethinking Layer Redundancy in Large Language Models: Calibration Objectives and Search for Depth Pruning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T03:56:11.148569Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2604.24938"},"observation_digest":"sha256:0766774e610f84746d0c7447495dc4faedb427bf6a05a209570bb3230c87219b","observation_id":"e5a9ee51-7911-40f9-96c3-8162cffc11dc","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2604.24938","last_updated":"2026-05-09T03:09:53Z","snapshot_observed_at":"2026-07-31T18:37:45.542966Z","submitted_at":"2026-04-27T19:25:28Z","title":"Rethinking Layer Redundancy in Large Language Models: Calibration Objectives and Search for Depth Pruning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T01:10:54.457902Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2604.24938"},"observation_digest":"sha256:6040e2ace47a3b04e270850ff02dd41223f0f666757000aa0710a90815d4787b","observation_id":"bccd3aef-50c5-445c-805e-02e4b87a9c02","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2605.08738","last_updated":"2026-05-18T06:29:11Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:50:35Z","title":"SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-12T03:34:10.370956Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2605.08738"},"observation_digest":"sha256:aece0e23bacc1cdee0fd323908c2e369223f6a773960bc6b6bbf105672b46943","observation_id":"9fa2839f-7d51-4a28-9297-01b2e5b8239e","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2605.08738","last_updated":"2026-05-18T06:29:11Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T06:50:35Z","title":"SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-20T23:22:51.808346Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2605.08738"},"observation_digest":"sha256:5d236ef6e220cf1adc960e604b047d087353a5420724ef9e96fb4a87f8cf351e","observation_id":"996fc274-a8a9-41e8-8298-eb093bc6e64f","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2605.14738","last_updated":"2026-06-10T08:53:16Z","snapshot_observed_at":"2026-08-04T03:58:08.508076Z","submitted_at":"2026-05-14T12:01:05Z","title":"TAPIOCA: Why Task- Aware Pruning Improves OOD model Capability","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-22T10:09:46.259358Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2605.14738"},"observation_digest":"sha256:27395b85af84df2b24f1532077667f343d3ea3dc29c2555de9c5f14b48e6fe40","observation_id":"b6a78910-92e7-4f60-adcf-55776626944c","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.07780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-07-16T01:22:24.421594Z","title":"arXiv preprint arXiv:2502.07780 , year=","venue":null,"work_id":"4b0b75ce-7503-40b6-aadb-28f7f807acc3","year":2025},"citing_paper":{"arxiv_id":"2606.02559","last_updated":"2026-06-01T17:52:53Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:52:53Z","title":"From Layers to Submodules: Rethinking Granularity in Replacement-Based LLM Compression","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-06-28T14:47:44.384206Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2606.02559"},"observation_digest":"sha256:ae82a0db4e1c98ecbd919e8c60d395f69a7afa6545c8e72d09d492cf90c55a80","observation_id":"7a26f8be-893f-4462-9376-c4eaf0260501","resolution":{"observed_at":"2026-07-16T01:22:24.421594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07780","snapshot_observed_at":"2026-08-05T10:26:24.624287Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03887","last_updated":"2026-08-04T16:22:30Z","snapshot_observed_at":"2026-08-07T23:12:37.061943Z","submitted_at":"2026-08-04T16:22:30Z","title":"Omega-S: A Functional Resilience Index for LLM Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:26:24.624287Z"},"links":{"cited_paper":"/paper/2502.07780","citing_paper":"/paper/2608.03887"},"observation_digest":"sha256:777c17d842daf0739ec6cbe5f0af11fcf39109906e20bdf0cdf8b1fb839d23a7","observation_id":"8cd6f8d9-dfc2-4d3a-983f-4a5728b10c99","resolution":{"observed_at":"2026-08-05T10:26:24.624287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07780/citation-record","integrity":"/paper/2502.07780/integrity","json":"/paper/2502.07780/citation-record.json","paper":"/paper/2502.07780"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-08T11:39:09.437345Z","title":"Gqa: Training generalized multi-query transformer models from multi-head check- points","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.437345Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:4393862f0f2fe084895b7ddfd3247dc8ccb5ce85ee9e380c762d861b280e0208","observation_id":"d3fb247d-1691-48b8-b1c7-755605812f6b","resolution":{"observed_at":"2026-08-08T11:39:09.437345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-08T11:39:09.460074Z","title":"Gptq: Accurate post-training quantization for generative pre- trained transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.460074Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:0d38441073fbb4a8f561a01ca2994c6209bead28152762b412d52edbfc9965f6","observation_id":"b2451882-0cac-4f90-a4ba-224a94ab4565","resolution":{"observed_at":"2026-08-08T11:39:09.460074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:09.466314Z","title":"org/records/10256836,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.466314Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:d38bf13819b88e8f4c131b9362bfbe24bcb2db9bf55a7d178306f35da86f8565","observation_id":"db021aec-52ff-4927-8bf1-e0deb80a309b","resolution":{"observed_at":"2026-08-08T11:39:09.466314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-08T11:39:09.472396Z","title":"H., Ivison, H., Magnusson, I., Wang, Y ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.472396Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:cfdbf3897f57b00d098e47dc5b86412f440a8a1bae605bbd2cfa2112f8fa6c66","observation_id":"223e63a8-696d-4224-8b7e-fc995043ecd2","resolution":{"observed_at":"2026-08-08T11:39:09.472396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-07T23:10:12.222808Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-08T11:39:09.491926Z","title":"Shortened llama: A simple depth pruning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.491926Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:e2b8ca7ea63a7c38c5d0334f983a89831680bb726183d0122dbbb49b2fda964a","observation_id":"363b53d1-08ec-468d-b165-0972311ae340","resolution":{"observed_at":"2026-08-08T11:39:09.491926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.444306Z","title":"Structural pruning of large language models via neural architecture search","venue":null,"work_id":"7d1d6770-6aa0-4652-a789-fea26714124c","year":2023},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.497008Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:fb4654dcebe1846e8bce824693b065d920177ae823f11e5defdf5f8d8f418909","observation_id":"3d4359af-9896-4b52-8bc2-5495b300cff5","resolution":{"observed_at":"2026-08-08T11:39:10.449395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07259","last_updated":"2022-10-17T23:24:22Z","snapshot_observed_at":"2026-08-06T18:58:20.499511Z","submitted_at":"2022-03-14T16:40:31Z","title":"The Optimal BERT Surgeon: Scalable and Accurate Second-Order Pruning for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07259","snapshot_observed_at":"2026-08-08T11:39:09.502096Z","title":"The optimal bert surgeon: Scalable and accurate second-order pruning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.502096Z"},"links":{"cited_paper":"/paper/2203.07259","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:322a1998acc7e281ac388e530ee402fd890ecd2018f9ff63d719c2de0d6843a6","observation_id":"fcaebf1a-5306-4fd8-ad94-9dc109472f79","resolution":{"observed_at":"2026-08-08T11:39:09.502096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.426916Z","title":"Evolving knowledge distillation with large lan- guage models and active learning","venue":null,"work_id":"e875bd28-a20a-44ea-9883-83a662a77635","year":2024},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.507926Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:b1c9c8e2b34a9e12ddf8943e6beeb077c21377e557acc3cd9fcaf3aa806cae39","observation_id":"6190810f-3a5d-43b6-9db0-ef7be1017dd3","resolution":{"observed_at":"2026-08-08T11:39:10.432198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-09T06:25:20.879304Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-08T11:39:09.512897Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.512897Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:cc123fe3c4e21707add1a7ed8dfa42a22caeaa01fad7c951ad12ad84302dfce1","observation_id":"196ec8e1-f710-4fcd-b2c8-adfee11451db","resolution":{"observed_at":"2026-08-08T11:39:09.512897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T11:39:09.518281Z","title":"Ma, S., Wang, H., Ma, L., Wang, L., Wang, W., Huang, S., Dong, L., Wang, R., Xue, J., and Wei, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.518281Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:960fe853eab8649d6a182755eeb2a0c7acb61ae81def102121092cf1c500229e","observation_id":"2b9858a8-0484-4a0d-9041-bcaa8dd21d10","resolution":{"observed_at":"2026-08-08T11:39:09.518281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-08T11:39:09.524078Z","title":"Shortgpt: Layers in large language mod- els are more redundant than you expect","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.524078Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:669c4c3c2999d6dba9d05b0b88d2e22b6ea6dd9ddfbe37c92f798a4bca7359d7","observation_id":"3431147f-267a-4fe2-a761-1108e0950ca8","resolution":{"observed_at":"2026-08-08T11:39:09.524078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14679","last_updated":"2024-11-04T17:36:38Z","snapshot_observed_at":"2026-08-08T01:30:40.012013Z","submitted_at":"2024-07-19T21:47:57Z","title":"Compact Language Models via Pruning and Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14679","snapshot_observed_at":"2026-08-08T11:39:09.529197Z","title":"T., Joshi, R., Chochowski, M., Patwary, M., Shoeybi, M., Catanzaro, B., Kautz, J., and Molchanov, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.529197Z"},"links":{"cited_paper":"/paper/2407.14679","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:dec5edd2253e55bae8aa839e54261538dd5c826aeed1ab115402000c6fed8436","observation_id":"ef10a020-0b0d-4ab6-bab3-62f1db9d6120","resolution":{"observed_at":"2026-08-08T11:39:09.529197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14649","last_updated":"2025-07-01T14:41:08Z","snapshot_observed_at":"2026-07-06T19:36:05.879892Z","submitted_at":"2024-10-18T17:46:37Z","title":"EvoPress: Accurate Dynamic Model Compression via Evolutionary Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14649","snapshot_observed_at":"2026-08-08T11:39:09.540751Z","title":"Evopress: Towards optimal dynamic model compression via evolutionary search.arXiv preprint arXiv:2410.14649,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.540751Z"},"links":{"cited_paper":"/paper/2410.14649","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:a810296241fdd0ea8e1e387152372cfaf0564a7efdd3d65218cebecfc9efff8a","observation_id":"bb00abb2-6fcb-446a-a9c4-8c439587ff42","resolution":{"observed_at":"2026-08-08T11:39:09.540751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:09.545868Z","title":"Bi-mamba: Towards accurate 1-bit state space models.arXiv preprint arXiv:2411.11843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.545868Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:a868d06c1b2776c11a7a574d2bec4549c1d679c4c7f58e0c793ab2cdb15b09a3","observation_id":"108c2495-b135-40d6-82b3-694becfe4038","resolution":{"observed_at":"2026-08-08T11:39:09.545868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.410587Z","title":"Structured pruning for efficient gen- erative pre-trained language models","venue":null,"work_id":"534f4b69-6c33-4950-991b-f9072c24a664","year":2023},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.551157Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:aca84d4065e9b83b824d8af7d8fa7f5e3cc8e0c2f6fbe28b882804e3ca59e2d7","observation_id":"58193d75-dc75-4323-97be-a0ac34e8e8ec","resolution":{"observed_at":"2026-08-08T11:39:10.415806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T11:39:09.557254Z","title":"Llama 2: Open foundation and fine- tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.557254Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:86f632edc9ae62013b580a08d9e09fe61bd58977fd3df56d283b8861b85741c6","observation_id":"828d6cbe-e6b8-4cdf-a62e-e7b029ee1ff7","resolution":{"observed_at":"2026-08-08T11:39:09.557254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-08T11:39:09.562177Z","title":"Bitnet: Scaling 1- bit transformers for large language models.arXiv preprint arXiv:2310.11453,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.562177Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:e507c3f38c44c083ba02bfe16ac306dbcb4940e1d08bac9450b8a45650b22dfb","observation_id":"41190357-c3f6-47f7-829e-4829ddf01ad5","resolution":{"observed_at":"2026-08-08T11:39:09.562177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.392386Z","title":"Structured pruning of large language models","venue":null,"work_id":"b9fc1379-8d15-41e3-9715-4b02c92346e0","year":2020},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.566649Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:f949c421cb68791f72998132ab678160a5ed98ff4f371e981a470a4806c366f1","observation_id":"da1be7dd-e7cd-4801-b113-a482fb707da8","resolution":{"observed_at":"2026-08-08T11:39:10.398694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-08T11:39:09.575087Z","title":"A survey on knowledge distillation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.575087Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:dbdadeee0be8bdab47a9f5ace2a06eb97805cc985910a4fc2297024e5e632aaa","observation_id":"e71af61a-2d47-4b8b-bd8b-b36223a7677b","resolution":{"observed_at":"2026-08-08T11:39:09.575087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-08T11:39:09.579673Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.579673Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:1c53c0cb266d6cea18ea5312a9906152e9b075f4dfdc7316008dcc36b68b2db6","observation_id":"5cb60127-53c8-4de8-a755-96f38856c977","resolution":{"observed_at":"2026-08-08T11:39:09.579673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.376642Z","title":"Appendix A.1","venue":null,"work_id":"ffecca44-d223-41b4-ac1c-8b9690fb2273","year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.584611Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:505fb5c594876555431c0d926b34d28592ea22b1b5079c8dccf7d2602031abc3","observation_id":"fe03e990-bbfc-4e29-9321-221dd8473041","resolution":{"observed_at":"2026-08-08T11:39:10.381075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:10.360282Z","title":null,"venue":null,"work_id":"b79b8970-2901-406b-8a42-94f1d9a22dd4","year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.589461Z"},"links":{"citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:aa5902a9ddced47ecfb09dbda6c688cca4e75c229891b66792cef9f1a49f7d53","observation_id":"ade80e4c-e3e9-4ee6-923a-8afec18e7052","resolution":{"observed_at":"2026-08-08T11:39:10.365627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T11:39:09.481680Z","title":"Measuring mas- sive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.481680Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:b38912766381dd1f6ed022f415f109e08db5391b416dcc0124886e18b37d36f6","observation_id":"bc97ac90-e404-4897-a187-fa695b7a0e1d","resolution":{"observed_at":"2026-08-08T11:39:09.481680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02301","snapshot_observed_at":"2026-08-08T11:39:09.486140Z","title":"Distill- ing step-by-step! outperforming larger language models with less training data and smaller model sizes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.486140Z"},"links":{"cited_paper":"/paper/2305.02301","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:7071c889b58abd03b2e7e2710c627b71ea69fc3030df4b44f81e6f652a6feaa5","observation_id":"4cf598d5-b791-4bbd-88c9-2138a6bc45ae","resolution":{"observed_at":"2026-08-08T11:39:09.486140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-08T23:08:43.190961Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-08T11:39:09.448488Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.448488Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:491853db853a371cf99a2f0f793679bf4633f105237b8162fab4017eb68ac40f","observation_id":"4552d4dc-05a5-4eb7-bc4e-0d23c51ccdaf","resolution":{"observed_at":"2026-08-08T11:39:09.448488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-08T11:39:09.443255Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.443255Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:adfd0fcbec6d1f74dc8fe4b7f8c905bb57f5c170b9a25aeb47e793c69caa42e8","observation_id":"a98c19f7-83ca-4d59-b96f-281ba108c7d5","resolution":{"observed_at":"2026-08-08T11:39:09.443255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-08T11:39:09.570614Z","title":"F., and Gardner, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.570614Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:34af7f25f6f06512e2d47a5446a777e95731ea87a0a1c00f307418e25c135ca3","observation_id":"1a665f90-3402-4a0b-ae9a-782d207b496f","resolution":{"observed_at":"2026-08-08T11:39:09.570614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-08T11:39:09.534277Z","title":"Distilbert, a distilled version of bert: Smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.534277Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:08fb21cba2e5ec9bf1dbd52b488cfa43fd6d5c80189c820dd46153fce43b865f","observation_id":"ea83cfa1-fd80-46ad-866c-e46b5f1aba58","resolution":{"observed_at":"2026-08-08T11:39:09.534277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T11:39:09.454237Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.454237Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:2167262e9bf5ff163d5da7b2609a4a9ee70eff6006a622123affc6ba42907cef","observation_id":"ec62ba22-deda-4977-b2b9-60ad4611c1e8","resolution":{"observed_at":"2026-08-08T11:39:09.454237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-03T06:33:46.668360Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-08T11:39:09.477311Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.477311Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:59b7cd6e44099dace93921e79f5666cd059efeffff86737067cff9da316600ba","observation_id":"d0879de0-20b5-4512-9560-2606bf0d14a3","resolution":{"observed_at":"2026-08-08T11:39:09.477311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T06:26:59.031313Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 12 inbound Pith citation observations for arXiv:2502.07780."}