{"as_of":"2026-08-18T11:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9683a9155b037d0cd709f7adbba491e2666426a152beba5700128e44dc6d955","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:58:17.887134Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12953/citation-record","integrity":"/paper/2608.12953/integrity","json":"/paper/2608.12953/citation-record.json","paper":"/paper/2608.12953"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T19:58:17.570168Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.570168Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:3c80cc55f8376d915da8e4de325f5c19374aaeacbb0bf47de0afa57a6c27fd47","observation_id":"7ac930d8-8a02-4ccb-8df5-6595d3e22288","resolution":{"observed_at":"2026-08-15T19:58:17.570168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T19:58:17.576822Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.576822Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:21856dca623cad6a97aea8949b9a716ea9b7bc346522c1b78e2b77a8545032f4","observation_id":"d34fa210-4a33-45fa-9c83-ce3cc9953984","resolution":{"observed_at":"2026-08-15T19:58:17.576822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T19:58:17.582268Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.582268Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:141ce1b155f898a9d7be3ed83ee21de3b77267788e956083a61e7613daf68eef","observation_id":"1e6bcf37-e3ae-4c41-a1cc-cf295f1eea2a","resolution":{"observed_at":"2026-08-15T19:58:17.582268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-14T02:46:12.121034Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-15T19:58:17.587528Z","title":"gpt-oss-120b & gpt-oss-20b model card,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.587528Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d3d6e4454f8da027e17dcd709ce473612a95a37af1b3d98fb4f21d7ffac3cfc2","observation_id":"358d6888-9cd0-4ce6-8649-64a1e6b6141a","resolution":{"observed_at":"2026-08-15T19:58:17.587528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-16T15:08:25.859326Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T19:58:17.591834Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.591834Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:6399268e000dab2115e39b8a4424b4f3e040544531bcc2f400d3de873600b51d","observation_id":"d7ad915d-16b2-4492-a0cb-307eb22ecf6c","resolution":{"observed_at":"2026-08-15T19:58:17.591834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20011","last_updated":"2024-10-25T23:52:28Z","snapshot_observed_at":"2026-08-16T13:05:49.624956Z","submitted_at":"2024-10-25T23:52:28Z","title":"A Survey of Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20011","snapshot_observed_at":"2026-08-15T19:58:17.596292Z","title":"A survey of small language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.596292Z"},"links":{"cited_paper":"/paper/2410.20011","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:7be8f427620434006f907f9bb1443b71f46d8f234003e1e1d4abc38f2e56c27d","observation_id":"a529f626-b143-4411-bb47-f2230ed0df60","resolution":{"observed_at":"2026-08-15T19:58:17.596292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00532","last_updated":"2019-06-07T16:27:47Z","snapshot_observed_at":"2026-08-14T16:22:12.102152Z","submitted_at":"2019-06-03T02:29:22Z","title":"Efficient 8-Bit Quantization of Transformer Neural Machine Language Translation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00532","snapshot_observed_at":"2026-08-15T19:58:17.600956Z","title":"Eﬀicient 8-bit quantization of transformer neural machine language translation model,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.600956Z"},"links":{"cited_paper":"/paper/1906.00532","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:f5f8d9dbbcf447003b2794fc708d73e13244af39dbd6847498880708ba33de40","observation_id":"6081fddf-19ce-4215-b5eb-adc26899ba8a","resolution":{"observed_at":"2026-08-15T19:58:17.600956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.153490Z","title":"Qlora: eﬀicient finetuning of quantized llms,","venue":null,"work_id":"7ab5d437-3fa5-4b93-85f6-b5903a444df8","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.605226Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:59785275baf55fb9729ec5f3377c69c8ef53facf8661f2a093e6933e884cf3bc","observation_id":"e90524c1-ea53-4117-b3c7-e6fc0d72b528","resolution":{"observed_at":"2026-08-15T19:58:19.157497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.140920Z","title":"CBQ: Cross-block quantization for large language models,","venue":null,"work_id":"c8af2550-06f9-4a44-872a-a4a5d7b325ae","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.609562Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:2885abad7e15073a6873d16167b661e547e22d627e652964d26bf9b698c58078","observation_id":"8468d2b7-74dc-4a7a-8618-9ce8c24a2637","resolution":{"observed_at":"2026-08-15T19:58:19.145645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08543","last_updated":"2026-01-31T09:16:35Z","snapshot_observed_at":"2026-08-16T00:37:04.298248Z","submitted_at":"2023-06-14T14:44:03Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08543","snapshot_observed_at":"2026-08-15T19:58:17.613248Z","title":"Minillm: Knowledge distillation of large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.613248Z"},"links":{"cited_paper":"/paper/2306.08543","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:14dc29b126022a0d1956ad9504d40bab1050096f07635743b3fcd7f32243cd56","observation_id":"696c57bf-3d76-42fe-bb32-5c796c46da7f","resolution":{"observed_at":"2026-08-15T19:58:17.613248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.127748Z","title":"A good learner can teach better: Teacher-student collaborative knowledge distillation,","venue":null,"work_id":"a1708345-b0ba-404e-8a4e-634425bf14fd","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.617237Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:c13017be2b7b47a5b2fa39d59c4965bba351c0c57a4f97e53c36641a47724d34","observation_id":"30cfe390-b67a-4c5a-a205-7b961f1f72cb","resolution":{"observed_at":"2026-08-15T19:58:19.131814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.02819","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.519308Z","title":"Replaceme: Network simplification via depth pruning and transformer block linearization,","venue":null,"work_id":"e4f3a802-1074-4aee-a17f-876ca35f0b7e","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.621289Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:076911ec4438a7bc71e68f58bb2ff7a0c6229f5e67d993fa94a09b35e4186a6f","observation_id":"31462cd9-75d9-41c4-8670-23cb9af894b0","resolution":{"observed_at":"2026-08-15T19:58:18.525675Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-16T14:12:14.696997Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-15T19:58:17.624897Z","title":"Shortgpt: Layers in large language models are more redundant than you expect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.624897Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:9acec057c5e68d9a0ac62fd52adfc9be57c9d6bbb046cfe5048c897bd3e37c0a","observation_id":"60d07a5e-d8af-4dd1-b833-012076a63079","resolution":{"observed_at":"2026-08-15T19:58:17.624897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.114734Z","title":"SLEB: Streamlining LLMs through redundancy verification and elimination of transformer blocks,","venue":null,"work_id":"752795cd-56d9-4a4c-beaa-f9735f3dfc3d","year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.629406Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:58908b23c49d0172448214c790a77d0aa1ce363cb96d53f62610e44b66a7ba49","observation_id":"44a4c48d-f42f-4dcc-bce9-4c1b2f541578","resolution":{"observed_at":"2026-08-15T19:58:19.119624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.101615Z","title":"The unreasonable ineffectiveness of the deeper layers,","venue":null,"work_id":"5aba02b0-f700-41cc-9d94-04fce8f0bae8","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.633026Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:92087535992ad897af4b246aac0d4f2a7b8fbcfc9f4c609f57dc3c24e202281d","observation_id":"96537e75-9780-4f30-8358-94a386e1bed7","resolution":{"observed_at":"2026-08-15T19:58:19.105845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.088985Z","title":"Llm-pruner: on the structural pruning of large language models,","venue":null,"work_id":"a3348f34-ce99-4053-9560-baaea3af5085","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.636874Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:fe103e47093116e163a4583f41baffe0109b04a4f780ce5cff523464fe0637a1","observation_id":"8ae69e94-9a9e-45b7-80d5-e3685e77b77e","resolution":{"observed_at":"2026-08-15T19:58:19.094315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.074892Z","title":"Y ou only prune once: Designing calibration-free model compression with policy learning,","venue":null,"work_id":"3a54fc58-02d1-4f0c-a63e-b5ecf8d8926c","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.640794Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:5cb34d557557c8e485df17d7c5261bfa23732ef87610e01bd70ced5a7b032833","observation_id":"c53df1b6-c14d-4676-90cf-77154a9f8373","resolution":{"observed_at":"2026-08-15T19:58:19.079357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-15T19:58:17.644475Z","title":"Slicegpt: Compress large language models by deleting rows and columns,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.644475Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:e932ffd657f93c08a56e184b1d35dfc672a57844cc8291ceec76f2344a2579eb","observation_id":"dbda6eff-0b50-45b3-bd3d-5ce35d707bf3","resolution":{"observed_at":"2026-08-15T19:58:17.644475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-16T14:21:31.545370Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-15T19:58:17.649158Z","title":"Shortened llama: Depth pruning for large language models with comparison of retraining methods,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.649158Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:ab61f26ee0e8c6201148cb851927edf99a45d8bbbee2968376d5fd904eae33af","observation_id":"3ec65aee-ff2f-4c5f-aada-73f8f4787b34","resolution":{"observed_at":"2026-08-15T19:58:17.649158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i25.39222","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.933291Z","title":"Sliding-window merging for compacting patch-redundant layers in llms,","venue":null,"work_id":"28677031-4a06-442f-8297-710246b193ca","year":2026},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.653122Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d6ecf55dd93d7492cb8baafc5134c930fdeb30a7be2354b9fa099a28371fc105","observation_id":"60b41dfa-e088-483c-8485-68f967d493f8","resolution":{"observed_at":"2026-08-15T19:58:17.939790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.063585Z","title":"Beware of calibration data for pruning large language models,","venue":null,"work_id":"0bce61f9-09c8-4425-bf38-f588949796d4","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.657284Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:07bfed8e8ebf23e2b093d3527916bbc8e6686b16b95760378f313ae938715b02","observation_id":"d30ab97f-f96b-426d-b3d8-fdf00b9f82ac","resolution":{"observed_at":"2026-08-15T19:58:19.067548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.052433Z","title":"I-bert: Integer-only bert quantization,","venue":null,"work_id":"df98f9c6-621b-4fea-a71c-68050123d348","year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.661367Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:85454b0e058f0c1a6cb01365280adec4a6c4065100a64f8088f99a166d9025f1","observation_id":"77e4b368-0511-4715-95ec-0bb061eecb1e","resolution":{"observed_at":"2026-08-15T19:58:19.056297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.665428Z","title":"Llm-fp4: 4-bit floating-point quantized transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.665428Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:67f3fd98fbbfb30ec95612ebfb2c8cd6cb5079e35623a9a26448698c7872c32a","observation_id":"11053eb2-9d2f-4fe2-a02d-431438d36867","resolution":{"observed_at":"2026-08-15T19:58:17.665428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.669428Z","title":"Aptq: Attention-aware post-training mixed-precision quantization for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.669428Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:582a12651004537ee330084d13ad6cf0d158fac5d741aaaebdc4e91282db1f8e","observation_id":"16e72b1a-077c-42cc-b8ad-a419a1ba646d","resolution":{"observed_at":"2026-08-15T19:58:17.669428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T19:58:17.673469Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.673469Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:5370145698836379b2390614fa7838444a41d24b2f27020a84799dcd8c30775f","observation_id":"983469a0-a314-4c1a-a01c-26747010387d","resolution":{"observed_at":"2026-08-15T19:58:17.673469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.040471Z","title":"TinyBERT: Distilling BERT for natural language understanding,","venue":null,"work_id":"a12e3525-f781-412b-8aa6-ad0a278dfcd2","year":2020},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.677492Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:2898893aee2db5b2b67b97e35eb637f3a9b421297abbe0135fce8bae962daa58","observation_id":"cbe78255-4706-4877-b4a8-f6e7e1a8f471","resolution":{"observed_at":"2026-08-15T19:58:19.044424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07155","last_updated":"2025-08-26T12:19:42Z","snapshot_observed_at":"2026-08-16T13:53:28.073484Z","submitted_at":"2024-05-12T04:18:10Z","title":"Meta-Learned Modality-Weighted Knowledge Distillation for Robust Multi-Modal Learning with Missing Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07155","snapshot_observed_at":"2026-08-15T19:58:17.681644Z","title":"Meta-learned modality-weighted knowledge distillation for robust multi-modal learning with missing data,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.681644Z"},"links":{"cited_paper":"/paper/2405.07155","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:f9f7aac9fdfd7accc1434239ae5493fc283fdef52b0ed1c2241e5a29ec6f645f","observation_id":"1c0e06d5-5097-4e5b-be58-b2f50810b682","resolution":{"observed_at":"2026-08-15T19:58:17.681644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.685725Z","title":"Activation sparsity opportunities for compressing general large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.685725Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:0e9c0005f7bf4fb661ddac090d4d4990aa69eebe8b879f2166f7f540fd2c14ec","observation_id":"4ba8e24d-987e-43dd-a05f-5318d20a94bb","resolution":{"observed_at":"2026-08-15T19:58:17.685725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02335","last_updated":"2025-06-30T09:50:52Z","snapshot_observed_at":"2026-08-16T13:03:04.541705Z","submitted_at":"2024-11-04T17:59:04Z","title":"Sparsing Law: Towards Large Language Models with Greater Activation Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02335","snapshot_observed_at":"2026-08-15T19:58:17.689641Z","title":"Sparsing law: Towards large language models with greater activation sparsity,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.689641Z"},"links":{"cited_paper":"/paper/2411.02335","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:425c86873755dd7646cb270ef990d2661d3a32c6f0a095c3df723a36c3f8aae6","observation_id":"92b8990e-e227-4992-8cf1-27859f06b6a8","resolution":{"observed_at":"2026-08-15T19:58:17.689641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-15T19:58:17.694467Z","title":"Training-free activation sparsity in large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.694467Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:246cf3669c37b92159cb53162117d37c3c647ddbc721fb1a2907421c0ce0b2cf","observation_id":"e52f6848-aa3b-48c8-815a-a5e43eaebdba","resolution":{"observed_at":"2026-08-15T19:58:17.694467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19449","last_updated":"2025-04-28T03:30:32Z","snapshot_observed_at":"2026-08-16T23:28:50.874978Z","submitted_at":"2025-04-28T03:30:32Z","title":"R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19449","snapshot_observed_at":"2026-08-15T19:58:17.698832Z","title":"R-sparse: Rank-aware activation sparsity for eﬀicient llm inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.698832Z"},"links":{"cited_paper":"/paper/2504.19449","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:38aa4910cf2ccf1d83e77df6a6b94bbfffb2eef42b8eb51c208ed13da0f261c7","observation_id":"2cf05b86-2969-4ff9-b105-715602bd1e5d","resolution":{"observed_at":"2026-08-15T19:58:17.698832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02626","last_updated":"2015-10-30T23:29:27Z","snapshot_observed_at":"2026-08-15T13:34:24.234242Z","submitted_at":"2015-06-08T19:28:43Z","title":"Learning both Weights and Connections for Efficient Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02626","snapshot_observed_at":"2026-08-15T19:58:17.702896Z","title":"Learning both weights and connections for eﬀicient neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.702896Z"},"links":{"cited_paper":"/paper/1506.02626","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:0fe5a1975b854ef56c54ee3b54a085a905aff47889fb89e39333412ace8864ff","observation_id":"fe4bd0ea-41f5-42fc-a5c0-2b3634e67a60","resolution":{"observed_at":"2026-08-15T19:58:17.702896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-13T04:32:33.562415Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-15T19:58:17.707021Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.707021Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d588cfb6bfde68a238550ad138797c9dad6fe0aa4bba2cad9957e036afecf335","observation_id":"1be629ca-aff7-4404-be75-24489939386a","resolution":{"observed_at":"2026-08-15T19:58:17.707021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.029378Z","title":"Second order derivatives for network pruning: Optimal brain surgeon,","venue":null,"work_id":"69c2efa6-f540-4640-b866-66ef51f8629f","year":1992},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.711354Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:a6c25195b709f9f72c8b3501da7216657091ace8d5cc99cf6f07ced55fbb5b08","observation_id":"835b78f8-9602-40ad-b036-f6ce40090b7d","resolution":{"observed_at":"2026-08-15T19:58:19.033535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.016481Z","title":"Sparsegpt: massive language models can be accurately pruned in one-shot,","venue":null,"work_id":"e6b20642-2924-481a-af53-d925a54df883","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.715286Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:58f025b613a31cc41ff1b0954201282a1c3c399dad9d4d293f0a0036246ec5d3","observation_id":"c5ab5b0f-ca71-495e-8f82-73d176392d45","resolution":{"observed_at":"2026-08-15T19:58:19.021723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:19.004942Z","title":"The LLM surgeon,","venue":null,"work_id":"69a3f209-49ee-44fb-8eb9-a2b0086827ab","year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.719625Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d249a664a28a75ec9da1195c5ba3e492d9dcde289c2bc025eaa1f3b97f3c6c84","observation_id":"1682e9bf-4ff6-4e81-a939-a5222e11f2e1","resolution":{"observed_at":"2026-08-15T19:58:19.009050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08378","last_updated":"2021-04-16T21:27:32Z","snapshot_observed_at":"2026-08-16T18:30:58.242028Z","submitted_at":"2021-04-16T21:27:32Z","title":"Accelerating Sparse Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08378","snapshot_observed_at":"2026-08-15T19:58:17.724608Z","title":"Accelerating sparse deep neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.724608Z"},"links":{"cited_paper":"/paper/2104.08378","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d27bfe149ce12915ab474d0c75525036140d2a7c86e78a2bf3af55c3f4e0b9ce","observation_id":"8421378e-9aea-4a51-b3a2-6879a5967435","resolution":{"observed_at":"2026-08-15T19:58:17.724608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.992042Z","title":"Analyzing multi-head self-attention: Specialized heads do the heavy lifting, the rest can be pruned,","venue":null,"work_id":"227210a8-5d5a-4695-ab87-99d8ac1648ab","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.729033Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:120a0f9f401e2ad8ec75b1865fcb2369ce10fcb16589d020c0addfed5b8d72c9","observation_id":"02dab4da-1e69-4554-9f89-0c7b2d4d4aea","resolution":{"observed_at":"2026-08-15T19:58:18.997246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.979341Z","title":"Are sixteen heads really better than one?","venue":null,"work_id":"8c4bc71d-d437-46fc-9836-9abb6cf93b2a","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.734001Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:dd3877ca0a411dcde9af6e233f23b220ce5e259a90cc63a5a7c533b6fb2fbd72","observation_id":"fb4c46f5-ebe6-48a9-a68a-bad1dbebd5d4","resolution":{"observed_at":"2026-08-15T19:58:18.983274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.967920Z","title":"SlimLLM: Accurate structured pruning for large language models,","venue":null,"work_id":"8c35c625-288d-4da1-8bb3-8a69b27fb6da","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.738189Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:efe1569ca507356909dbead125aa7e255e667490c0a340c31ac51f0cbc777ae4","observation_id":"4ec01560-ca5f-4b71-bb29-47a64e0b9daf","resolution":{"observed_at":"2026-08-15T19:58:18.971864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00112","last_updated":"2022-06-30T21:57:07Z","snapshot_observed_at":"2026-08-16T16:49:06.065092Z","submitted_at":"2022-06-30T21:57:07Z","title":"Language model compression with weighted low-rank factorization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00112","snapshot_observed_at":"2026-08-15T19:58:17.742368Z","title":"Language model compression with weighted low-rank factorization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.742368Z"},"links":{"cited_paper":"/paper/2207.00112","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:693247bdf4015aa8cbeb00813037d81205243f805e5b3ee428460396d5c78116","observation_id":"dc86c9f4-a687-4c65-8909-a1cd8d1aa1d0","resolution":{"observed_at":"2026-08-15T19:58:17.742368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05821","last_updated":"2025-08-28T03:57:52Z","snapshot_observed_at":"2026-08-16T15:03:40.750477Z","submitted_at":"2023-12-10T08:41:24Z","title":"ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05821","snapshot_observed_at":"2026-08-15T19:58:17.746535Z","title":"Asvd: Activation-aware singular value decomposition for compressing large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.746535Z"},"links":{"cited_paper":"/paper/2312.05821","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:3270d436e1800c5f9e982059ad7f489de7c8132d55c8095a31159521988c9d4c","observation_id":"5b9e766c-03db-4d4e-9b90-b9a693b5935d","resolution":{"observed_at":"2026-08-15T19:58:17.746535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07378","last_updated":"2025-03-16T03:27:33Z","snapshot_observed_at":"2026-08-16T14:10:41.693836Z","submitted_at":"2024-03-12T07:31:18Z","title":"SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07378","snapshot_observed_at":"2026-08-15T19:58:17.750846Z","title":"Svd-llm: Truncation-aware singular value decomposition for large language model compression,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.750846Z"},"links":{"cited_paper":"/paper/2403.07378","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:54cd58a99fb58baf1b70aaccab7673494612a6779532af77c257ae492663d1e9","observation_id":"2b1c4c22-cf84-44f5-9dad-688c9dc5f683","resolution":{"observed_at":"2026-08-15T19:58:17.750846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.956828Z","title":"Streamlining redundant layers to compress large language models,","venue":null,"work_id":"319626a2-cdc6-45f8-b686-22445d666527","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.754749Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:53b8380f937749ac7e46cb653d699ac1386c41a2c8776b38e35c1ef83cd6e8f1","observation_id":"7ac99b67-d594-4f52-b4e0-1485b782a3b2","resolution":{"observed_at":"2026-08-15T19:58:18.960550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.944539Z","title":"DLP: Dynamic layerwise pruning in large language models,","venue":null,"work_id":"e08bcc9f-ca27-478c-aa9f-9fd12f68cae8","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.758196Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:a46a976d4a61d2ff2056a011c83e1158be59dcdd008ba152b79bd79bbb108e0f","observation_id":"fd91df38-6daa-496f-94bd-2f4b04285787","resolution":{"observed_at":"2026-08-15T19:58:18.948869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.931840Z","title":"Prompt-based depth pruning of large language models,","venue":null,"work_id":"45c486b6-0de3-4d47-a06d-2051743cb322","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.761861Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:676dd23137698cb52fd6f0d81ce10318d9fce98fe6217684c5e1aac9ca9d33e7","observation_id":"5ed00657-deb9-4148-a0d1-0b0db3e2e704","resolution":{"observed_at":"2026-08-15T19:58:18.936480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15921","last_updated":"2025-04-23T23:24:01Z","snapshot_observed_at":"2026-08-14T01:20:10.531199Z","submitted_at":"2024-12-20T14:13:09Z","title":"Less is More: Towards Green Code Large Language Models via Unified Structural Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15921","snapshot_observed_at":"2026-08-15T19:58:17.765828Z","title":"Less is more: Towards green code large language models via unified structural pruning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.765828Z"},"links":{"cited_paper":"/paper/2412.15921","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:b26b779c20e48ba8fd11946e37d877a01a2cbbc92f44be80effd4334cdb3d53d","observation_id":"2059058f-b6e7-4c2f-b0ba-056d15fe80e7","resolution":{"observed_at":"2026-08-15T19:58:17.765828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.920885Z","title":"Knapsack problems,","venue":null,"work_id":"b7d208c9-2456-4300-a6d0-3f41afc366a8","year":1998},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.770021Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:9fc59f3f3e22f4eda51a0cb540ebd5c81302cac72bd33e3f724d0b6a196536c2","observation_id":"087b7255-e36b-4941-8129-62473ac4b613","resolution":{"observed_at":"2026-08-15T19:58:18.924997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T19:58:17.773699Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.773699Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:50bbce8003c39f28384d6686953ea992ec6accf8dbcb73483e95813bc93f0ae3","observation_id":"060cd6bb-8150-4525-b190-40c229a540bc","resolution":{"observed_at":"2026-08-15T19:58:17.773699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-14T03:45:52.225630Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-15T19:58:17.778138Z","title":"Phi-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.778138Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:4eb2c680d771496fff006e39cb607a8b21687c12607338742d3aa2ca228aec2c","observation_id":"6639f2d4-5c59-4891-8a64-e2ae1240c9fb","resolution":{"observed_at":"2026-08-15T19:58:17.778138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.908255Z","title":"2SSP: A two-stage framework for structured pruning of LLMs,","venue":null,"work_id":"1a8b481a-5390-411f-abef-c7318af933ef","year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.782678Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:da73a3f7955c66c33567e2fbd9a6d52536bc6a231d498b4b90e3f6436d388414","observation_id":"04294ee4-14a3-4a03-8844-dc2d96c24e2f","resolution":{"observed_at":"2026-08-15T19:58:18.912468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-15T19:58:17.786256Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.786256Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:7dcf2f520e5eef146b1e65bc19a338769609348b8ff4ce53475ea940d76cd7cf","observation_id":"59f66471-fb33-4429-87b2-b0c73133202c","resolution":{"observed_at":"2026-08-15T19:58:17.786256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.893361Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context,","venue":null,"work_id":"67b83b21-0b0f-4ca4-b386-be0385f50199","year":2016},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.790556Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:f2bfa1c42a6b7ba6c131b09235159de6728b4a298d2cc4a6e61450284fd9641b","observation_id":"d4367532-176d-46cc-9394-10f8015ce7d1","resolution":{"observed_at":"2026-08-15T19:58:18.897570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.881353Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":"6e818da4-ad44-42ec-a79c-494b2b580da0","year":2020},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.794492Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:012c34eead3e4e19b9a3535833e17cb4c4772524b2e5512037f99e7953733ca1","observation_id":"7df822b2-185b-4e73-a71e-aff1ecb1f928","resolution":{"observed_at":"2026-08-15T19:58:18.885339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.868961Z","title":"PROST: Physical reasoning about objects through space and time,","venue":null,"work_id":"43ecd916-dcea-4eed-839a-c3c15fd647a8","year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.798350Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:8ec00779f9e7fb1fed70fec6bc058c2fbf370054e2b9d95b9d3cafbf37afaa5f","observation_id":"dfe1fa7f-c28a-4ac3-b824-77d87ace3dec","resolution":{"observed_at":"2026-08-15T19:58:18.873511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.855712Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge,","venue":null,"work_id":"769a3998-4d3e-4e8b-91b3-1cccfb72dc94","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.802616Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:9fccfabaca0a639a333b5fb3625244081262ea28df4d71012aad31c853ef6e8e","observation_id":"d45432b5-cb0e-45cd-89c7-f9bf80b8c679","resolution":{"observed_at":"2026-08-15T19:58:18.860632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T19:58:17.807045Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.807045Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:d98443cb4102ff4a0fd3c33e78d142987bfe2413b91315cdea582fea0fb69fcb","observation_id":"2e065396-6d0a-4e1d-86b5-fb250ef047cc","resolution":{"observed_at":"2026-08-15T19:58:17.807045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.841924Z","title":"MathQA: Towards interpretable math word problem solving with operation-based formalisms,","venue":null,"work_id":"e19dc363-1086-4968-b8a2-9b993dcb46f5","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.811252Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:dfc0b51823b6733a56a82b58c4728446757868fdb9033c12cb4666b8645fa7e5","observation_id":"1fa4547f-c2fe-48f5-b7d6-33795d28034f","resolution":{"observed_at":"2026-08-15T19:58:18.847022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.829633Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering,","venue":null,"work_id":"deedf347-29a0-40fa-857b-028ee1a16695","year":2018},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.815420Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:95a8f54b2f09cf11f49a562864e6e37d85176450418bfb4add6979696597a4e9","observation_id":"040ed4d2-2127-4e40-9e67-6ecc35da4df0","resolution":{"observed_at":"2026-08-15T19:58:18.834274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.818052Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams,","venue":null,"work_id":"0e0c3974-680f-46b5-b8f7-8099dcb5273f","year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.819243Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:57753ff6791851d027e109f03b9ce9b687f8dc207fc6ea036d3fe9bf2bb5e320","observation_id":"ea146a8c-cf8e-413b-b7b5-8a2e57252d12","resolution":{"observed_at":"2026-08-15T19:58:18.822196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.803831Z","title":"Blimp: The benchmark of linguistic minimal pairs for english,","venue":null,"work_id":"61d8966b-b4c2-495e-aa75-d4464ad60aba","year":null},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.822839Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:eae3777c6ab7b8a8c0b6e5dfc2bd3a1b472fa30b428cc8f16fafd788cd5ddb27","observation_id":"947c4538-1edb-4c6d-af4f-b5ee71b5ae54","resolution":{"observed_at":"2026-08-15T19:58:18.810186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.790151Z","title":"BoolQ: Exploring the surprising diﬀiculty of natural yes/no questions,","venue":null,"work_id":"1e21c11e-6c0f-4979-8c7e-a07959e6578a","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.832137Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:364a8252c2db8998f03a8cb6401952ec4e6f299a672308c41cdada1f146b68ba","observation_id":"00917aab-eff4-4099-b414-4caf6c1bec0a","resolution":{"observed_at":"2026-08-15T19:58:18.794454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.776655Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":"17187105-745b-4a8c-9383-869a636c9371","year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.835862Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:e6c67f66634ac7703d205ea3d8a68b3c49b02a6b15af16435c36f1389e8cdf53","observation_id":"c75c707f-210c-40d9-afc6-1c3777098763","resolution":{"observed_at":"2026-08-15T19:58:18.781362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.762242Z","title":"CoQA: A conversational question answering challenge,","venue":null,"work_id":"866c0ad3-65d8-4e11-a85c-46aa4525d1e7","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.840044Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:342313c0ba5d87d2effe5ff3e07be2dbcb3dbba7ed23ba0ede99ad009a7cdf21","observation_id":"07774e3d-75af-4432-95fe-145439c9964c","resolution":{"observed_at":"2026-08-15T19:58:18.767056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.750323Z","title":"TruthfulQA: Measuring how models mimic human falsehoods,","venue":null,"work_id":"f81be9f9-892f-4f43-baa6-6b344369c620","year":2022},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.844378Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:41683465c7d70b4ddf503183fd145201085cc1d8f53f5ca05ac292e34c693777","observation_id":"8e5f0b28-0d2f-4409-b746-da03356590e8","resolution":{"observed_at":"2026-08-15T19:58:18.754667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.736039Z","title":"Gender bias in coreference resolution,","venue":null,"work_id":"23dfe168-8374-49ad-9109-9772dff933b8","year":2018},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.848475Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:8d077f31af54e0b08aa50928e5b7c79a17817c4258fec7c59a0b0a9674a49a9a","observation_id":"4ef2c92c-d261-463d-8557-ff5c0d58bee2","resolution":{"observed_at":"2026-08-15T19:58:18.742087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.724377Z","title":"Moral stories: Situated reasoning about norms, intents, actions, and their consequences,","venue":null,"work_id":"c63f174a-33b4-4b17-add5-8e57ec0ed7c8","year":2021},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.852136Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:4643c2c8b45d3b1771245509d2a1601f63117a538ffe4196d2f63ee2a390c665","observation_id":"e435c4d2-12af-403b-ad16-65440c8c7241","resolution":{"observed_at":"2026-08-15T19:58:18.728310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.709752Z","title":"Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification,","venue":null,"work_id":"5795d561-e489-4548-980b-c9cf010f16bb","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.855611Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:f15471e294ff545e65917d4abf45d76ce5a9866c5a8f6a7ac5ccd7221f20e75c","observation_id":"ec2ea693-7252-4349-9d7c-207f0e5115e2","resolution":{"observed_at":"2026-08-15T19:58:18.715333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.697066Z","title":"Stanford alpaca: An instruction-following llama model,","venue":null,"work_id":"7fced498-af77-497b-a8ab-4459716d3aac","year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.859116Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:ab507e4c490ac14e1a88b4ab6092a7650ee50e8352a775242212a5073c1e32ed","observation_id":"5d181749-1308-431b-8fe1-ed27e222be25","resolution":{"observed_at":"2026-08-15T19:58:18.701877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.682350Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":"af7ffa1d-7451-493d-a950-cabdea85a1b3","year":2020},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.863197Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:18eb11f97f8be55e0955b14aeebc27674d54ef99d2287e5be373abf0c94a067b","observation_id":"998538de-8f42-4f0c-953e-bd7885d8d123","resolution":{"observed_at":"2026-08-15T19:58:18.687441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.669471Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":"ad5e0031-652c-4403-84b7-260e19da580f","year":2019},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.867056Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:3a783ad2c8bf1d77d10cb4bfe1e3f6541388ad56f4227ee38d3b31455199a910","observation_id":"120cc6de-8606-4acb-83c4-2b9428d0a37f","resolution":{"observed_at":"2026-08-15T19:58:18.673814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.656331Z","title":"Transformers: State-of-the-art natural language processing,","venue":null,"work_id":"5c7ac0d8-91d2-477a-a548-172374297a66","year":2020},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.871054Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:f12d0b2bd4a23b42f221ea4aac9a5422d29ff17e771917e5d99d4cac9d49721a","observation_id":"8e8d49b0-d69f-4fad-9c77-dbca2ba280ce","resolution":{"observed_at":"2026-08-15T19:58:18.660947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.874721Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.874721Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:959029d03b1047008a785e7f56b59404414041933a07272196d99f03439ed2a2","observation_id":"e36801dc-8371-4c8c-bd2e-738baaf5a2cc","resolution":{"observed_at":"2026-08-15T19:58:17.874721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-15T19:58:17.878665Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.878665Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:ede9e97dbc17491ffb0be11ada707a0a8e60d4c89fc597c41ab98d5e4928f157","observation_id":"1c40f326-ec9a-4936-9e24-471e370a50d6","resolution":{"observed_at":"2026-08-15T19:58:17.878665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.643158Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"aa4f5933-d42f-4bab-b733-1f889ee10f3c","year":2022},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.882644Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:69566ce570fe925a4dec8df0cddf4d5ea2c1614f687424be4bf5b4615d83344b","observation_id":"cb88d44d-bca1-45d9-908c-b83c491f46a9","resolution":{"observed_at":"2026-08-15T19:58:18.648053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:18.629103Z","title":"he” changed to “she","venue":null,"work_id":"f4e24be9-b2e3-4dfb-85da-2ad69b90f46b","year":null},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.887134Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:4b33deadd68540cd35e4b17b58bdca0709bcef80aa53d9d1bf6d7c07015d7d82","observation_id":"aa977938-fc61-427b-8d2a-38d9565740a3","resolution":{"observed_at":"2026-08-15T19:58:18.633442Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:58:17.827149Z","title":"Available: https://doi.org/10.1162/tacl_a_00321","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.827149Z"},"links":{"citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:0d13251f4d30a279a10bd0fa591d821b1acc3de71dfee83c3895f4761dd10c7a","observation_id":"3ce8487c-f668-41b7-872e-21a077f33d1b","resolution":{"observed_at":"2026-08-15T19:58:17.827149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":2,"verified_fuzzy":41},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2608.12953."}