{"as_of":"2026-08-11T10:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a2363fa30f5103d6ea6260e9514dc41dba2361a0f11522b3bbe69505894fa26","coverage":[{"denominator":140,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:46:38.527851Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:53:27.672710Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-09T05:45:21.036588Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15014","snapshot_observed_at":"2026-08-06T17:53:27.672710Z","title":"On accelerating edge ai: Optimiz- ing resource-constrained environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09702","last_updated":"2025-07-13T16:26:05Z","snapshot_observed_at":"2026-08-09T18:51:40.228035Z","submitted_at":"2025-07-13T16:26:05Z","title":"Token Compression Meets Compact Vision Transformers: A Survey and Comparative Evaluation for Edge AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:53:27.672710Z"},"links":{"cited_paper":"/paper/2501.15014","citing_paper":"/paper/2507.09702"},"observation_digest":"sha256:23c5ec4a3b56b0e88b1ed06627a5651f93c76ffee7c1a2df380144feca9d40d2","observation_id":"1e3af81f-46f6-4f84-bf14-2b32bb6ec881","resolution":{"observed_at":"2026-08-06T17:53:27.672710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15014","snapshot_observed_at":"2026-08-03T11:05:02.953719Z","title":"On accelerating edge ai: Optimizing resource-constrained environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07600","last_updated":"2026-07-13T10:40:20Z","snapshot_observed_at":"2026-08-09T20:23:41.040510Z","submitted_at":"2026-01-12T14:49:52Z","title":"Performance Isolation for Inference Processes in Edge GPU Systems","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:05:02.953719Z"},"links":{"cited_paper":"/paper/2501.15014","citing_paper":"/paper/2601.07600"},"observation_digest":"sha256:b9df139060d251b42f125940baa7ffbf6a4103c79db40406a98577efe653b5e9","observation_id":"b7b67d51-e4b1-43fe-9383-5a493b71e479","resolution":{"observed_at":"2026-08-03T11:05:02.953719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"cited_work":{"arxiv_id":"2501.15014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15014","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On accelerating edge ai: Optimiz- ing resource-constrained environments","venue":null,"work_id":"0e38e9f7-f863-4175-90ae-e15e66a4f53d","year":2025},"citing_paper":{"arxiv_id":"2605.01742","last_updated":"2026-05-03T06:45:24Z","snapshot_observed_at":"2026-08-10T21:31:07.354943Z","submitted_at":"2026-05-03T06:45:24Z","title":"Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T19:37:07.672702Z"},"links":{"cited_paper":"/paper/2501.15014","citing_paper":"/paper/2605.01742"},"observation_digest":"sha256:0bb5af3124fadac3f815f95dd4ce6e69c1d0eb4b165bbe3e4038c0984f270261","observation_id":"35e2445b-1cc9-4d7d-9574-c9fe4e169eb8","resolution":{"observed_at":"2026-05-09T05:45:21.041683Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15014/citation-record","integrity":"/paper/2501.15014/integrity","json":"/paper/2501.15014/citation-record.json","paper":"/paper/2501.15014"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.133501Z","title":"Quantization and training of neural networks for efficient integer-arithmetic-only inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.133501Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:53360212aad83a03412e4b387d962c485ab07ed0185ed878abc821bbf3672535","observation_id":"7bbca4b2-ce35-431e-914b-dd0bb73b2712","resolution":{"observed_at":"2026-08-10T14:46:38.133501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-08T01:47:51.652242Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-10T14:46:38.137485Z","title":"Efficientqat: Efficient quantization-aware training for large language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.137485Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ec0cf5f7c6277308299dd2054e39ab8475541bf56a999cba1bf835c13d07a86d","observation_id":"59eab8df-dad0-45df-95d0-3f4113c80d7a","resolution":{"observed_at":"2026-08-10T14:46:38.137485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11650","last_updated":"2024-09-18T02:35:00Z","snapshot_observed_at":"2026-08-04T13:49:59.867662Z","submitted_at":"2024-09-18T02:35:00Z","title":"Art and Science of Quantizing Large-Scale Models: A Comprehensive Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11650","snapshot_observed_at":"2026-08-10T14:46:38.141662Z","title":"Art and science of quantizing large-scale models: A comprehensive overview","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.141662Z"},"links":{"cited_paper":"/paper/2409.11650","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:e609363d720784a41f5a40d1a4665b5c3addf44796142f04d87a4a40667e217a","observation_id":"94b55ef8-4416-47ec-9d53-d4f6c7a7b80f","resolution":{"observed_at":"2026-08-10T14:46:38.141662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02026","last_updated":"2024-10-03T16:31:59Z","snapshot_observed_at":"2026-08-06T06:00:03.819847Z","submitted_at":"2024-09-03T16:20:22Z","title":"Foundations of Large Language Model Compression -- Part 1: Weight Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02026","snapshot_observed_at":"2026-08-10T14:46:38.145982Z","title":"Foundations of large language model compression--part 1: Weight quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.145982Z"},"links":{"cited_paper":"/paper/2409.02026","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:c4051198365e5d96984de4d6b39f2dec17a90a84510cb159ab32ad59f1eee9f2","observation_id":"c4a76823-a8ad-49d0-8412-33019aad2618","resolution":{"observed_at":"2026-08-10T14:46:38.145982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-10T14:46:38.150913Z","title":"AWQ : Activation -aware Weight Quantization for LLM Compression and Acceleration , July 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.150913Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:c4e30f169d8a701f069231f9a65bf869fd6d3e1f6e83558fc9654b7c3f10d04e","observation_id":"26a0b5a8-ce62-47e0-8b3e-d17450655d66","resolution":{"observed_at":"2026-08-10T14:46:38.150913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-10T14:46:38.155470Z","title":"Qlora: Efficient finetuning of quantized llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.155470Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:427d8dbf94d9633d1b4efbc7a06863b61515403fb03c8864c439cda3c85a72ca","observation_id":"5f13e718-ef1b-42d3-8c4a-1734987aa677","resolution":{"observed_at":"2026-08-10T14:46:38.155470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.159769Z","title":"Integer or floating point? new outlooks for low-bit quantization on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.159769Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:086e9e8532ad5ffbaee559f37c9028050c8ecfa3ed3af4f299dc7369d752a0f0","observation_id":"18d71ae2-03b1-4932-acb5-bcf93f78f6d4","resolution":{"observed_at":"2026-08-10T14:46:38.159769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01089","last_updated":"2023-05-17T10:07:33Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T15:46:15Z","title":"RPTQ: Reorder-based Post-training Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01089","snapshot_observed_at":"2026-08-10T14:46:38.163507Z","title":"Rptq: Reorder-based post-training quantization for large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.163507Z"},"links":{"cited_paper":"/paper/2304.01089","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:0fab10c27a77f8d7c140f2610ec3373f3e3e934e59c4e95d3b80b8ad2ec43b6c","observation_id":"80b729b7-d83c-4bc4-8222-c2ed17484916","resolution":{"observed_at":"2026-08-10T14:46:38.163507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09145","last_updated":"2023-10-23T08:48:31Z","snapshot_observed_at":"2026-07-06T15:17:05.623407Z","submitted_at":"2023-04-18T17:34:23Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09145","snapshot_observed_at":"2026-08-10T14:46:38.167424Z","title":"Outlier suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.167424Z"},"links":{"cited_paper":"/paper/2304.09145","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:81a3b0a121bc6b3ef5383298b9b54fba2b4b7f5026163678b1470710c5f3a540","observation_id":"fa6a0ec5-f35c-433f-9f9d-556e71043bd8","resolution":{"observed_at":"2026-08-10T14:46:38.167424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-10T14:46:38.171419Z","title":"Mixed precision training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.171419Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:6d231e85608a58cec0d65258f65d6774551ce197faa2ce524ce3858e4551a6c8","observation_id":"93aca12d-60e6-4136-9d0c-9496ee375057","resolution":{"observed_at":"2026-08-10T14:46:38.171419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.175466Z","title":"Layered mixed-precision training: A new training method for large-scale ai models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.175466Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:1a1877dc16f78c059b8af5be85fa4cbb340424d5f5773725456f5e6701f7e6cf","observation_id":"d0727b2a-f5e2-4b55-b92d-0578d713031b","resolution":{"observed_at":"2026-08-10T14:46:38.175466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13056","last_updated":"2026-06-04T07:21:46Z","snapshot_observed_at":"2026-08-08T05:37:51.969937Z","submitted_at":"2024-10-16T21:34:41Z","title":"Channel-Wise Mixed-Precision Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13056","snapshot_observed_at":"2026-08-10T14:46:38.179221Z","title":"Channel-wise mixed-precision quantization for large language models, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.179221Z"},"links":{"cited_paper":"/paper/2410.13056","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:1a953660053d4060fbb4c7fa49518115b69aa799214b541997321a8631455095","observation_id":"d686842b-2e37-4842-82ba-f54a96f683fc","resolution":{"observed_at":"2026-08-10T14:46:38.179221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.183118Z","title":"Mixed precision low-bit quantization of neural network language models for speech recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.183118Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:e52bdab700ceb5c96f95b6cd7f9df080e98f49906affebbcb403cfd532bcafff","observation_id":"38cf8457-1374-4fb7-8a4b-9efe2af78aec","resolution":{"observed_at":"2026-08-10T14:46:38.183118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.186941Z","title":"Efficient deep learning: A survey on making deep learning models smaller, faster, and better","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.186941Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:08a9f3399177405a3404339fb4d5e3b94327924b7283230c2273a4549d092fe6","observation_id":"747d88b1-aaa9-4680-bfe6-d403761b12af","resolution":{"observed_at":"2026-08-10T14:46:38.186941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.190754Z","title":"Model optimization - google ai","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.190754Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:6088ee11d8ef07cc81fd37c8883972ff38604fde857daa4a0968abc050c6dffd","observation_id":"16b502ab-f930-4661-8d07-dfe224e487f0","resolution":{"observed_at":"2026-08-10T14:46:38.190754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02530","last_updated":"2024-10-30T04:55:26Z","snapshot_observed_at":"2026-08-10T12:28:09.471772Z","submitted_at":"2024-10-30T04:55:26Z","title":"A Comprehensive Study on Quantization Techniques for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02530","snapshot_observed_at":"2026-08-10T14:46:38.194253Z","title":"A comprehensive study on quantization techniques for large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.194253Z"},"links":{"cited_paper":"/paper/2411.02530","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:172c1f4a9c5e11327fce51b602dca8ab97d29f0113e373ac37e9c7b6d901df65","observation_id":"3cffbc8a-a4b6-4ab5-85e2-2b093843da26","resolution":{"observed_at":"2026-08-10T14:46:38.194253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.0233","last_updated":"2015-01-21T22:25:26Z","snapshot_observed_at":"2026-08-04T23:10:05.993602Z","submitted_at":"2014-11-30T15:48:16Z","title":"The Loss Surfaces of Multilayer Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.0233","snapshot_observed_at":"2026-08-10T14:46:38.198416Z","title":"The loss surface of multilayer networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.198416Z"},"links":{"cited_paper":"/paper/1412.0233","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:9c5441183d55a5f7eb98c29e8b4d79ff7594c1d32633c559cadc72db2db7dd24","observation_id":"a61b0b69-a24a-4fff-91e9-d9ce53f1efe0","resolution":{"observed_at":"2026-08-10T14:46:38.198416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.204876Z","title":"A survey on deep neural network pruning-taxonomy, comparison","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.204876Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:1311db7c29e9611d2acb3eb9bf6e3932d40b1914b89757229c8890b088ef0630","observation_id":"5c57f2bc-fad7-4afc-a5de-965e9f6fb765","resolution":{"observed_at":"2026-08-10T14:46:38.204876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02340","last_updated":"2019-02-23T07:45:29Z","snapshot_observed_at":"2026-07-06T07:06:10.289386Z","submitted_at":"2018-10-04T17:39:58Z","title":"SNIP: Single-shot Network Pruning based on Connection Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02340","snapshot_observed_at":"2026-08-10T14:46:38.209487Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.209487Z"},"links":{"cited_paper":"/paper/1810.02340","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:f26b28a5a005f2c11395ade676c0249c0a280a5eb054ffc0ec881be416b6983e","observation_id":"443aa724-f24e-4470-80d9-5491790c87a9","resolution":{"observed_at":"2026-08-10T14:46:38.209487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07376","last_updated":"2020-08-07T00:02:33Z","snapshot_observed_at":"2026-08-10T04:53:00.900945Z","submitted_at":"2020-02-18T05:14:47Z","title":"Picking Winning Tickets Before Training by Preserving Gradient Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.07376","snapshot_observed_at":"2026-08-10T14:46:38.213775Z","title":"Picking winning tickets before training by preserving gradient flow, 2020 a","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.213775Z"},"links":{"cited_paper":"/paper/2002.07376","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:a00f385a5d68130c8af26237b47dbdbf08c7675a9cbf2dc05986ca74aa63b7eb","observation_id":"beebf16b-87b8-4200-a0c7-603fd51e5c8a","resolution":{"observed_at":"2026-08-10T14:46:38.213775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00774","last_updated":"2023-03-22T12:33:46Z","snapshot_observed_at":"2026-08-11T05:33:50.033336Z","submitted_at":"2023-01-02T17:48:56Z","title":"SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00774","snapshot_observed_at":"2026-08-10T14:46:38.218245Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.218245Z"},"links":{"cited_paper":"/paper/2301.00774","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ba4edca98cb40973350e75cc504e5c3b039bceb31c88eefed30c3bfb4fdbf7a7","observation_id":"5b15a04d-e505-442b-b71e-680e2c8fbe4a","resolution":{"observed_at":"2026-08-10T14:46:38.218245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06168","last_updated":"2017-08-21T09:44:26Z","snapshot_observed_at":"2026-07-06T05:51:49.080204Z","submitted_at":"2017-07-19T15:52:14Z","title":"Channel Pruning for Accelerating Very Deep Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06168","snapshot_observed_at":"2026-08-10T14:46:38.222315Z","title":"Channel pruning for accelerating very deep neural networks, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.222315Z"},"links":{"cited_paper":"/paper/1707.06168","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:90907722d5f8cb25f91a11034d0226d4173094a344248783ac6d65adaddef5e5","observation_id":"f70e91db-3bbc-4b75-a990-e665cb576c18","resolution":{"observed_at":"2026-08-10T14:46:38.222315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.226147Z","title":"Gate Decorator : Global Filter Pruning Method for Accelerating Deep Convolutional Neural Networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.226147Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:791d943ef62513e4d0ac3b24c04e2bba14e1a8d65fceb685a460ff822f4689f6","observation_id":"191d9205-9600-4bde-b6a1-396456cfffe1","resolution":{"observed_at":"2026-08-10T14:46:38.226147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.229807Z","title":"Layer-wise pruning of transformer attention heads for efficient language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.229807Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:d872ba885db81911f2e79f6be3a98e8b7a96c981c7e5abfd0bee2b68204836db","observation_id":"56d90dca-8913-41bf-9116-2118e204c944","resolution":{"observed_at":"2026-08-10T14:46:38.229807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-10T14:46:38.233502Z","title":"Croci, Marcelo Gennari do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.233502Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:2d4c91b0e229f0e2615c50e2a6aff446423697d2684fd3e43a1155a904dbeffd","observation_id":"feba9842-ca0a-4c1d-a2ef-4d1780cd6721","resolution":{"observed_at":"2026-08-10T14:46:38.233502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-10T14:46:38.237471Z","title":"Shortgpt: Layers in large language models are more redundant than you expect, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.237471Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:e3c94579d2e4bdd879ea9f454d875e5697569cb126a7ce96efece68fc0dd37ab","observation_id":"6369a1ce-10bc-455d-94f1-a1f8788fa130","resolution":{"observed_at":"2026-08-10T14:46:38.237471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11627","last_updated":"2023-09-28T03:59:27Z","snapshot_observed_at":"2026-07-06T15:29:39.466936Z","submitted_at":"2023-05-19T12:10:53Z","title":"LLM-Pruner: On the Structural Pruning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11627","snapshot_observed_at":"2026-08-10T14:46:38.241369Z","title":"Llm-pruner: On the structural pruning of large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.241369Z"},"links":{"cited_paper":"/paper/2305.11627","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:59bf41772105fc162870803cf9d1ceaaef3888c1f7c234b6423cf644219b3b76","observation_id":"b1946240-4b6c-431b-82a3-0dbe2c06793c","resolution":{"observed_at":"2026-08-10T14:46:38.241369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02068","last_updated":"2025-04-15T07:54:24Z","snapshot_observed_at":"2026-07-06T18:40:10.103133Z","submitted_at":"2024-07-02T08:58:19Z","title":"LPViT: Low-Power Semi-structured Pruning for Vision Transformers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02068","snapshot_observed_at":"2026-08-10T14:46:38.245641Z","title":"Lpvit: Low-power semi-structured pruning for vision transformers, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.245641Z"},"links":{"cited_paper":"/paper/2407.02068","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:0e2a62ddd46d76c53628e5b2962ee3a9052025e2a3ac32504c60b8a084c701b0","observation_id":"c0f32fd0-4f4a-40ab-b7bb-cdce41df1f39","resolution":{"observed_at":"2026-08-10T14:46:38.245641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.07710","last_updated":"2020-07-05T01:22:19Z","snapshot_observed_at":"2026-07-06T08:51:52.563800Z","submitted_at":"2020-01-20T16:17:36Z","title":"An Image Enhancing Pattern-based Sparsity for Real-time Inference on Mobile Devices","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.07710","snapshot_observed_at":"2026-08-10T14:46:38.249668Z","title":"An image enhancing pattern-based sparsity for real-time inference on mobile devices, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.249668Z"},"links":{"cited_paper":"/paper/2001.07710","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:e38fec4e892f2c85ab1b8776ead5a8a6630d3c77e70a3acedb15353e8d85ae08","observation_id":"cf6a1cf8-c980-480e-820e-53e5852adbd1","resolution":{"observed_at":"2026-08-10T14:46:38.249668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14410","last_updated":"2020-12-09T08:35:21Z","snapshot_observed_at":"2026-07-06T09:59:59.588527Z","submitted_at":"2020-09-30T03:35:16Z","title":"Pruning Filter in Filter","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14410","snapshot_observed_at":"2026-08-10T14:46:38.254153Z","title":"Pruning filter in filter, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.254153Z"},"links":{"cited_paper":"/paper/2009.14410","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:fb5ea1dfac2eb760d5530743869191e6b9ad62d21425de3658cdad3650f8d514","observation_id":"d5efe6fe-0e48-4f77-a7e6-cfdb0d3b0dda","resolution":{"observed_at":"2026-08-10T14:46:38.254153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05467","last_updated":"2020-11-19T03:54:34Z","snapshot_observed_at":"2026-08-10T06:22:32.913383Z","submitted_at":"2020-06-09T19:21:57Z","title":"Pruning neural networks without any data by iteratively conserving synaptic flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05467","snapshot_observed_at":"2026-08-10T14:46:38.258240Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.258240Z"},"links":{"cited_paper":"/paper/2006.05467","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:d1344969029432e2d11a6b580383ac41356ceef58d9dce9ae4b6006e2f468d67","observation_id":"523a67ce-6df9-47b0-97b8-b3158409dce0","resolution":{"observed_at":"2026-08-10T14:46:38.258240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.06307","last_updated":"2020-02-16T18:23:41Z","snapshot_observed_at":"2026-08-10T10:05:37.637267Z","submitted_at":"2019-06-14T17:26:29Z","title":"A Signal Propagation Perspective for Pruning Neural Networks at Initialization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.06307","snapshot_observed_at":"2026-08-10T14:46:38.262450Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.262450Z"},"links":{"cited_paper":"/paper/1906.06307","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:072ecf90141389edbaf73e335a624334fb0876a927df698c186768eb94b60d9b","observation_id":"a782c686-6983-488e-9877-effc0e2409f3","resolution":{"observed_at":"2026-08-10T14:46:38.262450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11134","last_updated":"2021-07-23T14:12:42Z","snapshot_observed_at":"2026-07-06T08:39:52.703032Z","submitted_at":"2019-11-25T18:58:53Z","title":"Rigging the Lottery: Making All Tickets Winners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11134","snapshot_observed_at":"2026-08-10T14:46:38.265887Z","title":"Rigging the lottery: Making all tickets winners, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.265887Z"},"links":{"cited_paper":"/paper/1911.11134","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:0f34c38239822b5baa88ddf67f52253879c5f85609f6d93869ea39ae98c7d6c0","observation_id":"f6c03526-9886-4a35-bb5e-1db5eca44b56","resolution":{"observed_at":"2026-08-10T14:46:38.265887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03665","last_updated":"2016-10-18T04:03:41Z","snapshot_observed_at":"2026-08-10T23:29:31.106795Z","submitted_at":"2016-08-12T03:20:43Z","title":"Learning Structured Sparsity in Deep Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03665","snapshot_observed_at":"2026-08-10T14:46:38.269353Z","title":"Learning structured sparsity in deep neural networks, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.269353Z"},"links":{"cited_paper":"/paper/1608.03665","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:aaeb0ef32f93449741ecb79d17d8519a4c79c4b28a5301337fb0b525df4690ee","observation_id":"ddbc4549-3f8b-4b3b-b23e-74e8adbd0388","resolution":{"observed_at":"2026-08-10T14:46:38.269353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06519","last_updated":"2017-08-22T07:35:26Z","snapshot_observed_at":"2026-08-01T16:28:43.417058Z","submitted_at":"2017-08-22T07:35:26Z","title":"Learning Efficient Convolutional Networks through Network Slimming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06519","snapshot_observed_at":"2026-08-10T14:46:38.272982Z","title":"Learning efficient convolutional networks through network slimming, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.272982Z"},"links":{"cited_paper":"/paper/1708.06519","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ac8245fdedc53aa59f3a6a3736c7a73240b037419d30d139697b24e9fc9d9dc6","observation_id":"3473d1cf-5371-47de-a326-918a24857c7f","resolution":{"observed_at":"2026-08-10T14:46:38.272982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02164","last_updated":"2020-07-20T15:26:14Z","snapshot_observed_at":"2026-08-05T18:36:15.605417Z","submitted_at":"2020-04-05T11:28:39Z","title":"DSA: More Efficient Budgeted Pruning via Differentiable Sparsity Allocation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02164","snapshot_observed_at":"2026-08-10T14:46:38.275991Z","title":"Dsa: More efficient budgeted pruning via differentiable sparsity allocation, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.275991Z"},"links":{"cited_paper":"/paper/2004.02164","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:479e649edd441a4f99ea988042f43d1a86d2ef9fa49b9d8f66e269e52ef4ce18","observation_id":"4e3e87d2-475f-47a7-a184-c7e2a4e9ea2c","resolution":{"observed_at":"2026-08-10T14:46:38.275991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.08509","last_updated":"2020-06-15T16:09:17Z","snapshot_observed_at":"2026-07-06T09:29:15.531530Z","submitted_at":"2020-06-15T16:09:17Z","title":"APQ: Joint Search for Network Architecture, Pruning and Quantization Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.08509","snapshot_observed_at":"2026-08-10T14:46:38.279869Z","title":"APQ : Joint Search for Network Architecture , Pruning and Quantization Policy , June 2020 b","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.279869Z"},"links":{"cited_paper":"/paper/2006.08509","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:168ec883a62f4199fc2c338911968e2fcfc51f229b355683e61c7e20a373b783","observation_id":"f40a7400-6074-49b0-940d-2655e9359a8a","resolution":{"observed_at":"2026-08-10T14:46:38.279869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09656","last_updated":"2022-10-17T08:59:15Z","snapshot_observed_at":"2026-08-11T05:32:31.726135Z","submitted_at":"2022-03-29T07:41:11Z","title":"A Fast Post-Training Pruning Framework for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.09656","snapshot_observed_at":"2026-08-10T14:46:38.283999Z","title":"Mahoney, Joseph Hassoun, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.283999Z"},"links":{"cited_paper":"/paper/2204.09656","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:484c3448257c19597bcb91e00192cc951b34ac8f775378bbce613817fc434e6f","observation_id":"b29ab30e-1ef3-43e1-8f81-b5f9563a56de","resolution":{"observed_at":"2026-08-10T14:46:38.283999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.00708","last_updated":"2021-08-02T08:21:44Z","snapshot_observed_at":"2026-08-09T21:40:07.527600Z","submitted_at":"2021-08-02T08:21:44Z","title":"Group Fisher Pruning for Practical Network Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.00708","snapshot_observed_at":"2026-08-10T14:46:38.287873Z","title":"Group fisher pruning for practical network compression, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.287873Z"},"links":{"cited_paper":"/paper/2108.00708","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:7cb998676796e7f0575d668a01f0eb19b8df5ba4adc6c0f8e388a901ae525e53","observation_id":"123729c9-0cec-4f2b-8e62-afa6312fd0be","resolution":{"observed_at":"2026-08-10T14:46:38.287873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-10T14:46:38.291799Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.291799Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:93d6dc08fcb5a3d5a36df715c549775db9d00f91d1f33b98d59c22addf27cd2b","observation_id":"fcb84075-9dc4-4cae-849b-e9fb4e8cef5f","resolution":{"observed_at":"2026-08-10T14:46:38.291799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11957","last_updated":"2025-03-03T17:04:08Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:43:56Z","title":"Drawing Early-Bird Tickets: Towards More Efficient Training of Deep Networks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11957","snapshot_observed_at":"2026-08-10T14:46:38.295741Z","title":"Baraniuk, Zhangyang Wang, and Yingyan Lin","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.295741Z"},"links":{"cited_paper":"/paper/1909.11957","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:eef4380bdba07ebde2543c5a99979286620cb78a30fc62171c9025046692e286","observation_id":"8a97f40b-3c3c-4a2f-a286-338fd637e44a","resolution":{"observed_at":"2026-08-10T14:46:38.295741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00063","last_updated":"2021-06-07T18:26:28Z","snapshot_observed_at":"2026-08-10T09:59:33.975123Z","submitted_at":"2020-12-31T20:38:20Z","title":"EarlyBERT: Efficient BERT Training via Early-bird Lottery Tickets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00063","snapshot_observed_at":"2026-08-10T14:46:38.299488Z","title":"Earlybert: Efficient bert training via early-bird lottery tickets, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.299488Z"},"links":{"cited_paper":"/paper/2101.00063","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:51205ac762bcb11439cf9487f2d486ee497fc07a28c5deb0cd196f4054d35f87","observation_id":"1b2e5457-8591-4209-8b31-cbd0ef804789","resolution":{"observed_at":"2026-08-10T14:46:38.299488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.303261Z","title":"Runtime network routing for efficient image classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.303261Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:61b44a4a0a02bead6b9d117f0c816eee52993e58e71650c48ed2ef53ff2bc827","observation_id":"666369c5-bec5-42fb-884e-591232599155","resolution":{"observed_at":"2026-08-10T14:46:38.303261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.05861","last_updated":"2021-03-10T03:59:03Z","snapshot_observed_at":"2026-07-31T20:44:19.364627Z","submitted_at":"2021-03-10T03:59:03Z","title":"Manifold Regularized Dynamic Network Pruning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.05861","snapshot_observed_at":"2026-08-10T14:46:38.306767Z","title":"Manifold regularized dynamic network pruning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.306767Z"},"links":{"cited_paper":"/paper/2103.05861","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:40c99aeac9c74622250ecf93d35cddff437759048b0c7bb185a9c659745b5a49","observation_id":"ab5d072c-cd1e-4ba4-9e4e-f5bc6fcc5e49","resolution":{"observed_at":"2026-08-10T14:46:38.306767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-10T14:46:38.310472Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.310472Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:25bbea8e8dd7a531b86fb3cc11d943cc65acf01e8a3552752f5ecf3ebbc53721","observation_id":"b982a158-7a00-47fd-9057-7633e7c82ce2","resolution":{"observed_at":"2026-08-10T14:46:38.310472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-08-09T05:37:48.140401Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-10T14:46:38.314470Z","title":"Pruning filters for efficient convnets, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.314470Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:46b697907e1d7e2e9b927324b78de9fb69e1ec9cfc2b8c2e302026f07c9f4d6d","observation_id":"0bf525a5-15d4-4c88-a901-c28f5c146044","resolution":{"observed_at":"2026-08-10T14:46:38.314470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.318412Z","title":"Variational convolutional neural network pruning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.318412Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:34885225dd109b3135ed8ee0039fcb490bd27bf5df828a60e9c9e010a0100bc5","observation_id":"60596ee3-31bd-4cbb-9b4c-81586e0ed9f4","resolution":{"observed_at":"2026-08-10T14:46:38.318412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03773","last_updated":"2023-02-07T22:05:55Z","snapshot_observed_at":"2026-08-11T01:12:39.939983Z","submitted_at":"2023-02-07T22:05:55Z","title":"What Matters In The Structured Pruning of Generative Language Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03773","snapshot_observed_at":"2026-08-10T14:46:38.321953Z","title":"What matters in the structured pruning of generative language models?, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.321953Z"},"links":{"cited_paper":"/paper/2302.03773","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:837f5485a5c92c58a331c781b5de413a5b484aeac2401c55da5f115653c40664","observation_id":"44967318-9bc6-4813-a3a1-b68448dcf17e","resolution":{"observed_at":"2026-08-10T14:46:38.321953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.325740Z","title":"Everybody prune now: Structured pruning of llms with only forward passes, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.325740Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:365fe7155b7a26caca9847eb380929d8ca13e1a6cec364962d5504d5ed41c602","observation_id":"d50e0991-34e6-4626-9637-d8a62f853256","resolution":{"observed_at":"2026-08-10T14:46:38.325740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.09817","last_updated":"2021-09-23T03:14:23Z","snapshot_observed_at":"2026-07-06T08:39:09.670340Z","submitted_at":"2019-11-22T02:32:15Z","title":"Graph Pruning for Model Compression","version":2},"cited_work":{"arxiv_id":"1911.09817","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.09817","snapshot_observed_at":"2026-08-10T14:46:40.084280Z","title":"Graph Pruning for Model Compression","venue":"cs.CV","work_id":"86edf8a1-f0a8-4ccc-bd98-b42c9212331f","year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.329439Z"},"links":{"cited_paper":"/paper/1911.09817","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:4d4a736aaa0e12d98942d1538fddb0d919d7d7d61bb8221cd4ba30f8a6f7f0f1","observation_id":"5f6880e4-f459-4038-9d12-f66c0d144854","resolution":{"observed_at":"2026-08-10T14:46:40.088510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-01234-2_48","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.762286Z","title":"AMC: AutoML for Model Compression and Acceleration on Mobile Devices, page 815–832","venue":null,"work_id":"6c3204d9-cb59-4e41-8ac6-5b1875ce6a5c","year":2018},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.333427Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:500cd95105c1881733f3670cae7d815440fbe7ad219837211097cc40abc43aee","observation_id":"c59b3724-9f2b-455f-aa4b-b0351463d2f8","resolution":{"observed_at":"2026-08-10T14:46:38.766538Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6534.2022","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:40.066023Z","title":"Efficient neural network pruning using model-based reinforcement learning","venue":null,"work_id":"a76599de-8650-496d-95eb-01c213de75d6","year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.337256Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:3142a837ae081bb23a63d023e0bda046687434c2b57a0669fe264c352758b5e6","observation_id":"d5dc9d93-59ec-4dd8-b381-500a3d4970e0","resolution":{"observed_at":"2026-08-10T14:46:40.072065Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.341038Z","title":"Model compression for deep neural networks: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.341038Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:b7664cd32dc28dc9e9ea3f0f9cea2e94af278a2e6b43a59debf334e61808003c","observation_id":"f857d809-885a-4881-99e2-ceb1b3f182d6","resolution":{"observed_at":"2026-08-10T14:46:38.341038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.345209Z","title":"Compressing pre-trained language models using progressive low rank decomposition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.345209Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:fef46c51c85ad67f6244b25ee37dd10c4416ea820eff80feab5269c884960ba4","observation_id":"9814f67d-a2b4-4741-aa7a-c1ddf0e7596c","resolution":{"observed_at":"2026-08-10T14:46:38.345209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18886","last_updated":"2024-11-03T20:25:29Z","snapshot_observed_at":"2026-08-10T22:43:30.390223Z","submitted_at":"2024-05-29T08:42:30Z","title":"Compressing Large Language Models using Low Rank and Low Precision Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18886","snapshot_observed_at":"2026-08-10T14:46:38.348825Z","title":"Goldsmith, and Mert Pilanci","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.348825Z"},"links":{"cited_paper":"/paper/2405.18886","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:2f9956947377a0128f9f1b85e7c932807da825ceccbf521f516df9396f91854f","observation_id":"359ac8eb-a30c-4602-91a7-c8aad07a4551","resolution":{"observed_at":"2026-08-10T14:46:38.348825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00526","last_updated":"2024-10-03T23:28:27Z","snapshot_observed_at":"2026-08-07T09:30:39.446831Z","submitted_at":"2023-07-02T09:33:09Z","title":"TensorGPT: Efficient Compression of Large Language Models based on Tensor-Train Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00526","snapshot_observed_at":"2026-08-10T14:46:38.352564Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.352564Z"},"links":{"cited_paper":"/paper/2307.00526","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:c94406f50958d05e1b2dc1e80a3f7c5f172b9c904d646499222a53fcfd33e00c","observation_id":"e1e9f2b9-9de5-4277-9b27-9b68444496f1","resolution":{"observed_at":"2026-08-10T14:46:38.352564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09632","last_updated":"2025-05-02T15:34:42Z","snapshot_observed_at":"2026-08-10T19:35:16.830592Z","submitted_at":"2024-08-19T01:30:14Z","title":"MoDeGPT: Modular Decomposition for Large Language Model Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09632","snapshot_observed_at":"2026-08-10T14:46:38.356469Z","title":"Modegpt: Modular decomposition for large language model compression, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.356469Z"},"links":{"cited_paper":"/paper/2408.09632","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:a539ad8af238b6296fbf4d8eff604db0a641626da3ceed556715ae946c63b9ff","observation_id":"2c2a43da-05c0-49d0-9840-6848390f7f15","resolution":{"observed_at":"2026-08-10T14:46:38.356469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-10T14:46:38.360516Z","title":"Distilling the knowledge in a neural network, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.360516Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:0480bb0d5c1cb6aad529ca6602b2c047793e8102159193c09fed3121e4c81a5d","observation_id":"4b7f9528-3948-4a0e-bc7e-4ff332147daf","resolution":{"observed_at":"2026-08-10T14:46:38.360516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-10T17:26:33.432994Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-10T14:46:38.363920Z","title":"A Survey on Knowledge Distillation of Large Language Models , March 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.363920Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:3486f80d1b1a98685c21e9be491a2c4e8c04fcba2a7d40a09328aec6b710110e","observation_id":"27f9a6c7-33a0-40ee-895d-45cf6922df1b","resolution":{"observed_at":"2026-08-10T14:46:38.363920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v34i04.5816","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.743439Z","title":"Adversarially robust distillation","venue":null,"work_id":"4e06e531-7db1-44a0-895c-49dde1227b88","year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.367560Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:550359fd490e6a755b97fe7d5a7883661a41bd8a24bad6ba554a43fc7cf97aae","observation_id":"4ef193f9-044f-4a89-9ab1-f7f28844b3fe","resolution":{"observed_at":"2026-08-10T14:46:38.747255Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-07-06T03:46:00.791740Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-10T14:46:38.370970Z","title":"Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron Courville, and Yoshua Bengio","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.370970Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:9831962cde815b1e71faa3db79028efaa442fd47994c5de12d3c64ee1252aefc","observation_id":"44499107-cc33-48ee-bf55-2e577ee9a03f","resolution":{"observed_at":"2026-08-10T14:46:38.370970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06668","last_updated":"2024-05-17T05:29:05Z","snapshot_observed_at":"2026-07-06T17:42:33.242895Z","submitted_at":"2024-03-11T12:36:14Z","title":"PeerAiD: Improving Adversarial Distillation from a Specialized Peer Tutor","version":3},"cited_work":{"arxiv_id":"2403.06668","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.06668","snapshot_observed_at":"2026-08-10T14:46:39.915210Z","title":"PeerAiD: Improving Adversarial Distillation from a Specialized Peer Tutor","venue":"cs.LG","work_id":"1386c8bd-f827-4630-aff8-e79ec78f7a81","year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.375001Z"},"links":{"cited_paper":"/paper/2403.06668","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:559d462e1becb6406cd15f0f3e03321fa68622e6685eae6a98159ca69540bfa6","observation_id":"e445bd47-b258-42b2-9818-f6c67062570f","resolution":{"observed_at":"2026-08-10T14:46:39.919091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01186","last_updated":"2019-12-31T06:58:35Z","snapshot_observed_at":"2026-07-06T07:43:14.473925Z","submitted_at":"2019-04-02T03:00:06Z","title":"Data-Free Learning of Student Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01186","snapshot_observed_at":"2026-08-10T14:46:38.378778Z","title":"Data-free learning of student networks, 2019 a","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.378778Z"},"links":{"cited_paper":"/paper/1904.01186","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:da2a295f56823a6b5f0ee59e1e9edb08d96ce80c391ecd8bc00ebff95cdaf04c","observation_id":"459bca02-04cd-4aa3-87cf-b0e1017ecbe0","resolution":{"observed_at":"2026-08-10T14:46:38.378778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.00384","last_updated":"2017-06-01T16:57:15Z","snapshot_observed_at":"2026-08-08T08:20:52.573119Z","submitted_at":"2017-06-01T16:57:15Z","title":"Deep Mutual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.00384","snapshot_observed_at":"2026-08-10T14:46:38.382756Z","title":"Hospedales, and Huchuan Lu","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.382756Z"},"links":{"cited_paper":"/paper/1706.00384","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:cfb8988309126e71221c2e4311a2022951310295ce36d8b5239ade227142dbf0","observation_id":"7edb43d7-645b-4710-abbb-b4e6da56ec95","resolution":{"observed_at":"2026-08-10T14:46:38.382756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08110","last_updated":"2020-05-16T21:40:47Z","snapshot_observed_at":"2026-08-09T08:23:29.837717Z","submitted_at":"2020-05-16T21:40:47Z","title":"Generalized Bayesian Posterior Expectation Distillation for Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"2005.08110","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.08110","snapshot_observed_at":"2026-08-10T14:46:39.875189Z","title":"Generalized Bayesian Posterior Expectation Distillation for Deep Neural Networks","venue":"cs.LG","work_id":"2dc3a0e0-efaa-4b3b-a346-1aee883160cd","year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.387027Z"},"links":{"cited_paper":"/paper/2005.08110","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:585b6e55df9102df738af4110cef33d54e65a8468b4b0e97f3aea3929717d3fb","observation_id":"0ddb3cc6-b87d-4d9a-b63e-a83ccc9850aa","resolution":{"observed_at":"2026-08-10T14:46:39.879307Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.00448","last_updated":"2015-11-25T08:46:56Z","snapshot_observed_at":"2026-08-01T23:01:23.476895Z","submitted_at":"2015-07-02T07:21:04Z","title":"Cross Modal Distillation for Supervision Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.00448","snapshot_observed_at":"2026-08-10T14:46:38.391033Z","title":"Cross modal distillation for supervision transfer, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.391033Z"},"links":{"cited_paper":"/paper/1507.00448","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:899424ad6319801685438eb469d3f84d4b0fb4d6a66f53932253cc0bb96c170c","observation_id":"fdec11e2-cd7f-45e0-b3bb-c5a8c1b5c872","resolution":{"observed_at":"2026-08-10T14:46:38.391033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.395270Z","title":"Robust cross-modal representation learning with progressive self-distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.395270Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ef08a84681d00a53ea0e8c712dc40cd3b297e6e56f419051189ef40ac9379ec8","observation_id":"90f05cdc-01fc-411a-ad3f-d7435de089b6","resolution":{"observed_at":"2026-08-10T14:46:38.395270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.399895Z","title":"C2kd: Bridging the modality gap for cross-modal knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.399895Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:441636b58a008bd2c6811c8c3e70f0a6275db67ad28b008e32c4c77202e0d6b0","observation_id":"baf55b35-1b96-4541-b7bb-21d4a69f3430","resolution":{"observed_at":"2026-08-10T14:46:38.399895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14643","last_updated":"2023-02-27T11:39:23Z","snapshot_observed_at":"2026-08-09T22:24:11.814774Z","submitted_at":"2023-02-27T11:39:23Z","title":"Graph-based Knowledge Distillation: A survey and experimental evaluation","version":1},"cited_work":{"arxiv_id":"2302.14643","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.14643","snapshot_observed_at":"2026-08-10T14:46:39.848746Z","title":"Graph-based Knowledge Distillation: A survey and experimental evaluation","venue":"cs.LG","work_id":"a1dddaa0-c7dc-4d62-94a8-f48f8a19a4af","year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.404574Z"},"links":{"cited_paper":"/paper/2302.14643","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:abd90082dae31a46ed2e8043ae1f3d18850de30baf54040ed3f3fa755e0a603d","observation_id":"a2ee16a7-393b-4e57-a53c-1b97400db641","resolution":{"observed_at":"2026-08-10T14:46:39.852850Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-10T14:46:38.410334Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.410334Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:791e9246fb074f184bdc14bed6c841daf6e4670d10527db5c0d91f12a7778100","observation_id":"67052e37-d4c0-4de0-8edd-56074ebe3ac4","resolution":{"observed_at":"2026-08-10T14:46:38.410334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.415015Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.415015Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:20a3b79f0d2168619bcc36ea0764a8d188c63755c1d640a29c67682cdf518e74","observation_id":"0259a69a-7921-403f-9107-a477e2760329","resolution":{"observed_at":"2026-08-10T14:46:38.415015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00944","last_updated":"2022-10-03T14:01:46Z","snapshot_observed_at":"2026-07-06T13:59:00.116062Z","submitted_at":"2022-10-03T14:01:46Z","title":"Attention Distillation: self-supervised vision transformer students need more guidance","version":1},"cited_work":{"arxiv_id":"2210.00944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.00944","snapshot_observed_at":"2026-08-10T14:46:39.821305Z","title":"Attention Distillation: self-supervised vision transformer students need more guidance","venue":"cs.CV","work_id":"93f7d6fc-e02b-4cca-b7d1-250483494532","year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.418960Z"},"links":{"cited_paper":"/paper/2210.00944","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:06d6bdd93c9813645cbca2de48ed9456a58c06e3ed0457b7db0d982605a1bc83","observation_id":"4719ef4e-edea-42c6-aa68-ebe7e77fe262","resolution":{"observed_at":"2026-08-10T14:46:39.825681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02613","last_updated":"2019-01-17T12:26:19Z","snapshot_observed_at":"2026-07-06T06:08:14.677196Z","submitted_at":"2017-11-07T17:21:06Z","title":"Moonshine: Distilling with Cheap Convolutions","version":4},"cited_work":{"arxiv_id":"1711.02613","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.02613","snapshot_observed_at":"2026-08-10T14:46:39.803521Z","title":"Moonshine: Distilling with Cheap Convolutions","venue":"stat.ML","work_id":"d7e682c6-ed0c-4faa-8280-2653ee3a0eeb","year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.423092Z"},"links":{"cited_paper":"/paper/1711.02613","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:7f063b93d643f4f7e25a016cd055647c897f037bef6473bcbf33a3ae54c950ec","observation_id":"edca2eac-0d0d-4ead-a2d5-1cbaf0cd0ad2","resolution":{"observed_at":"2026-08-10T14:46:39.808016Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.427560Z","title":"Maybank, and Dacheng Tao","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.427560Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:b4b75cabaa353e4f30d213cd846e496f2c46dcb3315bc88b1d9309cddf2ac546","observation_id":"2731f557-8dec-497a-85ed-2369f8468f34","resolution":{"observed_at":"2026-08-10T14:46:38.427560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.00350","last_updated":"2019-12-05T11:59:14Z","snapshot_observed_at":"2026-08-11T04:52:59.545433Z","submitted_at":"2019-12-01T08:19:09Z","title":"Online Knowledge Distillation with Diverse Peers","version":2},"cited_work":{"arxiv_id":"1912.00350","doi":null,"metadata_source":"pith","pith_arxiv_id":"1912.00350","snapshot_observed_at":"2026-08-10T14:46:39.787823Z","title":"Online Knowledge Distillation with Diverse Peers","venue":"cs.LG","work_id":"2f5ead4c-b270-4a67-a2dd-6af5eb7584a0","year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.431504Z"},"links":{"cited_paper":"/paper/1912.00350","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:59367d9302ea1c4d10c7439efea8e75b65dea501ae657e38f71636ccf84ba15c","observation_id":"468819d4-6d7a-4e78-8d07-6b45b49b9334","resolution":{"observed_at":"2026-08-10T14:46:39.791986Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.435609Z","title":"Self-distillation amplifies regularization in hilbert space","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.435609Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:dcde7d1e5c376096f7324fe9a8d85cbadb579d697f457ab4c074fe9807e4fa3b","observation_id":"9f5b5f6f-92e9-4fa2-aa68-a8d0bcbecc46","resolution":{"observed_at":"2026-08-10T14:46:38.435609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.08094","last_updated":"2019-05-17T08:46:50Z","snapshot_observed_at":"2026-07-06T07:54:10.798256Z","submitted_at":"2019-05-17T08:46:50Z","title":"Be Your Own Teacher: Improve the Performance of Convolutional Neural Networks via Self Distillation","version":1},"cited_work":{"arxiv_id":"1905.08094","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.08094","snapshot_observed_at":"2026-08-10T14:46:39.771393Z","title":"Be Your Own Teacher: Improve the Performance of Convolutional Neural Networks via Self Distillation","venue":"cs.LG","work_id":"e35b87b7-00df-411b-a667-6b0a7640cbae","year":2019},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.439162Z"},"links":{"cited_paper":"/paper/1905.08094","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:6e19064e73c943449034e74603b22cf107dabf1a9039883fbc0740f99187036f","observation_id":"1fc37460-86d9-485c-86c8-f22229ca148e","resolution":{"observed_at":"2026-08-10T14:46:39.775868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.442721Z","title":"Self-instruct: Aligning language model with self generated instructions, 12 2022 b","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.442721Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ccdb5c96d8be220d754ace7287dc49abaa5dc880a3c42f3c0b395128803abf25","observation_id":"56b94f70-741d-46fc-8897-63e05400c2d7","resolution":{"observed_at":"2026-08-10T14:46:38.442721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10110","last_updated":"2024-06-07T20:23:21Z","snapshot_observed_at":"2026-07-06T17:30:43.666819Z","submitted_at":"2024-02-15T17:06:21Z","title":"Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10110","snapshot_observed_at":"2026-08-10T14:46:38.445760Z","title":"Selective reflection-tuning: Student-selected data recycling for llm instruction-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.445760Z"},"links":{"cited_paper":"/paper/2402.10110","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:cce3dadb8b62d50330eb0d7d384e0a16a722550fd4fd6645db5a60743fae591a","observation_id":"0b569ab5-cd21-4632-86da-c53ff8297f26","resolution":{"observed_at":"2026-08-10T14:46:38.445760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-10T14:46:38.449027Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.449027Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:b878a64104e71c116abe7f80e1f4179faf3562c1ea8e8b77f1aad9a1e87b4c8b","observation_id":"3b3b0f38-4e87-4436-b127-e8e02820b26d","resolution":{"observed_at":"2026-08-10T14:46:38.449027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01196","last_updated":"2023-12-02T21:05:22Z","snapshot_observed_at":"2026-08-08T20:31:50.928074Z","submitted_at":"2023-04-03T17:59:09Z","title":"Baize: An Open-Source Chat Model with Parameter-Efficient Tuning on Self-Chat Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01196","snapshot_observed_at":"2026-08-10T14:46:38.452462Z","title":"Baize: An open-source chat model with parameter-efficient tuning on self-chat data, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.452462Z"},"links":{"cited_paper":"/paper/2304.01196","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:476bec38bee28c9923341cb6778131ff13ff72595e5173d38342e00627b5fbc2","observation_id":"e071c7a6-b453-4912-94f9-2523c12c413f","resolution":{"observed_at":"2026-08-10T14:46:38.452462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18395","last_updated":"2023-10-30T08:20:14Z","snapshot_observed_at":"2026-07-06T15:34:59.457879Z","submitted_at":"2023-05-28T13:00:00Z","title":"Knowledge-Augmented Reasoning Distillation for Small Language Models in Knowledge-Intensive Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18395","snapshot_observed_at":"2026-08-10T14:46:38.455765Z","title":"Knowledge-augmented reasoning distillation for small language models in knowledge-intensive tasks, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.455765Z"},"links":{"cited_paper":"/paper/2305.18395","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:73e7f442a59ebac002617c856e336e1ddaca10b5874d9687ab8bc11b0512fafb","observation_id":"4be93db7-09a0-42f6-abb2-9e433ee160e5","resolution":{"observed_at":"2026-08-10T14:46:38.455765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11511","last_updated":"2023-10-17T18:18:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T18:18:32Z","title":"Self-RAG: Learning to Retrieve, Generate, and Critique through Self-Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11511","snapshot_observed_at":"2026-08-10T14:46:38.459584Z","title":"Self-rag: Learning to retrieve, generate, and critique through self-reflection, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.459584Z"},"links":{"cited_paper":"/paper/2310.11511","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ba07a77024254f1a57be4851382c54c29e3838f082466cf6a69113c988be5264","observation_id":"d39edbd0-f453-4e0f-a07c-df529381f9ca","resolution":{"observed_at":"2026-08-10T14:46:38.459584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-10T14:46:38.463573Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.463573Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:c0ef188a3668306a60386df5885cc96b2d552593335be2454ce4e9f8a29f36de","observation_id":"da7ae879-0506-49c9-95a3-b82ed00f337f","resolution":{"observed_at":"2026-08-10T14:46:38.463573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-10T14:46:38.467570Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.467570Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:b809c7798f8c1eb0aef6a6a1dcf0aa8e867efebd402b1ab1651c6cf531e0de38","observation_id":"4549be5c-e0bc-409e-a853-09b99bba609b","resolution":{"observed_at":"2026-08-10T14:46:38.467570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-10T14:46:38.471849Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.471849Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:eb3897235bcc91a1fe324ee887ee7aa0a80d3b6ea2bf4cf82af47d175c65fe36","observation_id":"75778f95-59f2-482c-8fbc-39936c186e85","resolution":{"observed_at":"2026-08-10T14:46:38.471849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-10T14:46:38.475866Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.475866Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:f3ef5fe88729c80d5481cade1de2c47bf81df36cefdb5f7539b3a6c52e3998b1","observation_id":"4b133633-013b-43e0-b7d7-8cf1b70e1238","resolution":{"observed_at":"2026-08-10T14:46:38.475866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02749","last_updated":"2024-05-04T20:34:06Z","snapshot_observed_at":"2026-08-07T10:09:20.500918Z","submitted_at":"2024-05-04T20:34:06Z","title":"Sub-goal Distillation: A Method to Improve Small Language Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02749","snapshot_observed_at":"2026-08-10T14:46:38.480061Z","title":"Sub-goal distillation: A method to improve small language agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.480061Z"},"links":{"cited_paper":"/paper/2405.02749","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:160f8127505ba4fb02c1541b9a117b6bb29d96d1d23cbab30765d7fa5d59b8e3","observation_id":"1854f0dc-5f92-49e9-9c87-a49b01d31b45","resolution":{"observed_at":"2026-08-10T14:46:38.480061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05657","last_updated":"2024-07-10T17:36:02Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T00:30:13Z","title":"Agent Lumos: Unified and Modular Training for Open-Source Language Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05657","snapshot_observed_at":"2026-08-10T14:46:38.484211Z","title":"Agent lumos: Unified and modular training for open-source language agents, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.484211Z"},"links":{"cited_paper":"/paper/2311.05657","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:2befb7343ec669431cde99fdaba7b859cf46199ccca612a874073fb914190be9","observation_id":"90a12a1b-eacf-4eff-aac0-28087351075c","resolution":{"observed_at":"2026-08-10T14:46:38.484211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-10T14:46:38.488034Z","title":"Fireact: Toward language agent fine-tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.488034Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:7fe869d1e8eb1600cfdba28ed9a4e970e3ba40b38aa036014278cecd2c364239","observation_id":"8e0aa012-322f-4fc4-8919-a50c581c0df7","resolution":{"observed_at":"2026-08-10T14:46:38.488034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-10T14:46:38.492092Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.492092Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:3fa7e623c08e015c38ace8669723faeb82a69680da691790eb5e484d4350fc04","observation_id":"3ef2dfbb-3358-4533-94b7-bb6e975613d8","resolution":{"observed_at":"2026-08-10T14:46:38.492092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08543","last_updated":"2026-01-31T09:16:35Z","snapshot_observed_at":"2026-08-11T06:23:25.586017Z","submitted_at":"2023-06-14T14:44:03Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08543","snapshot_observed_at":"2026-08-10T14:46:38.496449Z","title":"Minillm: Knowledge distillation of large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.496449Z"},"links":{"cited_paper":"/paper/2306.08543","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:1bfebc2990976c8adeaa35972f48249709fc0fcb771c32695fe6bf709302edc8","observation_id":"12d2a092-d5a9-4e02-adc9-19c8f1e84559","resolution":{"observed_at":"2026-08-10T14:46:38.496449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03898","last_updated":"2024-07-03T04:57:41Z","snapshot_observed_at":"2026-08-05T01:48:55.895470Z","submitted_at":"2024-02-06T11:10:35Z","title":"DistiLLM: Towards Streamlined Distillation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03898","snapshot_observed_at":"2026-08-10T14:46:38.501603Z","title":"Distillm: Towards streamlined distillation for large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.501603Z"},"links":{"cited_paper":"/paper/2402.03898","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:dbf4fe866883fc2f869bb9b140ea610975dc132089c6bc601fba1909acb3fb14","observation_id":"994244e9-e0b4-4f92-95d3-d3765efae91b","resolution":{"observed_at":"2026-08-10T14:46:38.501603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.506460Z","title":"Impossible distillation: from low-quality model to high-quality dataset and model for summarization and paraphrasing, 05 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.506460Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:daa14f8e420c165daad761500a439366d235e3b096450d388c2be2c07004ec96","observation_id":"2bc579fd-2346-4d6b-a940-b99e3e99e227","resolution":{"observed_at":"2026-08-10T14:46:38.506460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15718","last_updated":"2022-10-27T18:44:58Z","snapshot_observed_at":"2026-07-06T14:11:23.745126Z","submitted_at":"2022-10-27T18:44:58Z","title":"QUILL: Query Intent with Large Language Models using Retrieval Augmentation and Multi-stage Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15718","snapshot_observed_at":"2026-08-10T14:46:38.510532Z","title":"Quill: Query intent with large language models using retrieval augmentation and multi-stage distillation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.510532Z"},"links":{"cited_paper":"/paper/2210.15718","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:dd3771b167c0d098b1904f4d791c3800da98f471c9e69a7f66cdc0a16886c2f7","observation_id":"d2baf331-6968-4f1c-853f-d26a388be083","resolution":{"observed_at":"2026-08-10T14:46:38.510532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-10T14:46:38.514635Z","title":"Visual instruction tuning, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.514635Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:752b114ef430cdcaeacbcd7c1eef6a576de18582e8b604cc5a9beeb0c68192f3","observation_id":"8160cbd4-2d44-470a-9275-a6ca9f1fe555","resolution":{"observed_at":"2026-08-10T14:46:38.514635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09093","last_updated":"2023-06-15T12:45:25Z","snapshot_observed_at":"2026-07-06T15:42:56.285045Z","submitted_at":"2023-06-15T12:45:25Z","title":"Macaw-LLM: Multi-Modal Language Modeling with Image, Audio, Video, and Text Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09093","snapshot_observed_at":"2026-08-10T14:46:38.518573Z","title":"Macaw-llm: Multi-modal language modeling with image, audio, video, and text integration, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.518573Z"},"links":{"cited_paper":"/paper/2306.09093","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:7cd9b9d2808d73f3d0e3cca4ae98e4112d218da2d4627d55fede8f5de6519bfd","observation_id":"d30c24d8-bc1b-46e8-9270-fae6bbfed8e2","resolution":{"observed_at":"2026-08-10T14:46:38.518573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.521740Z","title":"Junk DNA hypothesis: Pruning small pre-trained weights \\ textit\\ Irreversibly\\ \\ and \\ textit\\ Monotonically\\ \\ impairs ``difficult'' downstream tasks in LLM s","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.521740Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:a5d1417a9e203645911d7d07efc9a88793cb8e0f9b99e5a17ff942df80e5cd8b","observation_id":"96753af1-11ac-4e2e-8ace-5ea10de95cc5","resolution":{"observed_at":"2026-08-10T14:46:38.521740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:46:38.524858Z","title":"AutoML : A survey of the state-of-the-art","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.524858Z"},"links":{"citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:ef61035d4b8d7bd0bc168c12dd668e3bdf2cefca59a437a3bee5bc192f2eb9b4","observation_id":"62cc5dd7-ad19-46af-9724-1d3ace7c1b88","resolution":{"observed_at":"2026-08-10T14:46:38.524858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01578","last_updated":"2017-02-15T05:28:05Z","snapshot_observed_at":"2026-07-06T05:17:29.499249Z","submitted_at":"2016-11-05T00:41:37Z","title":"Neural Architecture Search with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01578","snapshot_observed_at":"2026-08-10T14:46:38.527851Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-10T14:46:38.527851Z"},"links":{"cited_paper":"/paper/1611.01578","citing_paper":"/paper/2501.15014"},"observation_digest":"sha256:c6463ab75d01b8c86aa9f9ef99e91618e535fe92c2c0861c96fc2903fa77dfcf","observation_id":"de3c73e5-2d83-4974-9747-4e2df88c8771","resolution":{"observed_at":"2026-08-10T14:46:38.527851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15014","last_updated":"2025-01-28T20:29:44Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T01:12:50.576066Z","submitted_at":"2025-01-25T01:37:03Z","title":"On Accelerating Edge AI: Optimizing Resource-Constrained Environments"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":89,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":140},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 140 outbound references and 3 inbound Pith citation observations for arXiv:2501.15014."}