{"as_of":"2026-08-10T22:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:deee038ad1bf108739245413b6320077da6fc8f16bb1d00e8f8c8453a4e30abc","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T10:07:35.063038Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T04:03:37.649301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T04:06:44.643562Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"cited_work":{"arxiv_id":"2605.04062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.04062","snapshot_observed_at":"2026-07-10T04:06:44.643562Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","venue":"cs.LG","work_id":"ee0c85b0-0ed0-43f4-bdd6-7a19a4f9db30","year":2026},"citing_paper":{"arxiv_id":"2607.08643","last_updated":"2026-07-09T16:17:10Z","snapshot_observed_at":"2026-08-06T21:01:29.401263Z","submitted_at":"2026-07-09T16:17:10Z","title":"BiSCo-LLM: Lookup-Free Binary Spherical Coding for Extreme Low-Bit Large Language Model Compression","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-10T04:03:37.649301Z"},"links":{"cited_paper":"/paper/2605.04062","citing_paper":"/paper/2607.08643"},"observation_digest":"sha256:1b1fb0d773a20f193342256bd0d0a48dfd2b147ba008df7b4b1813d6429c8fc9","observation_id":"4d553ebf-597f-4eb4-8fc0-b1874bbfbf04","resolution":{"observed_at":"2026-07-10T04:06:44.645477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.04062/citation-record","integrity":"/paper/2605.04062/integrity","json":"/paper/2605.04062/citation-record.json","paper":"/paper/2605.04062"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QuaRot: Outlier-free 4-bit inference in rotated LLMs","venue":null,"work_id":"a569b7f1-25b6-44f5-b7d8-f5d67a9186e5","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:e3e7d4a3848f4af0da35dd530acffab4f59a5952fb090aebc5a52add00828476","observation_id":"f961b3c9-df77-4c1e-ad16-9d02f24a7aef","resolution":{"observed_at":"2026-05-22T10:16:24.395093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":"1308.3432","doi":"10.48550/arxiv.1308.3432","metadata_source":"pith","pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","venue":"cs.LG","work_id":"1fe8c7c8-aff7-4b94-9096-e549d7e60789","year":2013},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:7e070e409c6f09561e388d2dc4bbfbf3ee75690599d336e4d7c4bac451fce1c8","observation_id":"2cd76207-a1ca-4625-9e11-5c52ba118040","resolution":{"observed_at":"2026-05-22T10:11:23.344625Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-19T16:22:27.235199+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T16:22:27.235199+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PIQA: Reasoning about physical commonsense in natural language","venue":null,"work_id":"7ab78788-0b11-4847-9da4-13d9d6ae072f","year":2020},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:e5012908e3c054809341f6fb153a03e9d0af6919e2e12cd219cf714cd4cfbf04","observation_id":"dc70212e-e80a-4e46-a3d8-77ca0c48d393","resolution":{"observed_at":"2026-05-22T10:16:24.402581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:63a560eda54b1eda0ff500f2771f57d01d92cf07ca2f82de6eb8d3161da8c3e2","observation_id":"a5c1d3fb-669c-4e2b-b13f-c17514790916","resolution":{"observed_at":"2026-05-22T10:11:23.350500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EfficientQAT: Efficient quantization-aware training for large language models","venue":null,"work_id":"53d562f0-36a7-46c6-9c2f-03a9ee590627","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:6b43524c59d90fedfba0903a35c3c59cdd19fe9b7d2ae436a0adcf0577345ca4","observation_id":"42279ed3-7ae8-47e3-90dd-e7314a927488","resolution":{"observed_at":"2026-05-22T10:16:24.387826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimize weight rounding via signed gradient descent for the quantization of LLMs","venue":null,"work_id":"a7850425-fd3a-4f86-ab37-7fc7493a6182","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:dbc7456d79469be79322e6f59cabbbc3fb2a01d6330f364c241d3382b9ce4133","observation_id":"1f0ec0dc-2034-4cac-b634-1270240103fe","resolution":{"observed_at":"2026-05-22T10:16:24.375678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"67c57282-3cc7-439f-a8ad-73aba74bfd83","year":2019},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:26cc41b09ebe739889abb951da1b34f7a1d9cdbba8230453734adebb6a7fca27","observation_id":"7f306b5d-20c3-4e9a-bd3a-48f489c6e267","resolution":{"observed_at":"2026-05-22T10:16:24.379982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:222d6143f0d57f8f674980cc613a2149f416fefa8180aabdebdad1e31a99a5f9","observation_id":"125d4ba5-e555-451e-9e28-157cd1f31ace","resolution":{"observed_at":"2026-05-22T10:11:23.392490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:54639601025be8d7d679f6cad5584d2309bfb3984fb4819151784c77e2ee9ed3","observation_id":"8bff71ef-9420-479b-a8ae-974a5b83bb0b","resolution":{"observed_at":"2026-05-22T10:11:23.403689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The case for 4-bit precision: K-bit inference scaling laws","venue":null,"work_id":"cdbfb9d1-fae9-4a6c-8b13-15a90d4f653e","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:c077606ca5889c25948589070ee340f4cab0c7d8c596aab891e2a9ce3ea2b3fe","observation_id":"e52770b9-8a2b-4ed4-9e06-5fa327afa278","resolution":{"observed_at":"2026-05-22T10:16:24.383791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BitDistiller: Unleashing the potential of sub-4-bit LLMs via self-distillation","venue":null,"work_id":"e93efa0f-d672-4c3d-a6ed-0af1491b47cc","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:bc2e8176ca3f1aa1fd75538c1e6fd5020c1e8a8c25b4971688dd38726384de37","observation_id":"2e291874-1f4a-48b9-98e1-c4b17a19cb15","resolution":{"observed_at":"2026-05-22T10:16:24.391452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extreme compression of large language models via additive quantization","venue":null,"work_id":"a142a360-8b9b-4c05-804c-8015845b19d8","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:eceea5389ca37b1712e4a83ae6958ed59780e5d424f53f5e916b5eae30795d11","observation_id":"a5ff85df-7574-4850-b439-4a4884658b5b","resolution":{"observed_at":"2026-05-22T10:16:24.355138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How contextual are contextualized word representations? Comparing the geometry of BERT, ELMo, and GPT-2 embeddings","venue":null,"work_id":"be6ec4bf-683e-43f9-8c93-c7cf18dd01fd","year":2019},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:cef918a2f439967d0741a927075b2fbb168ec54a07e7c082561f0ac2286d7406","observation_id":"24e0a399-61a7-4a44-9562-ff6857e1072d","resolution":{"observed_at":"2026-05-22T10:16:24.364011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:5dc8bf5ae8c8c2a7007c5131d19bff2d1dae6253b0a65ea5518e3586e802ccce","observation_id":"1e83dd21-b734-4dc2-b2a1-9e176d8a7ce3","resolution":{"observed_at":"2026-05-22T10:11:23.398644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-MME: The first-ever comprehensive evaluation benchmark of multi-modal LLMs in video analysis","venue":null,"work_id":"939d412d-f823-477b-bfa1-7bf5008894df","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:832eb40b33c1c3597a576b77fc79a02585307cd01eaf35d690b294cd7203e794","observation_id":"543fecd1-07ae-427f-bd77-074065051469","resolution":{"observed_at":"2026-05-22T10:16:24.371861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"APTQ: Attention-aware post- training mixed-precision quantization for large language models","venue":null,"work_id":"3a4de41b-25b9-47e3-9d83-4bf7911afc9f","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:4511772854b5f1df7f7021542ff4a4e5b26e6287b3e396aace0e6347ca189f90","observation_id":"8587b9ab-a66d-4359-b398-b671c248dad7","resolution":{"observed_at":"2026-05-22T10:16:24.351411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02275","last_updated":"2023-02-17T16:08:22Z","snapshot_observed_at":"2026-08-06T11:22:24.347810Z","submitted_at":"2020-08-05T17:59:16Z","title":"Aligning AI With Shared Human Values","version":6},"cited_work":{"arxiv_id":"2008.02275","doi":"10.48550/arxiv.2008.02275","metadata_source":"pith","pith_arxiv_id":"2008.02275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aligning AI With Shared Human Values","venue":"cs.CY","work_id":"5e01e415-b531-432c-a080-659d1d46dfb6","year":2020},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2008.02275","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:647f01b76def64c668b02926e3d13b12cbe777e5a9e0284734fc7083bd6664cb","observation_id":"d6dfa4e6-a751-41bc-82cf-b21c37cf8780","resolution":{"observed_at":"2026-05-22T10:11:23.408621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:50.195493+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:50.195493+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:db08f0b76d0d28970aa44696a1caffb096c060eb578d26909f04783502e64c25","observation_id":"2546a4f5-db2c-413d-bb46-75a8d712738a","resolution":{"observed_at":"2026-05-22T10:11:23.378403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking channel dimensions to isolate outliers for low-bit weight quantization of large language models","venue":null,"work_id":"c44e734f-9bc1-4562-a50b-b1ddbb6035b5","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:d0b859f48ef6ed77baae7403ed982a55bdd878af7af9c966536255a272f00dc7","observation_id":"e458e1ad-0a71-4fd2-a60b-cd8ba0c6d002","resolution":{"observed_at":"2026-05-22T10:16:24.340391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:04d8400eaee5c3d3ac9c6eee576cd3bac78b1eadb24010c5fa16d9385b557e95","observation_id":"0f7523c3-b73a-4ed3-a2f7-d7ccee8bfc62","resolution":{"observed_at":"2026-05-22T10:11:23.372678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BiLLM: Pushing the limit of post-training quantization for LLMs","venue":null,"work_id":"738e71b9-4314-412a-bd6b-3555482991e1","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:94675e5b7011aabfb422a72e7878374ff1da91c638efd07213bc7b898324ce71","observation_id":"37b6000e-0665-460f-a48a-7aa921c62f46","resolution":{"observed_at":"2026-05-22T10:16:24.344117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SliM-LLM: Salience-driven mixed-precision quantization for large language models","venue":null,"work_id":"e85b852e-a1b5-46b4-882d-21bdbabe2c10","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:e5cc0f4f9983d863367b199fe0389cd79d0206557f7029b59213b82291a41c35","observation_id":"f19aace1-b7e1-4304-b652-0fce979b318a","resolution":{"observed_at":"2026-05-22T10:16:24.347766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.20214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:06:26.995028Z","title":"Q-Palette: Fractional-bit quantizers toward optimal bit allocation for efficient LLM deployment","venue":null,"work_id":"6bcbc780-1311-4dbe-9a33-111bca3bc2cc","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:571e6a5cbcd0a4cd4b687f6091daea4a9ede1734f9a087b9082e347e7d94fedf","observation_id":"f72b67e5-f8c7-4aa1-9ea4-5d0d3a931661","resolution":{"observed_at":"2026-05-22T10:11:23.361467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11116","last_updated":"2025-06-09T06:37:15Z","snapshot_observed_at":"2026-08-07T05:30:36.959314Z","submitted_at":"2025-06-09T06:37:15Z","title":"Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models","version":1},"cited_work":{"arxiv_id":"2506.11116","doi":"10.48550/arxiv.2506.11116","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11116","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Infinity Instruct: Scaling instruction selection and synthesis to enhance language models","venue":"ArXiv.org","work_id":"728884e2-e6cf-4dc9-a9ce-0c8146038e70","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2506.11116","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:e9441c75c8082915393146d7e64e3c514587d7b5ec94c1fd53df551314a665af","observation_id":"c960889b-af23-4732-984f-ba40751322fe","resolution":{"observed_at":"2026-05-22T10:11:23.366758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GPTAQ: Efficient finetuning-free quantization for asymmetric calibration","venue":null,"work_id":"b27c4801-5360-4b80-b28b-11bd6bbfa05c","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:a9b2a94d9dd7ed33c2ea23db0919933e10cb69d2474dca9dee59973fcbe5e5e8","observation_id":"55ebc97e-5b74-440a-acf2-56ae90bc073f","resolution":{"observed_at":"2026-05-22T10:16:24.367967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TGIF: A new dataset and benchmark on animated gif description","venue":null,"work_id":"43edebe2-50d3-4fbe-b0fc-96e150dddfcf","year":2016},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:3692baa782819a1abe95a21e95e0e9119a44ad3833dbccc6b6f45e23eedacd88","observation_id":"7c419a65-3793-4128-ab62-1968bc5aecbf","resolution":{"observed_at":"2026-05-22T10:16:24.398820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ARB-LLM: Alternating refined binarizations for large language models","venue":null,"work_id":"0964bd40-3ccd-43a2-aa58-f8cbff011de6","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:51acf266ea2644c5c16c6c04ca8f392f63c9feef01fcdac36591c87c8f3e59c3","observation_id":"8fd72e5b-85bc-4576-8e60-04ef11418d5e","resolution":{"observed_at":"2026-05-22T10:16:24.406302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AWQ: Activation-aware weight quantization for on-device LLM compression and acceleration","venue":null,"work_id":"9c024c22-544a-4870-bba3-6b2ac41d262a","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:882cebcab47bfacb38129ab7f686a63b2cad0d41d5c5f58da955f3ebbb0c6bdb","observation_id":"891e9a01-59b5-488f-8974-455fd16104a7","resolution":{"observed_at":"2026-05-22T10:16:24.410266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":"ebed03c5-16b1-4496-8414-409749ecf17a","year":2022},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:0b9af96db26dac8d3e12aa7bd5e2013d6b1038baa178a9bcbaa12f32b6134776","observation_id":"e102ee20-fbd5-41a3-82ba-28e176987e02","resolution":{"observed_at":"2026-05-22T10:16:24.302735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QServe: W4A8KV4 quantization and system co-design for efficient LLM serving","venue":null,"work_id":"c6da7412-9748-4364-96ae-a91985c6dea5","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:3452654237ad94e3922b95ccafe83e8d6bbfb4d515c4c4ff784917f50523c967","observation_id":"2584fc4f-fd92-451e-90db-c990aa2f10c1","resolution":{"observed_at":"2026-05-22T10:16:24.284151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VPTQ: Extreme low-bit vector post-training quantization for large language models","venue":null,"work_id":"df403f3c-9e5c-4991-9849-ab219e9f8a26","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:7af54ca8732f287f682d25f1fba458f1c5d54c384afe3e9c91e3953cbc3719bb","observation_id":"0a9cdf48-9ce6-46c3-b472-f8f8e3709e78","resolution":{"observed_at":"2026-05-22T10:16:24.288864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:c43af8113072299f4cb3f18c6f5ce50fb84f638bd445e34039f092299e7e3755","observation_id":"266fad7a-5546-4724-bb32-a6709a8833ea","resolution":{"observed_at":"2026-05-22T10:11:23.356051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.02631","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:08:58.110577Z","title":"ParetoQ: Scaling laws in extremely low-bit LLM quantization","venue":null,"work_id":"9005825b-a282-435f-8eda-0163175e61fd","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:fd98309b61ea44e2376bb0131a2b475638a2e90f366c6f7fbf62056de967b897","observation_id":"73f76727-90bf-47cd-8606-6c3c3e052658","resolution":{"observed_at":"2026-05-22T10:11:23.385125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SpinQuant: LLM quantization with learned rotations","venue":null,"work_id":"eb0ab127-2a5a-40ef-8d70-300b80e51a42","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:5c86f9764c11534c36def245af35794a81ef9f55a95873db523fd1a764f9e7db","observation_id":"b0ed9a4b-e85b-48fb-ab44-b35dc02deeb7","resolution":{"observed_at":"2026-05-22T10:16:24.298386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can a suit of armor conduct electricity? A new dataset for open book question answering","venue":null,"work_id":"fe0ec7e7-0250-4d81-aba3-471c39403c83","year":2018},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:c95423e4e85db630d68e090e1ac0a81ef68501584887bdaad420ccf7182abc93","observation_id":"214f302d-842a-4a48-be86-514406ba5182","resolution":{"observed_at":"2026-05-22T10:16:24.329191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"WinoGrande: An adversarial Winograd schema challenge at scale.Communications of the ACM, 64(9):99–106","venue":null,"work_id":"94efef25-8ace-4b08-9d89-de3f53f1cae3","year":2021},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:bfe67a3eba74d07eaeb1d914b36763a0e6029344a134dee2c8da77539da55d16","observation_id":"fbb6b3db-d6f5-46c9-a262-a6b31bd3d171","resolution":{"observed_at":"2026-05-22T10:16:24.259509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social IQa: Commonsense reasoning about social interactions","venue":null,"work_id":"b0f61dde-dd63-42be-80f2-d7c948e21e04","year":2019},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:63eba9dbf656f9cba836533ed32ebc76e7ff6a1a1ecde68c8391d13d0e121834","observation_id":"4000a229-bd0b-4ddb-8660-c12706c09d38","resolution":{"observed_at":"2026-05-22T10:16:24.263123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OmniQuant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":"ce25241e-709a-4050-bd5e-9c4657c05427","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:043ae51517550f8e310205e208409fb27503dd9e4f32544918eae7002f128b3d","observation_id":"35718577-7606-40bb-88a4-3905d2af106d","resolution":{"observed_at":"2026-05-22T10:16:24.273605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FlatQuant: Flatness matters for LLM quantization","venue":null,"work_id":"653c7f75-c3eb-440d-9fb5-5b1c6015ec69","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:78f58b49c28508a5c8643995fbced2be6e1dfd8a33ee18f17f3dd17d9e61836d","observation_id":"6423fe27-80f1-44d9-8a3e-7a3341451373","resolution":{"observed_at":"2026-05-22T10:16:24.241500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MobileQuant: Mobile-friendly quantization for on-device language models","venue":null,"work_id":"25bac9ed-a345-409f-966a-3b876c3fc8a5","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:a1ee4d44072e37964902b4a9d1c6829f763524c08a28cf16dbf4a48de115d32e","observation_id":"02cde144-33ab-48a8-a996-431fcc272a2b","resolution":{"observed_at":"2026-05-22T10:16:24.246692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BERT rediscovers the classical NLP pipeline","venue":null,"work_id":"01a2ee62-9212-411a-b80a-80abf47dea49","year":2019},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:2bb1cd99ea508cf44f2ad2e8f76fce92cd37fd646ad93b82f7fe485f0dfb21cb","observation_id":"f7f4e68e-bb60-4026-8998-6cd5610e9d52","resolution":{"observed_at":"2026-05-22T10:16:24.251457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QuIP#: Even better LLM quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":"fdec81fb-765b-41f7-ad4e-b1660ccfca13","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:9f54b02c0ca6e23ab95e80e702e1daf407cdaf8fbac59f48eed26982eaf3ea0c","observation_id":"056a4481-c84e-4f8a-87c7-060a250c6fc6","resolution":{"observed_at":"2026-05-22T10:16:24.335364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QTIP: Quantization with trellises and incoherence processing","venue":null,"work_id":"3e245dfb-7466-4c4a-b5c2-91638d847f28","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:20531cb1fdaeff3585bcf499d186ce887badbd37b1959ac2774cdcd9ffa1ad6c","observation_id":"424c0aec-9df0-49f0-8a14-5fa43f55cab9","resolution":{"observed_at":"2026-05-22T10:16:24.269743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BitNet: 1-bit pre-training for large language models.Journal of Machine Learning Research, 26(125):1–29","venue":null,"work_id":"2d554311-4069-4a10-bbe8-f1d30bbb6d65","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:ce1673f32bf4d3aa1824008d6b676f4fb1d39daa0cce33ed43b087c984686238","observation_id":"f1e9dd44-ffb8-4759-ab2c-88fac099f431","resolution":{"observed_at":"2026-05-22T10:16:24.255773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniLM: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":"df5efa6b-55bc-430c-9a18-d22894e400f5","year":2020},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:47e4ac1cae05f45c96f4da262cd27f2cf01d8a45d3949fd5624f89904fd9ca24","observation_id":"c01de3a4-5157-4469-9b01-cb960ff582a5","resolution":{"observed_at":"2026-05-22T10:16:24.227990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking kullback-leibler divergence in knowledge distillation for large language models","venue":null,"work_id":"c4cde6c9-ca88-44b2-a331-81b6c7a012ec","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:7ab5e188be8e30476a1cb43510dd9d01fd47e31c5c2375a2cb43e2e1f66d2b02","observation_id":"ccee7f78-1218-4339-8ea6-ca5ed3940f3c","resolution":{"observed_at":"2026-05-22T10:16:24.237755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SmoothQuant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"a10481d4-4edc-4815-9f1b-fa49cfcb1654","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:152463d94c5da2707f2990741c2b737370d14206a35f409cbc68f5c5cda180be","observation_id":"61a5580c-c0f1-42df-941d-0160b9f07012","resolution":{"observed_at":"2026-05-22T10:16:24.223236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2503.20215","doi":"10.48550/arxiv.2503.20215","metadata_source":"pith","pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Omni Technical Report","venue":"cs.CL","work_id":"438f105c-fa9b-44aa-ad52-43acb8045cda","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:53c5a1ece1bffb535199a921311b7bf78b18ada2ab4f31ed820b244abce5c1db","observation_id":"0af928a6-7a9c-463b-aa02-34a486f50714","resolution":{"observed_at":"2026-05-22T10:11:23.328008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OneBit: Towards extremely low-bit large language models","venue":null,"work_id":"0bd9dfe1-bd76-4285-ba0d-34f103ade8a1","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:174534a5339b69d7b7db032099b06a24a3aec4d98df4190c7e327f9f7b9c0910","observation_id":"130ee510-c540-4b5a-aa1b-de9c10d987d1","resolution":{"observed_at":"2026-05-22T10:16:24.306567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:a198286cf8a6691654202fa67e8df703b8218cf70f05a21686e882d28a10de44","observation_id":"22b50fb2-f27a-4363-926c-09edde40133a","resolution":{"observed_at":"2026-05-22T10:11:23.333458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2309.05653","doi":"10.48550/arxiv.2309.05653","metadata_source":"pith","pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","venue":"cs.CL","work_id":"e74feaec-ca8a-4bdb-945e-e747355406e7","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:03a303568b8cc9b126c6cbe545aa1e024620c8ef7dc0d0eb1c4dbd78f1ff93ea","observation_id":"34d5ee32-dd65-4476-ad16-a1c22b8920fa","resolution":{"observed_at":"2026-05-22T10:11:23.338672Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HellaSwag: Can a machine really finish your sentence? InProceedings of the 57th Annual Meeting of the Association for Computational Linguistics, pages 4791–4800","venue":null,"work_id":"4540c21b-b572-423c-ba01-0998d78a4ca2","year":2019},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:bd5fed063cf551a11fb676a8f32fab97d75567ecc36cd6c3097916154c7181f1","observation_id":"845e2352-4177-412b-ac55-3a0cee2fe63f","resolution":{"observed_at":"2026-05-22T10:16:24.213545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ABQ-LLM: Arbitrary-bit quantized inference acceleration for large language models","venue":null,"work_id":"ad154522-6f22-414c-a2e1-971557e5e832","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:88a32b15423c5c3c3f41d8a084384bc93c4eed8bff06d8387450a704a2030e44","observation_id":"51fdc9ad-fc5a-4151-ab23-9814c3ca14b6","resolution":{"observed_at":"2026-05-22T10:16:24.218776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LQER: Low-rank quantization error reconstruction for LLMs","venue":null,"work_id":"ba54b6b6-5e61-4ece-b77e-c9e4ffac5529","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:46fd0a5ac8c71a4a0484b92e8b93b0f206668ff5af8d8cda1f393da3501e5f22","observation_id":"fc72bd4a-982a-4d89-aa6d-881f0a2154d4","resolution":{"observed_at":"2026-05-22T10:16:24.232871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19633","last_updated":"2025-03-25T13:19:46Z","snapshot_observed_at":"2026-08-07T16:38:25.767133Z","submitted_at":"2025-03-25T13:19:46Z","title":"1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training","version":1},"cited_work":{"arxiv_id":"2503.19633","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19633","snapshot_observed_at":"2026-06-29T12:13:26.834380Z","title":"1.4 million open-source distilled reasoning dataset to empower large language model training","venue":null,"work_id":"916370ba-ae1f-4d71-a6db-086aa16d94e9","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2503.19633","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:d3ed41d5ca2eaaa383652145d92412897719a295fe142976979d6b622157dbcb","observation_id":"f96283b2-251a-4b9d-8b9a-c3624726bb39","resolution":{"observed_at":"2026-05-22T10:11:23.322638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review on edge large language models: Design, execution, and applications.ACM Computing Surveys, 57(8):1–35","venue":null,"work_id":"f6f8f366-f27a-401b-82db-f2376e6d77b1","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:29bbce88276b2d066859d6250e91e3a34314965e6d2fc9ccaa2afc6a8be8a4f3","observation_id":"b1e2146a-7636-48f9-b6ea-ecf2bb61abee","resolution":{"observed_at":"2026-05-22T10:16:24.199071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.07911","doi":"10.48550/arxiv.2311.07911","metadata_source":"pith","pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Instruction-Following Evaluation for Large Language Models","venue":"cs.CL","work_id":"3aa06177-125a-4f5a-8f4a-8070c5986c26","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:5fe0cd2b6d9fe0f26d0ab48e2ef9abbe3afa2cc21bc97fbbc50c307ab2b2b381","observation_id":"0e836e11-0d25-41a8-80fc-22539a9af58c","resolution":{"observed_at":"2026-05-22T10:11:23.311393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MLVU: Benchmarking multi-task long video understanding","venue":null,"work_id":"ce18a9fb-ad42-4b7a-96dd-f2396421893e","year":2025},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:dfe36aed7e7d1082461019c285546e42ba6767ac1b6dbc014378413772177871","observation_id":"b991e72a-c586-4fb0-9ef4-e47fc157c210","resolution":{"observed_at":"2026-05-22T10:16:24.204218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c605e8c2-9028-4927-bfd1-dabc9ae67219","year":2004},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:326a2bbb84dfba66f951d49ff713dfebb1c8960d11b8d15e706dec890b7293ea","observation_id":"94564f05-3112-47e3-a246-4bfc8ab16281","resolution":{"observed_at":"2026-05-22T10:16:24.208831Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on model compression for large language models.Transactions of the Association for Computational Linguistics, 12:1556–1577","venue":null,"work_id":"d483f028-446c-4530-9178-a13f69fd1439","year":2024},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:9cc6d3e70e7347ac699ad0e2a576f93f65568d2c9633b45691277df30e167c91","observation_id":"22a84477-c294-492d-bdf4-e182f91b8efc","resolution":{"observed_at":"2026-05-22T10:16:24.193948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"∼Unif[0,1]","venue":null,"work_id":"c5f50a31-b029-4eca-b4fa-5f09e025114c","year":null},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:e18d7c4326d7a88d08e5ba40f8d065bee57440f2b8240a874011041f24d85082","observation_id":"d269e5dd-79ba-4038-9d96-66e7e69978de","resolution":{"observed_at":"2026-05-22T10:16:24.359335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"N−0.5 dout .(17) Since all points lie in a sub-interval of length ρ, taking t=ρ in the definition of D∗ N gives a deviation of1−ρ","venue":null,"work_id":"c9f5c09e-7611-477b-988a-7b37a2781aeb","year":null},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:9ed3b5b991afb28896f9b0be749d63e4c4b97bad3fea42bf5ac26395eab2b38a","observation_id":"942348bc-1744-4c97-bedc-87aa4132e2d3","resolution":{"observed_at":"2026-05-22T10:16:24.188428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1669.1936","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"\"\" Given a string, find out how many distinct characters (regardless of case) it consists of >>> count_distinct_characters(’xyzXYZ’) 3 >>> count_distinct_characters(’Jerry’) 4","venue":null,"work_id":"830b6f13-b544-4ed9-ac56-6a6fa310ccaf","year":1936},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:ef9474af0e557793d2302b00ab0c07fb6c27e4d877e0b51f1eff31eff5342cca","observation_id":"51320670-df27-428b-97b6-f95a52dbcc8f","resolution":{"observed_at":"2026-05-22T10:11:23.317146Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":17,"verified_fuzzy":44},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2605.04062."}