{"as_of":"2026-08-10T17:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c6bfb27f0b43e859d7b7d8fe01564b8418f657e65afca7b311e1eed8b63516c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":57,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T15:48:57.257985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":39,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-13T13:35:35.972596Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2208.07339"},"observation_digest":"sha256:0f27eb7d699a02c342669d6ee1d9d8d5801ac885ba2838e3ebb183397a65cb14","observation_id":"00b66eee-06d4-492e-a75d-7f95a2020df6","resolution":{"observed_at":"2026-05-13T13:35:36.084102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:18:35.153078Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2210.17323"},"observation_digest":"sha256:075f2bbefe9e6237320bfec1776a2de023048c640cf356c67e0124f71735bf15","observation_id":"0bba9aaf-d8f3-4125-8ef5-c3afbad10a39","resolution":{"observed_at":"2026-05-10T17:18:35.220447Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T08:27:35.798991Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2306.00978"},"observation_digest":"sha256:2600a7b3a7013c024994d420717d383c0cfdcf862538e220bda803bb9da6cc31","observation_id":"96bb1c26-5673-40fb-a214-620865aac78c","resolution":{"observed_at":"2026-05-24T08:29:11.292898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-09T15:48:57.257985Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01330","last_updated":"2025-08-13T09:51:20Z","snapshot_observed_at":"2026-08-10T02:47:39.101614Z","submitted_at":"2025-02-03T13:09:21Z","title":"Accelerating Linear Recurrent Neural Networks for the Edge with Unstructured Sparsity","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T15:48:57.257985Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.01330"},"observation_digest":"sha256:13fe51287deae485c4d4ca3ef10f343dbeaa6cdf1dbaae8a25991ad6ebf16976","observation_id":"b19fa976-c65a-4390-8afd-0e3f0d948751","resolution":{"observed_at":"2026-08-09T15:48:57.257985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-08T13:22:57.365228Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07842","last_updated":"2025-03-13T11:32:19Z","snapshot_observed_at":"2026-08-09T13:50:05.841090Z","submitted_at":"2025-02-11T05:32:14Z","title":"Column-wise Quantization of Weights and Partial Sums for Accurate and Efficient Compute-In-Memory Accelerators","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T13:22:57.365228Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.07842"},"observation_digest":"sha256:2fba2faaf01b56a47847a5495c5df3450d1f78385b7541b793c22ede4f32d297","observation_id":"27523974-4ea5-4b32-b343-5785644b2cf5","resolution":{"observed_at":"2026-08-08T13:22:57.365228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T23:06:30.721328Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.08989","last_updated":"2025-08-21T07:25:23Z","snapshot_observed_at":"2026-08-07T22:57:06.023167Z","submitted_at":"2025-02-13T06:01:09Z","title":"Setup Once, Secure Always: A Single-Setup Secure Federated Learning Aggregation Protocol with Forward and Backward Secrecy for Dynamic Users","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T23:06:30.721328Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.08989"},"observation_digest":"sha256:f46e0a923229af0fd3f3e516f6bd9b1023e275b55070b4ce0cad7f73ca9ecb62","observation_id":"409bfe8f-c526-4420-b01d-8342132f3f09","resolution":{"observed_at":"2026-08-07T23:06:30.721328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T22:12:50.004131Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09297","last_updated":"2025-09-09T07:21:48Z","snapshot_observed_at":"2026-08-09T20:32:05.259492Z","submitted_at":"2025-02-13T13:11:54Z","title":"When Do Neural Networks Learn World Models?","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T22:12:50.004131Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.09297"},"observation_digest":"sha256:f8ddc5494601e63b2ccc2d343f35fa3f77c5965131376c072571d4f25dbcc29b","observation_id":"6de8f12d-cb44-47f3-9775-b6c5d410df9c","resolution":{"observed_at":"2026-08-07T22:12:50.004131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T19:03:04.836700Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10202","last_updated":"2025-02-14T14:56:19Z","snapshot_observed_at":"2026-08-10T00:44:02.764750Z","submitted_at":"2025-02-14T14:56:19Z","title":"Can Post-Training Quantization Benefit from an Additional QLoRA Integration?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:03:04.836700Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.10202"},"observation_digest":"sha256:4f5ce84715a73283fff11e862f940cebd3dd1f0ea963d5600ceada1450f259f6","observation_id":"be0c3fb5-8441-4c69-9787-a111ff43e423","resolution":{"observed_at":"2026-08-07T19:03:04.836700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T19:04:45.538462Z","title":"Gholami, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10216","last_updated":"2025-08-12T07:34:30Z","snapshot_observed_at":"2026-08-08T07:46:40.733541Z","submitted_at":"2025-02-14T15:10:43Z","title":"Forget the Data and Fine-Tuning! Just Fold the Network to Compress","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:04:45.538462Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2502.10216"},"observation_digest":"sha256:1dab72778c8b4a9916d213805cbec8e39f7ed0932aa9815f22e4fffebf40f970","observation_id":"99284c22-70a6-4e24-aaa0-5b6928c39c63","resolution":{"observed_at":"2026-08-07T19:04:45.538462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T15:14:01.468760Z","title":"CoRR, abs/2103.13630","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15909","last_updated":"2025-05-21T18:01:32Z","snapshot_observed_at":"2026-08-09T00:36:31.746367Z","submitted_at":"2025-05-21T18:01:32Z","title":"Is (Selective) Round-To-Nearest Quantization All You Need?","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T15:14:01.468760Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2505.15909"},"observation_digest":"sha256:385a7222572b37ca395cc72b5edc7f15916c635b21e707d559844c9bd20c71f2","observation_id":"769f1d7e-efac-45a7-9a6a-5e7e5b8f84a3","resolution":{"observed_at":"2026-08-07T15:14:01.468760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T12:42:56.274457Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24012","last_updated":"2025-05-29T21:18:12Z","snapshot_observed_at":"2026-08-07T12:35:30.352031Z","submitted_at":"2025-05-29T21:18:12Z","title":"Large Language Model Meets Constraint Propagation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:56.274457Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2505.24012"},"observation_digest":"sha256:68fdea7687b2911f4ad6d106373e6ddecbb44fa3507a548f27c5051fca63da1c","observation_id":"b2f43a7e-a1c9-427f-89d8-214f9fb73466","resolution":{"observed_at":"2026-08-07T12:42:56.274457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T11:07:15.911425Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.911425Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:5368cf8bcaab05382be6d7067fdc0d45dcc6519d929b7cbe0b5545f9406395f1","observation_id":"e365ab8a-b784-4406-927b-dea0195e3e40","resolution":{"observed_at":"2026-08-07T11:07:15.911425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T21:39:19.804559Z","title":"A survey of quantization methods for efficient neural network infer- ence,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-10T10:06:48.942352Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.804559Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:24e0e3c0602265799e37d2b79e6224abf53da10fb0eb7f5a98026b0749a8c39e","observation_id":"b9177401-69f6-48b0-bebe-ad54a5599369","resolution":{"observed_at":"2026-08-06T21:39:19.804559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T20:47:20.455721Z","title":"A survey of quantization methods for efficient neural network inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01823","last_updated":"2025-07-02T15:38:49Z","snapshot_observed_at":"2026-08-09T20:20:38.725306Z","submitted_at":"2025-07-02T15:38:49Z","title":"TD-MPC-Opt: Distilling Model-Based Multi-Task Reinforcement Learning Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:47:20.455721Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2507.01823"},"observation_digest":"sha256:c522830e88c734748f61e4d7a67ab0b5e135bb0b3b655c979c48b88475548541","observation_id":"bc07b9b3-bef6-4e53-bf11-8ff2c6c5b35c","resolution":{"observed_at":"2026-08-06T20:47:20.455721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T15:43:35.654496Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15146","last_updated":"2025-07-20T22:46:42Z","snapshot_observed_at":"2026-08-09T17:00:47.012293Z","submitted_at":"2025-07-20T22:46:42Z","title":"Design of an Edge-based Portable EHR System for Anemia Screening in Remote Health Applications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:43:35.654496Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2507.15146"},"observation_digest":"sha256:f14298b63c7127e77117693d1c9b5d77b67265cfdf2b0d31d9e41b1e90e2637d","observation_id":"2b3591ea-676e-410d-b313-49cc164bc3d5","resolution":{"observed_at":"2026-08-06T15:43:35.654496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T15:44:53.246566Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15151","last_updated":"2025-07-20T23:02:58Z","snapshot_observed_at":"2026-08-06T15:37:08.802897Z","submitted_at":"2025-07-20T23:02:58Z","title":"Performance Analysis of Post-Training Quantization for CNN-based Conjunctival Pallor Anemia Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:53.246566Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2507.15151"},"observation_digest":"sha256:52c2f7449e2ca07d06d9c4e26b865c4cb294bfbf64bfd5589ba0c4c6aa822266","observation_id":"30e36c17-7ef8-4375-b83d-e0fc10e3d34a","resolution":{"observed_at":"2026-08-06T15:44:53.246566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2507.18553","last_updated":"2026-05-13T13:18:37Z","snapshot_observed_at":"2026-08-02T23:33:27.427966Z","submitted_at":"2025-07-24T16:22:18Z","title":"The Geometry of LLM Quantization: GPTQ as Babai's Nearest Plane Algorithm","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T02:47:57.446718Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2507.18553"},"observation_digest":"sha256:90947a45e0b78a60c39d1835385c72107fed49b08e5290a3138a1c2d49a33688","observation_id":"cef6eecd-6b06-45af-8117-5ad273eab734","resolution":{"observed_at":"2026-05-19T02:52:00.477563Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T11:15:35.904337Z","title":"Gholami, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22873","last_updated":"2025-07-30T17:47:25Z","snapshot_observed_at":"2026-08-10T09:27:38.438054Z","submitted_at":"2025-07-30T17:47:25Z","title":"LCS: An AI-based Low-Complexity Scaler for Power-Efficient Super-Resolution of Game Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:35.904337Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2507.22873"},"observation_digest":"sha256:71cc37d09f0f0444f6a491209172515f5669e78b4c23bcb81440d4c33fd5ad1c","observation_id":"ff657a65-67a1-40a6-87ef-5581be772dfd","resolution":{"observed_at":"2026-08-06T11:15:35.904337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2509.03472","last_updated":"2026-04-15T20:18:20Z","snapshot_observed_at":"2026-07-06T22:23:00.681940Z","submitted_at":"2025-09-03T16:51:26Z","title":"DPQuant: Efficient and Differentially-Private Model Training via Dynamic Quantization Scheduling","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T19:09:04.217591Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2509.03472"},"observation_digest":"sha256:b127a036f921b36f628136c219d04cfea50e2ef30e0ce1982cce5f23a5c8d8a2","observation_id":"7899aa98-c1af-4207-b559-19544490283b","resolution":{"observed_at":"2026-05-18T19:11:46.619871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T04:53:15.380860Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05937","last_updated":"2025-09-07T05:56:38Z","snapshot_observed_at":"2026-08-05T04:53:13.713388Z","submitted_at":"2025-09-07T05:56:38Z","title":"Hardware Acceleration of Kolmogorov-Arnold Network (KAN) in Large-Scale Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T04:53:15.380860Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2509.05937"},"observation_digest":"sha256:0ce1de5d44fb88ddaa64cb425e296fe09d021f1b0e20790a2f8c439b8745e65b","observation_id":"9c2f9e14-7e9e-4bd1-ba72-7da11ad5a3c8","resolution":{"observed_at":"2026-08-05T04:53:15.380860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-04T19:47:08.807509Z","title":"Markus Nagel, Marios Fournarakis, Rana Ali Amjad, Yelysei Bondarenko, Mart van Baalen, and Tijmen Blankevoort","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09090","last_updated":"2025-09-11T01:52:25Z","snapshot_observed_at":"2026-08-07T08:28:40.679181Z","submitted_at":"2025-09-11T01:52:25Z","title":"SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T19:47:08.807509Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2509.09090"},"observation_digest":"sha256:df6db52ee9b3f5e1486b9c7ab90a38c27fd6b476ad034c451a3dad3396d6ea33","observation_id":"8e164972-68af-458e-a1a3-67e8b39dc80c","resolution":{"observed_at":"2026-08-04T19:47:08.807509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-03T23:21:36.698338Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-21T18:46:04.926179Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:aad1b95430adbbff334abfc0bd0094ae389aa500581b5c2b87b112e8ba764431","observation_id":"73dfb776-9b0e-4bf7-ae46-d02998c8e665","resolution":{"observed_at":"2026-05-21T18:50:30.316237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-03T23:21:38.316714Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-03T23:21:36.698338Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T23:21:38.316714Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:45684c60f985d9eaa48f18df76fe5c9520c7c1051564ea952d1a6551af8d3fb3","observation_id":"30bb7e37-dce0-4421-a3cc-0708ff5cca08","resolution":{"observed_at":"2026-08-03T23:21:38.316714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-02T21:53:19.873410Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.873410Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:f23eb6606121828bb0ba2fbf2f3483beb470b7eab7622014164a87ba44d0e32e","observation_id":"25bd78b3-a95f-442e-be59-9f3ed5ccdfc2","resolution":{"observed_at":"2026-08-02T21:53:19.873410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-02T19:02:36.023080Z","title":", Kim, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.03971","last_updated":"2026-07-20T14:18:37Z","snapshot_observed_at":"2026-08-02T19:02:33.538115Z","submitted_at":"2026-03-04T12:14:21Z","title":"No Certificate, No Categorical Speech Act: A Brouwerian Assertibility Constraint for Public Reason","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T19:02:36.023080Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2603.03971"},"observation_digest":"sha256:362bf1ef419ca6977bccb98dac38ce5fcd5296e9a4cc53aaac43881674c73620","observation_id":"1a9ff4f1-1a30-43a5-a7a7-bef9ce394417","resolution":{"observed_at":"2026-08-02T19:02:36.023080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-07-14T22:32:36.129552Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.11917","last_updated":"2026-06-19T06:31:29Z","snapshot_observed_at":"2026-08-06T09:49:05.377173Z","submitted_at":"2026-03-12T13:31:43Z","title":"PicoSAM3: Real-Time In-Sensor Region-of-Interest Segmentation","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T22:32:36.129552Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2603.11917"},"observation_digest":"sha256:ae7f6126b257493f660755c2169e7ef3cf7863f320ba694f09cb674ee8fb9308","observation_id":"19e7a59f-1396-4116-b23e-28ada2ad86db","resolution":{"observed_at":"2026-07-14T22:32:36.129552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2603.26603","last_updated":"2026-05-20T17:48:34Z","snapshot_observed_at":"2026-08-08T16:50:54.146177Z","submitted_at":"2026-03-27T17:00:25Z","title":"Sustainability Is Not Linear: Quantifying Performance, Energy, and Privacy Trade-offs in On-Device Intelligence","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-21T09:27:34.204972Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2603.26603"},"observation_digest":"sha256:965b68b9277d26b50fc385745473c2e03b48c359595a31bcc622995347552fcd","observation_id":"066bf084-a63e-474a-aea5-f0ea9bbdc345","resolution":{"observed_at":"2026-05-21T09:29:56.944260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2604.08118","last_updated":"2026-04-09T11:38:24Z","snapshot_observed_at":"2026-07-06T22:57:18.202215Z","submitted_at":"2026-04-09T11:38:24Z","title":"Initialisation Determines the Basin: Efficient Codebook Optimisation for Extreme LLM Quantization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T17:37:31.175385Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2604.08118"},"observation_digest":"sha256:e566249a9ae4b6ef8cf2151d8545ef7f484c7f540c18d1c59dde025a8a49d204","observation_id":"080d1c6c-d53c-421e-93ca-36bd7330b2e5","resolution":{"observed_at":"2026-05-11T06:30:58.645303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2604.10841","last_updated":"2026-04-12T22:23:14Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T22:23:14Z","title":"Harnessing Photonics for Machine Intelligence","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:08:41.680567Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2604.10841"},"observation_digest":"sha256:9c620b3fdde989ba37cbacff5e1d19b0fa87eb7a572028d2a30ca0db5b85372a","observation_id":"6e680e32-1d81-4a5c-8cfa-5ff6f0284360","resolution":{"observed_at":"2026-05-11T11:11:01.129306Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.06485","last_updated":"2026-06-10T14:41:46Z","snapshot_observed_at":"2026-08-09T19:15:08.038528Z","submitted_at":"2026-05-07T16:07:39Z","title":"Litespark Inference For CPUs: Ultra-Fast SIMD Framework for Ternary (1.58-bit) Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T10:12:36.972813Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.06485"},"observation_digest":"sha256:21d0753b0ced4caaf7f326442fcc88d5839b983dc5976a4915fb767597f17b9a","observation_id":"dc96319b-6373-4a8c-8ccb-f9a11cdc5e3a","resolution":{"observed_at":"2026-05-11T20:11:08.760148Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.06485","last_updated":"2026-06-10T14:41:46Z","snapshot_observed_at":"2026-08-09T19:15:08.038528Z","submitted_at":"2026-05-07T16:07:39Z","title":"Litespark Inference For CPUs: Ultra-Fast SIMD Framework for Ternary (1.58-bit) Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T23:12:52.038253Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.06485"},"observation_digest":"sha256:66518015f506174e684d5909c4b9655eca48ec1c77618b63a90eccf1a54b2733","observation_id":"a9081ec2-8c24-42f3-a64b-926acc3813da","resolution":{"observed_at":"2026-07-01T13:25:46.077628Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.10886","last_updated":"2026-07-09T02:30:06Z","snapshot_observed_at":"2026-07-12T23:17:31.243229Z","submitted_at":"2026-05-11T17:32:29Z","title":"LoKA: Low-precision Kernel Applications for Recommendation Models At Scale","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T04:33:41.411292Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.10886"},"observation_digest":"sha256:9305116f5880931506bdb1f18b656da3d1eef10e462fb0b0822c486d6eeb8592","observation_id":"11f0428d-b44b-4eae-aa50-919b9acd2c9a","resolution":{"observed_at":"2026-05-12T06:06:28.021916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.10886","last_updated":"2026-07-09T02:30:06Z","snapshot_observed_at":"2026-07-12T23:17:31.243229Z","submitted_at":"2026-05-11T17:32:29Z","title":"LoKA: Low-precision Kernel Applications for Recommendation Models At Scale","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T04:55:01.973832Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.10886"},"observation_digest":"sha256:28703143ee57213c81e89f16b168625e6993b5da4ebc54c14a1e5a546b48ffd2","observation_id":"68ae93d3-3789-47fe-a550-34bf64d79dfa","resolution":{"observed_at":"2026-05-15T04:59:46.145486Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.12046","last_updated":"2026-05-12T12:26:43Z","snapshot_observed_at":"2026-07-06T23:23:48.960874Z","submitted_at":"2026-05-12T12:26:43Z","title":"Rethink the Role of Neural Decoders in Quantum Error Correction","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T04:54:29.757965Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.12046"},"observation_digest":"sha256:a7a965f506493b1480edc2233c2b4651c60ca60d0410cbc04668628eba162d01","observation_id":"33becbf7-8bbc-42e0-ae84-ab17dcf3a61e","resolution":{"observed_at":"2026-05-13T04:57:17.516333Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.13699","last_updated":"2026-05-13T15:51:05Z","snapshot_observed_at":"2026-07-06T23:25:16.229144Z","submitted_at":"2026-05-13T15:51:05Z","title":"Memristor Technologies for Dynamic Vision Sensors: A Critical Assessment and Research Roadmap","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-14T17:45:42.414771Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.13699"},"observation_digest":"sha256:8ca4ad10598ca5a7c80fd71490162d62c49ded60d35da762c1fc1da36c9cfe78","observation_id":"9e9d16aa-7485-4c15-940a-1a1cd0621b44","resolution":{"observed_at":"2026-05-14T17:47:32.266103Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.15551","last_updated":"2026-05-15T02:44:25Z","snapshot_observed_at":"2026-08-03T14:14:32.753126Z","submitted_at":"2026-05-15T02:44:25Z","title":"Characterizing Learning in Deep Neural Networks using Tractable Algorithmic Complexity Analysis","version":1},"reference_index":297,"source":"arxiv_source","source_observed_at":"2026-05-20T20:24:16.373261Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.15551"},"observation_digest":"sha256:f88655d6c50471025e651f864e5dfdd4d99765cd1dba48013ca1937f05163944","observation_id":"7c917496-7944-4c49-b644-dd69d6daa2fe","resolution":{"observed_at":"2026-05-20T20:29:00.012599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.17160","last_updated":"2026-08-04T20:55:20Z","snapshot_observed_at":"2026-08-08T23:09:33.143239Z","submitted_at":"2026-05-16T21:19:31Z","title":"When Bits Break Recourse: Counterfactual-Faithful Quantization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T14:43:18.182586Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.17160"},"observation_digest":"sha256:19628556f58a6dc858834171536d030453d0b5ae79b2a2dff5ddc29a25b323ca","observation_id":"d9ab45ee-97aa-4a14-996e-4c02b83cc323","resolution":{"observed_at":"2026-05-20T14:43:22.007935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-03T02:20:53.530912Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.17160","last_updated":"2026-08-04T20:55:20Z","snapshot_observed_at":"2026-08-08T23:09:33.143239Z","submitted_at":"2026-05-16T21:19:31Z","title":"When Bits Break Recourse: Counterfactual-Faithful Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:20:53.530912Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.17160"},"observation_digest":"sha256:af2c2778fd270a175a9e0a88f5338f2f0ef54bfdd30caadb84805c9df4b7fa6f","observation_id":"fe01c9bb-2751-4762-b364-575ea68a0c57","resolution":{"observed_at":"2026-08-03T02:20:53.530912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-04T05:08:29.889425Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.17160","last_updated":"2026-08-04T20:55:20Z","snapshot_observed_at":"2026-08-08T23:09:33.143239Z","submitted_at":"2026-05-16T21:19:31Z","title":"When Bits Break Recourse: Counterfactual-Faithful Quantization","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T05:08:29.889425Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.17160"},"observation_digest":"sha256:d94fa6b76855a8d9625ce8755c9863b11a6363bb857b1e40f0014fb0bfdbed31","observation_id":"c0baae1a-f6f6-4ef4-8e4c-bb195ebce903","resolution":{"observed_at":"2026-08-04T05:08:29.889425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.18474","last_updated":"2026-05-19T08:19:47Z","snapshot_observed_at":"2026-07-06T23:29:20.279470Z","submitted_at":"2026-05-18T14:30:32Z","title":"Prompt2Fingerprint: Plug-and-Play LLM Fingerprinting via Text-to-Weight Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T09:34:59.995475Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.18474"},"observation_digest":"sha256:c61c8a28fd8af11f39fb19a8ee791c8fd108d6731b0baa5ef60a67858499da45","observation_id":"fabdbb09-f437-40e2-b345-ddb832b4111a","resolution":{"observed_at":"2026-05-20T09:38:10.880108Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.19195","last_updated":"2026-05-18T23:51:02Z","snapshot_observed_at":"2026-07-06T23:29:57.003383Z","submitted_at":"2026-05-18T23:51:02Z","title":"The Thermodynamic Costs of Simple Linear Regression","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-20T07:03:21.987679Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.19195"},"observation_digest":"sha256:5becc744ca5773af5dfd80b008614c9b29c14697863de4abc2b8b95f0fbbaf85","observation_id":"e53ca334-5dc2-4c5b-9a78-e4134d30fbb3","resolution":{"observed_at":"2026-05-20T07:03:23.273800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.19645","last_updated":"2026-05-19T10:31:47Z","snapshot_observed_at":"2026-08-07T18:15:24.907845Z","submitted_at":"2026-05-19T10:31:47Z","title":"K-Quantization and its Impact on Output Performance","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-20T05:37:46.225362Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.19645"},"observation_digest":"sha256:09d857689b4016b978afbd30adb61358ccdc5a5952eeca04316a7b1a00c4fc36","observation_id":"2ede1385-f556-486c-94a0-9f59a642baba","resolution":{"observed_at":"2026-05-20T05:38:04.928558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.27937","last_updated":"2026-05-27T04:15:01Z","snapshot_observed_at":"2026-08-06T10:30:27.297193Z","submitted_at":"2026-05-27T04:15:01Z","title":"Machine learning enables experimental access to photon-by-photon arrival times in scintillation detectors","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T09:49:07.517164Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.27937"},"observation_digest":"sha256:7a41c7fed2431fec10f496c879416028a04c971478f318bb978f0d78b7ca834b","observation_id":"9e3657d0-edf1-4134-9530-827005f66567","resolution":{"observed_at":"2026-06-29T09:53:17.409156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2605.29537","last_updated":"2026-05-28T07:52:29Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:52:29Z","title":"The Complexity of Verifying Feedforward Neural Networks in Quantised Settings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T00:09:07.981665Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2605.29537"},"observation_digest":"sha256:444528be3f0c20fa54cb29cb5acc769d0128723e73002ce950772cca9ff383f7","observation_id":"2ef426c2-1881-4425-84a0-1cb010ea3651","resolution":{"observed_at":"2026-06-29T00:12:49.989139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.08891","last_updated":"2026-06-08T00:33:44Z","snapshot_observed_at":"2026-08-07T09:04:32.600620Z","submitted_at":"2026-06-08T00:33:44Z","title":"PALUTE: Processing-In-Memory Acceleration via Lookup Table for Edge LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T15:08:25.880424Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.08891"},"observation_digest":"sha256:30135f7edc7ab7f712f76a625155859f65492ac3876ab31b26fc0986228e9ed4","observation_id":"8d05e762-cfbb-4f92-a600-89c920cfaefb","resolution":{"observed_at":"2026-07-03T03:37:35.534010Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.10458","last_updated":"2026-06-09T06:06:41Z","snapshot_observed_at":"2026-08-08T12:18:49.079007Z","submitted_at":"2026-06-09T06:06:41Z","title":"Minimum Distortion Quantization with Specified Output Distribution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T11:58:15.793011Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.10458"},"observation_digest":"sha256:44947fb9218900b51395d268ce9243e907419aed29b70fc26b60fda863ee561b","observation_id":"df96f0e2-f023-4824-9b30-b2d5de7db15d","resolution":{"observed_at":"2026-07-03T07:37:45.441499Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.13300","last_updated":"2026-06-11T12:53:03Z","snapshot_observed_at":"2026-07-06T23:52:04.574604Z","submitted_at":"2026-06-11T12:53:03Z","title":"Quantizing Time-Series Models As Dynamical Systems: Trajectory-Based Quantization Sensitivity Score","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T07:21:21.103554Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.13300"},"observation_digest":"sha256:2e863c1cb6c9e0a15abff760c506875faedd274c7685aff4cf7ee4b98e0b612b","observation_id":"d6802a1d-cf49-44ce-bbd9-27ee1d7de2a3","resolution":{"observed_at":"2026-07-03T13:58:22.016841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.22249","last_updated":"2026-06-20T22:22:26Z","snapshot_observed_at":"2026-08-06T20:47:52.441640Z","submitted_at":"2026-06-20T22:22:26Z","title":"On the Expressive Power of Weight Quantization in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T11:53:45.787243Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.22249"},"observation_digest":"sha256:c076dae8782db0acdc238dd22ea7bf354ac4235307000646030ba3f0e2c0134b","observation_id":"77947d34-ba98-4087-93dd-ceac11290e4e","resolution":{"observed_at":"2026-07-04T08:19:44.272097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.26587","last_updated":"2026-06-25T04:19:04Z","snapshot_observed_at":"2026-08-02T10:04:20.542320Z","submitted_at":"2026-06-25T04:19:04Z","title":"SharQ: Bridging Activation Sparsity and FP4 Quantization for LLM Inference","version":1},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-06-26T05:41:39.052865Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.26587"},"observation_digest":"sha256:1633455a9ae9f0ebb027b92b98215c4b55024d49ab290abe01bf540c4a0c8fcf","observation_id":"e5514e51-a7fd-494b-9431-cf45e6db27f9","resolution":{"observed_at":"2026-07-04T12:59:52.403341Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2606.26822","last_updated":"2026-06-25T10:03:55Z","snapshot_observed_at":"2026-08-04T14:54:46.519904Z","submitted_at":"2026-06-25T10:03:55Z","title":"Quantization in Federated Learning: Methods, Challenges and Future Directions","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T04:56:12.424439Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2606.26822"},"observation_digest":"sha256:42a957cddec8cd5ad0b8764284ecd14d18ab972f49c60c24b31aaf2d79d7dfbf","observation_id":"cfe547c6-22bf-441d-a7c8-09ba03676a89","resolution":{"observed_at":"2026-07-04T13:49:51.289218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":"2103.13630","doi":"10.48550/arxiv.2103.13630","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., and Keutzer, K","venue":"arXiv (Cornell University)","work_id":"9743aced-b121-4707-b83f-a7bbe09f738c","year":2021},"citing_paper":{"arxiv_id":"2607.01127","last_updated":"2026-07-01T16:13:03Z","snapshot_observed_at":"2026-08-10T04:33:34.724071Z","submitted_at":"2026-07-01T16:13:03Z","title":"$\\text{Log}_\\text{b}$Quant: Quantizing Language Models in Logarithmic Space","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-02T12:35:58.613973Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.01127"},"observation_digest":"sha256:d4fa70e1dd05fc186667fe9e1d861650094d1bb92fc3f3c62d53d0b461af0441","observation_id":"f5d6647f-9421-400f-aee8-8bac83eb7ee4","resolution":{"observed_at":"2026-07-02T12:36:55.881300Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-07-11T17:52:29.131365Z","title":"A Survey of Quantization Meth- ods for Efficient Neural Network Inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04531","last_updated":"2026-07-05T22:25:52Z","snapshot_observed_at":"2026-07-11T17:52:28.890935Z","submitted_at":"2026-07-05T22:25:52Z","title":"Lyapunov-Guided Training for Hardware-Safe Neural Networks Under Fixed-Point Arithmetic","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T17:52:29.131365Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.04531"},"observation_digest":"sha256:7dd97f7b9ea09ce8f9e0362ad1b83ee2f196a9335f2a84b351be87a1a98e09f9","observation_id":"4159fcf2-36dd-47b0-80b2-a690665a03d8","resolution":{"observed_at":"2026-07-11T17:52:29.131365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-02T01:37:47.281341Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14622","last_updated":"2026-07-16T06:38:49Z","snapshot_observed_at":"2026-08-08T11:05:08.970524Z","submitted_at":"2026-07-16T06:38:49Z","title":"ExaGEMM: Exploration Framework for CPU-Driven ML Inference via Associative In-Register Computing for Low-Bit GEMM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T01:37:47.281341Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.14622"},"observation_digest":"sha256:7307cef7fef7fd1047e475f6660874c5badcbbdc940af70058c0739070c7a566","observation_id":"c0f57189-cecb-468d-a4fc-06c51b67d633","resolution":{"observed_at":"2026-08-02T01:37:47.281341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-01T14:20:27.328655Z","title":"Gholami, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18802","last_updated":"2026-07-21T07:30:08Z","snapshot_observed_at":"2026-08-10T05:45:05.068254Z","submitted_at":"2026-07-21T07:30:08Z","title":"QScheduler: Adaptive Gradient Sampling for Zeroth-Order On-Device Training on INT8 NPUs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:20:27.328655Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.18802"},"observation_digest":"sha256:9da90af7cf99e61d7aeab5a17d40d41564e19496060d96eab5ffbf4851506ec7","observation_id":"a6a1969b-5349-42d7-9add-41d6457898bf","resolution":{"observed_at":"2026-08-01T14:20:27.328655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-01T00:28:14.757587Z","title":"et al.: A survey of quantization methods for efficient neural network inference, arXiv: 2103.13630 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26238","last_updated":"2026-07-28T20:19:25Z","snapshot_observed_at":"2026-08-07T18:25:45.481557Z","submitted_at":"2026-07-28T20:19:25Z","title":"Lightweight Image Classification of Raptor Species for Edge Devices: Rare-Species Dataset Expansion via Video Frame Extraction, Knowledge Distillation, and TensorRT Deployment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T00:28:14.757587Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.26238"},"observation_digest":"sha256:4135690975defa2ec76f509a18e4ef287bf1fe074046edfabd95a6ed238593b2","observation_id":"9d56633a-8464-4bf9-b762-95bb344dd067","resolution":{"observed_at":"2026-08-01T00:28:14.757587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-07-31T02:57:27.356357Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28589","last_updated":"2026-07-30T17:43:36Z","snapshot_observed_at":"2026-08-09T14:49:14.944377Z","submitted_at":"2026-07-30T17:43:36Z","title":"MixFrag: Fragility-Guided Mixed-Precision Post-Training Quantization for Vision Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T02:57:27.356357Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2607.28589"},"observation_digest":"sha256:a4b5728b1963500774ed10d335b718d001c0134a6f083668b0945df39f8fe43b","observation_id":"824d8568-6119-4bcc-91c5-30e341240d80","resolution":{"observed_at":"2026-07-31T02:57:27.356357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-08T01:04:45.725654Z","title":"W.; and Keutzer, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03057","last_updated":"2026-08-04T03:14:48Z","snapshot_observed_at":"2026-08-09T01:40:12.831628Z","submitted_at":"2026-08-04T03:14:48Z","title":"TASQ: Temporal-Adaptive Bit Sparsification Quantization for Diffusion Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T01:04:45.725654Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2608.03057"},"observation_digest":"sha256:895cdf48db853d48f7893317840d9df8d00a7489068b9f283fd41bf0f164b018","observation_id":"04db17ea-4882-4970-9c26-d5fb26d0e2c5","resolution":{"observed_at":"2026-08-08T01:04:45.725654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2103.13630/citation-record","integrity":"/paper/2103.13630/integrity","json":"/paper/2103.13630/citation-record.json","paper":"/paper/2103.13630"},"outbound":[],"paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 57 inbound Pith citation observations for arXiv:2103.13630."}