{"as_of":"2026-08-15T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e3c64cac77dd46d9c417c9ca0f63681a2820d39637ff686d7127135d75c9289","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:05.850300Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14638/citation-record","integrity":"/paper/2505.14638/integrity","json":"/paper/2505.14638/citation-record.json","paper":"/paper/2505.14638"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-14T17:13:05.593256Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-07T15:36:05.491210Z","title":"Learned step size quantization,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.491210Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:4d1e749109b539a2941a650cbbfdf879156221fdaf5fd7c450c3a8f4ee51c685","observation_id":"236c17b8-9918-47c9-aa7d-3e09aa1d7f80","resolution":{"observed_at":"2026-08-07T15:36:05.491210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.074964Z","title":"Ef- fective training of convolutional neural networks with low- bitwidth weights and activations,","venue":null,"work_id":"312d7837-e630-4507-8604-8b3eebe38823","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.498781Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:8736a75d51bc713155fa80f0a9e3bb2ad72d5570e613d63d27b3518ccbc38cba","observation_id":"94b1badb-5fc8-4880-ac05-496904854c23","resolution":{"observed_at":"2026-08-07T15:36:07.082662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.048406Z","title":"Cluster- promoting quantization with bit-drop for minimizing net- work quantization loss,","venue":null,"work_id":"795d90b1-da76-4658-b7f1-8495ffeb367d","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.506094Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:92d9478d425795a6ee9821660a64a326f2b0f79843e526d9b7c35401224ee783","observation_id":"2c1403f1-ef5d-45e0-9004-6e41e8b4630e","resolution":{"observed_at":"2026-08-07T15:36:07.056103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-13T11:30:33.812255Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T15:36:05.513839Z","title":"Llm-qat: Data- free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.513839Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:eea6145907495b1cc28437fa637bb0af67311790a3e65cdc8ceec8613873a1e4","observation_id":"1c5fd896-d33d-4a13-8799-4efc3d93369b","resolution":{"observed_at":"2026-08-07T15:36:05.513839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.024097Z","title":"Data-free quantization through weight equalization and bias correction,","venue":null,"work_id":"a5bcbb7e-fb7c-45ac-afda-20dc8b43e863","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.520642Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:dfdd6a53e63986c4d3148fce8654dba2123a44c7e1b06903f5e3315560b4fc9f","observation_id":"89a56030-cdbd-4dc1-94f1-e2a0167bf1b3","resolution":{"observed_at":"2026-08-07T15:36:07.030194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10518","last_updated":"2020-12-14T15:55:05Z","snapshot_observed_at":"2026-08-10T19:57:22.557568Z","submitted_at":"2020-06-14T16:07:55Z","title":"Improving Post Training Neural Quantization: Layer-wise Calibration and Integer Programming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10518","snapshot_observed_at":"2026-08-07T15:36:05.527071Z","title":"Improving post training neural quantization: Layer-wise calibration and integer programming,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.527071Z"},"links":{"cited_paper":"/paper/2006.10518","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:cc5c4d3512353a0863e48140b72262da7409f5779dd668b63d8492ee407d5d38","observation_id":"e0c27305-2a9d-404e-a070-7be9039062a8","resolution":{"observed_at":"2026-08-07T15:36:05.527071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.001091Z","title":"Accurate post training quantization with small calibra- tion sets,","venue":null,"work_id":"a298c6ea-78a8-499d-9184-9c487603dcc8","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.534639Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:7ac16e19a55da079860e144a6172238ac3e861d19d09688b0cc2407a37261825","observation_id":"13814e29-fb9e-4965-9a5a-ca9090c6622c","resolution":{"observed_at":"2026-08-07T15:36:07.009418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.981943Z","title":"Post-training quantization for vision transformer,","venue":null,"work_id":"5475532c-08b5-4af3-927b-9c49b3ce2058","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.540267Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:94b985d0ead8d9e947835c634d13e941936248dff72f91d0f8c5a6f5409a4a73","observation_id":"c581bb25-a830-4af4-a641-a331f5e4e420","resolution":{"observed_at":"2026-08-07T15:36:06.987699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.964565Z","title":"Loss aware post-training quantization,","venue":null,"work_id":"455591a0-e504-488d-a15d-a8f845e05e80","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.545529Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:226e59468eacafd853671c99e77f1bc89e461bbb3e5c3694311f82a6a5ea7b93","observation_id":"0475f67b-30fc-4443-97e9-829742ba1e62","resolution":{"observed_at":"2026-08-07T15:36:06.970339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.947853Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers,","venue":null,"work_id":"5bb8865f-84e0-47cc-9348-a20fa23b064f","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.551616Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:7273904e6e2e390d4984955569bee3b9c8950e40547d2a689c482a788bf7b3df","observation_id":"080915ef-394e-4e00-845d-b555b13a803e","resolution":{"observed_at":"2026-08-07T15:36:06.953361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.930666Z","title":"Up or down? adaptive rounding for post- training quantization,","venue":null,"work_id":"b95a70b1-0a20-463a-8f25-199269cbf29c","year":2020},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.556800Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:6fb233b58bcbf298b23157fa5bc7a09fe5427c149228b5d741d078bc76997f55","observation_id":"5e6e918e-5112-4acb-8998-657589850c16","resolution":{"observed_at":"2026-08-07T15:36:06.935823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T15:36:05.562492Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.562492Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:7b847ff70993aed731d85e2ef9c0b36cc812248e8239dfaa31febb2017050ef2","observation_id":"26777c0e-02f8-4ef8-8aca-08f2bc01fa26","resolution":{"observed_at":"2026-08-07T15:36:05.562492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.912038Z","title":"Awq: Activation- aware weight quantization for on-device llm compression and acceleration,","venue":null,"work_id":"7d4fe579-af91-4439-9bb7-a2f3a5832424","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.569140Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:2a219a08afd186aadfb3fc122ec64a066ff5e245fc954cb13a2a3f8cb03f936d","observation_id":"eb585fe7-2705-479a-84eb-424dbe2362c1","resolution":{"observed_at":"2026-08-07T15:36:06.918359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.889355Z","title":"Q-vlm: Post-training quantization for large vision-language models,","venue":null,"work_id":"0fcbcf48-b1ed-4d7b-9b2a-0e754ffdba8c","year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.575244Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:5957547eca1a6e0935b305718d84afcf339368339aab9ff58065a1c33351f550","observation_id":"d959deeb-80d8-4ca0-9b45-3fab8ec4f7a9","resolution":{"observed_at":"2026-08-07T15:36:06.895542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.871199Z","title":"Advancing multimodal large language models with quantization-aware scale learning for efficient adaptation,","venue":null,"work_id":"e6a876f7-1196-408b-a95a-b5c757d2e1e9","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.581813Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a343883232c8ddf00c999251d09a7a3e156bf2162475331199c3d32834fccdc0","observation_id":"d0470db3-9213-4550-b031-f30ff1dead43","resolution":{"observed_at":"2026-08-07T15:36:06.877051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.850796Z","title":"Reg-ptq: Regression-specialized post-training quantization for fully quantized object detector,","venue":null,"work_id":"addafee1-4951-46d9-8d8d-56c91a7734b3","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.588245Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:82a4eb6f092dd33fd63607485c5eb65bcf0df463076704e305580e7ae9cc8ca7","observation_id":"71c0371c-cbd3-4427-9d06-8d0ae17c2a4b","resolution":{"observed_at":"2026-08-07T15:36:06.857168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.827829Z","title":"Ptq4sam: Post- training quantization for segment anything,","venue":null,"work_id":"865b9cf2-ac0a-430c-9b7f-d2b44b7a56f5","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.594252Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:c6d7db2a5f1d1368081c9de12486104f1adb8efac1b3032b151114dabfdb5224","observation_id":"246f09ef-fe89-4379-8f6c-7cdabb71c9fb","resolution":{"observed_at":"2026-08-07T15:36:06.834265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-08-14T05:39:52.416140Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-07T15:36:05.600094Z","title":"Fp8 formats for deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.600094Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:3aba0cc20dca9bad80a74cbd977da194397846313dc8ea23e6a4d9b45874da21","observation_id":"16077d71-deda-48f9-8cb1-53adac73f52d","resolution":{"observed_at":"2026-08-07T15:36:05.600094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09975","last_updated":"2025-03-17T03:04:50Z","snapshot_observed_at":"2026-08-12T20:55:08.676157Z","submitted_at":"2025-03-13T02:21:39Z","title":"Faster Inference of LLMs using FP8 on the Intel Gaudi","version":3},"cited_work":{"arxiv_id":"2503.09975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.09975","snapshot_observed_at":"2026-08-07T15:36:06.318277Z","title":"Faster Inference of LLMs using FP8 on the Intel Gaudi","venue":"cs.AR","work_id":"dc768db7-9bdd-498f-a02b-1413bf76e54a","year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.606709Z"},"links":{"cited_paper":"/paper/2503.09975","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:d40bb470057f30d1e4133d005aac4f4c9e80859b49fab9e67ce35757a41cea06","observation_id":"1bd83e60-759d-4ada-924b-038855fe6362","resolution":{"observed_at":"2026-08-07T15:36:06.326317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.808440Z","title":"Fp8 quantization: The power of the expo- nent,","venue":null,"work_id":"dbfd661c-466f-424f-bb92-5155730ffa4f","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.613578Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:47253888ada05e2dbb6d73230708b72c16742d42facf17b3cede050c550482ce","observation_id":"838360a2-baa4-4155-99d9-7c9a44345f88","resolution":{"observed_at":"2026-08-07T15:36:06.814266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01070","last_updated":"2025-08-25T06:01:25Z","snapshot_observed_at":"2026-08-12T16:29:34.108900Z","submitted_at":"2025-02-03T05:26:22Z","title":"An Inquiry into Datacenter TCO for LLM Inference with FP8","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01070","snapshot_observed_at":"2026-08-07T15:36:05.619868Z","title":"An investigation of fp8 across accelerators for llm inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.619868Z"},"links":{"cited_paper":"/paper/2502.01070","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:6b95dfb157a52e44f9f236e123d7069d1b02d3eb8cf335a7d8f8a6f4aac19d3b","observation_id":"c798dbe1-7d59-4c39-bb16-ae3069122cd4","resolution":{"observed_at":"2026-08-07T15:36:05.619868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-13T12:12:37.645920Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-07T15:36:05.626348Z","title":"Fp8 versus int8 for efficient deep learning inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.626348Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:8bce598fb32e2c96bed32d242dbe6a7449cbd2eb9e83431cade1cf1a97eb1fb0","observation_id":"2eb5b9e2-2d15-4d7e-a109-12e46ba393d6","resolution":{"observed_at":"2026-08-07T15:36:05.626348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-13T00:12:52.272658Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-07T15:36:05.631849Z","title":"Qserve: W4a8kv4 quantization and sys- tem co-design for efficient llm serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.631849Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:042c88b4d5893cb45adaff7f23ed8f16ac0d851112b778a30a3033a49a2dccb2","observation_id":"737d520a-c7aa-464c-97e5-ec41adcffdce","resolution":{"observed_at":"2026-08-07T15:36:05.631849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07191","last_updated":"2025-07-07T17:42:19Z","snapshot_observed_at":"2026-08-13T14:55:20.001264Z","submitted_at":"2024-11-11T18:05:48Z","title":"The Super Weight in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07191","snapshot_observed_at":"2026-08-07T15:36:05.638811Z","title":"The super weight in large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.638811Z"},"links":{"cited_paper":"/paper/2411.07191","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:313d8df36b3eb5fcd9d4a7ce85e6752baca78e95387345954ca0c35a4fc1a1ab","observation_id":"2041b6a0-c748-49ed-bdc0-c59c99c7781a","resolution":{"observed_at":"2026-08-07T15:36:05.638811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.786712Z","title":"Smoothquant: Accurate and efficient post-training quan- tization for large language models,","venue":null,"work_id":"fb43f654-85ce-482e-b13b-0b01ad2d84b1","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.645160Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:13cfe3fbc79896d8d194cc8dc85751bbfebf2c3f8f49a6ca1e05f39d266d5d31","observation_id":"256a2434-d6c1-47b5-af54-542cc5f7bff8","resolution":{"observed_at":"2026-08-07T15:36:06.792801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-07T15:36:05.650647Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.650647Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f925c4eff69519ad538fa0a3e909c0f390bf1517fc063082a2dea26755382dcf","observation_id":"7ff6de07-f271-49c8-89c7-15423dd1ddcc","resolution":{"observed_at":"2026-08-07T15:36:05.650647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-13T11:18:21.844753Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-07T15:36:05.656359Z","title":"Squeezellm: Dense- 9 and-sparse quantization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.656359Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:64081c4d98f532ccfd921e10055572e74aeb73db6c52d49e461675f2a50ededc","observation_id":"776bbb39-0683-4ba8-a428-617b2fe31cc3","resolution":{"observed_at":"2026-08-07T15:36:05.656359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.766688Z","title":"Towards accurate post-training quantization for vi- sion transformer,","venue":null,"work_id":"fdbd2cd4-7966-432a-bfda-0c12b813ca8c","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.661934Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a81b62cb1c8aa63a460ebd7d253a8534a1acd48ce55bfd5949ccc324e5b79e4b","observation_id":"3930d6bd-754d-4e32-b8df-b762c1043d1b","resolution":{"observed_at":"2026-08-07T15:36:06.774110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.746801Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers,","venue":null,"work_id":"5ec68dc1-7eb7-42b8-8239-050c5b4656c6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.666862Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:d416a06df42d290dc21de47305d3bb20cff6c7d2cac03b6a53b4ebb81bfea79b","observation_id":"95cf1fa8-c207-4e47-bc0a-7d556ba4f0a5","resolution":{"observed_at":"2026-08-07T15:36:06.752996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05516","last_updated":"2024-10-08T02:02:35Z","snapshot_observed_at":"2026-08-14T07:24:19.123306Z","submitted_at":"2023-09-11T14:58:23Z","title":"Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05516","snapshot_observed_at":"2026-08-07T15:36:05.672891Z","title":"Optimize weight rounding via signed gradi- ent descent for the quantization of llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.672891Z"},"links":{"cited_paper":"/paper/2309.05516","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f794bbb701ed545bedb0dfe1b5ce7c36d2ef56e7912971007a291dcade590f52","observation_id":"6c4e8709-e7a7-4e5d-9709-47d47966f795","resolution":{"observed_at":"2026-08-07T15:36:05.672891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-15T10:44:06.141247Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-07T15:36:05.678322Z","title":"Omniquant: Omni- directionally calibrated quantization for large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.678322Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:4a357b87483edffe4cb29441df6f2072a643ac98aa08f858e6ad010b87281e5e","observation_id":"0f4a9bee-0eb8-4885-ac3b-a90dbc2e4367","resolution":{"observed_at":"2026-08-07T15:36:05.678322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.724178Z","title":"Half-quadratic quantization of large machine learning models,","venue":null,"work_id":"37a15501-8964-40e4-94b1-2a1d617e5cb6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.684564Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:65fcbfae561e945f910cfb429f21687b9eba9c919a9a5ae1babd058627bed096","observation_id":"288a4b30-0a7e-44a2-9498-3fe66a8649ad","resolution":{"observed_at":"2026-08-07T15:36:06.730280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.700558Z","title":"Pd-quant: Post-training quantization based on prediction difference metric,","venue":null,"work_id":"2e764107-d18a-4d64-ad74-61d2af4d6c90","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.690691Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:68403c2cf9ca0f7cb9fe15d5a7f29873de7c3631e5a6f57d5398e2d5ee04ba00","observation_id":"0acc76a7-1570-4324-9422-4a8600415e8c","resolution":{"observed_at":"2026-08-07T15:36:06.706490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.680133Z","title":"Pd-quant: Post-training quantization based on prediction difference metric,","venue":null,"work_id":"bd0e66f0-db9c-4a23-96af-a9f15e07f2a2","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.696624Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:1a6c4c40c4ebd90ee6d722ea840e61bfa2338d0879cb051c608818d8a4fb2e2f","observation_id":"93cd2ddc-5142-4fe7-b545-2e32eeb6e68b","resolution":{"observed_at":"2026-08-07T15:36:06.686680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.661243Z","title":"Optimal brain sur- geon and general network pruning,","venue":null,"work_id":"265fd449-79d2-4125-96dc-07b46fb3d455","year":1993},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.702137Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:e7250ef255312303e6f020289f703e5c9b7ead76ba137fe5a217559ab76ff4ef","observation_id":"1bc2262d-b2c5-4f0c-ba8e-28df625beb99","resolution":{"observed_at":"2026-08-07T15:36:06.667965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.641452Z","title":"Optimal brain compression: A framework for accurate post-training quantization and prun- ing,","venue":null,"work_id":"af12e96b-c823-4221-aaa1-8052957fca87","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.707688Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:0507ce87820c93fc201d54be6fbae7061e3f5f74ad83ab2d034f02be8e54e4cd","observation_id":"fa35d4cf-af9e-4a6c-b26c-467877ef1d27","resolution":{"observed_at":"2026-08-07T15:36:06.647598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.615628Z","title":"Ptq4vit: Post-training quantization for vision transformers with twin uniform quantization,","venue":null,"work_id":"331a51dc-97b5-4394-9f1d-f53b2266a613","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.715369Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:122ca4bd1b85b0433e006f332b53b51827f9748a82815ef33f94bdf60f557523","observation_id":"24f09a99-4a9d-4cae-bad6-bd6e87e8ce7c","resolution":{"observed_at":"2026-08-07T15:36:06.623799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09904","last_updated":"2024-07-31T07:35:42Z","snapshot_observed_at":"2026-08-12T23:56:12.905367Z","submitted_at":"2024-06-14T10:23:45Z","title":"QQQ: Quality Quattuor-Bit Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09904","snapshot_observed_at":"2026-08-07T15:36:05.720980Z","title":"Qqq: Quality quattuor- bit quantization for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.720980Z"},"links":{"cited_paper":"/paper/2406.09904","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:0ebc5cf31fc6cb68ffd33d1636902e064d3407bcc6435fec3b09b41d866e6d6c","observation_id":"f168e218-e86b-4e7b-932e-e33431ef6247","resolution":{"observed_at":"2026-08-07T15:36:05.720980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.595247Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":"721ac125-4bbf-4532-942f-c3e2defa49b6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.726742Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f7d0e65d927011b991351fd818e0f09761d1b7436149f7dd7554e4eadfb22b27","observation_id":"fd3c5138-7ee3-4af2-8310-3fa74fe23239","resolution":{"observed_at":"2026-08-07T15:36:06.601626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-07T15:36:05.731877Z","title":"Spinquant: Llm quantization with learned rotations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.731877Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:4632f1705cd2df7ca10094e025ed17dfb66bd7d81e43f3a81bd784ae5ce813b8","observation_id":"45deaeb0-6ad2-445a-a43a-de4b52f0b1e6","resolution":{"observed_at":"2026-08-07T15:36:05.731877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-07T15:36:05.737732Z","title":"Mas- sive activations in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.737732Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:cba41b6367aff50478e98d55b88d778c651b420295ac8fdffdd070235da787c3","observation_id":"6f2c8c5c-774a-4a46-9200-b00f149dacea","resolution":{"observed_at":"2026-08-07T15:36:05.737732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.575159Z","title":"Mmmu: A massive multi-discipline multimodal understanding and rea- soning benchmark for expert agi,","venue":null,"work_id":"d253b154-988c-4605-ae29-35feb4aaaf3e","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.743472Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:801ad51de464fa93431d8b88d329096a592d50ed009bd3c1e5d222a6471f2769","observation_id":"b8afbdc7-d703-48ec-8fb4-9b0bbc7b8aec","resolution":{"observed_at":"2026-08-07T15:36:06.581618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.555305Z","title":"Mmbench: Is your multi-modal model an all-around player?","venue":null,"work_id":"71880f45-0488-48cf-82f8-7c9d07968774","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.748996Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:d053c7a33c2261e4c6ee6e4319baa5340247603d8b6eedd25aa530cb418bcffb","observation_id":"4574bcbf-a4c9-4416-8eea-b5ec034b1866","resolution":{"observed_at":"2026-08-07T15:36:06.561697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T15:36:05.754358Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.754358Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a2831fa7074911d195325c135c3b8a27c969b0f9c450af4fa43947e574268c0e","observation_id":"3745ee05-ec80-4ae7-a844-0a136a981a5c","resolution":{"observed_at":"2026-08-07T15:36:05.754358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:36:05.760223Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.760223Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:c9c6b399e10d438fb0c948df6b2398b69ce3a92ebeca576d45d38eaf63a35043","observation_id":"00b31de8-d9bc-4270-b39f-07fc5ad2812a","resolution":{"observed_at":"2026-08-07T15:36:05.760223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.532343Z","title":"Vlmevalkit: An open-source toolkit for evaluating large multi-modality models,","venue":null,"work_id":"84c1751d-495d-4b0d-b1b3-68f52d49aeff","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.765099Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:e7308bb4b23858c1def01a238e773981b10994e1e1e0e14a87def25e3fa27278","observation_id":"42cebc4f-9923-4baa-be4b-2fc40dc95cfb","resolution":{"observed_at":"2026-08-07T15:36:06.539573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:36:05.771908Z","title":"Llama 2: Open foundation and fine-tuned chat mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.771908Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:2b0c2b2f0c17bd9a5b3a25b30fcad028d528027c0c2dc2ff4adf21dac82de4b5","observation_id":"4bfbd2ce-a4ad-4242-abdb-26744edb88a7","resolution":{"observed_at":"2026-08-07T15:36:05.771908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:36:05.778165Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.778165Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:9a85bdd57af54c7c3921446c06bc0892a256ec242fbde00d3666c0f209c6c7e1","observation_id":"7e06e537-d460-4808-8db1-67c7902ccab0","resolution":{"observed_at":"2026-08-07T15:36:05.778165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-07T15:36:05.783715Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.783715Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:94dcb0fb32218fa445416e79e14da71811912a854d66988ada21c090fc9cec46","observation_id":"6344a6fe-09f4-452f-8914-209142fd5ef1","resolution":{"observed_at":"2026-08-07T15:36:05.783715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:36:05.790299Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.790299Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:62e9765c02e95ed552594ab25a5baa2c22e8580ec87286f9dc69b43c51ca66f6","observation_id":"7c1037a0-f90d-49be-a677-3cf71978fae8","resolution":{"observed_at":"2026-08-07T15:36:05.790299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-07T15:36:05.797383Z","title":"Hellaswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.797383Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:412a11a4fefaec517842cdafbb366b69f778ab469d64662d3e28113b392577b4","observation_id":"2d12ea00-6193-4ffc-83d4-73c7f518e560","resolution":{"observed_at":"2026-08-07T15:36:05.797383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.509116Z","title":"Language models are unsupervised mul- titask learners,","venue":null,"work_id":"62f3365d-46f5-4ff4-bf81-c09504ffdee1","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.803578Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:fcb1e432224c47a0a467ee8e4136ac857fb8c893e0e736eae222c32387f91f17","observation_id":"bff160fa-db2b-4996-9a0b-bc3ed1d1035b","resolution":{"observed_at":"2026-08-07T15:36:06.517796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-14T15:52:43.138964Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-07T15:36:05.809663Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.809663Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:ed03e81cdf2f2b584469c46ff4f6e0e79b31d2817300eb7a0668cc07630f34c8","observation_id":"200b87c5-d284-4a8d-9322-28264c0cb5e2","resolution":{"observed_at":"2026-08-07T15:36:05.809663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T15:36:05.815524Z","title":"Think you have solved ques- tion answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.815524Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:bb52739e30ec48b904b2c9162e49e20800eb23088b21c300a407606fb5782d30","observation_id":"d74b1fd4-21b7-48a3-be62-12be5560fa0b","resolution":{"observed_at":"2026-08-07T15:36:05.815524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.489116Z","title":"Reason- ing about physical commonsense in natural language,","venue":null,"work_id":"0965ef9c-3398-4f90-a2f8-ae24a48c2ae3","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.821393Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:978013de4853ba6e76ecdb8b4d1f5071666bf5672c44020ae52efe7e2682db1c","observation_id":"773700e1-cc7f-484f-9068-9c7681b95810","resolution":{"observed_at":"2026-08-07T15:36:06.494418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-14T04:48:01.875703Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-07T15:36:05.826444Z","title":"An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.826444Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:29240d4b44fbe2955414d57f29332b2ac8eda3e4ffeef6790747774e0d3d9cb1","observation_id":"307dd09e-be6c-4d85-8b7f-2c63168013cf","resolution":{"observed_at":"2026-08-07T15:36:05.826444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-14T07:00:02.529732Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-07T15:36:05.831954Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.831954Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f1dc4c86861b7d355c128e3851dc3a6747ef5adfa8cadafabe14d4aac22c6137","observation_id":"d2267353-2366-4298-b1d5-bf7637c81f46","resolution":{"observed_at":"2026-08-07T15:36:05.831954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.468276Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":"c0af80e9-ba43-431f-abfb-b66fc5640ff2","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.838070Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:4dd0669d42233fe1fead99cdfe6ee81f9ea803c832b8f6780db81340f95b7607","observation_id":"14025751-8455-4e36-a77e-90ac1c071fa5","resolution":{"observed_at":"2026-08-07T15:36:06.476599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.448379Z","title":"Semantic parsing on Freebase from question-answer pairs,","venue":null,"work_id":"e4388942-5098-49c6-be93-500534fb8616","year":2013},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.843955Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:278e9e7748e9575a7061cfaaf71f9422335349c1d9e25ab9543030f1af83b563","observation_id":"3973de9a-8f95-417c-9b88-ddac976c38c2","resolution":{"observed_at":"2026-08-07T15:36:06.455038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T15:36:05.850300Z","title":"The pile: An 800gb dataset of diverse text for language modeling,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.850300Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:49210d6d646e7295678cef0f9ec1887988c17e84ff5e71820f447e64d1f609e6","observation_id":"82a53ce8-7103-4aba-baf1-5aa3ba9503b1","resolution":{"observed_at":"2026-08-07T15:36:05.850300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2505.14638."}