{"as_of":"2026-08-18T17:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:840a2e1eadc36bdf504becf47d8900e128493ba24694361824beef3d2b83efe6","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T06:56:51.829741Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:38.647231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T00:49:18.139563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-08-06T14:45:38.647231Z","title":"Mixllm: Llm quantization with global mixed-precision between output-features and highly-efficient system design","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18073","last_updated":"2025-07-24T03:55:19Z","snapshot_observed_at":"2026-08-15T10:44:46.623181Z","submitted_at":"2025-07-24T03:55:19Z","title":"Squeeze10-LLM: Squeezing LLMs' Weights by 10 Times via a Staged Mixed-Precision Quantization Method","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:38.647231Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2507.18073"},"observation_digest":"sha256:5ac52f41ee7f8ea749d759710fc443422ddd2584c2505aaf06bbf882f07b43be","observation_id":"2485f3ff-a7bd-485d-a157-0c9e71abb003","resolution":{"observed_at":"2026-08-06T14:45:38.647231Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":"2412.14590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-04T00:49:18.139563Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","venue":"cs.LG","work_id":"c4d7fa5b-fdc9-48d3-908e-c3214b7aa67b","year":2024},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-14T18:57:19.754744Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:6b9a2c5116ec40017996615c75e16094802a42c1b31290c1c92c3ecc9203a7eb","observation_id":"f7421b5f-a3f4-4fec-90df-40557947d13d","resolution":{"observed_at":"2026-05-20T05:23:03.651022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":"2412.14590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-04T00:49:18.139563Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","venue":"cs.LG","work_id":"c4d7fa5b-fdc9-48d3-908e-c3214b7aa67b","year":2024},"citing_paper":{"arxiv_id":"2606.19558","last_updated":"2026-06-17T19:59:26Z","snapshot_observed_at":"2026-08-17T17:03:30.474296Z","submitted_at":"2026-06-17T19:59:26Z","title":"Displacement Is Not Direction: Evaluating Fidelity Metrics for Quantized LLM Deployment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T20:58:33.720040Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2606.19558"},"observation_digest":"sha256:82f44977f723a0bb5d5ccd7dbe14d05ccce90e8416424620dba3256da94ecf42","observation_id":"357fa1c1-a011-493d-b621-bca2b712eb82","resolution":{"observed_at":"2026-07-04T00:49:18.141527Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-12T06:20:07.112455Z","title":"MixLLM: LLM quantization with global mixed- precision between output-features and highly-efficient system design","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02893","last_updated":"2026-07-03T02:42:04Z","snapshot_observed_at":"2026-08-17T08:01:33.845481Z","submitted_at":"2026-07-03T02:42:04Z","title":"Variable Bit-width Quantization: Learning Per-Group Precision for \"Bigger-but-Smaller\" Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T06:20:07.112455Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2607.02893"},"observation_digest":"sha256:af3999c9cc619985015b2fba1136116eeec409ea082cc740c4bfb926ddb33c03","observation_id":"58e27d8e-bafb-43ad-9522-5e1bd0616350","resolution":{"observed_at":"2026-07-12T06:20:07.112455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14590/citation-record","integrity":"/paper/2412.14590/integrity","json":"/paper/2412.14590/citation-record.json","paper":"/paper/2412.14590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cffb2791-894b-47a1-bb41-43e217b5916e","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:d1e45d9f99e020be2441a2b28a24cd29f0ae490bc19a49d440469b920a59e25b","observation_id":"37e62c2a-8bcb-451e-ae7e-285763dcdce8","resolution":{"observed_at":"2026-05-23T06:57:41.068343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":"53c016af-dc6e-4a80-aded-629daab8ae9b","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:219355a74a871a3604e0d11d0cdc5f0fc4303c0fba2886ba188b4eab5488f973","observation_id":"80233a95-9765-431e-8da9-c8aec65df4f4","resolution":{"observed_at":"2026-05-23T06:57:41.060729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-16T14:04:57.666315Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":"2404.00456","doi":"10.48550/arxiv.2404.00456","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Croci, Bo Li, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":"arXiv (Cornell University)","work_id":"b0bace20-bbcd-45d2-99df-9bf26e089b47","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:df4434cd6bd6f3785d4b5b72231963bdc7ffd370cfe4b8e5a40b0803e1179b02","observation_id":"3d05d206-a179-4663-894f-efe5f138528e","resolution":{"observed_at":"2026-05-23T06:57:40.303236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-14T20:38:11.300775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-14T20:38:11.300775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3fb2d45-2463-4d82-b167-51147a351af7","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:21e64dfac1823f70fd1aea9bb31bd2ff1515c80a423f6339f2c63a81bc64be79","observation_id":"a79ce376-f19e-4d98-b145-ba71dbc37eb5","resolution":{"observed_at":"2026-05-23T06:57:41.066006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autogptq","venue":null,"work_id":"0d92ccb1-93df-43e3-9c0e-5a38a5c8f650","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7a40e133c9231a51b05062e9e033e5f80a7d82f61b747addd25c0051d19fde65","observation_id":"9e2c2e61-c1ba-4ead-b6a2-fa5ad332ef80","resolution":{"observed_at":"2026-05-23T06:57:41.063348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A systematic classification of knowledge, reasoning, and context within the ARC dataset","venue":null,"work_id":"4c969357-f4fd-44fe-a5d3-32c976a834bb","year":2018},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:e1650e3b28b310a6633e3f6cb1cd05fbc16078748a3a5981d83ff51f6f485cc8","observation_id":"b435e830-b05f-4aed-a269-f03613b4b5c5","resolution":{"observed_at":"2026-05-23T06:57:41.076269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":"2303.12712","doi":"10.48550/arxiv.2303.12712","metadata_source":"pith","pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","venue":"cs.CL","work_id":"a23cfe92-7f7c-424b-98d4-b386a83002fb","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:517196ef28b3c62094f34561608eeea3b6955f4b62290663ba477e34067f52c7","observation_id":"328dbda5-aab3-4f19-9012-b69289a0ed10","resolution":{"observed_at":"2026-05-23T06:57:40.294413Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quip: 2-bit quantization of large language models with guarantees","venue":null,"work_id":"8ed4da23-d795-4bb5-9d5a-ef1276c51e7f","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:a91d80472ff70dfac4a1cceb27fb2d821f247da9a3502709906da7fc394b64d9","observation_id":"cf5f2a50-3df0-4687-92a0-c22a5f281592","resolution":{"observed_at":"2026-05-23T06:57:41.073634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4529776d-a940-47ac-b870-ef2d42693d1b","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7a79915abd336525bb04b14f9053dd1caff6f459b3bb0c58e8dfd9d5af2918d1","observation_id":"44d0ce27-b02e-4ede-9552-4d15ae1f48d9","resolution":{"observed_at":"2026-05-23T06:57:41.071072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":"2208.07339","doi":"10.18653/v1/2020.findings-emnlp.314","metadata_source":"pith","pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","venue":"cs.LG","work_id":"98201f98-f4e5-4d1c-9ed7-b795e3c8f76c","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1fa2f22db4a419c5afc7026dac9c3191fb6bb31cb37b69ee62459f999c05449c","observation_id":"b567af91-f51d-4045-b786-727f64249083","resolution":{"observed_at":"2026-05-23T06:57:40.298346Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spqr: A sparse-quantized representation for near-lossless LLM weight compression","venue":null,"work_id":"acf7ad51-53ae-4706-b8c0-99200186b7fa","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:8330c5b137cc6aabbc0762ac0227de3e234a87d69409aa598977f0bfdb413079","observation_id":"36e87cfe-e0b8-4882-80f6-23765d942231","resolution":{"observed_at":"2026-05-23T06:57:41.133770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"1a35cad2-4590-453f-9a97-642790da8a95","year":2019},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:521ecab6f2bcc7e714ee35133d02ec8d1f0e04cf2b57ad8cd5a7a3f55cbfffa9","observation_id":"5dd118ca-c11b-4669-9c0a-5f7cfc8f4d10","resolution":{"observed_at":"2026-05-23T06:57:41.136046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal brain compression: A framework for accurate post-training quantization and pruning","venue":null,"work_id":"65d64961-1427-41ff-b7ba-f19b3bc49650","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:8ab7cd8c39bfc2cf2f19318f9b81901e31bede3d6895b1253f4ab48aac66730b","observation_id":"625e4c1c-2724-4088-9700-81c4b2dfb807","resolution":{"observed_at":"2026-05-23T06:57:41.131468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:c0c97946565bd3d53bc6f7123af4c0809adaf12cd99bb45b753fbed96cec2227","observation_id":"7d4685eb-7449-43f7-8289-f7c56f092f09","resolution":{"observed_at":"2026-05-23T06:57:40.248123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:15.265514+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:15.265514+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":"4f7e8b7b-9bd8-4bd1-b6ce-0df501e41450","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:5d0b05e0f85b3bbff5647d835132b29a0f9a71b1c1e0cfe809736561bd4e9cb6","observation_id":"c7e285a5-b683-40a4-abc5-450fa0e3c48c","resolution":{"observed_at":"2026-05-23T06:57:41.145836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-16T14:06:10.494270Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":"2403.17887","doi":"10.48550/arxiv.2403.17887","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The unreasonable ineffectiveness of the deeper layers.arXiv preprint arXiv:2403.17887","venue":"arXiv (Cornell University)","work_id":"93761c3c-6e0f-41d0-a8ea-17b8d13c3387","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1aca3e35ff176837db7284306c268b78d0badddc605a9100977cc6804f36ee07","observation_id":"15924654-a6e9-4bb0-a154-96407715c746","resolution":{"observed_at":"2026-05-23T06:57:40.285477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen2.5: A party of foundation models","venue":null,"work_id":"bd478a0d-7741-4f6b-b8d3-a747e57c8aa5","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:095b4083ee2c1d4f2197de3c8796cbff86b7a502ed329dc2f3a8e529209fbe55","observation_id":"3c2d872c-6dc6-4506-bb6f-d8a2b6a34909","resolution":{"observed_at":"2026-05-23T06:57:41.127122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stork, and Gregory J","venue":null,"work_id":"0557339e-c26f-433d-86e8-934ae050a827","year":1993},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:9891d257e09bdbfe9c15dddaf35be869ec6be5a94d0c2a962e09f3688bc7a4c3","observation_id":"2b793956-7161-48b8-8df3-de9b75fb91c2","resolution":{"observed_at":"2026-05-23T06:57:41.129322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08671","last_updated":"2024-01-09T06:49:40Z","snapshot_observed_at":"2026-08-16T14:47:07.109022Z","submitted_at":"2024-01-09T06:49:40Z","title":"DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference","version":1},"cited_work":{"arxiv_id":"2401.08671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.08671","snapshot_observed_at":"2026-07-04T11:59:50.582581Z","title":"Deepspeed-fastgen: High-throughput text generation for llms via MII and deepspeed-inference","venue":null,"work_id":"d970e106-3cea-4d01-88f2-f4ffc759b0da","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2401.08671","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:75eb04107ca4e6d01d50e8b0ecf9f7da0cae75fd9b49376089379042a703e1d6","observation_id":"0c8721d8-0d08-4ff2-ad35-51587c21c02f","resolution":{"observed_at":"2026-05-23T06:57:40.262382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:4f5a7b33b511ecf5b5496b5940255ce76a32f2ae3255f1e64b85281d30434096","observation_id":"dd189893-7f68-4131-ae81-4c7c4203e583","resolution":{"observed_at":"2026-05-23T06:57:40.289405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T22:08:12.954417+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"2252e356-f698-40d8-b6d7-732cf3293e7d","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:f595b52ffbc0c9d54fd659d9a5f7d6869b0b34cf2d3890fc312ef9715bd1adee","observation_id":"fccbe28f-94f4-442d-b8c0-fcc1435bc337","resolution":{"observed_at":"2026-05-23T06:57:41.140885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04330","last_updated":"2024-11-30T02:42:31Z","snapshot_observed_at":"2026-08-18T06:31:48.022505Z","submitted_at":"2024-11-07T00:10:10Z","title":"Scaling Laws for Precision","version":2},"cited_work":{"arxiv_id":"2411.04330","doi":"10.48550/arxiv.2411.04330","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.04330","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spector, Blake Bordelon, Niklas Muennighoff, Mansheej Paul, Cengiz Pehlevan, Christopher Ré, and Aditi Raghunathan","venue":"arXiv (Cornell University)","work_id":"988bd25e-4ff9-47cd-89f4-f30e112706ec","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2411.04330","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:34c8bf84874bc99bf4ab0790dd9bb99b57de210bc9c4ebe50e63367108533391","observation_id":"7ebcf684-9784-4b84-b16c-b8a1dc19ec57","resolution":{"observed_at":"2026-05-23T06:57:40.270961Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Joseph Hassoun, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"72f21cec-3f3e-4cc0-afc7-acd7b67584fa","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:2c3df7b9f32162f02dfd3b60a3b6015eddebf0d83cc9f785cfa771c186632cbf","observation_id":"5d490239-93d0-46b6-87d2-8ccca3958243","resolution":{"observed_at":"2026-05-23T06:57:41.107546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denker, and Sara A","venue":null,"work_id":"f639513c-78bb-4bbc-add0-31a3b8f35003","year":1989},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:81b7769259eaebadf2f15559f8f0c0eea7c27f1898d02f3a615173b19614d49f","observation_id":"77a1fb6c-d6b1-455a-9e77-e80c3881cf1a","resolution":{"observed_at":"2026-05-23T06:57:41.124803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWQ: outlier-aware weight quantization for efficient fine-tuning and inference of large language models","venue":null,"work_id":"191960e8-5a26-4065-8cb2-318a5fd7ac5a","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1fab7b5aa7a808682e9c1a160fbde0c7b645e9323df142484e5425e3950c5aa1","observation_id":"46af8c01-ddc2-46c9-8737-68ebd542122a","resolution":{"observed_at":"2026-05-23T06:57:41.117685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AWQ: activation-aware weight quantization for on-device LLM compression and acceleration","venue":null,"work_id":"b6b5c58d-fce8-4be1-9edb-2499f9f9bdfa","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:4322d7ac2f581065790ec9c8c8405a57c57e9be210d803a54a6504e3efe83052","observation_id":"96ff1376-e8d0-45d4-bd22-8ccefc5e0f74","resolution":{"observed_at":"2026-05-23T06:57:41.119902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-16T13:54:34.341970Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":"2405.04532","doi":"10.48550/arxiv.2405.04532","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qserve: W4A8KV4 quantization and system co-design for efficient LLM serving.CoRR, abs/2405.04532","venue":"arXiv (Cornell University)","work_id":"c210d46c-8391-4e16-ac58-5568cd278fc1","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:adb37bf572159185f2eca5dacaf539a7143c1f38da55bd5e0da5dc54354e7a16","observation_id":"25cf0132-d301-4547-b25e-42fbae3358b2","resolution":{"observed_at":"2026-05-23T06:57:40.275531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:49:58.779354+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:49:58.779354+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":"2405.16406","doi":"10.48550/arxiv.2405.16406","metadata_source":"pith","pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SpinQuant: LLM quantization with learned rotations","venue":"cs.LG","work_id":"489855f8-bd1c-4c87-a334-f6ab27d6707d","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:05d941838e155a589e332e4a61be205c32c830c6bbabb6aa8c2caa057bce3b22","observation_id":"5cc3f7dc-0408-44ef-8b6a-a465057f4807","resolution":{"observed_at":"2026-05-23T06:57:40.266681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affinequant: Affine transformation quantization for large language models","venue":null,"work_id":"5f8b063e-9e9c-493b-9407-934278b1bf33","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:405dd20085036447c925e8bd0c8bd0495db428b4c918c944f7942d32f4119398","observation_id":"082821a9-6969-4256-a07e-71703f945bdf","resolution":{"observed_at":"2026-05-23T06:57:41.122100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-16T14:12:14.696997Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":"2403.03853","doi":"10.48550/arxiv.2403.03853","metadata_source":"pith","pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shortgpt: Layers in large language models are more redundant than you expect","venue":"cs.CL","work_id":"195a45aa-5b87-4058-97eb-f08eca8ee8c6","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:8b22045c9c22e6b92b3097979d123a67e180d6f96f38527bccf3c59f90c70319","observation_id":"c5fa5e41-febb-4a3d-acb1-bc99b492e866","resolution":{"observed_at":"2026-05-23T06:57:40.238529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"11924862-857f-44a3-8657-5e0a636db68c","year":2017},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:f555093ffd3617cf570e332a97102f4c145ded3ad0b63c7c20432b74db451ce4","observation_id":"27706596-3357-4875-9fb2-efb2ad40f6f8","resolution":{"observed_at":"2026-05-23T06:57:41.109864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"db8c0e02-6880-4fbd-b6cd-71d5a8aacf70","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:ec5bfb0dc7d28905c8601e756454616c9c011f91d2d589ce304bf211a94035c7","observation_id":"5925bd4b-8abd-4459-8de0-e2626acedd48","resolution":{"observed_at":"2026-05-23T06:57:41.138711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf33b586-cf27-4ff6-9ad1-9036725ec4fe","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:511b07d937cfa51ad782a5d660ac0122374502379050a23f801ad76b4826ca52","observation_id":"7ee67852-e4db-4291-b213-f86024dfce4a","resolution":{"observed_at":"2026-05-23T06:57:41.112699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"345554b8-f956-42a9-9516-6ff1003ba5c0","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7fcc97f5530df40dbeb75ceda4faf034ed5dffea15983b7d3621eec537422daa","observation_id":"24699ae9-ba64-4717-8032-0503701a09f8","resolution":{"observed_at":"2026-05-23T06:57:41.115047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4abfd228-83d1-43ff-8f42-05be6b8f6eda","year":2020},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:5aad106ba46f4eb733b7d8b8dddd20ddb923528c5c653b2fa3f96266bdecbc8c","observation_id":"70aa6d0d-76cc-418b-9d3e-b091e345afaf","resolution":{"observed_at":"2026-05-23T06:57:41.105230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":"2311.12022","doi":"10.48550/arxiv.2311.12022","metadata_source":"pith","pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":"cs.AI","work_id":"9e2a976b-f5ad-4aee-af5c-243fe0fe75d2","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:fc778d998264b137fa17c927bb87c66c1f822bed4ba67ffd29719ce54d294aea","observation_id":"df2d04e5-ba55-4ded-9db7-d4e2e52ad99f","resolution":{"observed_at":"2026-05-23T06:57:40.233060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":"ec9d0af3-9cdb-4fde-8899-49b925c12493","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:03eaff93436e5c223519302263d8f1b511103111aaa83a4adc30aec4bd60ea44","observation_id":"150ed859-5ba6-42ea-b95d-902aab744314","resolution":{"observed_at":"2026-05-23T06:57:41.100063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Musr: Testing the limits of chain-of-thought with multistep soft reasoning","venue":null,"work_id":"44136783-f25d-4dba-a343-16e0053aff4e","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7acb9d5edfb0a667c94ac2dd38868c8fb76302d6cc2ed92a231f4a1c120ef1df","observation_id":"9a916006-04de-4242-a580-cce8adaaf96f","resolution":{"observed_at":"2026-05-23T06:57:41.097254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Le, Ed H","venue":null,"work_id":"0af6f096-4adb-4c5b-b092-c7a1a9771794","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1d097279a32b4c65fb090044376346c2db3d2497a1a5bbd893e622db959e0ed8","observation_id":"9ab5c030-5907-41f6-9520-ca5bbb367aad","resolution":{"observed_at":"2026-05-23T06:57:41.102699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tensorrt-llm","venue":null,"work_id":"eb3a4f3e-4ef1-4a1a-bf35-ba65e6e439df","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:07d9df83e466f0793b06b2410e4e1d012831bb5cd932e451ec1a44a7ea5a49d9","observation_id":"1af3be82-8754-4986-9e91-b642720089cf","resolution":{"observed_at":"2026-05-23T06:57:41.091846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-17T13:17:07.963143Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":"2406.01574","doi":"10.1145/3711896.3737413","metadata_source":"pith","pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","venue":"cs.CL","work_id":"3c028052-035a-4c22-b80e-3046edb44adc","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:fc4159f5b80040c3d0ca92d4f5350008621b7db53039d6659abd7dfee50dde8e","observation_id":"14bf5fc2-f624-4d6f-8bad-89df8cbd4141","resolution":{"observed_at":"2026-05-23T06:57:40.280362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08583","last_updated":"2023-12-18T05:08:23Z","snapshot_observed_at":"2026-08-18T08:36:44.045833Z","submitted_at":"2023-12-14T01:06:37Z","title":"ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative Tasks","version":2},"cited_work":{"arxiv_id":"2312.08583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.08583","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero- quant(4+2): Redefining llms quantization with a new fp6-centric strategy for diverse generative tasks","venue":null,"work_id":"06af1687-0281-4f80-9aad-d534be167f0c","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2312.08583","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:543788a57fb4d14a9a00b2b5264686ae3ddebda3f18499360c3d523939b4dace","observation_id":"eed79741-d8c4-4379-8170-d62df4d12977","resolution":{"observed_at":"2026-05-23T06:57:40.258320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flash-llm: Enabling low-cost and highly-efficient large generative model inference with unstructured sparsity","venue":null,"work_id":"11bbbc76-1152-40d5-bc1b-d9d0996fdef1","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:84421fe813f16febbc47c88ff67e876c657f6e6099cfff1ed2587d7c21cc2703","observation_id":"76c4fb00-95ce-4142-b113-fc6415d154b3","resolution":{"observed_at":"2026-05-23T06:57:41.094814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quant-llm: Accelerating the serving of large language models via fp6-centric algorithm-system co-design on modern gpus","venue":null,"work_id":"1dbb937e-5235-481b-a0ae-6c47d28bc089","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:5b9a108fbdc04d4d131fe6e45ae064d52b2de240ec3683432572bae2d47017bd","observation_id":"a272b44b-2ee9-4610-80eb-f1e7cca57fee","resolution":{"observed_at":"2026-05-23T06:57:41.143164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"96f9952a-c8f5-433b-a986-76c623fecb4f","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:bc09907dafee6a5261a81d7ae2cf90fdc5a480607b6436310234a1bb38edc044","observation_id":"852e474e-3a66-475d-af0f-0d40db242d5b","resolution":{"observed_at":"2026-05-23T06:57:41.087377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers","venue":null,"work_id":"1e6ffbbb-2769-491a-beb8-3bd86c3b80ca","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:f66ac7d59e72e44bd2f91f7f81513e20bf490600003d784309ca9c08252be236","observation_id":"b98ecc84-49b8-424c-806e-381e79472077","resolution":{"observed_at":"2026-05-23T06:57:41.084338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orca: A distributed serving system for transformer-based generative models","venue":null,"work_id":"ab8fc7f5-2e3e-427a-a113-9f17fccb4614","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:e71863d4e711c0ca5141eb2e4626f1f3e25044e34feb05f08960deae9dd0dcdc","observation_id":"06da1fc8-e47f-4710-8f4f-da7a2c3af0d9","resolution":{"observed_at":"2026-05-23T06:57:41.089673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01089","last_updated":"2023-05-17T10:07:33Z","snapshot_observed_at":"2026-08-16T15:43:09.896060Z","submitted_at":"2023-04-03T15:46:15Z","title":"RPTQ: Reorder-based Post-training Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":"2304.01089","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.01089","snapshot_observed_at":"2026-07-04T20:00:08.944266Z","title":"RPTQ: reorder-based post-training quantization for large language models","venue":null,"work_id":"b931b4e1-c0f8-42b7-b4ac-e82847daa65c","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2304.01089","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:89ea7b7f4bb9c6bec1801ca4824911d875008848169970441a69e2bee3f75089","observation_id":"f4de0dba-4110-4ca8-9826-474856e95ec3","resolution":{"observed_at":"2026-05-23T06:57:40.243433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hellaswag: Can a machine really finish your sentence? In Anna Korhonen, David R","venue":null,"work_id":"28240578-c0c5-438c-83ab-01801b3ae2eb","year":2019},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:56b184356f84c8e99c46e35221b035b5c0fa077fdf723ea2034608bb98dc98cd","observation_id":"1c153e90-38a1-464b-9575-64af6d836d91","resolution":{"observed_at":"2026-05-23T06:57:41.079285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Atom: Low-bit quantization for efficient and accurate LLM serving","venue":null,"work_id":"6b827396-f667-47d5-a8d9-f7c750542972","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:9451671fc54dd81d981418d449fe59c18e498a6dc5c32ef75fee8574d876e709","observation_id":"288a7325-3656-4722-bda6-b4afa6948d63","resolution":{"observed_at":"2026-05-23T06:57:41.081983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03594","last_updated":"2026-04-22T15:33:51Z","snapshot_observed_at":"2026-08-17T14:15:25.018905Z","submitted_at":"2024-11-29T05:57:37Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","version":3},"cited_work":{"arxiv_id":"2412.03594","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03594","snapshot_observed_at":"2026-07-02T17:27:14.639995Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","venue":"cs.CL","work_id":"cc16229c-90d6-4f31-95b8-37dd36ca157c","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2412.03594","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:bdeb65193ed98970929bd377d7920285dacd8e8e4f31c779a0b6df3b6f59f4f0","observation_id":"3c7fae06-d6b4-4e1a-8f53-58f68161af7f","resolution":{"observed_at":"2026-05-23T06:57:40.253161Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T01:35:40.607992Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":7,"verified_exact":14,"verified_fuzzy":28},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 4 inbound Pith citation observations for arXiv:2412.14590."}