{"as_of":"2026-08-10T06:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93f5b6a9790985458cbf170275b412138e313d530a48922f70edf869a8646f42","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:08:29.799420Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:38:11.071221Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:31:26.282151Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"cited_work":{"arxiv_id":"2507.16933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16933","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Esser, Jeffrey L","venue":null,"work_id":"99049a18-b8f5-4de7-810c-40d71d077650","year":2025},"citing_paper":{"arxiv_id":"2605.09425","last_updated":"2026-05-10T08:56:08Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T08:56:08Z","title":"AtteConDA: Attention-Based Conflict Suppression in Multi-Condition Diffusion Models and Synthetic Data Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T02:38:11.071221Z"},"links":{"cited_paper":"/paper/2507.16933","citing_paper":"/paper/2605.09425"},"observation_digest":"sha256:2ea6e26579363b172ce198f5c55ed847647c0bc1dc56b832b4a02a5c7c1b47f5","observation_id":"b227dcf7-2a16-480c-8cdd-fd94f39f1e9f","resolution":{"observed_at":"2026-05-12T07:31:26.284793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16933/citation-record","integrity":"/paper/2507.16933/integrity","json":"/paper/2507.16933/citation-record.json","paper":"/paper/2507.16933"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:33.151187Z","title":null,"venue":null,"work_id":"34f058a3-7b66-4545-b823-904521a115ed","year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.102850Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:7b7e9cd83b9e65b3d75b518334d58d30e3b8d55c5e14a95f68d29dbedda346cd","observation_id":"5baac5d1-5fd9-4271-8ee8-bb50732ab57b","resolution":{"observed_at":"2026-08-06T15:08:33.301777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:32.844340Z","title":null,"venue":null,"work_id":"aa1a5340-59c6-4365-8658-ad00bae446d4","year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.155176Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:b43aa3db9ecdc1a47245a2da34ab9335373cc7d9795ddc6821950a4d556323f7","observation_id":"b7837cf5-cf70-47a6-9c0e-ca5cb06516b2","resolution":{"observed_at":"2026-08-06T15:08:32.987585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T15:08:26.301138Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.301138Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:eb73c02515594a08ff6e98b344e6cdbda4ea934ee4266cebc187a48a3d63505e","observation_id":"a790008b-46fd-4a59-ac4a-69a8f4706e9e","resolution":{"observed_at":"2026-08-06T15:08:26.301138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-06T15:08:26.413524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.413524Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:9a92ebae00927933f48bc5745a642c620a7dbd5715d673988a5df40c97c728fa","observation_id":"9bf823a9-ad89-4c39-99d7-368d25843d7f","resolution":{"observed_at":"2026-08-06T15:08:26.413524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-08T01:47:51.652242Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-06T15:08:26.568508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.568508Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:70595b99ad250cfb8b78903d3bb72c2caeb299baea4fe41d7b7bcf688e781b15","observation_id":"fd84d796-2cf5-4b7f-8e53-5a75ae456c08","resolution":{"observed_at":"2026-08-06T15:08:26.568508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:32.625016Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R \\'e","venue":null,"work_id":"6c4520a6-12e5-4ac8-8833-f99555b960eb","year":2022},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.717618Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:1e3bfb66bd88915196f640db23d410fa4bd57a5a61dea67fece8a74214791016","observation_id":"c296ec80-830a-4812-b5ae-1a6d519a41d8","resolution":{"observed_at":"2026-08-06T15:08:32.690384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10631","last_updated":"2024-02-16T12:27:15Z","snapshot_observed_at":"2026-07-06T17:31:08.762955Z","submitted_at":"2024-02-16T12:27:15Z","title":"BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10631","snapshot_observed_at":"2026-08-06T15:08:26.859827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.859827Z"},"links":{"cited_paper":"/paper/2402.10631","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:dca70d0cb6d6d5fec4ef1a536b1bf51adac6052b085e7f1d32c9abfc9e9f48fe","observation_id":"8f314e75-ca3b-447b-9648-af25be343cd5","resolution":{"observed_at":"2026-08-06T15:08:26.859827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:32.352459Z","title":null,"venue":null,"work_id":"03b9c5fa-5c1b-499e-bceb-8c09f02aa62d","year":2019},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:26.982294Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:aff042ef3ff21fa68d780fbf981bb5dad52d216b5aed00de45a20a1f2582f537","observation_id":"c9a89695-b5ca-400c-b104-94990150d472","resolution":{"observed_at":"2026-08-06T15:08:32.496434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-06T15:08:27.101492Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.101492Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:4072b0480d3090702e65904d98d4e806d1e36a7e21c3963eec302a1b2218181e","observation_id":"fdb6a6e9-43eb-4baa-b7f4-a187957cefe4","resolution":{"observed_at":"2026-08-06T15:08:27.101492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:27.217357Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.217357Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:201b0755667d3c34197847671c2502fdd4c86902476a847164f158569a3940e0","observation_id":"2b4fe852-b01c-4541-8072-0ee8f6b4f777","resolution":{"observed_at":"2026-08-06T15:08:27.217357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T15:08:27.368246Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.368246Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:138b3940b5422a4ecd0fae5c7058382fecbcaca1283b1ed53cd02ab7b368c0fa","observation_id":"3d87b40c-8c32-4e05-94ea-bea2f0f8b03d","resolution":{"observed_at":"2026-08-06T15:08:27.368246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:32.034474Z","title":null,"venue":null,"work_id":"ff0d19b2-409b-4e08-af40-b583162f58ea","year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.480150Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:0c99f309c52c8684a2041adb261e178bc87d8bc8b37a464032eff1fa6faf8d50","observation_id":"79f4bc61-c53a-47b4-9e38-511059cd917d","resolution":{"observed_at":"2026-08-06T15:08:32.227892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:31.757880Z","title":"Sft trainer — trl documentation","venue":null,"work_id":"ed3c4cf3-35aa-4c4b-ae70-7b725ac14589","year":2025},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.570609Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:44626cfcf16a1b87528e9067874952ea6ea3c7c9ff0716a5b95693239f313190","observation_id":"f209ca72-dfb3-4a03-a87c-73965a29ea66","resolution":{"observed_at":"2026-08-06T15:08:31.886610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-08T12:58:42.430328Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T15:08:27.751884Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.751884Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:30d3713deae189b48c7828ba07677a3dd7299de29fed7b39a9b22659a86ed626","observation_id":"1fcfa5a1-2395-4d70-85a3-0cc4378b5a08","resolution":{"observed_at":"2026-08-06T15:08:27.751884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11055","last_updated":"2025-06-04T01:15:49Z","snapshot_observed_at":"2026-08-06T14:52:52.028018Z","submitted_at":"2024-09-17T10:31:37Z","title":"Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11055","snapshot_observed_at":"2026-08-06T15:08:27.899104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:27.899104Z"},"links":{"cited_paper":"/paper/2409.11055","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:bc4a1ba941cff1641b6ec89f2f026df9811278841a8caa4663c0239b5d63b349","observation_id":"3ed256d7-a068-4937-89fa-bdd3fa7edddd","resolution":{"observed_at":"2026-08-06T15:08:27.899104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:31.377972Z","title":null,"venue":null,"work_id":"cc1351bb-89a1-4f03-ae4d-e0ce4a4cb696","year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.009238Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:6199dedda3ac2342338e02a2448a435c909f4781009b82b3446040f3763d8fd9","observation_id":"8badd7f2-ff3d-435e-a3a0-49886357854a","resolution":{"observed_at":"2026-08-06T15:08:31.537278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T15:08:28.125268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.125268Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:150098e9ab9c19b8f4f5cb7fcf34fd62d3b5ef354aab5784627ff723c62123b5","observation_id":"b814e3ab-99ec-4300-aa5e-a2060109a7fe","resolution":{"observed_at":"2026-08-06T15:08:28.125268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-06T15:08:28.214739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.214739Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:66cdc3fd94a071197ee6556f5667efc46735fa944946c5d6f7ce1285880afbe4","observation_id":"eaeed9bd-da10-446b-bd69-1300b891e7d1","resolution":{"observed_at":"2026-08-06T15:08:28.214739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:28.368262Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.368262Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:50e34b5b4d670eef04401dc433700f76e006bfda7d1014552ee84789585486c4","observation_id":"e6295020-d45f-4060-8428-b6db17d85d41","resolution":{"observed_at":"2026-08-06T15:08:28.368262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T15:08:28.517646Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.517646Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:0527fcc67b6f8f058a8a535df25dd99a97a4d9b554879c5f97d36d58e9c22fe4","observation_id":"33c9b6d1-415c-4699-826d-8458d6bb6ac7","resolution":{"observed_at":"2026-08-06T15:08:28.517646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:31.133475Z","title":null,"venue":null,"work_id":"e6eb6aff-e707-4f7c-9c78-c80596b8df29","year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.719583Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:82a631e3b1b570fcd990b1d5c4876f0af8eda1b6c9a43dbda6893b04f2f256bf","observation_id":"466df803-ac7c-425d-8cf3-20e2321972d8","resolution":{"observed_at":"2026-08-06T15:08:31.259306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:30.961751Z","title":null,"venue":null,"work_id":"c7a66bd3-7aaf-411a-95fb-4004718e93d4","year":1966},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.800600Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:32a3683b665c6ddbb40c487e108abb1d85c2f7153d1238faf6aab98ad9dd3f9a","observation_id":"8f1fc671-7f1f-4f48-89f3-2ea61bae8bbe","resolution":{"observed_at":"2026-08-06T15:08:31.037446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13359","last_updated":"2024-09-11T20:48:05Z","snapshot_observed_at":"2026-07-06T19:05:18.260091Z","submitted_at":"2024-08-23T20:22:20Z","title":"Power Scheduler: A Batch Size and Token Number Agnostic Learning Rate Scheduler","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13359","snapshot_observed_at":"2026-08-06T15:08:28.936813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.936813Z"},"links":{"cited_paper":"/paper/2408.13359","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:b3bc88018e860ea01768248683176bd0a6276b81b1cc0962dc3cf4ed19edadca","observation_id":"3bfa4de5-803d-429d-827b-ac5a995d7023","resolution":{"observed_at":"2026-08-06T15:08:28.936813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:30.612337Z","title":"https://github.com/facebookresearch/LLM-QAT, Accessed: 2025-06-19","venue":null,"work_id":"727328e3-b4e5-4922-aec1-382265083703","year":2025},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.093041Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:8bf2e4581fdac7e71236b31048a2eed3c5729385c4b17b3c4a31c3b2650c0307","observation_id":"04573746-73c2-4467-921f-fc0156a45b36","resolution":{"observed_at":"2026-08-06T15:08:30.762839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04965","last_updated":"2024-11-07T18:41:50Z","snapshot_observed_at":"2026-08-04T09:57:22.968756Z","submitted_at":"2024-11-07T18:41:50Z","title":"BitNet a4.8: 4-bit Activations for 1-bit LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04965","snapshot_observed_at":"2026-08-06T15:08:29.258048Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.258048Z"},"links":{"cited_paper":"/paper/2411.04965","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:781a9739505183cf16a3972f31e19858612b6deff397e0fb2d27e5f291058917","observation_id":"c968c840-9b15-4a3b-ab6d-fa46d242edff","resolution":{"observed_at":"2026-08-06T15:08:29.258048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:30.238281Z","title":null,"venue":null,"work_id":"1b12b534-de2b-4d6c-b577-7ba0738e746c","year":2024},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.431011Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:91192599e25476612db776f00d469904eb9bb6469dfad1da2f8d4c68d0f860d4","observation_id":"e16ef3ae-d6ec-40c1-a0b7-235198e21f99","resolution":{"observed_at":"2026-08-06T15:08:30.388348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:29.530102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.530102Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:c3f53131e148588ec658d5f075f8a5df3ab595794229e0a500bf14005e7cf099","observation_id":"24e555cf-f4aa-4ff6-a58a-63884a6dbeeb","resolution":{"observed_at":"2026-08-06T15:08:29.530102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14717","last_updated":"2023-10-09T07:39:04Z","snapshot_observed_at":"2026-08-03T21:40:53.000035Z","submitted_at":"2023-09-26T07:22:23Z","title":"QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14717","snapshot_observed_at":"2026-08-06T15:08:29.673002Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.673002Z"},"links":{"cited_paper":"/paper/2309.14717","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:c2d69ebb1c32d37f2853c234bb4cdd0e50c1dcde8a7909082494c8d9cbc15d87","observation_id":"3a3a095f-eda8-41a2-a546-7817e53568a1","resolution":{"observed_at":"2026-08-06T15:08:29.673002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:29.799420Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:29.799420Z"},"links":{"citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:a79ce0644914d22d0a7da964d62aef9a99b54c4a3642351d8c56ce9bedc987f1","observation_id":"d1122fd9-4d29-43fe-96f4-d99741b8e8b8","resolution":{"observed_at":"2026-08-06T15:08:29.799420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2507.16933."}