{"as_of":"2026-08-09T15:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e836c134947ba5791c0b5b1880ba23ed3f81c60d05610e89110167d6b33666ae","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:03:44.735227Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:42:14.467357Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:06:28.124222Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09003","snapshot_observed_at":"2026-08-07T14:42:14.467357Z","title":"Roste: An efficient quantization-aware supervised fine-tuning approach for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18113","last_updated":"2026-06-01T15:34:34Z","snapshot_observed_at":"2026-08-07T14:32:59.714204Z","submitted_at":"2025-05-23T17:11:22Z","title":"Beyond Discreteness: Sample Complexity Analysis of Straight-Through Estimator for 1-bit Quantization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:42:14.467357Z"},"links":{"cited_paper":"/paper/2502.09003","citing_paper":"/paper/2505.18113"},"observation_digest":"sha256:01acbe17149c2d23c264281a3a8054e3a61372ad6460dbda65e510452e852884","observation_id":"af633ce9-fa78-45fe-9e8d-52d6ada65d07","resolution":{"observed_at":"2026-08-07T14:42:14.467357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":"2502.09003","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09003","snapshot_observed_at":"2026-08-07T13:06:28.124222Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","venue":"cs.LG","work_id":"43970240-85a5-4d17-af87-9da309ffc2cb","year":2025},"citing_paper":{"arxiv_id":"2505.22922","last_updated":"2025-05-28T22:51:43Z","snapshot_observed_at":"2026-08-09T07:36:25.123706Z","submitted_at":"2025-05-28T22:51:43Z","title":"Scalable Parameter and Memory Efficient Pretraining for LLM: Recent Algorithmic Advances and Benchmarking","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:06:26.860384Z"},"links":{"cited_paper":"/paper/2502.09003","citing_paper":"/paper/2505.22922"},"observation_digest":"sha256:ef979701942824a8ea2921b141211d3062f757f015c006486ef26e11a1387b8b","observation_id":"0d447c84-afb6-4f22-b0d9-8eb50b8259cb","resolution":{"observed_at":"2026-08-07T13:06:28.231100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09003","snapshot_observed_at":"2026-08-01T09:31:59.865124Z","title":"arXiv preprint arXiv:2502.09003 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20757","last_updated":"2026-07-24T12:57:08Z","snapshot_observed_at":"2026-08-08T08:21:59.358665Z","submitted_at":"2026-07-22T22:14:23Z","title":"GaugeQuant: Online Learning of Quantization-Optimal Bases from LLM Symmetries","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T09:31:59.865124Z"},"links":{"cited_paper":"/paper/2502.09003","citing_paper":"/paper/2607.20757"},"observation_digest":"sha256:e61f25920e6bdd9024c33a95ac53ff273beccc3222b169b538a55f7ec16867f5","observation_id":"9f32c2bc-feee-4828-9510-00a671ebd2bd","resolution":{"observed_at":"2026-08-01T09:31:59.865124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09003/citation-record","integrity":"/paper/2502.09003/integrity","json":"/paper/2502.09003/citation-record.json","paper":"/paper/2502.09003"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T23:03:44.536917Z","title":"M., Firat, O., Johnson, M., Lepikhin, D., Passos, A., Shakeri, S., Taropa, E., Bailey, P., Chen, Z., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.536917Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:22fbec8385696628ed8b4eb64740524ae78d4c2e14c14187fdd4e47df50e616e","observation_id":"91196593-cbd3-4fc1-ac6a-1426435b932b","resolution":{"observed_at":"2026-08-07T23:03:44.536917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06385","last_updated":"2024-09-03T16:36:06Z","snapshot_observed_at":"2026-08-03T17:41:51.570643Z","submitted_at":"2024-06-10T15:44:22Z","title":"Low-Rank Quantization-Aware Training for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06385","snapshot_observed_at":"2026-08-07T23:03:44.553156Z","title":"Low- rank quantization-aware training for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.553156Z"},"links":{"cited_paper":"/paper/2406.06385","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:e41c398c32b918155440bfe752ad6501d4bfd95ae96d0b7379a3fdc82263d206","observation_id":"b702a118-15d6-4df0-a959-82e74271d743","resolution":{"observed_at":"2026-08-07T23:03:44.553156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:03:45.389586Z","title":null,"venue":null,"work_id":"6dc26516-a3ad-4e04-b83b-990dcdd419eb","year":2004},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.725351Z"},"links":{"citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:7a9c1e4df35a0153d085005e6d210bdf49d2b9e3f61fe7fc512b601e8591b3f6","observation_id":"d8b264b3-16a6-44c3-af21-2e84216fb888","resolution":{"observed_at":"2026-08-07T23:03:45.394408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T23:03:44.563345Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.563345Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:d384aba4bd212df981e5a703097402ff80bfa857412a009bed3b14286ed7383f","observation_id":"76a4f2b4-3362-49df-a6f7-4b3c9fb5517b","resolution":{"observed_at":"2026-08-07T23:03:44.563345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T23:03:44.569109Z","title":"Self-play fine-tuning converts weak language models to strong lan- guage models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.569109Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:733d97af3c3f714a215b2a0867a4190c13d9eb1f624c56b787b250c0abead199","observation_id":"bbeb088b-ee50-40aa-a380-74eb3ef543cb","resolution":{"observed_at":"2026-08-07T23:03:44.569109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T23:03:44.573985Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.573985Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:bc4da113fe3128703e3988b0efde1f5c0ba3caf5a49b119f8dad38f8fd486c5d","observation_id":"9ff8c709-d6c4-4f0d-9dd4-1d298af90e89","resolution":{"observed_at":"2026-08-07T23:03:44.573985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10631","last_updated":"2024-02-16T12:27:15Z","snapshot_observed_at":"2026-07-06T17:31:08.762955Z","submitted_at":"2024-02-16T12:27:15Z","title":"BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10631","snapshot_observed_at":"2026-08-07T23:03:44.578813Z","title":"Bitdistiller: Unleashing the potential of sub-4-bit llms via self-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.578813Z"},"links":{"cited_paper":"/paper/2402.10631","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:0f7f4b538c738225d5eeecb0ff00208865bd6ce9025ec3e644a6b78046519970","observation_id":"2c7bbd9e-662b-4c71-a055-6c65c17b0897","resolution":{"observed_at":"2026-08-07T23:03:44.578813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T23:03:44.583841Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.583841Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:a6026bad07de6e10a9092948798c9a492de1ee65eed2fb087a8bbc4f329eaefa","observation_id":"188b7196-5e3c-4c06-a85b-bd370be08691","resolution":{"observed_at":"2026-08-07T23:03:44.583841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06118","last_updated":"2024-09-11T07:48:26Z","snapshot_observed_at":"2026-08-06T11:31:16.355778Z","submitted_at":"2024-01-11T18:54:44Z","title":"Extreme Compression of Large Language Models via Additive Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06118","snapshot_observed_at":"2026-08-07T23:03:44.588832Z","title":"Extreme compression of large language models via additive quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.588832Z"},"links":{"cited_paper":"/paper/2401.06118","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:57223d6d79872892f9bfeac67ea784e623d461107c3bc09e27571f8bcfcd1191","observation_id":"658cba5f-2a5f-4553-a33f-3deabaab3908","resolution":{"observed_at":"2026-08-07T23:03:44.588832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T23:03:44.598381Z","title":"Measuring mas- sive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.598381Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:1655d1e647ade835960812b91a883f88ff5549b2430d780aba70255b79158b8f","observation_id":"ffd278fc-b5f0-42b9-8390-767bf3042365","resolution":{"observed_at":"2026-08-07T23:03:44.598381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02272","last_updated":"2024-01-24T02:53:27Z","snapshot_observed_at":"2026-08-08T15:32:26.824441Z","submitted_at":"2023-06-04T06:33:13Z","title":"OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02272","snapshot_observed_at":"2026-08-07T23:03:44.613095Z","title":"Owq: Outlier- aware weight quantization for efficient fine-tuning and inference of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.613095Z"},"links":{"cited_paper":"/paper/2306.02272","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:91d5b1fed35b2a55a37683659dfb52d5acd14ab1d065d85be94802e5a7b3001d","observation_id":"c04afc0c-c6e3-4371-87c7-d4323d6bb726","resolution":{"observed_at":"2026-08-07T23:03:44.613095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03051","last_updated":"2024-07-18T06:21:23Z","snapshot_observed_at":"2026-07-06T18:40:52.966572Z","submitted_at":"2024-07-03T12:19:06Z","title":"Improving Conversational Abilities of Quantized Large Language Models via Direct Preference Alignment","version":2},"cited_work":{"arxiv_id":"2407.03051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.03051","snapshot_observed_at":"2026-08-07T23:03:45.080493Z","title":"Improving Conversational Abilities of Quantized Large Language Models via Direct Preference Alignment","venue":"cs.CL","work_id":"3e484908-8343-441e-8976-1622b5e8e5e6","year":2024},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.618092Z"},"links":{"cited_paper":"/paper/2407.03051","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:b81c7c422132f751bab0e095e413a9746137269ac806a827009de94bd0b37c13","observation_id":"1cb90dd1-e410-45f2-af32-a0ebcc7e9b92","resolution":{"observed_at":"2026-08-07T23:03:45.089611Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-07T23:03:44.628672Z","title":"Awq: Activation-aware weight quantization for llm compres- sion and acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.628672Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:95bbf6bb0dda171352dd099b351ebac58cdcb4e81b1c835911880229e5f02e6a","observation_id":"0f871fe7-72fa-4ae7-9e6a-6590a6868103","resolution":{"observed_at":"2026-08-07T23:03:44.628672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T23:03:44.633487Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.633487Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:b16507df788c9117d5b2ef049bffb6ed051d98fad636f05b4f271d16ed5db0bd","observation_id":"ad37036c-436e-405f-9b8f-ae63a4561ea9","resolution":{"observed_at":"2026-08-07T23:03:44.633487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T23:03:44.638140Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.638140Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:5a3202e9634bbc693f07843b0ee9ade5ad0b520e2e81b8e72b95311cb2ba7f07","observation_id":"c06bde00-4f54-477a-8dbb-b25bd8c9a328","resolution":{"observed_at":"2026-08-07T23:03:44.638140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-07T23:03:44.643014Z","title":"Spinquant–llm quantization with learned rotations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.643014Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:2985b9b2d4413cacda1aa16052421e60baf47ea28298fd1c2a587e4db499cb9c","observation_id":"870ab7bb-5903-483c-811b-e28872c54edd","resolution":{"observed_at":"2026-08-07T23:03:44.643014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-07T23:03:44.658008Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.658008Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:443c75781b06c902b2580ad14bb591d238969aa26cfb38078017e2e9ef3dc730","observation_id":"231e96d9-cbf8-4fab-bb14-2ed9419f4af5","resolution":{"observed_at":"2026-08-07T23:03:44.658008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T23:03:44.662978Z","title":"W., Chowdhery, A., Le, Q","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.662978Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:3740cbb40bec19fd935c73e1b875f69860d06f33f0b840b8f3c46e64a68a3eb9","observation_id":"45500c75-d4ab-429d-81d9-7d08780ac842","resolution":{"observed_at":"2026-08-07T23:03:44.662978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-07T23:03:44.667576Z","title":"Lamda: Language models for dialog appli- cations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.667576Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:70c87c6f34457703b23a672d53821e6d4d5991c1d110857a67afed9e2cd6edaa","observation_id":"8cae0720-9231-46ba-be5f-2a00ed610710","resolution":{"observed_at":"2026-08-07T23:03:44.667576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T23:03:44.672666Z","title":"Llama 2: Open foundation and fine- tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.672666Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:b1a809a8214d71685b02d39da5d68375b61b836759ca130812cffd051b597d22","observation_id":"e187d0bf-8b0a-4ce0-b47c-804f16b4a4d1","resolution":{"observed_at":"2026-08-07T23:03:44.672666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-08-09T13:06:16.631036Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T23:03:44.677581Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.677581Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:ad253007f5abc8e2b0809e8e31e3987c9ad6e8b705eecb1cd9ae5c90d5d08b91","observation_id":"b18d4993-1044-44d9-a6ac-83d11e28ebb1","resolution":{"observed_at":"2026-08-07T23:03:44.677581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-07T09:04:32.994880Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-07T23:03:44.687117Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.687117Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:eb1197f32a8ff007f543bc5af773a6cd318a9765c256831d9ddefd8e2db624b4","observation_id":"b3c12fc4-65e4-4635-ad6f-fdabf39500e9","resolution":{"observed_at":"2026-08-07T23:03:44.687117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08092","last_updated":"2024-09-23T07:37:34Z","snapshot_observed_at":"2026-08-09T14:18:39.128715Z","submitted_at":"2024-01-16T03:35:26Z","title":"A Survey of Resource-efficient LLM and Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08092","snapshot_observed_at":"2026-08-07T23:03:44.691600Z","title":"A survey of resource- efficient llm and multimodal foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.691600Z"},"links":{"cited_paper":"/paper/2401.08092","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:c56cf03c721500c632ad1bcb002c179d2347aa471363d27b4290c2f03a882390","observation_id":"68b05412-62f4-4bfb-b1b3-8ccfb6bc6ecf","resolution":{"observed_at":"2026-08-07T23:03:44.691600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11295","last_updated":"2024-11-29T11:47:55Z","snapshot_observed_at":"2026-07-06T17:31:37.574049Z","submitted_at":"2024-02-17T14:26:57Z","title":"OneBit: Towards Extremely Low-bit Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11295","snapshot_observed_at":"2026-08-07T23:03:44.696274Z","title":"Onebit: Towards extremely low-bit large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.696274Z"},"links":{"cited_paper":"/paper/2402.11295","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:b535cec533114819318df7764cc7808ca63e06c2441c03f89a5a0019f1a6c8c1","observation_id":"3ae27ece-5255-4b0c-b991-0cb5d2e17b75","resolution":{"observed_at":"2026-08-07T23:03:44.696274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.05662","last_updated":"2019-09-25T14:33:44Z","snapshot_observed_at":"2026-07-06T07:39:06.044012Z","submitted_at":"2019-03-13T18:23:43Z","title":"Understanding Straight-Through Estimator in Training Activation Quantized Neural Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.05662","snapshot_observed_at":"2026-08-07T23:03:44.701302Z","title":"Understanding straight-through estimator in train- ing activation quantized neural nets","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.701302Z"},"links":{"cited_paper":"/paper/1903.05662","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:8b5e816c61820ef5df6ec4c5dd7f5d245175e7d1124f12093167690d2c2f8081","observation_id":"ffbd40e8-6e66-4f06-9f31-efd726e19250","resolution":{"observed_at":"2026-08-07T23:03:44.701302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05821","last_updated":"2025-08-28T03:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-10T08:41:24Z","title":"ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05821","snapshot_observed_at":"2026-08-07T23:03:44.706092Z","title":"Asvd: Activation-aware singular value decomposition for compressing large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.706092Z"},"links":{"cited_paper":"/paper/2312.05821","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:368c8d60718a1a5779b8795ac3b4715ec6df7bda91f3d92cc1c2dfd8df3c8b33","observation_id":"e57ebf45-10fb-4f0c-bb32-09a3a8ee1493","resolution":{"observed_at":"2026-08-07T23:03:44.706092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-07T23:03:44.710819Z","title":"Agieval: A human-centric benchmark for evaluating foundation mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.710819Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:93d2cd1be495ad2862316829325d5595fd46a2728f0b4eff51de3e4cc4b751b9","observation_id":"6d83edae-8300-418e-804e-c3c73be701fb","resolution":{"observed_at":"2026-08-07T23:03:44.710819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:03:45.421148Z","title":"Proof of Theorem 4.3 Proof","venue":null,"work_id":"a7c0e5a9-d067-4adb-b42d-b320a7441f64","year":2024},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.715358Z"},"links":{"citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:0db22b461d4c3a0148345a871fb7684e6347c19819d01179568629d6ac3e65e5","observation_id":"1fc42e5e-4a2a-4516-addd-54e2e4bdf05d","resolution":{"observed_at":"2026-08-07T23:03:45.425934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:03:45.404872Z","title":null,"venue":null,"work_id":"e9aeabbc-783b-4944-92f6-981f144df4a9","year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.720483Z"},"links":{"citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:8f9ca755569d9c2b59d02755a0f66505a9fe42e106dda673568942b4978cf4a1","observation_id":"7ada6363-8aee-4207-b71e-e508b1775fe8","resolution":{"observed_at":"2026-08-07T23:03:45.410080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:03:45.374054Z","title":"Benchmark TruthfulQA MMLU-Pro BigBenchHard AGIEval GSM8K Math # shot 6 0 3 0 8 4 Metric Acc (mc1) EM EM Acc EM EM CoT ✓ ✗ ✗ ✗ ✓ ✗ D","venue":null,"work_id":"cbcb7ac2-cef9-4a8e-bc46-548f991b92fe","year":2024},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.730447Z"},"links":{"citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:3fb46f6d44070436a32c91587e282d036d77a03085bcdd28fd34e58504f49d5b","observation_id":"75963ffa-387f-4a90-8824-3fd9a7c30738","resolution":{"observed_at":"2026-08-07T23:03:45.378919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:03:45.357370Z","title":"(Left) Relative reduction rates of quantization error, calculated as Error w/o rotation−Error w/ rotation Error w/o rotation × 100%","venue":null,"work_id":"e77aa9a9-adf1-4471-a844-abb0380f5caf","year":2023},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.735227Z"},"links":{"citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:c6f7ea252c2d6adff936981bb1d71448436f88202fd48d5fe7eb44a778c4119d","observation_id":"1e0e5f4a-1980-496a-9823-f47744d304cc","resolution":{"observed_at":"2026-08-07T23:03:45.362651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T23:03:44.593599Z","title":"Gptq: Accurate post-training quantization for generative pre- trained transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":1976,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.593599Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:12f6061501137009295fee5bc0ccbfceae3bd7b10acde1eead15139e86cc00b1","observation_id":"05ea39b5-38dd-4da7-85fb-281371ae2a79","resolution":{"observed_at":"2026-08-07T23:03:44.593599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17888","last_updated":"2024-10-27T20:09:59Z","snapshot_observed_at":"2026-07-06T18:21:05.410042Z","submitted_at":"2024-05-28T07:11:05Z","title":"Getting More Juice Out of the SFT Data: Reward Learning from Human Demonstration Improves SFT for LLM Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17888","snapshot_observed_at":"2026-08-07T23:03:44.623807Z","title":"Getting more juice out of the sft data: Reward learning from human demonstration improves sft for llm align- ment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.623807Z"},"links":{"cited_paper":"/paper/2405.17888","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:968cf6db2baef7e51bb90cf9a25d053c6dbf8b66de75231a751d8afa530cefea","observation_id":"b0880f39-3b93-4bdc-aa5d-90bb0e6fabbc","resolution":{"observed_at":"2026-08-07T23:03:44.623807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-08T12:58:42.430328Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-07T23:03:44.608247Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.608247Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:f00e15cab6c2aed6c6eb5bd3f8fd9ad607d5aef427e5a7c38f88c2c4b1890e54","observation_id":"4e8b8003-b722-4dab-8f7d-1238ffe1b854","resolution":{"observed_at":"2026-08-07T23:03:44.608247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07378","last_updated":"2025-03-16T03:27:33Z","snapshot_observed_at":"2026-07-06T17:43:05.793351Z","submitted_at":"2024-03-12T07:31:18Z","title":"SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07378","snapshot_observed_at":"2026-08-07T23:03:44.682214Z","title":"Svd- llm: Truncation-aware singular value decomposition for large language model compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.682214Z"},"links":{"cited_paper":"/paper/2403.07378","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:358ac1bf6095802aa2acaa0e54683ef598b4e0d1a4feaddcd315cf42752a09b1","observation_id":"38879018-8b76-4517-8e84-41a142a399dd","resolution":{"observed_at":"2026-08-07T23:03:44.682214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17031","last_updated":"2024-03-24T02:59:27Z","snapshot_observed_at":"2026-07-06T17:50:26.908430Z","submitted_at":"2024-03-24T02:59:27Z","title":"The N+ Implementation Details of RLHF with PPO: A Case Study on TL;DR Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17031","snapshot_observed_at":"2026-08-07T23:03:44.603283Z","title":"The n+ implementation details of rlhf with ppo: A case study on tl; dr summarization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.603283Z"},"links":{"cited_paper":"/paper/2403.17031","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:cad0bc03dfec6f308737819795034eb8889887063f2dcc9bddba36f7e7bdc048","observation_id":"a1a41cf7-ac66-42ce-acd9-c437eca29d17","resolution":{"observed_at":"2026-08-07T23:03:44.603283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00861","last_updated":"2019-03-05T00:28:48Z","snapshot_observed_at":"2026-07-06T07:05:24.565760Z","submitted_at":"2018-10-01T17:57:02Z","title":"ProxQuant: Quantized Neural Networks via Proximal Operators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00861","snapshot_observed_at":"2026-08-07T23:03:44.548070Z","title":"Proxquant: Quantized neural networks via proximal operators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.548070Z"},"links":{"cited_paper":"/paper/1810.00861","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:5e3c25fc7b1f8f1f5cda4f439b6f82a6e497403e46d933cc872b4aeedf884f0f","observation_id":"21a7b5d1-8228-47b8-99f5-ce06768a87b9","resolution":{"observed_at":"2026-08-07T23:03:44.548070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05003","last_updated":"2025-06-10T18:01:40Z","snapshot_observed_at":"2026-08-09T10:27:19.269217Z","submitted_at":"2025-02-07T15:23:34Z","title":"QuEST: Stable Training of LLMs with 1-Bit Weights and Activations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05003","snapshot_observed_at":"2026-08-07T23:03:44.648169Z","title":"L., Nikdan, M., and Alistarh, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.648169Z"},"links":{"cited_paper":"/paper/2502.05003","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:75a89a7ae28350104ae472d6f1d71828cd2042dcdbe5ec4a435877a7b3b77943","observation_id":"dd72ea8d-4238-480b-89eb-25cb911e6a7b","resolution":{"observed_at":"2026-08-07T23:03:44.648169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-07T23:03:44.542756Z","title":"L., Nascimento, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.542756Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:3833b1e6c82701b713d264dd4fa37c4ac42af8eb236d438edb50ea313223b88f","observation_id":"86f3be89-c7cd-4f63-b803-edd8b29b2b35","resolution":{"observed_at":"2026-08-07T23:03:44.542756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T23:03:44.558311Z","title":"T., Li, Y ., Lundberg, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.558311Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:0692a4683e21037f6ccba77f82f6e2919f7f5ffb79aebca6bef2867faa79f850","observation_id":"9062b3a6-1094-40ea-a911-55dc8b9695a3","resolution":{"observed_at":"2026-08-07T23:03:44.558311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-07-06T16:10:15.694898Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-07T23:03:44.653134Z","title":"Omniquant: Omnidirectionally calibrated quantization for large lan- guage models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.653134Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:ac28db4c3eabeca33abea7adf639fcfc75cf998b209a91fc90ad41e0a998510a","observation_id":"03188f45-46f6-4947-a8fb-a08b0587913d","resolution":{"observed_at":"2026-08-07T23:03:44.653134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2502.09003."}